业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

2023-10-26 15:03:03 hao333 6902

10月26日消息，今年9月，腾讯混元大模型正式发布，1个多月后，该大模型今天迎来重磅升级。

据鹅厂技术派公众号介绍，今天上午，腾讯混元大模型迎来全新升级，并正式对外开放文生图功能。

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

升级后的腾讯混元中文效果整体超过GPT3.5，代码能力大幅提升20%，达到业界领先水平。

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

据介绍，相比其他大模型，腾讯混元的文生图应用，在人像真实感、场景真实感上有比较明显的优势。

同时，在中国风景、动漫游戏等场景等生成上有较好的表现。

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

大模型文生图的难点体现在对提示词的语义理解，生成内容的合理性以及生成图片的效果。

针对这三个技术难点，腾讯进行专项的技术研究，提出一系列原创算法，来保证生成图片的可用性和画质。

具体来说，在语义理解方面，腾讯混元采用了中英文双语细粒度的模型，模型同时建模中英文实现双语理解，而不是通过翻译。

通过优化算法提升了模型对细节的感知能力与生成效果，有效避免多文化差异下的理解错误。

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

为了解决AI生成人体结构和手部经常容易变形的问题，混元文生图增强了算法模型的图像二维空间位置感知能力。

并将人体骨架和人手结构等先验信息引入到生成过程中，让生成的图像结构更合理，减少错误率。

质感方面，经模型算法优化后，混元文生图的人像模型，包含发丝、皱纹等细节的效果提升了30%，场景模型，包含草木、波纹等细节的效果提升25%。

据悉，混元大模型为腾讯全链路自研大语言模型，参数规模超千亿，预训练语料超2万亿tokens（大语言模型文本单位），具有中文创作能力、任务执行能力和复杂语境下的逻辑推理能力。

该模型能在多种场景下处理超长文本，通过位置编码优化，提升长文处理效果和性能，结合指令跟随优化，让产出内容更符合字数要求。

混元大模型已在腾讯云、腾讯广告、微信搜一搜等多个腾讯内部业务和产品经过测试。

同时也服务产业场景，客户可基于API调用混元，也可基于混元做专属的行业大模型。

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5

业界领先！腾讯升级自研混元大模型：中文效果整体超越GPT3.5
以上图片均由腾讯混元文生图生成

下一篇： 首款配备钠固态电池的电动汽车！东风纳米01官图曝光

其他相关

特斯拉Cybertruck：史上最让人操心的皮卡真的快交付了吗

数码科技 9200

英语学了无用？国内双一流985大学中科大回应拟撤销英语等6个本科专业学科优化

数码科技 5872

到底算不算加班？男子下班后回工作消息离职获赔5千加班费：网友点赞

数码科技 1116

业内首家！阿里达摩院遥感AI大模型亮相：让AI下沉到田间地头

数码科技 6618

全国首例多基因编辑猪皮移植成功：救治特重度烧伤患者

数码科技 2062

性能最强骁龙8 Gen3旗舰！真我GT5 Pro证件照出炉

数码科技 4728