腾讯混元大模型迎来V1.2升级，加入“文生图”功能，支持6种风格模型绘图-AI奇点网

首页 > 资讯 > 文章

2023-10-27 10:48

腾讯混元大模型迎来V1.2升级，加入“文生图”功能，支持6种风格模型绘图

AI奇点网10月27日报道丨10月26日，“鹅厂技术派”（腾讯产品技术官方发布账号）发布消息称，腾讯混元大模型近日迎来全新升级，并正式对外开放“文生图”功能。官方宣称，升级后的腾讯混元中文效果整体超过 GPT-3.5，代码能力大幅提升 20%，大模型能力已经达到了业界领先水平。

据介绍，大模型文生图的难点体现在对提示词的语义理解，生成内容的合理性以及生成图片的效果，针对这三个技术难点，腾讯进行了专项的技术研究，提出了一系列原创算法：

在语义理解方面，腾讯混元采用了中英文双语细粒度的模型，模型同时建模中英文实现双语理解，而不是通过翻译，通过优化算法提升了模型对细节的感知能力与生成效果，有效避免多文化差异下的理解错误。

在内容合理性方面，AI 生成人体结构和手部经常容易变形。混元文生图通过增强算法模型的图像二维空间位置感知能力，并将人体骨架和人手结构等先验信息引入到生成过程中，让生成的图像结构更合理，减少错误率。

在画面质感方面，混元文生图基于多模型融合的方法，提升生成质感。经过模型算法的优化之后，混元文生图的人像模型，包含发丝、皱纹等细节的效果提升了 30%，场景模型，包含草木、波纹等细节的效果提升了 25%。

如果用户想生成一张更接近真人感的照片，或接近实拍的图片，可以加上“真实感”或“摄影风”等描述;如果用户想要特定风格的图片，建议在提示词中加入该风格的描述，如油画风、赛博朋克风等。此外，用户还可以对画面进行尽可能详细地描述，以获得满意的效果。

以下为官方发布的更多示例图：

目前，超过180个腾讯内部业务已接入腾讯混元，包括腾讯会议、腾讯文档、企业微信、腾讯广告和微信搜一搜等。任何用户都可以腾讯混元大模型官网或“腾讯混元助手”微信小程序申请内测体验。

7

查看相关话题： #腾讯 #混元大模型 #AI大模型 #文生图 #AI绘图

相关文章

AI奇点网主编

作者已发布 426 篇文章

近期文章

更多

OpenAI宣布企业架构重组丨可灵发布V1.5图像模型，推出「AI 模特」丨爱诗科技PixVerse V3.5版本上线

OpenAI宣布企业架构重组丨可灵发布V1.5图像模型，推出「AI 模特」丨爱诗科技PixVerse V3.5版本上线

新“智”慧全国 AI 数字创意大赛颁奖盛典完美收官

新“智”慧全国 AI 数字创意大赛颁奖盛典完美收官

深度求索发布DeepSeek-V3开源模型丨理想汽车转型 AI 公司丨雷军亲自招兵买马，小米开启自研大模型训练

深度求索发布DeepSeek-V3开源模型丨理想汽车转型 AI 公司丨雷军亲自招兵买马，小米开启自研大模型训练

“最强AI手机”小米14、小米澎湃OS首发登场：6秒离线本地生图，内置“妙鸭AI写真”+WPS AI

上一篇

ChatGPT正在测试原生文件分析功能，DALL·E 3能P图啦！

下一篇