当前位置：网站首页技术文章正文

腾讯宣布升级混元大模型，中文能力整体超过 GPT3.5，新增的“文生图”功能

来源：互联网发布时间：2024-06-30 17:23:00

腾讯宣布升级混元大模型，中文能力整体超过 GPT3.5，代码能力提升 20%。并正式对外开放“文生图”功能。针对新增的“文生图”功能。腾讯表示进行了专项的技术研究，提出了一系列原创算法：

在语义理解方面，腾讯混元采用了中英文双语细粒度的模型，模型同时建模中英文实现双语理解，而不是通过翻译。这样做通过优化算法提升了模型对细节的感知能力与生成效果，有效避免了多文化差异下的理解错误。

在内容合理性方面，AI生成的人体结构和手部经常容易出现变形。为了解决这个问题，混元文生图通过增强算法模型的图像二维空间位置感知能力，并将人体骨架和人手结构等先验信息引入到生成过程中。这让生成的图像结构更加合理，同时也减少了错误率。

在画面质感方面，混元文生图采用了基于多模型融合的方法来提升生成质感。经过模型算法的优化，人像模型在发丝、皱纹等细节方面的效果提升了30%，而场景模型在草木、波纹等细节方面的效果提升25%。

目前超过 180 个腾讯内部业务已接入腾讯混元，包括腾讯会议、腾讯文档、企业微信、腾讯广告和微信搜一搜等。最近，QQ 浏览器还基于腾讯混元推出了「PDF 阅读助手」，具备智能摘要、智能问答和多轮提问等功能。

相关教程

得到：妙用飞书，实现办公协作新升级记得多年前，有位姓罗的胖子在微信公众号每天早上6点多发布60秒语音，不长不短。开始听了蛮有意思，虽然很短，却时常听到新颖的观点。后面
技术文章 06-29
第一批因为AI而失业的人已经出现，一家游戏公司裁掉了一半的原画师。随着人工智能技术的发展，AI绘画软件越来越强大，可以从文本或图片生成逼真的图像。这对于游戏行业来说是一个提高效率、降低成本的机会，但
技术文章 06-27
王会文的“China OpenAI”与光年之外的“一流技术”达成合并意向。据悉，王会文创办的公司将以换股的形式收购京一流技术，在现有团队基础上打造中国版ChatGPT。目前，该收购已通过一级科创板。截至记者发稿
技术文章 06-28

产业资讯

游戏下载 +

近期热点 +

最新技术文章 +

06-30

智谱AI推出第三代基座大模型ChatGLM3及新一代AI助手智谱AI于10月27日宣布，推出全自研的第三代基座大模型 ChatGLM3 及相关系列产品。据智谱AI 表示，ChatGLM3实现了多模态理解能力、代码生
06-30

百川智能发布 Baichuan2-192K 大模型可处理约35万个汉字百川智能发布了 Baichuan2-192K 大模型，具有全球最长的上下文窗口长度，能够处理约35万个汉字。与目前最优秀的大模型 Claude2相比，Bai
06-30

ChatGPT Plus 推出新测试版：支持上传和分析处理文件 OpenAI 正在为 ChatGPT Plus 会员推出新的测试版功能。订阅者报告显示，此次更新包括上传文件和处理文件的能力，以及多模态支持。用户
06-30

文本生成高质量3D模型，支持二次编辑！Stable Difusion新产品来啦 11月2日，著名开源平台Stability AI（Stable Difusion母公司）在官网宣布推出了Stable 3D，支持用户通过文本、图片或插图，直接就能生成
06-30

ChatGPT 新版本更多功能和OpenAI开发者大会细节曝光清晰的表明OpenAI将发布一个【机器人商店】的功能，所有人都可以利用GPT创建自己的聊天机器人，并可以将其发布到市场中，同时你也可以使用