40B参数大模型Yuan3.0Flash开源,多模态推理新突破!
创始人
2025-12-31 18:11:02
0

12月31日,浪潮旗下YuanL网页链接团队宣布开源发布源Yuan3.0Flash多模态基础大模型。Yuan3.0Flash是一个40B参数规模的模型,采用稀疏混合专家(MoE)架构,单次推理仅激活约3.7B参数。该模型通过强化学习训练方法(RAPO)和反思抑制奖励机制(RIRM),在提升推理准确性的同时,显著降低了推理过程的token消耗和算力成本。

Yuan3.0Flash由视觉编码器、语言主干网络和多模态对齐模块组成。语言主干网络使用局部过滤增强的Attention结构(LFA)和混合专家(MoE)结构,以提高注意力精度并降低训练与推理的算力开销。在多模态方面,模型将视觉信号转化为token,并与语言token一起输入到语言主干网络,通过多模态对齐模块实现跨模态特征对齐。此外,引入自适应图像分割机制,支持高分辨率图像理解,同时降低显存需求及算力开销。

在企业场景的多个任务中,如RAG(ChatRAG)、多模态检索(Docmatix)、多模态表格理解(MMTab)和摘要生成(SummEval),Yuan3.0Flash的表现已优于GPT-5.1。在多模态推理与语言推理评测中,Yuan3.0Flash(40B)的精度接近Qwen3-VL235B-A22B(235B)与DeepSeek-R1-0528(671B),但token消耗仅约为其1/4~1/2,有效降低了企业大模型应用成本。Yuan3.0Flash现已全面开源,全系列模型参数和代码均可免费下载使用。

相关内容

热门资讯

OpenAI取消ChatGPT... 8月10日,OpenAI宣布对ChatGPT的使用政策进行重大调整,取消免费版和Go版用户在纯文本对...
氢内燃机突破!美国展示零碳重卡... 近日,美国西南研究院展示了一款新型氢内燃机样机,专为中型商用卡车设计。该发动机采用火花塞点火燃烧氢气...
小米澎程系列涉水安全升级,N9... 近日,小米汽车澎程系列在社交平台上分享了其涉水安全配置,强调雨季驾驶的安全性。澎程系列中的N90Ma...
巴美外交争端背后是“唐罗主义”... 日前,巴西与美国、阿根廷间的紧张关系再度升级。4日,美国政府撤销巴西驻美大使签证;同日,巴西将其与阿...
“APEC大会倒计时100天媒... 文/图 羊城晚报记者 沈婷婷 实习生 王思涵8月7日,“相约深圳 见证奇迹——APEC大会倒计时10...
AI影音创作如何“接地气”?全... 羊城晚报讯 记者惠天骄报道:日前,作为2026年广东十大赛事活动之一的“全民AI创作大赛分享会”在广...
以赛代练夯基础 师徒同台砺匠心 49名青年厨师出战“粤菜师傅”大赛新秀组对决,名厨组选手完赛后到场指导后辈积累实操经验羊城晚报讯 记...
先进制造企业汇聚,广州白云建科... 文/羊城晚报全媒体记者 徐炜伦图/受访者提供8月6日,“链动民科・智造未来”2026年广州白云建科集...
【中国那些事儿】基建赋能、产业... 中国日报网8月7日电 2026年是中非人文交流年,一系列合作成果正转化为非洲青年对中国的广泛认可与深...
视频丨跨省购物、短途观光 列车... 暑期来临,各地群众的夏日出游热潮持续走高,旅途中,一趟趟各具特色的列车,正在把客流稳稳转化为实实在在...