谷歌发布Gemini3.1Flash-Lite:AI速度提升2.5倍,成本大降!
创始人
2026-03-04 07:31:58
0

3月3日,谷歌宣布推出轻量级AI模型Gemini3.1Flash-Lite,这是其Gemini3系列中速度最快、最具成本效益的模型。开发者可以通过GoogleAIStudio中的GeminiAPI获取预览版,企业级用户也能在VertexAI平台上体验。谷歌为该模型设定了极具竞争力的价格,每百万输入Tokens收费0.25美元,每百万输出Tokens为1.50美元,旨在降低AI应用的门槛。

Gemini3.1Flash-Lite在性能上实现了显著提升。根据ArtificialAnalysis的数据,与前代2.5Flash相比,新模型的首字响应速度(TTFT)提升了2.5倍,整体输出速度提升了45%。这种低延迟特性使其成为构建实时响应体验的理想选择。在A网页链接排行榜上,3.1Flash-Lite获得了1432分的Elo得分,并在多模态理解与逻辑推理测试中全面领先同级竞品,如GPQADiamond测试中得分率高达86.9%,在MMMUPro测试中达到76.8%,甚至在多项指标上超越了体积更大的上一代Gemini2.5Flash模型。

此外,3.1Flash-Lite在AIStudio和VertexAI中标配了创新的“思考层级(thinkinglevels)”功能,允许开发者根据任务需求灵活控制模型的“思考深度”。这一机制使得模型在处理基础任务时追求极致效率,在面对高难度任务时激发更深度的推理能力。Latitude、Cartwheel以及Whering等企业已将3.1Flash-Lite部署于复杂的业务场景中,并反馈称该模型具备卓越的处理效率和逻辑推理能力,能以媲美大型模型的精准度处理复杂输入指令。

相关内容

热门资讯

强强联合共启新程!羊晚集团与越... 文/羊城晚报全媒体记者 陈玉霞 李妹妍 徐炜伦图/羊城晚报全媒体记者 梁喻 刘志勇8月3日,羊城晚报...
开启一场自下而上的“真实中国”... 央视网消息:长期以来,暑期并非我国传统入境游的旺季。而2026年暑期,入境游市场不仅实现“淡季不淡”...
世界周刊丨“特高课”复活? 国... 7月31日,日本东京,一台新的国家“情报机器”正式运转。它就是高市早苗政府成立的中央情报机构——国家...
满载前行,中欧班列跑出高质量发... 国家发展改革委日前发布的数据显示:截至今年6月,中欧班列重箱率已连续46个月保持100%。重箱率即指...
全球媒体聚焦 | 肯尼亚媒体:... 近日,标准银行肯尼亚子行正式上线人民币跨境支付系统(CIPS),成为非洲第六个接入该系统的国家。多家...
全红婵代言黄子韬品牌朵薇,此前... 8月3日,奥运跳水冠军全红婵在个人社交平台正式发文官宣,成为朵薇(Domyway)品牌代言人,配文写...
广东公安“雷霆”出击!刑事治安... 文、图/羊城晚报全媒体记者 张璐瑶 通讯员 粤公宣视频/羊城晚报全媒体记者 张璐瑶为确保2026年A...
中国驻泰王国特命全权大使张建卫... 文/羊城晚报全媒体记者 蒋铮 王漫琪 刘泳希图/羊城晚报全媒体记者 蒋铮视频/羊城晚报全媒体记者 刘...
“三个500”,是方法更是方向 日前,潮汕方言电影《给阿嬷的情书》内地票房突破20亿元,导演蓝鸿春在社交平台发文感谢“所有阿嬷的观众...
男子扫花生牛奶抽奖码疑遭提前核... 近日,有媒体报道了江苏扬州消费者王先生购买银鹭花生牛奶参与扫码抽奖,箱内抽奖二维码遭提前核销无法参与...