AI评分 头条 (78)AI 中文改写

Mistral推出Large 4 'Le Chonk',万亿参数文本输出模型

21 小时前 3 阅读来源:venturebeat.com

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

法国AI公司Mistral正式开启Mistral Large 4的公开预览,这是一款总参数量达1万亿的多模态模型,内部代号“Le Chonk”(网络俚语,意为“胖猫”)。模型缩写为ML4,推理时仅激活490亿参数,采用稀疏架构。Mistral称其从头训练耗时约两个月,动用了4000块英伟达Grace Blackwell GPU,全部部署在该公司位于欧洲的自有数据中心内。训练覆盖160多种语言,包括欧盟所有官方语言。公司计划先与开发者、网络安全负责人和政府机构进行约三周的测试,随后于10月27日通过API开放使用并公布模型权重,权重预计采用Mistral自定义许可证。VentureBeat查阅的材料中未包含API定价信息。 这次发布的分阶段策略是Mistral定位的核心。ML4并非又一款通用模型,而是面向企业和政府客户,主打可自主运行和定制,包括部署在主权基础设施上、支持零数据保留选项。Mistral表示,预览期还将用于继续强化学习并微调最终检查点。联合创始人兼首席科学家Guillaume Lample称ML4处于开放权重模型的前沿,并预计随着强化学习完成和训练容量扩大,能力还会提升。他还透露,Mistral的科学团队已从3名研究员扩展到约300人。 ML4的命名背后有一段网络文化渊源。今年6月,一个虚构的Mistral模型“Le Chaton Fat”(胖小猫)在X和Reddit上疯传,配有伪造的基准测试图表和越来越离谱的参数规格,有的版本声称该模型超过30万亿参数,还有的标榜“每秒1000次喵叫”。Mistral CEO Arthur Mensch也加入玩梗,在X上写道“其实是le gros chaton”(大猫)。玩笑背后是外界对Mistral正在筹备更大模型的真实预期。7月,TechCrunch报道了市场对Mistral即将推出大型开放权重模型的期待,并指出Mensch和Mistral投资人Marc Andreessen都曾放大这一梗的传播。如今Mistral真的拿出了1万亿参数模型,显然不打算浪费这个梗——内部代号“Le Chonk”正是又一次拿“巨型猫”做文章。Lample被问及ML4是否就是当初那个梗所预示的模型时表示,公司很喜欢这个梗,ML4可以视为该构想的一个初始版本,未来还会有更大的模型。高管称“Le Chonk”这个命名是在向一直期待公司打造大规模前沿模型的社区致意。玩笑与现实意外地接近:Le Chaton Fat从未存在,但几个月后,Mistral真的发布了一款1万亿参数的开放权重旗舰模型,代号就是一只胖猫。 对跨境卖家和AI从业者而言,ML4的开放权重路线值得关注。如果权重按计划在10月27日公布,意味着企业可以在自有基础设施上运行和微调这一级别的模型,不必依赖美国云厂商,这对数据合规要求高的欧洲市场尤其有吸引力。不过49亿激活参数的实际推理成本、自定义许可证的具体条款以及API定价,都还是未知数,需要等预览期结束后的正式发布才能判断其真实可用性。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · venturebeat.com

内容版权归原作者及 venturebeat.com 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0 条

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容