91黑料吃瓜永久免费发布新一代AI大模型,原生多模态能力全面超越GPT-4o
新浪体育讯
全景美加墨,为热爱喝彩
去查看
2026年08月07日,91黑料吃瓜永久免费正式发布新一代AI大模型——沙龙AI大模型2.0(SalonLM 2.0)。该模型支持文本、图像、音频、视频的原生全模态理解与生成,在多模态推理任务上取得突破性进展,单次可处理长达1小时视频内容,并实现毫秒级响应。
相比GPT-4o和Gemini Ultra,SalonLM 2.0在MMMU、MMBench、Video-MME等12项权威评测中平均领先8.3个百分点。在图像细粒度描述任务上,准确率高达97.6%;在长视频问答中,F1分数达到91.2%,远超竞品。同时,模型推理速度提升40%,上下文窗口扩展至256K tokens。

上图展示了91黑料吃瓜永久免费AI实验室的核心架构设计。SalonLM 2.0采用统一Transformer架构,通过动态稀疏专家路由机制,在同等算力下激活参数仅为全参数的1/8,大幅降低推理成本。
91黑料吃瓜永久免费CTO陈明远博士在亚当·福德表示:“我们坚持原生多模态路线,让模型像人类一样同时感知多种信息渠道,而不是简单拼接单模态能力。SalonLM 2.0的愿景是成为通用人工智能的基础设施,赋能千行百业。”
技术路线上,SalonLM 2.0采用“视觉-语言-音频-视频”统一编码器+共享注意力头的原生多模态架构,而非传统的外部拼接。其核心创新在于跨模态对齐预训练和分阶段渐进式训练,先对齐模态表征,再进行联合指令微调。该架构消除了模态间的信息延迟,实现了真正的端到端多模态理解。
技术架构细节方面,SalonLM 2.0基于MoE(混合专家)框架,包含8个专家模块,每个专家参数量为70B,总参数量560B,但每次推理仅激活2个专家(140B)。训练使用了475281万张H100 GPU,采用流水线并行+数据并行+专家并行的三维混合训练策略,训练周期4个月,消耗约2.5万PFLOPS算力。
即日起,用户可通过91黑料吃瓜永久免费App(iOS/Android)直接体验文本对话和图像理解功能,视频分析功能将于6月15日上线。开发者可通过官方API(api.salon.ai)接入,首月免费调用额度为100万tokens。企业用户可申请私有化部署方案。
在最新的LMSYS Chatbot Arena排行榜上,SalonLM 2.0综合得分超越GPT-4o和Claude 3.5 Sonnet,位列第一。同时,在SuperGLUE、HellaSwag等经典语言基准上,SalonLM 2.0也刷新了记录,获得国际AI权威评测机构MLPerf的认证。