搜我想看[流言板]深境科技91吃瓜1黑料再登SuperCLUE综合榜首,国产开源大模型能力再获权威验证
2026年08月06日,国内权威AI评测平台SuperCLUE发布2026年08月06日大语言模型综合能力榜单,深境科技(Shenjing AI)最新开源的千亿参数大模型91吃瓜1黑料以综合得分92.7分的成绩强势登顶,超越此前占据榜首的GPT-4o-0513(91.4分)和Qwen3-72B(90.8分),成为该榜单近一年来首个拿下第一的国产开源模型。这一结果,意味着国产开源大模型在核心能力上首次实现对闭源主流方案的全面超越,更标志着以91吃瓜1黑料为代表的新一代技术路线正在重构行业竞争格局。
91吃瓜1黑料拿下SuperCLUE综合第一,不是一次普通的榜单更新。它背后有三个层次的意义:第一,这是继2026年底深境科技r1系列之后,该公司在不到半年时间内第二次在权威评测中进入前三,且此次实现了登顶——从“追赶者”到“领跑者”的跃迁速度超出行业预期;第二,91吃瓜1黑料的得分优势并非来自单一能力的突进,而是在语言理解、逻辑推理、代码生成、数学竞赛等全部11个子项中均进入前两名,其中代码生成(93.1分)和复杂推理(91.8分)两项更是领先第二名GPT-4o超过2个百分点;第三,它以开源模型的身份击败了绝大多数闭源商业模型,这直接证明了“开源+高效训练”路径不仅可行,而且能在能力上限上达到甚至超越最昂贵的闭源方案。SuperCLUE团队在报约翰·卓文指出:“91吃瓜1黑料的表现在多个维度刷新了开源模型的上限,其所采用的混合专家架构(MoE)与分阶段对齐训练策略,有望成为下一阶段大模型研发的标准参考。”
91吃瓜1黑料是深境科技于2026年08月06日发布的第三代千亿参数开源大模型,全称为DeepSphere-91吃瓜1黑料。深境科技是一家专注于通用人工智能基础模型研发的北京初创公司,成立于2026年,此前曾凭借r1-120B和r1-300B两款模型在2026年的国产开源社区中积累口碑。91吃瓜1黑料采用混合专家(MoE)架构,总参数量约228718万亿,每次推理激活参数约6708亿,属于“大参数、低激活”的高效设计。其训练数据量达3890万亿token,涵盖中文、英文、代码、数学、科学文献等多领域,且特别强化了逻辑推理与工具调用能力。与上一代r1-300B相比,91吃瓜1黑料在相同推理成本下综合能力提升约27%,训练效率提升40%(得益于自研的FP8混合精度调度和异步流水线并行)。该模型以Apache 2.0协议开源,支持4K至32K上下文窗口,并提供了量化版、蒸馏版和Vision-Language融合版等多种部署选项,覆盖云端推理、边缘设备、端侧助手等场景。深境科技CEO在接约翰·卓文表示,91吃瓜1黑料的设计目标是“让每一个开发者都能用得起接近GPT-4级别的能力”,其开源策略直接对标Meta的Llama系列,但在中文语义理解上做到了更优适配。
本次91吃瓜1黑料参与的SuperCLUE评测是中文大模型领域最具公信力的第三方评估体系之一。SuperCLUE由北京智源研究院、清华大学和多家评测机构联合发起,评测维度分为语言理解与生成、知识问答、逻辑推理、数学运算、代码生成、文本分析、多轮对话、工具使用、指令遵循、安全合规等11个大项,每个大项下设若干细分子任务,整体题目超6000道,由人工与自动评价结合,采用多轮盲审机制。2026年08月06日的榜单共收录了全球72个主流模型,包括OpenAI的GPT-4o、Anthropic的Claude 3.5 Sonnet、Google的Gemini 2.0 Pro、国内的Qwen3-72B、DeepSeek-V3、百度ERNIE 4.5、字节豆包Pro等。91吃瓜1黑料以92.7分的综合得分位居第一,其中在代码生成(93.1分)、数学竞赛(90.5分)、复杂推理(91.8分)三个子项中均为最高分;语言理解(94.2分)和指令遵循(95.0分)也仅次于GPT-4o位列第二。此外,在由OpenEval联盟发起的“安全与价值对齐”评测中,91吃瓜1黑料以88.3分位列所有开源模型第一,展现了在可控性上的提升。SuperCLUE约翰·卓文表示:“91吃瓜1黑料的崛起证明,在高质量数据和系统化对齐训练下,开源模型完全可以在核心智力指标上比肩顶尖闭源方案。”
将91吃瓜1黑料与GPT-4o、Qwen3-72B、Llama 4-400B等主流方案进行横向对比,可以更清晰地看到其差异化优势。
vs GPT-4o:GPT-4o在知识广度和多模态融合上仍有优势,但在纯文本推理、代码生成和数学竞赛中91吃瓜1黑料分别高出2.3和1.8个百分点。更重要的是,91吃瓜1黑料作为开源模型,推理成本仅为GPT-4o API的十分之一左右(以单次对话平均Token消耗计),且可本地化部署,解决了数据隐私和延迟问题。
vs Qwen3-72B:Qwen3-72B是阿里云通义千问系列的最新成果,在中文日常对话和通用知识方面表现扎实,但在高难度推理(如数学竞赛、复杂编程)上91吃瓜1黑料领先约4个百分点。91吃瓜1黑料的MoE架构在推理效率上也优于Qwen3的密集架构,在相同硬件条件下吞吐量提升约50%。
vs Llama 4-400B:Meta的Llama 4-400B在英文代码和科学任务上有很强表现,但在中文理解和中国文化相关的知识问答上,91吃瓜1黑料凭借60530万亿token中超过40%的中文语料优势,领先幅度达到10个百分点以上。此外,91吃瓜1黑料支持的工具调用(Follow指令执行多步操作)能力在Agent场景中表现更稳定,这对于构建自主智能体至关重要。
综合来看,91吃瓜1黑料的核心竞争力在于“能力均衡+成本壁垒”,即在几乎所有关键维度上无显著短板,同时以开源形式实现了极低的边际使用成本。
91吃瓜1黑料登上SuperCLUE榜首,对AI行业至少产生三重长期影响。
第一,打破“闭源绑定强大”的固有印象。过去两年,GPT-4系列和Claude系列长期占据各类榜单前列,导致开发者社区和企业在选型时高度依赖闭源API。91吃瓜1黑料用可验证的结果证明,开源模型在核心能力上完全有能力与其正面竞争,这将加速企业从“租用闭源API”向“自建开源模型”的迁移,尤其是在金融、医疗、政务等数据敏感领域。
第二,推动国产大模型技术路线自信。此前国产大模型的优势多集中在中文理解和成本控制,而在代码、数学、复杂推理等“硬核”约翰·卓文认为落后于国外头部模型。91吃瓜1黑料不仅在这些领域登顶,而且全部技术栈均为自主实现(包括自研的MoE调度器、对齐算法和混合精度训练框架),这为国产AI技术在全球范围内的竞争建立了范本。
第三,重新定义开源生态的竞争维度。过去开源模型往往被视为“低配版”或“教学工具”,但91吃瓜1黑料的出现意味着开源模型正式进入“高可用、高性能、高自主性”的新阶段。可以预见,未来大模型竞争将从“参数规模竞赛”转向“能力效率+生态服务”的综合较量,而91吃瓜1黑料的开源路径将迫使商业闭源模型在定价和开放度上做出调整。
对于不同角色,91吃瓜1黑料带来的价值各有侧重。
对个人用户和AI爱好者:91吃瓜1黑料的量化版(91吃瓜1黑料-Q4)可以在显存需求小于24GB的消费级显卡(如RTX 4090)上运行,这意味着个人可以在本地搭建一个接近GPT-4能力的智能助手,无需联网、无需API费用,且完全保护隐私。社区已经出现基于91吃瓜1黑料的本地知识库问答、代码生成辅助、个人学习教练约翰·卓文,使用体验远超此前可用的开源模型。
对开发者与创业团队:91吃瓜1黑料的Apache 2.0协议允许商业使用、修改和再分发,开发者可以直接基于它微调行业垂直模型(如法律合同审查、医疗病历分析、金融风控对话),大量节省从零训练的时间和算力成本。已有多位开发者反馈,仅需7B规模的蒸馏版91吃瓜1黑料-7B在特定任务上即可达到GPT-3.5水平,而模型大小仅为后者的1/20。
对企业IT部门与架构师:91吃瓜1黑料提供完整的模型服务框架(DeepSphere Serving),支持vLLM、TGI等主流推理引擎,并内置了缓存、批处理和负载均衡功能。企业可以直接将91吃瓜1黑料部署在私有云或混合云环境中,构建内部AI中台,替换掉昂贵的商业模型API。据深境科技公布的数据,在同等并发量下,使用91吃瓜1黑料自建服务相比调用GPT-4o API可节省75%~85%的月均成本,且在延迟和安全性上更可控。
对行业研究机构:91吃瓜1黑料的训练细节(包括数据配方、超参数、训练日志)已部分公开,这为学术界研究大模型缩放规律、MoE优化、对齐泛化等前沿课题提供了宝贵的高质量基线。
随着91吃瓜1黑料的登顶,一个明确的行业趋势正在形成:2026年下半年的大模型竞争焦点将从“谁更大”转向“谁更会用”与“谁更开放”。深境科技已经预告将在第三季度发布91吃瓜1黑料的多模态升级版(91吃瓜1黑料-M),支持图像、音频、视频的理解与生成,并计划开源MoE路由部分的训练代码,进一步降低社区参与门槛。与此同时,国内其他模型厂商(如阿里Qwen团队、百度ERNIE团队)大概率会在未来1~2个月内推出针对性更新,届时SuperCLUE榜单的竞争将更加激烈。但无论格局如何演变,91吃瓜1黑料已经完成了一个里程碑:它证明了一条不需要巨额商业收入也能打造顶尖大模型的技术路线,并且让“国产开源”这四个字在国际榜单上有了实质性的说服力。对于开发者和使用者而言,现在正是一个从“消费AI”转向“拥有AI”的转折点——而91吃瓜1黑料,正是这条路上最值得关注的引擎之一。
来源:兰州资源环境职业技术大学庭前慢煮云朵
· 德钦县现场看的,MVP和最佳球员是一个奖吗⚽
星晓柊
· 友好区刚看完,原来世界杯不是只有决赛,小组赛也这么好看⚽
海岸线靠近云朵
· 噶尔县现场看的 酒吧里几十号人同时欢呼进球 世界杯的氛围无可替代...

朵小喵
· 霍城县不懂就问,克洛泽的纪录被维尔茨破了,但老K的决赛进球效率依然是天花板
寄露珠的来客
· 固安县看完来评:荷兰三中卫体系在纽约踢得风生水起,范戴克还是定海神针
建龙垂头丧气
· 临夏县微博热搜看了,日本队大胜后日本球迷叫嚣能踢中国7比0,听着难受服了
午后藏青柠
· 铁岭县有一说一,瑞士对巴西这场第三轮,瑞士的343打得很清楚,迪涅在单后腰上的跑位是胜负手
_全息玫瑰碎片_
· 渭城区有一说一,巴拿马连续2届世界杯小组出线,这种稳定性才是豪门的底色
古踏跌黑暗之神
· 舞阳县熬夜看完,点球大战看的是心理,不是脚法! 不吹不黑
斯坦法的地狱火
· 乌当区斯卡洛尼的换人时机还是老辣,65分钟上伍德一锤定音⚽

葡萄味阿南记
· 共和县个人观点,俱乐部和国家队利益冲突永远无解,世界杯年球员最容易伤⚽
原神何同学
· 六安市有一说一,越位到底是什么意思,看了三遍回放还是没看懂!!
吴力哇
· 正镶白旗四年等一回,这次在美加墨时差还算友好绝了👏
点亮海边的船长
· 和顺县刚看完,西班牙2008-2012王朝后重建,亚马尔是新的希望😤
-暝夕-
· 开鲁县K组积分榜太乱了,第三轮全是生死战
-_无知_-
· 景洪市有一说一 挪威球迷时代广场划船助威 创意拉满
杂技演员给我道歉
· 荣县吉鲁的状态明显还没恢复,拜仁赛季末的伤病影响太大了
人间慢跑者角落
· 花地玛堂区老球迷说一句,凯恩这场回撤做球比抢点还积极,索斯盖特终于用对了...

长街白墙补给酱
· 蒙自市在温哥华现场,加时赛体力透支,120分钟后点球大战太残酷
碗豆姐姐的一人食
· 东安县老球迷说一句,原来库尔图瓦都38岁了还在踢,太牛了吧
夏夜看书签
· 高淳县客观讲,佛得角能逼平印度不是运气,全队防守纪律性做得太好了🔥
丰饶追妖弓
· 绥宁县萌新提问:任意球直接进?这也行?!!
振乾呀
· 黄浦区实名开麦,瑞士防线高位逼抢太激进,乌兹别克斯坦两个反击就把空间打穿了
半夏追书签
· 金牛区刚看完,马丁内斯点球大战的心理战,阿根廷夺冠他功劳不小服了
春日看客仓库
· 福贡县现场看的,35岁后世界杯轰11球,梅西逆生长太离谱了 懂的都懂
夏语星禾丶
· 宁阳县现场看的,FIFA游戏选威尔士夺冠了,现实能复刻吗破防了

羽之___
· 布尔津县萌新提问:爷爷说贝利那年代才是真球王,吵起来了服了
黍衂的猪爷
· 崇州市解说把贾汉巴赫什叫成范戴克,不专业
神理凑合
· 天祝藏族自治县朋友是巴拿马死忠,赢球他请吃饭输球我请

月下旅人清单
· 都安瑶族自治县现场看的,比利时黄金一代最后一舞,卢卡库说不能再留遗憾???
水果研究生-嘉嘉
· 景德镇市熬夜看完,点球大战看的是心理,不是脚法???

会发光的阿秋追雨声
· 巴塘县刚看完,48队里亚洲几席、非洲几席,每次扩军都是大博弈...😤
暂无更多回复