新闻 速览

彭博:中美大模型性能差距缩至3%

赵家豪 阅读约 6 分钟 629923 阅读
彭博:中美大模型性能差距缩至3%
配图:彭博:中美大模型性能差距缩至3%

新闻导读

彭博:中美大模型性能差距缩至3%日用品背后的科学写得很对我胃口,买东西时少被营销词忽悠。没有连着弹窗求好评,页面清静,打扰少。本地与季节相关的编排有温度,科学不只在遥远实验室。配图标注清楚,动画示意服务理解,不靠夸张音效留人。亲子聊天也多了实在话题,少靠吼、多靠把事情讲明白。

10月6日消息,据外电报道,中国人工智能大模型正在逼近美国第一梯队,两国之间的性能差距已经缩小至创纪录的 3%。DeepSeek 上月发布的最新模型评测表现被认为已经可以比肩 Anthropic 与 OpenAI 的顶级系统,这也让越来越多人开始质疑美国技术优势能否长期维系。 彭博行业研究高级分析师罗伯特・利(Robert Lea)于 5 日发布一份报告称,随着 DeepSeek 推出V4.1 Flash,中国最优大模型与美国竞品之间的基准分数差距仅剩下 3%。今年 5 月这一差距约为 9%,年初更是达到 15%,降幅十分显著。该分析师预测,中国企业的市场份额还将继续扩大。 在 AI 模型评测平台 LiveBench 上,DeepSeek V4.1 Flash 全球排名第 6。这也是自去年 DeepSeek凭借推理专用模型 R1 出圈以来,中国大模型取得的最高位次。LiveBench 这套基准,会通过各类问答题、智力谜题与实操任务,对模型作答和分析能力做综合测评。

相关标签

免责声明:本文内容来自公开报道与编辑整理,仅供参考。转载请注明出处;版权争议请联系本站核实处理。页面地址:http://www.gxycedu.cn/ex_news?id=hkzkv9-axg1gbp%3D4p%3D11p%3D2p%3D3

评论区

热门讨论 · 占位展示
说说你的看法…
发表评论
  • 用户
    读者6号
    最喜欢它把抽象概念落到日常里,尽量用身边例子拆开讲。日用品、防护、营养这类贴近生活的主题特别实用。大人补课不掉价,小孩问为什么也好用,双方都受益。进度跨设备衔接自然,换手机平板继续看不费劲。细节体验也在线,长时间用不会觉得被敷衍。综合可读性、可信度和可坚持性,表现都还在线。
    20261006 · 来自移动端
  • 用户
    朱建强
    电脑深学、手机碎片复习,进度能对上,家庭共享也更放心。争议话题措辞谨慎,不站队煽情,更像在认真备课。比如想弄懂抗生素耐药到底怎么回事,基本能找到不绕弯的解释。字号行距可调,夜间模式护眼,长时间阅读相对不累。在心理健康话题上,克制本身就显得专业。
    2026-10-06 21:17:20
  • 用户
    热心网友
    大婚轮新娘许萌小说,内容值得关注,期待后续更新。
    20261006

期待你的精彩发言。