智能体时代,大模型竞争拼什么?
2026年世界人工智能大会7月在上海开幕。这次大会的主题叫“智能伙伴,共创未来”。这个主题说得很明白——AI行业已经变天了。大模型不再比谁参数多、谁榜单分数高,而是看谁真正能用起来、能解决实际问题。
就在大会开幕前9天,国家科学技术奖励大会公布结果。科大讯飞参与的“鹏城云脑”项目拿到2025年度国家科技进步奖一等奖。这个时间点不是巧合。它说明一件事:国家对AI产业的评判标准也变了,从看论文、看参数,转向看自主技术、看实际效益。
一、底座能力:从“能用”到“好用”
前两年大家比的是谁模型参数多。2023年比千亿参数,2024年比榜单分数。到了2026年,这些都不灵了。智能体要进工作流程,要替人干活,底座稳不稳才是关键。
“鹏城云脑”项目解决的问题很直接:用国产芯片把大模型训出来。项目团队突破了基于国产AI芯片的超大规模智算架构,做出国内首个全面自主可控的E级智能算力平台“鹏城云脑Ⅱ”。这个平台的I/O吞吐能力和大规模AI计算能力在国际上领先,大规模AI并行训练能力也达到国际先进水平。
更重要的是,这个平台不是摆着看的。它已经支撑了北京、武汉等全国25个智算中心建设,成了国产智算集群的主导方案。项目带动华为昇腾大规模产业化,带动科大讯飞、中国移动等企业搭建了10多个万卡昇腾智算集群,相关国产芯片累计出货超过100万片。国内超过一半的国产大模型,都用这套系统做过训练。
科大讯飞在这个项目里主要负责基于国产算力的大规模并行训练方法研究。后来讯飞自己主导建了“飞星一号”和“飞星二号”国产超大规模智算平台。讯飞星火也是国内最早完全用国产算力完成训练和推理的大模型。很多国内大模型还在用海外高端GPU做训练,只在推理环节用国产芯片。讯飞星火不一样,从训练到推理,全链条都在国产平台上跑通了。
2026年4月发布的星火X2-Flash最能说明问题。这个模型采用MoE架构,总参数300亿,最大支持256K上下文,用华为昇腾910B集群完成训练。它在国产算力上实现了DSA稀疏注意力和MTP多token预测结合的长文本高效训练,训练效率相比同规模A800集群从20%提升到90%。在智能体强化学习训练场景中,采样解码效率最高能提升2倍以上。它已经深度兼容OpenClaw、Claude Code这些主流Agent框架。
经讯飞智能体AstronClaw实测,星火X2-Flash在深度研究报告、Skill管理与调用、系统控制与执行这些智能体核心任务上,效果接近业界万亿参数模型。而在相同工作流下,整体Token消耗不到当前主流大尺寸模型的三分之一。它的API调用价格是1到2元/百万Tokens。
这些数据说明一件事:国产算力路线不光解决了“能不能训”的问题,还正在解决“训得好、跑得稳、用得起”的问题。
二、场景能力:AI要进真实世界
底座再稳,落不到场景里也是白搭。AI要真正释放生产力,必须进到社会刚需和产业核心流程里。
教育是AI落地最典型的场景之一。 2026年6月,科大讯飞发布星火多模态大模型X2-VL。这是中国首个基于全国产算力平台训练的全栈自主可控多模态大模型。它在视觉推理、图文理解、文档分析、图表理解这些任务上表现突出。基于2026年全国各地高考模拟试卷中的多模态试题测试,它全学科平均答题准确率接近95%。
分数不是关键,关键是它已经在真实场景里跑了。在无锡,科大讯飞智慧教育产品已经规模化应用:近1200台AI黑板覆盖75所中小学,日均应用活跃率87%;星火智能批阅机部署128台,覆盖80所中小学。这些设备基于多模态大模型能力,能实时分析学生的书写、绘图和答题过程,给出个性化反馈。
医疗是另一个AI深度介入的领域。 讯飞晓医APP搭载星火医疗大模型,服务超过25万医生、数百万家不同等级的医院,累计辅助诊断超过11亿次。从症状自查、药物查询到报告解读,AI正在覆盖“看病前、用药时、检查后”三大健康场景。
司法领域同样能看到AI的深度渗透。 科大讯飞基于多模态大模型能力,解决了复杂版面解析难题,让电子卷宗从“能识别”走向“好阅读、易应用”。手写体识别准确率97.2%,复杂表格识别准确率95%。这些技术推动民商事60天内结案率提升18%,刑事办案效率提升30%。智慧法庭已覆盖无锡全市两级法院,庭审时长缩短30%到50%,人力资源效率提升60%。
具身智能是AI从数字世界走向物理世界的关键一步。 星火多模态大模型X2-VL也赋能了具身智能大模型升级。科大讯飞提出新一代具身模型GEAR-VLA,提升了空间任务精度与物体特征泛化能力。讯飞的聆动通用机器人已经走进物流分拣场景,成为全国首个在工业应用领域获得具身智能机器人CR认证的企业。
从教育到医疗,从司法到物流,这种扎根真实场景的落地方式,打破了AI“重研发、轻落地”的行业通病。这也呼应了WAIC大会的主题:智能伙伴,共创未来。
三、经验能力:可复制才能做大
底座和场景之外,还有一个容易被忽略的维度——可复用的经验。国产AI软硬件生态的成熟,不能只靠一两次技术突破,需要可复制的工程经验、训练方法和落地路径。
“鹏城云脑”项目获奖的深层意义就在这里。它不只是一个技术成果,更是一套可以在全国范围内复制的国产智算集群建设方案。从“鹏城云脑”到“飞星一号”再到“飞星二号”,科大讯飞走出了一条可复制的路:先在国家级重大项目中验证技术可行性,再通过自建智算平台实现规模化,最后把经验反哺到芯片、算子、训练框架等产业链环节。
在MoE模型训练方面,科大讯飞联合完善并优化了MoE训练关键算子,协同设计亲和昇腾架构的MoE结构。2025年以来,讯飞攻克了国产算力训练的两座“大山”:在长思维链强化学习方面,把深度推理训练效率从30%提升到84%以上;在MoE模型全链路训练方面,把效率从30%提高到93%。
星火X2-Flash已经深度兼容OpenClaw、Claude Code等主流Agent框架。开发者不用为国产算力平台重写代码,就能把现有智能体应用迁移过来。这种兼容性降低了开发者的迁移成本,也让国产算力平台的生态建设门槛更低。
在更广的维度上,科大讯飞正在把国产AI能力输出到全球市场。2026年5月,讯飞入选福布斯中国“2026福布斯中国人工智能科技企业TOP 50”。讯飞AI眼镜整机仅40克,支持122种语言实时翻译。AstronClaw与讯飞AI眼镜结合打造了轻量化智能助手GlassClaw,通过技术联动实现信息实时理解与补全。
2026年4月,科大讯飞举办AstronClaw升级发布会,首次完整展示“软硬一体”AI Agent架构体系。桌面数字伙伴Loomy新增Buddy功能,可根据用户记忆、偏好及形象构建个性化超级团队。国内首个企业级开源技能仓库Astron SkillHub也同步亮相。
结语
面向智能体时代,科大讯飞计划2026年10月在华为昇腾950平台上,发布中国首个对标业界最先进模型的旗舰大模型。
从这些动作能看出来,智能体时代的大模型竞争,不是一场速成的跑分竞赛,而是一场长期的实力深耕。谁能守住自主可控的技术底座,谁能扎根真实产业创造实效,谁能沉淀可复用的生态经验,谁就能站稳AI产业的未来赛道。
对中国人工智能产业来说,智能体时代的突围之路,拼的不是谁的模型更大、谁的榜单更靠前,而是谁能在真实世界里站稳脚跟。谁站得稳,谁才能走得远。