基本信息

来源摘要/节选

公开展示已截断至最多 800 个字符;请访问原始来源查看完整上下文。

这几天科技圈最热闹的事,莫过于科大讯飞扔出的这颗重磅炸弹。 就在2026年2月11日,讯飞星火X2大模型正式发布。说实话,作为一名长期关注AI底层的博主,我起初对这场发布会的期待值是持保留态度的。毕竟市面上“吊打”、“遥遥领先”的PPT我们见得太多了。 但这次不一样。星火X2最让我感兴趣的不是它的参数量,而是它脚下踩着的基座—— 全链路国产算力 。 没错,在被卡脖子的大背景下,讯飞这次没用英伟达,而是完全基于国产昇腾服务器跑通了训练和推理。这本身就是一个巨大的工程学信号。 293B参数,单卡居然能跑? 先看参数党最关心的硬指标。星火X2采用了293B的MoE(混合专家)稀疏架构。 两年前我们还在纠结MoE怎么训练稳定,现在讯飞已经把它玩出花了。他们搞定了一个叫“训推采样校准”的技术,简单说就是让模型在训练和推理时的表现更一致,不再是“模拟考满分,高考拉胯”。 最离谱的数据是部署门槛。对于千亿级参数的模型,通常需要昂贵的集群支撑。但星火X2通过极极致的权重量化和VTP(虚拟张量并行)技术,宣称 单台国产昇腾服务器就能跑起来 。 这对企业意味着什么?意味着私有化部署的成本直接腰斩。推理性能比上一代X1.5提升了50%,这在实际业务中是肉眼可见的流畅度提升。 不只是聊天,更是“做题家” 为了证明自己不是只能聊天的“吉祥物”,讯飞直接拿出了哈佛-麻省理工数学锦标赛(HMMT)的题目来练手。 演示中,X2不仅解出了这道英文高难数学题,甚至连步骤逻辑都严丝合缝。官方称其数学和逻辑推理能力已经“媲美国际最优”。虽然“对标”这个词在业界通稿里很常见,但结合其在医疗和教育领域的实战数据来看,这次的底气确实比以往更足。 说到实战,这才是讯飞的老本行。 垂直场景的“降维打击” 如果不谈落地,大模型就是空中楼阁。讯飞这次显然是盯着“干活”去的: 医疗领域 :这可能是最硬核的背书。…

来源说明

当前只保存了公开页面节选,不代表原文全文。请以原始来源为准。

本页只呈现已做哈希绑定的来源证据,不包含基于旧正文或缺失原文的扩展推断。