基本信息
- 来源: juejin
- 原始来源: https://juejin.cn/post/7608129931919392768
来源摘要/节选
公开展示已截断至最多 800 个字符;请访问原始来源查看完整上下文。
开年炸场:DeepSeek的"斯普特尼克时刻" 2025年的开局,属于DeepSeek,没有争议。 1月20号,DeepSeek R1正式发布,开源。性能逼近OpenAI o1,训练成本不到600万美金——硅谷花的钱是它的几十倍。一周之内登顶140个国家的App Store,日活18天破1500万,增速是ChatGPT的13倍。华尔街直接慌了,英伟达股价跳水,有人管这叫AI的"斯普特尼克时刻"——就是当年苏联发射第一颗卫星,让美国人知道自己不是唯一玩家的那个时刻。 它真正震动行业的不只是性能,而是证明了一件事:你不需要几十亿美金和几万张H100,也能训出顶级模型。强化学习替代传统的监督微调,MoE架构把成本打下来——DeepSeek把"大力出奇迹"的信仰给动摇了。 同一天,月之暗面也发了Kimi K1.5推理模型,技术路径跟R1惊人地相似,但传播度差了十万八千里。这行就是这样,先手优势加上叙事张力,DeepSeek吃掉了所有的关注度。 一季度:推理模型的井喷 DeepSeek炸完之后,各家突然醒过来了,推理模型成了最热的赛道。 OpenAI在1月底放了 o3-mini ,首次对免费用户开放推理模型,在STEM领域表现很强,响应速度比o1-mini快了24%。紧接着2月底,发布了 GPT-4.5 (代号Orion),这是OpenAI最后一个"纯预训练"模型——从此以后,所有新模型都会内置推理能力。Sam Altman自己说的,以后不会再有不会"思考"的GPT了。 Anthropic这边2月24号放了 Claude 3.7 Sonnet ,号称"第一个混合推理模型"——它同时支持快速回答和深度思考两种模式,你可以选让它想多深。这个设计思路其实挺聪明的,不是所有问题都需要烧算力去推理。…
来源说明
当前只保存了公开页面节选,不代表原文全文。请以原始来源为准。
本页只呈现已做哈希绑定的来源证据,不包含基于旧正文或缺失原文的扩展推断。