10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 标签云 排行榜

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

DeepSeek登上了《Nature》封面!国内首家大模型!

1年前 AI最新动态 2687 0

今天刷到一条让我兴奋到想立刻写下来分享的消息:DeepSeek登上了《Nature》封面。

要知道,《Nature》是全球顶级的科学期刊,能在上面发表AI成果的,几乎都代表着划时代的突破。之前能上去的案例,像 AlphaGo、AlphaFold,都是AI发展史上浓墨重彩的一笔。而这一次,轮到了一家国内大模型厂商。

作为一个每天泡在各种AI产品里的产品经理,我第一反应是:为什么是DeepSeek? 它到底做对了什么,才有资格和这些重量级成果并列?

我结合论文和之前的跟进体验,总结了三点核心原因。

1. 成本

DeepSeek-R1 的训练成本只有 29万美元(约200万人民币)。

对比一下:Grok-4 的训练成本是 4.9亿美元,足足是 DeepSeek-R1 的 1689倍。

什么意思?同样的钱,能训练一个 Grok-4,还是能训练 1600多个 DeepSeek-R1。这不仅仅是“便宜”,而是颠覆了整个行业对于大模型训练“必须烧钱”的认知。

还记得今年年初,DeepSeek-R1 发布时,美股都被震了一下。很多人不信,质疑是不是“炒作”。结果大量同行去复现,最后证明:真·能跑出来。

2. 数据

当时还有不少声音怀疑 DeepSeek 是不是偷偷蒸馏了别人的模型。

结果团队直接把训练数据集细节公开了,用行动回击了这些质疑。

这套数据大约有 15.4万道题,覆盖五大类:

  • 数学:2.6万题,专注推理计算

  • 编程:2.5万题(算法竞赛题 + 代码修复),提升代码生成与调试能力

  • STEM:2.2万题,涵盖物理、化学、生物

  • 逻辑:1.5万题,训练推断与分析

  • 通用:6.6万题,创意写作、问答、角色扮演、无害性评估等

这种透明度,在大模型圈其实很罕见。也正因为如此,Nature 才认可了它的原创性和科学贡献。

3. 算法

最让我感兴趣的,是 DeepSeek 真正把强化学习用在推理能力提升上,而且是第一个做成功的。

传统的做法,需要大量人工标注推理过程,成本高得吓人。DeepSeek 走的是“自演化”路线:

  • 只看最终答案是否正确,把它作为奖励信号

  • 底座用 DeepSeek-V3-Base

  • 算法用 GRPO 强化学习

  • 再通过少量冷启动 + 拒绝采样 + 监督微调,把模型一步步打磨出来

这种做法有点像“把学生丢进考场,只看最后成绩”,结果还真让模型学会了“如何思考”。

更关键的是,这一突破不仅节省了训练成本,还让 DeepSeek-R1 成为了当时最强的推理模型之一。甚至和闭源的 O1 相比,也丝毫不逊色。

感想

说实话,我在体验过那么多 AI 产品之后,这次还是被 DeepSeek 震撼到了。

它证明了:顶级大模型,不一定要靠烧钱砸出来。

它用行动告诉大家:开源 + 透明,也能走上顶级舞台。

它还打开了一条新路:强化学习不止能玩游戏,还能让模型学会更强的推理。

如果说 2025 年中国 AI 技术的里程碑事件之一是什么,我觉得 DeepSeek-R1 肯定榜上有名。

从某种程度上,它让闭源阵营的“老大哥们”意识到:开放和创新的结合,可能才是最有杀伤力的武器。

文章地址:https://www.nature.com/articles/s41586-025-09422-z

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:DeepSeek登上了《Nature》封面!国内首家大模型!
#DeepSeek #Nature 
收藏 1
a16z:Top 100 Gen AI Consumer Apps(生成式 AI 消费应用 Top 100)
Bytebot:开源AI桌面代理(Desktop Agent),给AI配一台自己的电脑
推荐阅读
  • AutoClaw Hermes 自进化能力上线:可控可视的 AI 记忆系统,内置 Skills 商店
  • PixVerse V5.5 正式发布,自动做分镜、配对白、加音效,整段短片一键生成
  • 教你白嫖一台腾讯云服务器:CodeBuddy × 腾讯云 Lighthouse限时福利,手慢无!
  • OceanBase 发布 AI 数据库:Agent 时代的企业数据底座
  • Anthropic 发布 AI Agent Zero Trust 安全白皮书:六大能力域与八步部署指南
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
34065 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
30668 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
23422 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
22837 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
21063 5月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
18916 5月前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
18524 1年前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
18340 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
18094 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16547 1年前

文章目录

关于苏米客
分类排行
1 阿里内测 Qovest AI 金融投研 Agent:面向个人投资者的智能研究助手
2 Qoder 国际版限时福利:Qwen3.8-Flash 模型 0 元免费用至 9 月 30 日
3 GLM-5.3-FlashX 上线:推理提速 5 倍达 200 tokens/s,Agent 构建推理 Infra
4 Jev 模型发布:OpenAI 核心大佬打造纯决策 AI,速度快 200 倍成本降 400 倍
5 HD-V1 视频模型实测:先理解再生成,音画同步与物理规律全面突破
6 Agent 自动上传代码库引隐私担忧:开源办公 Agent 为何更重要——以有道 LobsterAI 为例
7 小米 MiMo-V2.6 公开 RL 训练直播:两天烧掉千万,过程数据成研究金矿
8 Anthropic公开AI递归自我改进核心数据:3万Agent参与研发,人类正退出一线
9 Gemini 3.8 Live 发布:语音天梯榜登顶,价格仅为 OpenAI 实时 API 的三分之一
10 OpenAI Codex 用户反馈:300 万阅读量下的额度限制、产品定位与体验痛点
苏米客
登录 注册
显示
没有账号? · 立即注册
显示
已有账号? · 直接登录
登录代表你已同意 用户协议 和 隐私政策
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6 网站地图 百度地图
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联