10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

Kimi K3正式发布:前端能力超越Fable 5,世界顶尖开源模型

1月前 AI最新动态 629 0

2026 年 7 月,月之暗面(Moonshot AI)正式发布了 Kimi K3 模型——上下文窗口 1M,总参数 2.8T。官方跑分数据非常强悍。

图片 1

到目前为止的基准测试中,Kimi K3 击败了:

  • GPT-5.6 Sol:14 项中 11 项胜出
  • Opus 4.8:全部 14 项胜出
  • Claude Fable 5:14 项中 6 项胜出

图片 2

图片 3

官方展示了几个有趣的案例:芯片自主设计概念验证、视频剪辑、可控核聚变研究。K3 可以搭起一套真正可用的编译器栈——这是真实的 GPU 编译器开发。

前端能力:超越 Fable 5

Kimi K3 在 Frontend Code Arena 中以 1679 分位居 #1,超越了 Claude Fable 5。这是从 Kimi K2.6(#18)跃升了 17 个名次。

图片 4

在前端领域,K3 在 7 个子领域中的 6 个位居 #1。实际测试中,K3 Max 仅用一个简单提示词就模拟了火星登陆页面,单次成功。

图片 5

智能水平

Kimi K3 在 Artificial Analysis Intelligence Index 上得分 57,超越 Opus 4.8,但落后于 Fable 5 和 GPT-5.6 Sol。

图片 6

令牌效率几乎是 Opus 4.8 的 2 倍。

图片 7

每任务成本 0.94 美元,与 GPT-5.6 Sol(1.04 美元)接近,约为 Opus 4.8(1.80 美元)的一半。API 定价为每 1M 输入/输出令牌 3.00/15.00 美元。

图片 8

令牌使用量比 K2.6 少 21%。

图片 9

原生多模态支持图像和文本输入。马斯克也对此发表了评价:

图片 10

文本能力

在 Text Arena 中,Kimi K3 排名 #9,得分 1486 分,总体优于 GPT-5.6 Sol(xhigh)。相比 K2.6 从 #38 跃升到 #9。

图片 11

在创意写作、编码和指令遵循方面进入前 10,在三个职业领域排名 #1。

CritPt 得分:23%,超越 Opus 4.8 Max

CritPt 难度极高,专注于前沿物理问题。Kimi K3 得分 23%。

图片 12

总结

K3 绝对是一个里程碑。虽然官方对 K3 设定了一些限制,需要理性看待,但其在前端、文本、物理推理等维度的突破已经足够亮眼。

图片 13

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:Kimi K3正式发布:前端能力超越Fable 5,世界顶尖开源模型
#Kimi K3 #Moonshot AI #开源模型 #大模型 #Frontend 
收藏 1
CodeBuddy/Cursor 嵌入在线应用:ACP+MCP 的 Agent 集成方案
DashiAI PPT Skill:8576个可调控件+1020个版式,开源AI演示文稿工具
推荐阅读
  • WorkBuddy(腾讯版小龙虾)开箱即用,全场景智能桌面版
  • GLM-5.1 代码能力实测:SWE-Bench Pro 全球第一,长程任务可连续工作 8 小时
  • 手把手教你白嫖一年Google Gemini Pro,学生免费订阅开通教程
  • 又是“最强模型”的一天!Google Gemini 2.5 Pro更新,性能再次跃升
  • WorkBuddy AI 专属卡实测:不是帮你花钱,是帮你省时间
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
33617 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
30122 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
23144 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
22299 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
19914 5月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
18402 4月前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
18067 1年前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
17933 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
17643 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16278 1年前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 腾讯Hy4 preview实测:对比GLM-5.3,谁的Agent编程能力更强?
2 豆包工作实测:只给一个博主名字,自动完成抖音博主内容研究
3 微信AI硬核技术开源:WeMM-Embedding 多模态搜索实测
4 豆包coding再升级:doubao-seed-evolving 无限流模式实测
5 智谱发布牛来模型:对标DeepSeek的国产大模型新突破
6 人形机器人务实转向:从炫技到落地,先找活干再长身体
7 Ox Alpha正式开源:V4Flash价格、Opus4.8能力,国产大模型新突破
8 RunningHub 上线 Wan3.0:文档/PPT 直接生视频,480P 仅 0.05 元/秒
9 Sub2API 重要提醒:OpenAI 明确不支持账号共享,核心功能停止开源
10 Qwen3.8-Flash上线:Next架构MoE模型,输入0.8元/百万Tokens,缓存低至0.1元
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联