#AI动态

GLM-5.3-FlashX 上线:推理提速 5 倍达 200 tokens/s,Agent 构建推理 Infra
智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型提速 5 倍,价格提价 2.5 倍,API 同步开放。这背后是在 10 万张国产芯片提供的推理算力基础上,进一步加大对 In…
Jev 模型发布:OpenAI 核心大佬打造纯决策 AI,速度快 200 倍成本降 400 倍
OpenAI 曾经教大模型"学会说人话"的 RLHF 核心作者 Diogo Almeida,隐身两年后重新创业,发布的全新模型居然"连一个字都不会打"?他的官宣推文迅速爆红,目前已有 3000 万浏览。 "放弃生成不是退步,而是像当年 Tr…
小米 MiMo-V2.6 公开 RL 训练直播:两天烧掉千万,过程数据成研究金矿
罗福莉也学雷军开直播了。没有主播,没有带货——页面上只有训练曲线,以及一串不断跳动的美元数字。 截至 9 月 17 日下午,MiMo-V2.6 Pro 和 Flash 两条训练线还没跑满两天,累计成本已约 137.8…
GPT-5.6 更新:Luna 免费无限文本,Sol 统一付费 Chat 快答与深思
OpenAI 更新了 ChatGPT Chat 体验:Plus/Pro 付费用户的快速回答和深度推理统一交给 GPT-5.6 Sol,Free/Go 免费用户则获得 GPT-5.6 Luna 的无限文本对话。Work 和 Codex 不在本…
AI Coding 渗透报告:非技术人员正在用它做什么
过去一年,关于 AI Coding 的讨论几乎都集中在研发团队:能不能写得更快、代码质量怎么样、采纳率多少。但一个容易被忽略的事实是,非研发角色也在大量使用 AI Coding 工具,而且场景比「写代码」宽得多。 Anthropic 在 2…