AI最新动态

为您提供AI人工智能新闻,人工智能消息,人工智能动态,人工智能行业等人工智能行业资讯报道

Karpathy:当AI产出超过人类阅读速度,别再让模型写更多文字
Karpathy 潜水许久,最近发了条推,说了一个很多人忽略的问题:当 AI 的产出速度超过人的理解速度,继续让它写更多文字,只会把瓶颈越堆越高。 模型可以在几分钟内生成几万行代码、研究报告和复杂方案,但人仍然要判断它做了什么、逻辑是否成立…
WorkBuddy上线Space-Bunny匿名模型:0.03x超低消耗,推理编码双强
就在大家过欢欢喜喜过国庆之际。WorkBuddy 国庆不休息。风风火火把近日大火的匿名模型 Space-Bunny,给上线了。 看得到,消耗倍率为 0.03x ,比 Hy4 preview的 0.29、DeepSeek-V4.1-Flas…
OpenAI DevDay 2026:GPT-6.1 Astra 因安全问题叫停,数字员工 Dots 登场
北京时间 9 月 30 日凌晨 1 点,OpenAI 在旧金山召开了 DevDay 2026,一口气发布了 20 多项内容。但最引人注目的,反而是那个没有登台的东西。 GPT-6.1 Astra 被自家叫停 就在开会前一天(9 月 28 日…
Google 发布 Gemini 4 Argon:百万 token 输出,18 项测试 14 项第一
Google 发布了新一代前沿模型 Gemini 4 Argon,将单次输出上限从 64K token 提升至 100 万 token。推广期价格为每百万 token 输入 2 美元、输出 10 美元,结束后调整为输入 4 美元、输出 20…
Anthropic 长文评测 GLM-5.3:网络安全能力逼近 Claude Mythos 水平
Anthropic 为 GLM-5.3 免费打了一个广告。 A 今天发表了一篇长文,专门研究 GLM-5.3 的网络安全能力,核心论点是:GLM-5.3 太强了,可以端到端开发可用的漏洞利用程序。 文章中提到,GLM-5.3 在 Expl…
Claude Sonnet 5.5 发布:性能超越 Fable 5.1 和 GPT-6 Astra,成本大幅降低
Anthropic 正式发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二个模型,定位为 Opus 5.5 的低成本、高速度搭档。速度比 Sonnet 5 快 30% 以上,大部分工作的成本最多降低 30%。 …
Claude Sonnet 5.5 发布:性能逼近 Opus 5.5,价格减半
Claude Sonnet 5.5 正式发布。此前发布的 Claude Opus 5.5 虽然性能最强,但价格昂贵且额度消耗极快,用户急需一款性价比更高的替代方案。 Sonnet 5.5 的价格是 Opus 5.5 的一半,也是目前 Cla…
Qoder实测:2小时生成293个测试全绿,Credits一分不扣
用/goal目标任务启动,Agent疯狂干活两个多小时,为一个真实项目从零生成293个测试用例,全绿。功能覆盖率73%,超过60%的门槛要求。业务代码零改动,测试新增2192行。Credits消耗:0。 Agent是Qoder,模型用的是…
OpenAI DevDay前瞻:常驻型AI助手"O"曝光,关掉ChatGPT它还在替你干活
北京时间后天凌晨1点,OpenAI DevDay 2026即将开幕。发布会前72小时是爆料最密集的窗口,而今年分量最重的一条,指向一个代号只有一个字母的产品:"O"。 爆料来自TestingCatalog的Alexey Shabanov,综…
腾讯Hy Image 3.5 preview实测:生图效果媲美GPT Image 2.5,限时免费
近期腾讯发布了全新的AI生图模型Hy Image 3.5 preview。先来看几组生成效果: 相比前一代模型,这一代的提升非常明显,已经可以和Nano Banana乃至GPT Image 2.0比上一比了。与国外顶级图像模型相比差…