AI最新动态

为您提供AI人工智能新闻,人工智能消息,人工智能动态,人工智能行业等人工智能行业资讯报道

Google 发布 Gemini 4 Argon:百万 token 输出,18 项测试 14 项第一
Google 发布了新一代前沿模型 Gemini 4 Argon,将单次输出上限从 64K token 提升至 100 万 token。推广期价格为每百万 token 输入 2 美元、输出 10 美元,结束后调整为输入 4 美元、输出 20…
Anthropic 长文评测 GLM-5.3:网络安全能力逼近 Claude Mythos 水平
Anthropic 为 GLM-5.3 免费打了一个广告。 A 今天发表了一篇长文,专门研究 GLM-5.3 的网络安全能力,核心论点是:GLM-5.3 太强了,可以端到端开发可用的漏洞利用程序。 文章中提到,GLM-5.3 在 Expl…
Claude Sonnet 5.5 发布:性能超越 Fable 5.1 和 GPT-6 Astra,成本大幅降低
Anthropic 正式发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二个模型,定位为 Opus 5.5 的低成本、高速度搭档。速度比 Sonnet 5 快 30% 以上,大部分工作的成本最多降低 30%。 …
Claude Sonnet 5.5 发布:性能逼近 Opus 5.5,价格减半
Claude Sonnet 5.5 正式发布。此前发布的 Claude Opus 5.5 虽然性能最强,但价格昂贵且额度消耗极快,用户急需一款性价比更高的替代方案。 Sonnet 5.5 的价格是 Opus 5.5 的一半,也是目前 Cla…
Qoder实测:2小时生成293个测试全绿,Credits一分不扣
用/goal目标任务启动,Agent疯狂干活两个多小时,为一个真实项目从零生成293个测试用例,全绿。功能覆盖率73%,超过60%的门槛要求。业务代码零改动,测试新增2192行。Credits消耗:0。 Agent是Qoder,模型用的是…
OpenAI DevDay前瞻:常驻型AI助手"O"曝光,关掉ChatGPT它还在替你干活
北京时间后天凌晨1点,OpenAI DevDay 2026即将开幕。发布会前72小时是爆料最密集的窗口,而今年分量最重的一条,指向一个代号只有一个字母的产品:"O"。 爆料来自TestingCatalog的Alexey Shabanov,综…
腾讯Hy Image 3.5 preview实测:生图效果媲美GPT Image 2.5,限时免费
近期腾讯发布了全新的AI生图模型Hy Image 3.5 preview。先来看几组生成效果: 相比前一代模型,这一代的提升非常明显,已经可以和Nano Banana乃至GPT Image 2.0比上一比了。与国外顶级图像模型相比差…
Anthropic 两周提速 Claude 3 倍:可衡量就能优化,150 线程并行 + CI 棘轮护栏实战
Anthropic 三位工程师在开发者博客上复盘了如何用两周时间,把 claude.ai 网页版和桌面端的核心体验整体提速约 3 倍:打开页面到能打字从 3.1 秒降到 0.55 秒,新开会话从 0.8 秒降到 0.3 秒,加载云端会话从 …
腾讯QClaw宣布12月停运:AI办公内部赛马结束,WorkBuddy胜出
就在今天,9 月 24 日,腾讯 QClaw 发布公告:QClaw 将在 2026 年 12 月 24 日正式停止运营。 关停原因:业务发展调整。这标志着,腾讯在 AI 办公领域的内部赛马正式结束。WorkBuddy 一路高歌,QClaw…
网易有道Confucius4双榜第一:R2T2语音识别与T3PO实时翻译模型开源
Hugging Face 今年3月出的报告里,过去一年的模型下载,中国占了41%,美国是36.5%;Artificial Analysis 的开源权重模型榜,前六名全是中国实验室;OpenRouter 上按 token 量排,前五名里有四个…