#模型
5 款主流 AI 模型 Agent 任务实测:MiniMax、DeepSeek、Step、GLM、Gemini 对比
市面上能调用的模型越来越多,各家都有自己的亮点,光看宣传文档和跑分数据很难判断哪个真正适合自己——尤其是当任务从单轮对话延伸到多步操作的时候。这次测试把五个主流模型拉出来实际跑一遍,看看它们在真实 Agent 任务中…
Anthropic封号潮应对:构建可替换的AIOS系统架构
这两天 claude 的封号潮又来了,被爆出来专门植入代码识别中国用户,大家的反应画风也是相当割裂。
几年老用户 Max 号说封就封,一些 IP 粉转黑疯狂输出情绪,并开始报复性给替代模型引流;
A\封完账号转头宣布 Fable5 解封,幸…
国产大模型算力账单:DeepSeek 峰谷涨价,智谱 Kimi 限流 429 成常态
DeepSeek 已正式发布 v4 版本,并同步调整定价策略:在高峰时段(每日 9-12 点和 14-18 点),价格将翻倍。此前 V4 预览版曾将折扣价设为永久价,此次改为峰谷定价,主要受算力供应紧张和正式版性能提升预期影响。
Deep…
实测美团LongCat-2.0:5万张国产芯片跑出的万亿参数MoE大模型
美团发布了 LongCat-2.0,一个总参数 1.6 万亿(激活约 480 亿参数)的 MoE 模型。值得瞩目的是,该模型从预训练到大规模部署,全程跑在 5 万张国产算力芯片上,耗时一个多月,处理超过 35 万亿 tokens,全程无回滚…
SmartCall:开源 AI 呼叫中心系统,Java + 大模型 + Asterisk 全链路语音交互
SmartCall 是一个基于 Java 开发的开源呼叫中心系统,将传统电话系统与 AI 大模型深度集成。它支持自动接听、外呼、AI 语音应答,并在遇到复杂情况时无缝转接人工客服,适用于电商售后、金融催收、教育招生等场景。
项目遵循 Apa…
GLM-5.2 免费编程指南:6个平台零成本替代 Claude Code
智谱上周开源了一个 744 亿参数的编程模型 GLM-5.2,编程能力与 GPT-5.5 打平,而且至少有 6 个平台可以直接免费使用。
关键数据:Artificial Analysis 榜单开源第一,智能体评测 1524 Elo&mdas…
DeepSeek V4 正式版即将发布:引入峰谷定价机制,闲时算力更低价
DeepSeek V4 正式版计划于 7 月中旬正式上线。本次版本更新将带来更多功能优化和性能提升。
同时,为了更合理地配置资源、提升服务稳定性,正式版发布后将同步调整 API 定价策略,引入峰谷定价机制。
具体计费调整
DeepSeek-…
Hermes Agent上线MoA功能:多模型混合协作,基准测试超越GPT-5.5和Opus-4.8
前几天 OpenAI 官方发布了 GPT-5.6 模型,但由于美国政府限制,我们暂时还用不了。不过,Hermes Agent 同时上线了一个很有意思的功能——MoA(Mixture of Agents,多模型混合):…
GPT-5.6 宣而不发,Fable 5 归来再禁:出口管制下的模型封锁
OpenAI 发布了迄今最强的模型——GPT-5.6,一口气推出三个型号:Sol、Terra、Luna,灵感来自太阳、地球、月亮。OpenAI 的命名规则也由此确立:数字管代际,名字管档位。
Sol 是旗舰,最贵也…
hlwy-ai-checker:用统计指纹检测第三方 AI API 是否掺水
第三方 AI API 市场水很深——号称提供 GPT-4、Claude 的渠道,实际背后可能用的是更便宜的模型。开源项目 hlwy-ai-checker 提供了一种检测思路:通过分析大模型在生成"随机数"时的统计指纹…