#模型对比

腾讯Hy4 preview实测:对比GLM-5.3,谁的Agent编程能力更强?
腾讯发布了最新的 Hy4 preview 模型,总参数 770B,激活参数 49B,参数规模已与头部旗舰模型相提并论。为了测试实际能力,用同样的回合制游戏 DEMO 需求,对比了 Hy4 preview 和前几天发布的 GLM-5.3。 …
MiniMax H3 vs Seedance 横测:7 大视频生成场景对比评测
这个月视频模型集中爆发:MiniMax H3 开源、字节 Seedance 2.0 升级到 2.5、阿里 Wan3.0 发布。本文主要对比 H3 和 Seedance 2.0 fast,从成本和 7 种经典场景的表现进行评测。 评论区中…
Kimi K3 对比 DeepSeek V4 Flash:2.8 万亿参数与 50 倍价差的路线之争
2026年7月,中国大模型赛道接连投下两枚重磅炸弹。7月17日,月之暗面在 WAIC 上海发布 Kimi K3——全球首个 3 万亿级别的开源模型,以 2.8 万亿参数将开源阵营推入新纪元。仅仅两周后,7月31日,D…
WorkBuddy 内置 9 款模型比价:B2B 营销人省积分选型指南
WorkBuddy 内置了 9 款 AI 模型,倍率差高达 95 倍。同一个任务使用不同模型,消耗的积分可以相差几十倍。选对模型,是节省积分的关键。 场景速查表 营销场景 首选模型 倍率 升档建议 舆情速览/邮件/翻译 Hy3…
5 款主流 AI 模型 Agent 任务实测:MiniMax、DeepSeek、Step、GLM、Gemini 对比
市面上能调用的模型越来越多,各家都有自己的亮点,光看宣传文档和跑分数据很难判断哪个真正适合自己——尤其是当任务从单轮对话延伸到多步操作的时候。这次测试把五个主流模型拉出来实际跑一遍,看看它们在真实 Agent 任务中…
Doubao-Seed-2.1 vs DeepSeek-V4 vs GPT-5.5 实测对比:谁最适合 Agent 开发任务?
字节 Doubao-Seed-2.1 刚刚发布,DeepSeek-V4 也推出了推理加速版 DSpark。与前沿模型 GPT-5.5 相比,这三款模型在实际 Agent 任务中的表现如何? 这次实测用一个典型的中小型 Agent 任务&md…
Claude Fable 5 vs GPT-5.5 实测对比,2026 年编程 AI 选型指南
三天前,Anthropic 放出了 Claude Fable 5 Reddit 上立刻冒出一条热帖,标题很直接:"Fable 5 把 GPT-5.5 甩在身后" 帖子下面 157 条评论里,有个开发者说了句大实话:"我现在替 GPT 说话都…
DeepSeek V4 发布:两款模型怎么选,以及怎么接入 API?
2026 年 4 月 24 日,DeepSeek 发布了 V4 系列模型,引发广泛关注。这次主要发布了两款模型:DeepSeek V4 Pro 和 DeepSeek V4 Flash,均支持 100 万上下文、开放权重,并提供 API 服务…
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
2026 年 4 月,国产大模型井喷。Kimi K2.6 刚上线,GLM-5.1、Qwen3、MiniMax M2 紧随其后。四大模型正面竞争,参数、性能、价格全面对比。 四大模型速览 模型 厂商 架构 总参数 激活参数 上下文 …