#模型

国内大厂CodingPlan/TokenPlan 套餐对比:阿里腾讯字节百度智谱 MiniMax 最新价格
摘要:本文详细介绍国内六大厂(阿里、腾讯、字节、百度、智谱、MiniMax)的 CodingPlan/TokenPlan 套餐费用、限制及可用模型。4 月底最新数据,帮助开发者选择合适的 AI 编程套餐。 国内各大厂的按次 CodingPl…
GPT-5.5正式发布:全面超越 Claude Opus 4.7,重新夺回 SOTA 宝座
摘要:OpenAI 正式发布 GPT-5.5,官方定义为"面向真实工作的全新智能类别"。在编程、知识工作、科学推理等多个维度全面超越 Claude Opus 4.7,重新夺回 SOTA 宝座。 本文整合多方信源,详解 GPT-5.5 的核心…
Qwen3.6-27B 实测报告:本地模型跑出 GPT-4 水准,27B Dense 架构超越 397B MoE
阿里发布了 Qwen3.6-27B,27B 参数的 Dense 架构模型(不是 MoE),原生支持 262K 上下文,Apache-2.0 开源。 苏米注:Dense 架构相比 MoE 部署更简单,不需要考虑路由问题,推理更稳定。这是本…
llmfit 开源工具:一键检测你的电脑能跑哪些本地大模型
今年以来,OpenClaw、Hermes 这些 Agent 工具接连爆火,但 Token 消耗快得吓人,只是对话几次、简单设置个任务,一天就烧掉几十块。于是越来越多人把目光转向了本地模型部署,既省钱又能离线使用。 苏米注:但真动手的时候,…
Gemma 4 + TurboQuant:Google开源模型新方案,本地部署 LLM 内存降低 83%
在过去三年里,很多人认为模型越大越"聪明"。他们觉得参数越多性能越好,GPU 越多就越强。这个普遍认知本周被 Google 的开源模型 "Gemma 4" 彻底颠覆。 Gemma 是 Google 发布的一系列 open-weight 模型…
Kimi K2.6 正式发布:开源代码能力新标杆,智能体集群扩展至 300 个
前言 月之暗面正式上线并开源了新模型 Kimi K2.6。从官方公布的 benchmark 来看,代码能力追平或者超越 GPT 5.4 和 Opus 4.6,非常能打。当然与 A 厂刚发布的 Mythos 和 Opus 4.7 还有差距。 …
手把手教你 在Hermes 接入 NVIDIA 免费使用 MiniMax-m2.7 模型教程
之前分享过 NVIDIA 注册和接入 OpenClaw 的教程,这次详细讲解如何在 Hermes Agent 中配置 NVIDIA NIM,并实测可以使用 MiniMax-m2.7 模型。本文对 NVIDIA 注册流程不再赘述,如需了解可查…
Mac Mini M4 部署 Qwen3.5 最佳方案:MLX、Ollama、DFlash 全面对比评测
苏米注:手持一台 Mac Mini M4 16GB,想跑本地大模型但不知道选哪个方案?这篇文章帮你选。我来详细对比 MLX、Ollama 和 DFlash 三种部署方案的优劣。 一、Mac Mini M4 16GB 能跑什么模型 先算一笔账…
Google TimesFM 开源详解:1000 亿时间点预训练,零样本时间序列预测模型
苏米注:Google Research 团队开源的 TimesFM 在 GitHub 上已经斩获 17.9K Star,在全球趋势榜冲到前三。在时间序列预测这个小众但极其实用的领域,能引起这么大轰动的项目真不多见。今天我来详细拆解这个"黑科…
Claude Opus 4.7 发布:长任务处理能力与自我验证升级,企业测试数据详解
苏米注:Anthropic 刚刚发布迄今为止最强大的 Opus 模型 4.7 版本。相比前代 4.6 版本,它在处理长任务时更加严谨,能更精确地遵循指令,并在反馈前验证自己的输出。这意味着用户可以更放心地将复杂工作交给它处理,减少监督需求。…