#模型
MiniMax-M2.7 量化版本地部署指南:Unsloth 22 个版本选择 +3 种部署方式详解
苏米注:MiniMax-M2.7 量化版发布后,Unsloth 团队第一时间推出了 22 个 GGUF 量化版本,从 1-bit 到 8-bit 全覆盖。最值得关注的是 4-bit 动态量化版只需要 108GB,一台 128GB 内存的 M…
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
2026 年 4 月,国产大模型井喷。Kimi K2.6 刚上线,GLM-5.1、Qwen3、MiniMax M2 紧随其后。四大模型正面竞争,参数、性能、价格全面对比。
四大模型速览
模型
厂商
架构
总参数
激活参数
上下文
…
1-bit Bonsai 8B 大模型详解:8B 参数压缩至 1.15GB,手机也能跑 AI
你手机里装了多少个 App?如果我问你,能不能在手机上跑一个 80 亿参数的大语言模型,你大概率会摇头——毕竟一个常规的 8B 模型至少需要 16GB 显存,手机那点内存根本装不下。
但就在上周,一家来自 Calte…
Hermes 接入 Kimi K2.6 实测:SOTA 代码能力深度评测,不限流但推理速度慢
昨天 Kimi Code 悄悄推了一条通知:K2.6-code-preview 已上线,向所有订阅用户开放。今天我把 Hermes 里 23 个 Agent 全切了过去,跑了整整一天。
结论先说:K2.6 目前是我用过的国产编程模型里最强的…
WorkBuddy 进阶:别再用默认模型了!切换 GLM-5.1 后我的工作效率翻了 3 倍
摘要:昨天下午 4 点,领导突然甩来一句:"把这半年所有 Excel 报表合并汇总,下班前给我。"127 个 Excel,格式五花八门。我打开 WorkBuddy,切到 GLM-5.1,3 分 47 秒全部搞定。这不是我效率高,是选对了模型…
WorkBuddy 内置的各个模型详解 | 侧重点 + 积分消耗 + 应用举例一次看懂!
WorkBuddy 内置模型详解
很多小伙伴用 WorkBuddy 时可能只默认使用一个模型,结果反映积分不够用。实际上,不同模型擅长的场景完全不同,如果选对了模型,既省积分又高效。
苏米注:这个观点很实用——很多人…
Anthropic Advisor Tool 详解:Sonnet 智能接近 Opus,成本降低 11.9%
Anthropic 最近发布了一个新的 API 工具,让 Sonnet 或 Haiku 在跑任务的过程中,遇到搞不定的决策时自动请教 Opus,拿到指导后继续干活。这个策略叫 Advisor Strategy,工具叫 Advisor Too…
MiniMax M2.7 接入 WorkBuddy 完整教程:5 分钟配置,204K 上下文实测
MiniMax 最近推出了 M2.7 模型,号称支持"AI 自我迭代",在代码和推理任务上表现优秀。本文将详细介绍如何将 MiniMax M2.7 接入 WorkBuddy,全程只需 5 分钟配置。
MiniMax M2 系列模型介绍
Mi…
Meta 发布全新大模型 Muse Spark:多模态是强项,编程是短板
今天凌晨,Meta 发布了全新的大模型 Muse Spark,已上线到 Meta 旗下的各类产品。
Meta Superintelligence Labs(MSL)负责人 Alexandr Wang 在推特上宣布了这个消息。他说,九个月前团…
28 个 OpenRouter 免费 AI 模型 API 汇总:无需信用卡即可使用
OpenRouter 目前提供了 28 个免费大语言模型 API 供开发者测试和使用,最关键的是完全不需要绑定信用卡就能直接调用。
苏米注:市面上很多价格便宜得离谱的 API 中转站,大概率就是拿这批免费模型套壳。与其花钱买"二手 API"…