#上下文

WorkBuddy 使用技巧 10 则:看住上下文、用对模式、别让技能吃掉窗口
很多 Buddy 们在使用 WorkBuddy 时,都可能遇到过:对话一长就开始出错;只想聊思路,但直接生成了文件;技能装了不少,真正要用时反而不知道怎么选... 7 月 30 日晚的直播中, WorkBuddy 产品经理 Anne 集中回…
dsh-context:DeepSeek Harness 开源插件,让 AI Agent 上下文完全可视化
如果你经常使用 AI Agent 处理长任务——比如让 Codex 重构中型项目,或者用 DeepSeek Harness 做持续数天的研究——你应该遇到过这种情况:前 20 轮对话流畅无比,…
Pi Agent 接入 Grok 实战:利用上下文压缩避开 200K 翻倍计价
将 Grok 作为主力编码模型有几项突出优势:周限额机制而非 5 小时短周期、原生上下文最大 500K、推理速度快、Token 效率高。但实际使用中发现一个关键问题:Grok 的计费在上下文超过 200K 后,价格会全量翻倍—&…
构建 Agent Harness 的 7 个关键设计决策:从单智能体到权限控制
前沿大模型之间的能力差距正在缩小,智能体系统真正的差异化因素,正逐渐转向模型之外的基础设施——Agent Harness(智能体运行框架)。 它围绕大语言模型(LLM),负责组织智能体循环、工具调用、记忆、上下文管理…
Cline.bot 免费 API 接入指南:1M 超长上下文,三款模型任选
分享一个可以白嫖的免费 AI 模型 API 渠道,支持 1M 超长上下文,不用搭反向代理,注册就能用。 Cline 是什么 Cline 本来是 VS Code 上的 AI 编程助手插件,后来官方开了自己的 API 平台 Cline.bot,…
Doubao-Seed-Evolving:支持 1M 上下文、按周迭代的持续进化大模型
字节跳动豆包团队发布了新模型 Doubao-Seed-Evolving——支持 1M 上下文,并按周级别持续迭代更新。当多数模型还在数月更新一次时,Doubao-Seed-Evolving 已经实现了"每周进化"的开…
Headroom:AI Agent 上下文压缩工具,token 节省 60-95% 的开源方案
跑 Claude Code 改个稍大的项目,一个长任务下来几万 token 就没了。Codex 调试一段日志,光日志本身就把上下文吃掉一大半。更难受的是,这些 token 大部分都是垃圾信息——一百行 grep 结果…
GLM 5.2 开源详览:1M 上下文、744B MoE 架构与 Coding 实测
智谱 AI 近日正式开源 GLM-5.2,同步发布技术博客。该模型基于 744B MoE 架构(40B 激活),支持 1M 上下文,采用 MIT 协议开源。API 已全量上线,价格与 5.1 保持一致。 在 Coding 领域,GLM-5.…
GLM-5.2 开源:1M 上下文、744B MoE 与工程化突破
智谱 AI 近日正式开源 GLM-5.2,同步发布技术博客。该模型基于 744B MoE 架构(40B 激活),支持 1M 上下文,采用 MIT 协议开源。API 已全量上线,价格与 5.1 保持一致。 这不仅仅是一个“又多了一…
GLM-5.2 发布:1M 上下文 + 全量开放,国产 Coding 模型新标杆
6 月 13 日,智谱正式向 GLM Coding Plan 全量用户开放了「GLM-5.2」 无需内测、无需排队,Lite / Pro / Max / 团队版全部可用 这是智谱迄今「能力最强」的开源模型,支持「真正可用」的 1M 上下文,…