#上下文
构建 Agent Harness 的 7 个关键设计决策:从单智能体到权限控制
前沿大模型之间的能力差距正在缩小,智能体系统真正的差异化因素,正逐渐转向模型之外的基础设施——Agent Harness(智能体运行框架)。
它围绕大语言模型(LLM),负责组织智能体循环、工具调用、记忆、上下文管理…
Cline.bot 免费 API 接入指南:1M 超长上下文,三款模型任选
分享一个可以白嫖的免费 AI 模型 API 渠道,支持 1M 超长上下文,不用搭反向代理,注册就能用。
Cline 是什么
Cline 本来是 VS Code 上的 AI 编程助手插件,后来官方开了自己的 API 平台 Cline.bot,…
Doubao-Seed-Evolving:支持 1M 上下文、按周迭代的持续进化大模型
字节跳动豆包团队发布了新模型 Doubao-Seed-Evolving——支持 1M 上下文,并按周级别持续迭代更新。当多数模型还在数月更新一次时,Doubao-Seed-Evolving 已经实现了"每周进化"的开…
Headroom:AI Agent 上下文压缩工具,token 节省 60-95% 的开源方案
跑 Claude Code 改个稍大的项目,一个长任务下来几万 token 就没了。Codex 调试一段日志,光日志本身就把上下文吃掉一大半。更难受的是,这些 token 大部分都是垃圾信息——一百行 grep 结果…
GLM 5.2 开源详览:1M 上下文、744B MoE 架构与 Coding 实测
智谱 AI 近日正式开源 GLM-5.2,同步发布技术博客。该模型基于 744B MoE 架构(40B 激活),支持 1M 上下文,采用 MIT 协议开源。API 已全量上线,价格与 5.1 保持一致。
在 Coding 领域,GLM-5.…
GLM-5.2 开源:1M 上下文、744B MoE 与工程化突破
智谱 AI 近日正式开源 GLM-5.2,同步发布技术博客。该模型基于 744B MoE 架构(40B 激活),支持 1M 上下文,采用 MIT 协议开源。API 已全量上线,价格与 5.1 保持一致。
这不仅仅是一个“又多了一…
GLM-5.2 发布:1M 上下文 + 全量开放,国产 Coding 模型新标杆
6 月 13 日,智谱正式向 GLM Coding Plan 全量用户开放了「GLM-5.2」
无需内测、无需排队,Lite / Pro / Max / 团队版全部可用
这是智谱迄今「能力最强」的开源模型,支持「真正可用」的 1M 上下文,…
删掉95%的Agent Skills,成功率反而从77%飙到97%
WorkOS 的 DX 工程师 Nick Nisi 在 AI Engineer 大会上分享了一个反直觉的发现:将 10000 行 Agent Skills 删到 553 行后,Eval 时间从 68 分钟降到 6 分钟,成功率从 77% 飙…
WorkBuddy记忆功能:让 AI 真正记住你的偏好和上下文
WorkBuddy记忆功能:让 AI 真正记住你的偏好和上下文
每次和 AI 对话都要重新介绍自己?反复解释背景和上下文?WorkBuddy 的记忆功能解决了这个问题——它让 AI 从"每次重新介绍自己"进化成"记得…
Codex 项目级上下文治理:用 AGENTS.md 规范 AI 编程项目规则
Codex 项目级上下文治理:用 AGENTS.md 规范 AI 编程项目规则
在使用 AI 编码工具时,你是否遇到过这些问题:
改了不该改的代码——让它加个按钮,它顺手把 API 封装层"重构"了
执行了错误的命…