#模型

doc7:1.1K Star 的开源工具,让 AI 像人一样看懂文档而非识别
今天推荐一个文档转 Markdown 的开源工具 doc7,GitHub 上已收获 1.1K Star。它可以把 PDF、Office、扫描件、截图、图表、公式、流程图等任意文档,通过你自己的多模态模型,转换成 AI 可直接检索、引用和推理…
DeepSeek Harness 首发体验:它不想做下一个 Codex
DeepSeek Harness 开源后,第一时间进行了体验。官方提供了两种上手方式:npm 一键运行和git 拉源码自己 build。两种方式都走了一遍,记录完整过程供参考。 方式一:npm 一键运行 只要装了 Node.js,直接执行:…
DeepSeek Harness 来了:一个可以随便换模型的 Agent 工作台
DeepSeek 正式开放了 DeepSeek Harness 开发者预览版(v0.1),采用 MIT 协议开源。官方明确表示这是一个早期版本,核心插件和基础接口还会快速变化。 Harness 是干什么的? DeepSeek Harnes…
Codex 接入 DeepSeek、Kimi K3 保姆级教程:OpenCodex 多模型配置指南
Codex 额度告急?与其干等着重置,不如直接把 DeepSeek V4 Flash、Kimi K3 等国产模型接入进来,多快好省还能续命。 通过 OpenCodex 项目,可以在保留原有 GPT 账号的同时无缝切换多种模型。 OpenCo…
DeepSeek 官宣 API 整体涨价:免费 Token 时代倒计时,开发者如何应对
2026 年 8 月 6 日,DeepSeek 官方发布了一则简短公告:"计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。" 没有具体数字和生效日期,但所有人都读懂了潜台词:DeepSeek 的"价…
阿里 CosyVoice Studio 实测:一站式 AI 语音平台,能听能说能聊
8 月初,阿里接连发布多个重磅产品。 千问办公开启公测,对标 WorkBuddy;Qwen3.8-Max 正式上线,总参数量 2.4 万亿;视频生成模型 Wan3.0 开启公测,单次可生成 30 秒视频。 不过最值得关注的是阿里新上线的 C…
AirLLM:4GB 显存跑 70B 大模型的逐层加载推理方案
之前通过 Ollama、SGLang 在本地部署过大模型的朋友都知道,受限于显卡显存,基本上只能部署小参数且量化后的模型。 这些模型在本地跑基本是残血状态,拿来玩玩还可以,但效果往往差强人意。 最近在 GitHub 上发现一个 3 万 St…
SenseNova U1.5-Lite-Preview 开源:8B 轻量级统一多模态模型,支持 4K 图像生成与编辑
今年 4 月,商汤科技发布了 SenseNova U1,首次完整展示了基于 NEO-Unify 架构的原生统一多模态路线。如今商汤持续强化模型的图像生成与编辑能力,正式开源轻量级统一多模态模型的预览版本 SenseNova U1.5-Lit…
Qwen 3.8 Max 实测:与 Kimi K3 三场景对比,工程严谨度更胜一筹
两周多前实测 Kimi K3 时,结论是国产模型已经摸进了第一梯队。 本周 Qwen 3.8 Max 发布,我的第一反应是没兴趣——印象里它的编程能力不太行。 但 Qoder 正好在送 800 次免费调用,于是我用 …
Qwen3.8-Max 评测:自主编程 16 天、2.4 万亿参数,能否挑战 GPT?
先是 GLM5.2,然后是 Kimi K3,现在是 Qwen3.8-Max。从 6 月开始,国产大模型在 Coding 和 Agent 领域明显加速,与海外顶级 SOTA 的差距正在肉眼可见地缩小。 参数与定价 Qwen3.8-Max 沿…