#本地部署

AirLLM:4GB 显存跑 70B 大模型的逐层加载推理方案
之前通过 Ollama、SGLang 在本地部署过大模型的朋友都知道,受限于显卡显存,基本上只能部署小参数且量化后的模型。 这些模型在本地跑基本是残血状态,拿来玩玩还可以,但效果往往差强人意。 最近在 GitHub 上发现一个 3 万 St…
MiniMax H3 本地部署教程:RTX 3060 即可运行,0 成本制作 AI 漫剧
MiniMax H3 现已上线。作为 33B 参数的开源全模态视频模型,支持最高 2K、24fps、15 秒视频输出,还可原生同步生成立体声音频,依托 Apache2.0 开源协议,RTX4090 这类消费级显卡就能本地部署,调用成本仅为同…
Light OCR:跑在本地的轻量 OCR 引擎,Node.js + C++ 原生支持
Light OCR 是一个运行在本地的 OCR 工具,面向 Node.js 和 C++ 开发者。不需要联网,安装后即可直接识别图片中的文字,返回识别内容、置信度和位置坐标。 核心特性 本地处理:图片和 OCR 结果始终留在本机,数据不外…
本地离线语音方案:SenseVoiceSmall + MeloTTS 组合实战指南
本地离线语音方案一直是开发者的痛点。云端语音服务虽然方便,但在电梯、地下车库、飞机上等无网场景完全失效。本文对比并推荐了"SenseVoiceSmall(语音识别)+ MeloTTS(语音合成)"组合,两个模型加起来不到 500MB,在普通…
Holo 3.1 本地部署指南:免费搭建 AI Agent,数据不出本地
OpenAI 的 Operator、Claude 的 Computer Use 确实惊艳——AI 像真人一样操作电脑,点击、输入、刷网页、整理文件。但按 Token 计费的模式让很多普通用户望而却步,企业级应用更是成…
Oh My PPT:本地AI自动生成PPT,30+风格一键出稿
每次要做分享、汇报、路演或答辩,最头疼的从来不是内容——是排版。市面上的 AI PPT 工具不少,但大多生成固定格式的文件,想微调样式得从头来过,而且你的商业计划书、数据报表,全部得先传到云端。 最近发现了一个开源项…
Holo3.1开源Computer Use模型发布:35B版性能超越Qwen3.5、Claude Sonnet 4.6
6 月 2 日,法国 AI 公司 H Company 推出 Holo3.1 系列开源计算机控制大模型。这是继两个月前 Holo3 发布后,该团队针对生产环境反馈优化的版本,核心解决此前计算机控制 AI 代理(Computer-use Age…
Qwen3.6-35B-A3B-Uncensored:35B参数仅3B激活的完全解锁开源MoE模型
Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 是一个基于 Qwen3.6 MoE 架构的去审查开源模型,由 HauhauCS 制作。该模型在 465 个测试案例中实现了 0 次拒绝,在 Hug…
从零构建本地AI Agent:可记忆、可扩展、可追踪
本文介绍如何从零构建一个本地AI Agent,实现真正的数据主权——记忆是本地Markdown文件,技能是文件夹中拖入即用的说明书。 为什么需要本地AI Agent? 云端AI助手像"黑盒",你不知道它记住了多少数据…
DeepSeek-V4 蒸馏版本地部署实测:5.6GB 就能跑,推理风格高度还原
DeepSeek-V4 发布两周后,社区终于推出了可本地部署的蒸馏版本。发布仅三天,下载量就突破数万。第一时间实测了部署和使用效果,下面分享完整流程。 什么是 DeepSeek-V4 蒸馏版? 社区模型 Jackrong/Qwen3.5-9…