#部署

智谱 GLM-5.3 开放权重:Hacker News 热帖与本地部署指南
智谱海外品牌 Z.ai 在 Hacker News 上开放了 GLM-5.3 的模型权重(open-weight),引发了海外开发者关注。 Open-weight 不同于 open-source:用户可以拿到训练好的模型文件进行本地推理、微…
MiniMax H3 视频模型开源部署指南:含越狱编码器与提示词模板
MiniMax H3 视频生成模型正式开源,这是一个全模态视频生成系统,支持文字、图片、视频、音频多模态输入,输出最高 2K 分辨率、最长 15 秒、24FPS 的视频,音频是原生 32kHz 立体声。玩法包括文生视频、图生视频、视频生视频…
Claude Code 和 Codex 作为 DeepSeek Harness 子 Agent 实战:几分钟上手部署教程
DeepSeek Harness 终于开源啦,昨天早上的 DeepSeek V4 pro 发布说实话,确实让很多人失望,价格...能力 但没关系,DeepSeek 的 flash 依旧抗打,最重要的还是DeepSeek Harness开源了…
AirLLM:4GB 显存跑 70B 大模型的逐层加载推理方案
之前通过 Ollama、SGLang 在本地部署过大模型的朋友都知道,受限于显卡显存,基本上只能部署小参数且量化后的模型。 这些模型在本地跑基本是残血状态,拿来玩玩还可以,但效果往往差强人意。 最近在 GitHub 上发现一个 3 万 St…
NAS 本地部署 llama.cpp 教程:Vulkan 核显加速,流畅运行 Qwen3.5 模型
llama.cpp 是一款纯 C/C++ 开发的开源大模型离线推理引擎,所有 AI 计算都在本地完成。支持 Linux、Windows、macOS 及多种 GPU 后端(CUDA、HIP、SYCL、Vulkan、WebGPU),提供 1.5…
MiniMax H3 本地部署教程:RTX 3060 即可运行,0 成本制作 AI 漫剧
MiniMax H3 现已上线。作为 33B 参数的开源全模态视频模型,支持最高 2K、24fps、15 秒视频输出,还可原生同步生成立体声音频,依托 Apache2.0 开源协议,RTX4090 这类消费级显卡就能本地部署,调用成本仅为同…
Modal 每月免费 30 美元:轻松部署 Kimi K3 等开源模型
Kimi K3 的完整模型权重正式开源后,多家云服务商开始陆续提供支持。今天介绍一个可以免费使用 K3 等开源模型的平台——Modal。其 Starter 套餐每月免费提供 30 美元的计算额度,支持多种国产开源模型…
Openship:6.7k Star 的开源自托管部署平台,桌面 CLI 双模式替代 Heroku
开源自托管部署平台 Openship(GitHub 6.7k Stars,Apache 2.0 协议)把从代码提交到应用上线的所有脏活累活打包成一个工具——装 Nginx、配 SSL、搞数据库、写 Dockerfil…
Light OCR:跑在本地的轻量 OCR 引擎,Node.js + C++ 原生支持
Light OCR 是一个运行在本地的 OCR 工具,面向 Node.js 和 C++ 开发者。不需要联网,安装后即可直接识别图片中的文字,返回识别内容、置信度和位置坐标。 核心特性 本地处理:图片和 OCR 结果始终留在本机,数据不外…
SmartTable:开源私有化多维表格,本地离线+团队协作双模式
做项目管理、客户台账、任务追踪时,不少人嫌弃飞书/Airtable云端数据不安全,私有化商业工具又价格高昂;Excel做不了关联数据,自建数据库门槛太高。今天分享一款全栈开源多维表格SmartTable,对标飞书多维表格,支持本地离线、私有…