#开源模型
智谱 GLM-5.3 开放权重:Hacker News 热帖与本地部署指南
智谱海外品牌 Z.ai 在 Hacker News 上开放了 GLM-5.3 的模型权重(open-weight),引发了海外开发者关注。
Open-weight 不同于 open-source:用户可以拿到训练好的模型文件进行本地推理、微…
MiniMax H3 视频模型开源部署指南:含越狱编码器与提示词模板
MiniMax H3 视频生成模型正式开源,这是一个全模态视频生成系统,支持文字、图片、视频、音频多模态输入,输出最高 2K 分辨率、最长 15 秒、24FPS 的视频,音频是原生 32kHz 立体声。玩法包括文生视频、图生视频、视频生视频…
微信AI硬核技术开源:WeMM-Embedding 多模态搜索实测
最近几个月微信陆续灰度了很多 AI 功能,现在的微信已经不只是聊天工具,而是搜索 + AI + 聊天三位一体,初步具备了 Agent 的影子。微信 AI 的核心能力之一是对文本、图像、视频做了 RAG 处理,官方也开源了 WeMM-Embe…
Modal 每月免费 30 美元:轻松部署 Kimi K3 等开源模型
Kimi K3 的完整模型权重正式开源后,多家云服务商开始陆续提供支持。今天介绍一个可以免费使用 K3 等开源模型的平台——Modal。其 Starter 套餐每月免费提供 30 美元的计算额度,支持多种国产开源模型…
Qwen3.8-Max 上线:2.4 万亿参数,自主编程 16 天,API 首发千问 AI 平台
阿里巴巴新一代基座大模型 Qwen3.8 正式发布,千问 AI 平台同步首发上线 Qwen3.8-Max 的 API 服务与 Token Plan,面向开发者与用户全面开放新模型调用。
核心能力
Qwen3.8 总参数量达 2.4 万亿,…
Kimi K3 对比 DeepSeek V4 Flash:2.8 万亿参数与 50 倍价差的路线之争
2026年7月,中国大模型赛道接连投下两枚重磅炸弹。7月17日,月之暗面在 WAIC 上海发布 Kimi K3——全球首个 3 万亿级别的开源模型,以 2.8 万亿参数将开源阵营推入新纪元。仅仅两周后,7月31日,D…
MiniMax H3 开源:全模态视频生成模型,支持 2K/15 秒/立体声
MiniMax 正式开源了新一代通用视频模型 H3。这是一个全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3 …
DeepSeek V4-Flash 正式版:284B 参数九项 Agent 测试全胜,对标 Claude Opus 4.8
DeepSeek-V4-Flash 正式版已发布
该模型以 284B 总参数(每 token 激活 13B)的体量,在九项 Agent 基准测试中全部超过此前最强的 DeepSeek-V4-Pro 预览版(1.6T 总参数,激活 49B)
…
2026 年 RAG Embedding Model 选型指南:六类场景与三条过时经验
2026 年,RAG 系统的 Embedding 模型选择不再是一刀切的答案。不同场景、不同预算、不同数据形态,需要不同的模型。本文梳理了六类典型场景的最优选择,以及三条 2025 年曾被视为常识、如今已过时的经验。
场景一:通用型商业 …
MiniMax H3视频模型上线:开源路线、多模态输入、0.23元/秒对标Seedance
MiniMax 近日正式上线 H3 视频生成模型,带来了一项关键升级:支持"全能参考"模式。与此前的首尾帧生成方式不同,H3 允许用户直接输入人物形象、场景素材、音频片段等多模态内容,模型自动理解并生成连贯视频。这种工作流的改变,大幅降低了…