#模型

智谱 GLM-5.1 高速版上线,全球最快旗舰API,7倍提速开始喷代码
智谱 AI 正式推出 GLM-5.1 高速版,定位旗舰模型,主打全球最快 API 响应速度。官方数据显示,GLM-5.1 高速版相比标准版实现了约 7 倍提速,首 token 时间(TTFT)低于 1 秒,同时保持旗舰级模型能力。 性能实测…
OpenCode Go套餐:国产开源编程模型5美元包月,无需抢购
国产 Coding Plan 现在不用抢了。OpenCode 推出了 Go 套餐,最低 5 美元首月,直接包圆所有国产开源模型。 OpenCode Go 套餐包含的模型 最低档 Go 套餐已包含一系列最新国产开源模型: GLM-5.1、…
Ollama与LM Studio本地运行AI大模型完全指南
本文介绍如何在本地运行AI大模型,使用目前主流的两个工具:Ollama和LM Studio。一个适合开发者,一个适合所有人。 为什么要本地运行大模型? 本地运行大模型的核心优势: 零费用:没有API调用计费,运行多少次都不花钱 隐私安全:…
MiniCPM-V 4.6:1B参数端侧多模态模型发布
面壁智能发布MiniCPM-V 4.6,这是MiniCPM-V系列端侧多模态家族中体量最小的新成员,整体参数规模仅约1.3B,但在性能和推理效率上表现突出。 1B参数意味着什么? 模型参数量大致决定了硬件要求。1B量级意味着手机、普通笔记…
DeepSeek-V4 蒸馏版本地部署实测:5.6GB 就能跑,推理风格高度还原
DeepSeek-V4 发布两周后,社区终于推出了可本地部署的蒸馏版本。发布仅三天,下载量就突破数万。第一时间实测了部署和使用效果,下面分享完整流程。 什么是 DeepSeek-V4 蒸馏版? 社区模型 Jackrong/Qwen3.5-9…
Google AI Edge Gallery:把大模型装进口袋,支持 iOS 和 Android 系统的端侧 AI 神器
最近这一年,关于端侧 AI 这个话题的讨论越发激烈,手机芯片的 NPU 算力也一路狂飙。上个月谷歌开源的 Gemma 4 模型,因为能直接塞进手机里跑,进一步把讨论推向高潮。 谷歌开源的 Google AI Edge Gallery 是一个…
LayerGen AI:一款AI驱动的3D模型生成器,专为桌面游戏和3D打印设计
LayerGen AI 是一款面向桌面游戏和 3D打印的 AI 3D模型生成器。 它通过文本或图像生成可直接打印的 3D 模型,例如自定义英雄、怪物、地形和道具。 用户可以在几秒钟内获得可用于各种场景的定制模型。 LayerGen AI功…
Mano-P 4B:本地开源 GUI 模型,把任何 App 当 Skill 用
本地4B开源模型,把任何 App 当 Skill 用 之前分享过 CUA(Computer Use Agent)开源项目,能让 AI Agent 直接操控电脑界面,相当于把任何 App 都变成 Agent 的 Skill。但评论区有两个高频…
New API:开源 AI 网关,一个接口统一管理所有大模型
问题:多模型切换太折腾?一个网关搞定所有 AI 用多个大模型时,最常见的痛点是:每家都要单独存 API 密钥、换接口地址,一会切 GPT 一会切 Claude,代码里要改半天,用量花了多少也没法统一统计。 New API 是一款开源的新一代…
DeepSeek-V4 发布:开源模型首支持百万Token 上下文,Codeforces 评级 3206
大语言模型的推理能力正在经历一场深刻变革——测试时计算扩展(Test-Time Scaling)范式已成为新的性能增长引擎。然而,标准注意力机制的复杂度随上下文长度呈平方级增长,这是制约超长上下文处理的根本瓶颈。 现…