#模型

MiniCPM-V 4.6:1B参数端侧多模态模型发布
面壁智能发布MiniCPM-V 4.6,这是MiniCPM-V系列端侧多模态家族中体量最小的新成员,整体参数规模仅约1.3B,但在性能和推理效率上表现突出。 1B参数意味着什么? 模型参数量大致决定了硬件要求。1B量级意味着手机、普通笔记…
DeepSeek-V4 蒸馏版本地部署实测:5.6GB 就能跑,推理风格高度还原
DeepSeek-V4 发布两周后,社区终于推出了可本地部署的蒸馏版本。发布仅三天,下载量就突破数万。第一时间实测了部署和使用效果,下面分享完整流程。 什么是 DeepSeek-V4 蒸馏版? 社区模型 Jackrong/Qwen3.5-9…
Google AI Edge Gallery:把大模型装进口袋,支持 iOS 和 Android 系统的端侧 AI 神器
最近这一年,关于端侧 AI 这个话题的讨论越发激烈,手机芯片的 NPU 算力也一路狂飙。上个月谷歌开源的 Gemma 4 模型,因为能直接塞进手机里跑,进一步把讨论推向高潮。 谷歌开源的 Google AI Edge Gallery 是一个…
LayerGen AI:一款AI驱动的3D模型生成器,专为桌面游戏和3D打印设计
LayerGen AI 是一款面向桌面游戏和 3D打印的 AI 3D模型生成器。 它通过文本或图像生成可直接打印的 3D 模型,例如自定义英雄、怪物、地形和道具。 用户可以在几秒钟内获得可用于各种场景的定制模型。 LayerGen AI功…
Mano-P 4B:本地开源 GUI 模型,把任何 App 当 Skill 用
本地4B开源模型,把任何 App 当 Skill 用 之前分享过 CUA(Computer Use Agent)开源项目,能让 AI Agent 直接操控电脑界面,相当于把任何 App 都变成 Agent 的 Skill。但评论区有两个高频…
New API:开源 AI 网关,一个接口统一管理所有大模型
问题:多模型切换太折腾?一个网关搞定所有 AI 用多个大模型时,最常见的痛点是:每家都要单独存 API 密钥、换接口地址,一会切 GPT 一会切 Claude,代码里要改半天,用量花了多少也没法统一统计。 New API 是一款开源的新一代…
DeepSeek-V4 发布:开源模型首支持百万Token 上下文,Codeforces 评级 3206
大语言模型的推理能力正在经历一场深刻变革——测试时计算扩展(Test-Time Scaling)范式已成为新的性能增长引擎。然而,标准注意力机制的复杂度随上下文长度呈平方级增长,这是制约超长上下文处理的根本瓶颈。 现…
商汤日日新开放免费Token:DeepSeek V4 Flash 等三大模型免费调用
商汤日日新(SenseNova)上线了 Token Plan 免费计划,注册即可领取免费 API Token,直接调用三个大模型。对于 AI 开发者和想零成本体验大模型的用户来说,这是一个值得关注的入口。 免费计划提供哪些模型? 目前免费计…
本地 Coding Agent 最佳拍档:LM Studio + Pi Agent + Gemma 4 26B A4B 完整部署指南
在 Token 大饥荒时代,各家 Code Plan 订阅要么抢不到,要么限流,再不就是像 Anthropic 这样动不动就封号。本文测试本地 Coding Agent 能否真正干活——结论:可以,而且比预期好很多。…
Claude Desktop 配置 DeepSeek-V4 完整教程:5 分钟开启第三方模型支持
Claude Code CLI 配置不同模型可以用 CC Switch,那 Claude Desktop 怎么配置第三方模型?本文演示如何在 Claude Desktop 里配置 DeepSeek-V4,5 分钟搞定。 前置准备 Dee…