#模型
谷歌发布 Gemini 2.5 Flash:跑分硬刚 Opus 5,价格仅七分之一的高性价比 AI 模型
刚刚,谷歌发布了旗下最强 Flash 模型——Gemini 2.5 Flash。跑分数据直接硬刚 Claude Opus 5,但价格仅为其七分之一。
Gemini 2.5 Flash 的亮点在于性价比极高:性能接近…
开源旅行海报工具 Yingzao · 营造:20 张废片对比实测,多模型协作把照片变杂志级海报
前几天回了趟山西老家,去大同转了一圈。善化寺、关帝庙、城墙、应县木塔,一路拍了不少古建。建筑本身很好看,但拍的照片总差点意思——直接发出来,配不上这些建筑。于是就想:能不能做个工具,把这些照片变成真正好看的海报?像杂…
智谱 GLM-5.3 开放权重:Hacker News 热帖与本地部署指南
智谱海外品牌 Z.ai 在 Hacker News 上开放了 GLM-5.3 的模型权重(open-weight),引发了海外开发者关注。
Open-weight 不同于 open-source:用户可以拿到训练好的模型文件进行本地推理、微…
MiniMax H3 视频模型开源部署指南:含越狱编码器与提示词模板
MiniMax H3 视频生成模型正式开源,这是一个全模态视频生成系统,支持文字、图片、视频、音频多模态输入,输出最高 2K 分辨率、最长 15 秒、24FPS 的视频,音频是原生 32kHz 立体声。玩法包括文生视频、图生视频、视频生视频…
腾讯Hy4 preview实测:对比GLM-5.3,谁的Agent编程能力更强?
腾讯发布了最新的 Hy4 preview 模型,总参数 770B,激活参数 49B,参数规模已与头部旗舰模型相提并论。为了测试实际能力,用同样的回合制游戏 DEMO 需求,对比了 Hy4 preview 和前几天发布的 GLM-5.3。
…
微信AI硬核技术开源:WeMM-Embedding 多模态搜索实测
最近几个月微信陆续灰度了很多 AI 功能,现在的微信已经不只是聊天工具,而是搜索 + AI + 聊天三位一体,初步具备了 Agent 的影子。微信 AI 的核心能力之一是对文本、图像、视频做了 RAG 处理,官方也开源了 WeMM-Embe…
不用视频模型也能加字幕:Doubao-Seed-Evolving + ffmpeg 实测教程
分享一个多模态模型的"邪修玩法":不用视频模型,也可以给视频加上炫酷字幕。
字幕效果完全不需要 MiniMax H3 或者 Seedance 系列模型,只需要一个多模态模型(如 doubao-seed-evolving)和 Agent 工具…
GitHub热门3D人体器官网站:AI生成交互式人体器官模型
心脏长什么样、心室和心房分布在哪里,你可以把知识点背下来,但比较难在脑子里建立一个完整的空间结构。
最近逛 GitHub,我看到一个做得贼精致的 3D 人体解剖项目:Anatomy Atelier。
打开网页后,你会看到一颗会缓慢转动的 3…
智谱发布牛来模型:对标DeepSeek的国产大模型新突破
前几天 OpenRouter 上出现了一个匿名模型 Ox Alpha,免费开放,五天流量累积超过 50T,刷新了平台历史纪录的四倍。全网都在猜它是谁。Gemini 团队的人跑来认领,说是自家的。结果谜底揭晓:智谱,GLM-5.3 Flash…
Ox Alpha正式开源:V4Flash价格、Opus4.8能力,国产大模型新突破
前几天,一个叫 Ox Alpha 的匿名模型上线了 OpenRouter。
这些天消耗了 23.2T tokens,是历史第二名的 2.6 倍。
OpenCode 那边,直接终结了 DeepSeek 连续 56 天的霸榜纪录。
有人拿这个…