#智谱

GLM-5.3-FlashX 上线:推理提速 5 倍达 200 tokens/s,Agent 构建推理 Infra
智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型提速 5 倍,价格提价 2.5 倍,API 同步开放。这背后是在 10 万张国产芯片提供的推理算力基础上,进一步加大对 In…
智谱 GLM-5.3 开放权重:Hacker News 热帖与本地部署指南
智谱海外品牌 Z.ai 在 Hacker News 上开放了 GLM-5.3 的模型权重(open-weight),引发了海外开发者关注。 Open-weight 不同于 open-source:用户可以拿到训练好的模型文件进行本地推理、微…
智谱发布牛来模型:对标DeepSeek的国产大模型新突破
前几天 OpenRouter 上出现了一个匿名模型 Ox Alpha,免费开放,五天流量累积超过 50T,刷新了平台历史纪录的四倍。全网都在猜它是谁。Gemini 团队的人跑来认领,说是自家的。结果谜底揭晓:智谱,GLM-5.3 Flash…
GLM 5.3 实测:750B 参数后训练逼平 GPT-5.6,复杂编码与安全能力全面评测
GLM5.3 API上线了,昨天又充值了GLM Coding Plan。 5.3的定位很直接,擅长复杂编码,长程Agent任务,加上防御性网络安全。 AA榜成绩也出来了,GLM-5.3拿到60分,也是进了前十。60分及以上的模型一共六个,G…
智谱ZCode 3.0升级:面向GLM-5.2深度优化,缓存命中率98%,限时额度1.5倍
智谱旗下的AI编程工具ZCode近期迎来了3.0版本升级。作为国内对GLM模型适配度更高的编程工具之一,这次升级带来了多项值得关注的新特性。 一、ZCode是什么? 如果你还没用过ZCode,可以把它理解为Codex的国内版。其UI界面与C…
CogVideoX 开源视频模型:4G 显存本地跑 AI 视频生成,文生视频/图生视频/视频续写三模式详解
4G 显存就能跑的 AI 视频生成模型,不用买会员,不用租服务器,装在自己电脑上就行。 CogVideoX 是智谱 AI 联合清华大学开发的开源视频生成模型,GitHub 星标 12.9K。输入一段文字描述,直接生成 6-10 秒视频。 …
国产大模型算力账单:DeepSeek 峰谷涨价,智谱 Kimi 限流 429 成常态
DeepSeek 已正式发布 v4 版本,并同步调整定价策略:在高峰时段(每日 9-12 点和 14-18 点),价格将翻倍。此前 V4 预览版曾将折扣价设为永久价,此次改为峰谷定价,主要受算力供应紧张和正式版性能提升预期影响。 Deep…
GLM-5.2 开源模型发布:百万 Token 上下文,Agent 编程能力登顶开放权重模型
最近 AI 圈炸了一颗重磅炸弹,智谱 AI 正式开源了旗舰模型 GLM 5.2。 我关注开源大模型有一段时间了,这次 GLM 5.2 的方向让我比较意外。它没有走「单纯卷聊天能力」的老路,而是把重点放在了 Agent(智能体)和长周期任务处…
GLM-5.2 实测评估:DeepSeek 之上的复杂执行层模型,海外社区真实反馈
GLM-5.2 在海外 AI 圈子里突然很热。很多人说它很强,甚至有人拿来和 Claude、GPT 的顶级模型比较。国内模型每次发布都容易被质疑"是不是又在刷榜",所以这次没有只看官方宣传,而是翻了一圈海外用户的真实反馈:Hacker Ne…
GLM 5.2 开源详览:1M 上下文、744B MoE 架构与 Coding 实测
智谱 AI 近日正式开源 GLM-5.2,同步发布技术博客。该模型基于 744B MoE 架构(40B 激活),支持 1M 上下文,采用 MIT 协议开源。API 已全量上线,价格与 5.1 保持一致。 在 Coding 领域,GLM-5.…