#WeLM

微信WeLM大模型Hidden Decoding更新:潜空间计算扩展到100B+ MoE架构
微信自研大语言模型 WeLM 近日再次更新。WeLM 官方博客发布了一篇题为《Hidden Decoding at Scale:面向前沿大模型的潜空间计算扩展》的技术论文,将此前已在中小规模模型上验证的「隐式解码」机制,扩展到了 100B+…
微信大语言模型 WeLM 揭秘:专为微信生态设计的低成本 MoE 架构,128K 长上下文
随着微信 AI Agent「小微」的内测版上线,其背后的大语言模型也浮出了水面。 不是腾讯的混元,不是深度求索的 DeepSeek,不是智谱的 GLM,而是微信自研的大语言模型 WeLM(WeChat Language Model)。 01…
微信小微 AI Agent :自研 WeLM 模型、语音优先交互、个人小工具生态
微信 AI Agent「小微」已进入小范围公测阶段。作为一款深度整合微信生态的 AI 助手,它的设计思路和技术架构透露出几个值得关注的信号。 一、底层模型:自研 WeLM + DeepSeek 兜底 小微使用的核心模型是 WeLM(Wech…