#ima
MiniMax-H3-Turbo-Lora:8 步推理加速视频生成,质量不输原生 20 步
MiniMax-H3 是一个通用的全模态生成系统,支持文本、图像、视频和音频多种输入组合,可以生成分辨率高达 2K、持续时间长达 15 秒的具有原生立体声音频的视频。
之前介绍了 MiniMax-H3 的特点和实测效果,当时生成的视频跑了 …
MiniMax-H3 视频提示词写作教程:T2VA/I2VA/FL2VA/L2VA 四种任务全解析
你兴冲冲打开 MiniMax-H3,输入「一个女孩在雨中奔跑,画面唯美」,点了生成。
等了半分钟,视频出来了。镜头乱晃,女孩的脸走形,没有脚步声,没有雨声,背景音乐像从电梯里偷录的。
你关掉页面,心想:就这?
但问题大概率不在模型,在你的提…
MiniMax H3 本地部署教程:RTX 3060 即可运行,0 成本制作 AI 漫剧
MiniMax H3 现已上线。作为 33B 参数的开源全模态视频模型,支持最高 2K、24fps、15 秒视频输出,还可原生同步生成立体声音频,依托 Apache2.0 开源协议,RTX4090 这类消费级显卡就能本地部署,调用成本仅为同…
Qwen-Image-3.0正式上线千问AI平台:Arena.ai文生图榜单国内第一,4.5k token复杂版面一次生成
阿里巴巴千问图像生成模型 Qwen-Image-3.0 已正式在千问 AI 平台上线,面向所有用户全面开放。旗舰版 Qwen-Image-3.0-Pro 与标准版 Qwen-Image-3.0-Standard 同步开放 API 调用,文生…
MiniMax H3 开源:全模态视频生成模型,支持 2K/15 秒/立体声
MiniMax 正式开源了新一代通用视频模型 H3。这是一个全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3 …
MiniMax H3视频模型上线:开源路线、多模态输入、0.23元/秒对标Seedance
MiniMax 近日正式上线 H3 视频生成模型,带来了一项关键升级:支持"全能参考"模式。与此前的首尾帧生成方式不同,H3 允许用户直接输入人物形象、场景素材、音频片段等多模态内容,模型自动理解并生成连贯视频。这种工作流的改变,大幅降低了…
GC Minimal Zine Poster:开源 Skill 用规则定义审美,生成日式极简 ZINE 海报
GC Minimal Zine Poster 是开发者 LiamGvchi 开源的一款风格化图片 Skill。给它一个主题、一句话、一个物件、一种情绪,甚至一张参考照片,它就会生成一张安静、留白充足的 ZINE 杂志风格海报。
有人用它把自…
guizang-material-illustration 开源 Skill:基于 GPT-Image 2.0 的文章配图生成工具
歸藏开源了 guizang-material-illustration,一个基于 GPT-Image 2.0 的文章配图 Skill。它能将文章、笔记、数据或产品说明转化为带中文标签的 3D 材质风格解释图,视觉风格为白底工作室光线、克制的…
Meta Muse Image 发布:首个 Agent 生图模型,支持写代码查资料和自主修正
Meta 旗下的超智能实验室 Meta Superintelligence Labs 推出了图像生成模型 Muse Image,并同步预览了 Muse Video。Muse Image 的核心创新在于引入了智能体(Agent)机制,不再单纯…
2026年大模型开源四大天王:DeepSeek、GLM、MiniMax、Nemotron 选型指南
在 AI 领域,一个关键趋势正在加速:越来越多的智能体(Agent)开发团队正把核心链路从闭源模型迁移到开源阵营。根据 OpenRouter 2026 年 6 月的行业洞察,开源与闭源前沿模型的能力差距已缩短到 3 到 6 个月,开源模型凭…