
MiniMax运营中
H3全模态视频上新!四模态成片
MiniMax 9
一张图带你了解 MiniMax 产品亮点
- 四模态统一理解并直出2K音视频
- 百万上下文承接长程Coding任务
- 复杂任务交给Agent团队并行推进
- 文本图像音视频串成连续创作链
MiniMax 评测报道
MiniMax介绍
MiniMax由上海稀宇科技有限公司提供,当前官网汇集自研大模型、AI原生产品与开放平台。视频创作侧,H3是2026年7月31日发布的通用全模态生成模型,可统一理解文字、图片、视频和声音,按素材之间的关系生成最高2K、最长15秒并带原生双声道的音视频,还能完成视频到视频动作迁移。复杂任务侧,M3提供1M长上下文、原生多模态与Coding/Agentic能力,MiniMax Code进一步让Agent拆解任务、组队协作并持续执行。MiniMax Design则把文本、图像、视频和音频模型串进连续创作流程,语音、音乐与开放平台继续承担声音生成和开发接入,形成从模型调用到任务执行与内容交付的完整链路。
MiniMax需求人群
视频与视觉创作者:结合文字、图片、视频和声音参考,为广告、品牌、电商或创意内容生成音视频。
开发者与工程师:处理大型代码库、Bug修复、应用开发以及需要长上下文持续协作的Coding任务。
研究与知识工作者:把复杂任务拆给Agent团队并行推进,持续处理资料、文件和多步骤工作。
品牌与内容团队:从Brief出发,让Agent继续完成创意拆解、素材生成、编排审核与内容交付。
MiniMax主要功能
H3全模态视频:把文字、图片、视频和声音作为同一任务的参考素材,理解彼此关系后生成最高2K、最长15秒并带原生双声道的音视频,也可进行视频到视频动作迁移。
Coding与Agent模型:M3最高提供1M上下文,并原生理解图片和视频,面向编程、工具调用、多步推理与Agentic任务持续处理复杂上下文。
Agent团队协作:MiniMax Code可独立处理简单任务,面对大型复杂工作则组建Agent团队,拆成多阶段、可并发并可动态调整的任务流程。
多模态内容创作:MiniMax Design从创意或策划文档开始,由Agent理解意图、拆解任务并调度文本、图像、视频和音频模型,继续进入审核与交付。
语音音乐与API:Speech 2.8、Music 3.0分别覆盖语音与完整歌曲生成,开放平台则提供文本、音频、图像、视频和音乐等模型的开发接入。
MiniMax产品特色
参考素材不再各自独立:H3重点不是单纯多一种输入格式,而是理解文字、图片、视频和声音之间的引用关系,例如同时指定镜头运动、人物和参考声音,再统一生成结果。
模型能力直接落进Agent工作流:M3的长上下文、原生多模态与Coding/Agentic能力继续进入MiniMax Code,而不是停在单轮模型对话。
长程任务会动态调整路线:Agent Team可并行推进不同阶段,并根据执行结果继续反思和修正;过程中仍可追加要求或改变方向。
创作保留“执导”与审核节点:MiniMax Design让Agent负责拆解和执行,同时保留画布编排、人工审核与Skill复用,更适合持续修改完整项目。
HI!我是星踪岛管家张铭宇
有任何疑问可添加微信号:uisdc5687
添加请务必备注:星踪岛问题反馈
© 免责声明:鉴于域名具有时效性,指向的网站内容可能发生变更。AI星踪岛对呈现的第三方网站不可控,无法承担任何责任。请自行判断内容风险。
AI星踪岛









1
2
3
4
5
嗨,岛上的小伙伴们在等您来评论区聊聊,期待您的反馈评价
MiniMax使用体验怎么样______?最需要改进的地方是______?欢迎评论区告诉我们👏