8 月 3 日,人工智能企业 MiniMax 正式宣布开源其新一代通用视频模型最高可达 12 个,为专业创作者提供了前所未有的精细控制手段。

在系统架构的底层设计上,完整的 MiniMax H3 包含三个核心模块。首先是 H3-Context-IR(上下文中间表示),它能够将复杂的多元指令深度剖析并转化为模型易于理解的结构,是保障高品质输出的关键环节;其次是负责生成 768p 基础音视频的 H3-Base 模块;最后则是通过将初始结果与原始上下文回传实现 2K 超分重构的 H3-Regenerate-2K 模块。这一组合既保留了生动的细节,又极大提升了视觉的保真度。

目前,该模型已基于 MiniMax H3 Community License 正式发布,相关开发者与技术爱好者可以通过Hugging Face获取完整的开源代码与资源。业内普遍认为,此次开源将进一步降低多模态视频生成的应用门槛,推动影视创作、视觉设计及 AI 交互迈向全新的高度。


点赞(21)

评论列表共有 0 条评论

立即
投稿
返回
顶部