8 月 3 日,人工智能企业 MiniMax 正式宣布开源其新一代通用视频模型
在系统架构的底层设计上,完整的 MiniMax H3 包含三个核心模块。首先是 H3-Context-IR(上下文中间表示),它能够将复杂的多元指令深度剖析并转化为模型易于理解的结构,是保障高品质输出的关键环节;其次是负责生成 768p 基础音视频的 H3-Base 模块;最后则是通过将初始结果与原始上下文回传实现 2K 超分重构的 H3-Regenerate-2K 模块。这一组合既保留了生动的细节,又极大提升了视觉的保真度。
目前,该模型已基于 MiniMax H3 Community License 正式发布,相关开发者与技术爱好者可以通过
发表评论取消回复