来源 :沐曦股份MetaX2026-08-03
8月3日,MiniMax宣布开源新一代多模态生成模型 MiniMax H3。沐曦股份曦云C系列GPU率先完成对该模型的Day 0适配。依托沐曦股份全栈自研 MXMACA 软件栈,实现快速部署MiniMax H3,调用 MiniMax H3 强大的多模态创作能力。
作为MiniMax从“特化任务模型”迈向“通用多模态智能”的重要探索,MiniMax H3不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。
曦云C系列GPU基于沐曦股份自研核心GPU IP打造,具备高能效比与高通用性,精准匹配大模型的超大规模参数处理及长上下文推理需求。沐曦曦云 C 系列依托自研高性能硬件架构,搭配MXMACA计算平台,从而实现对MiniMax H3模型的极速适配。
曦云C系列GPU测试验证效果
MXMACA软件栈是沐曦GPU从“可用”进阶为“好用、易用”的核心基石。作为连接硬件算力与上层应用生态的核心枢纽,MXMACA软件栈全链路覆盖底层驱动、用户态接口、MXCC编译器、算子深度适配及主流训练/推理框架对接,原生兼容国际主流生态,适配 PyTorch、TensorFlow、vLLM与SGLang等 40 余种主流 AI 框架,支持 500+ AI 模型稳定运行,大幅缩短传统模型适配周期。
自2025年12月以来,沐曦股份已累计完成30个主流顶尖模型Day 0适配,覆盖腾讯、智谱AI、阿里千问、阶跃星辰、百度飞桨、DeepSeek等头部厂商,适配囊括通用语言、多模态、OCR、机器翻译等,适配速度、数量、生态广度均实现领跑。
未来,沐曦股份将持续迭代GPU硬件与全栈软件技术,深化与国内AI企业的生态协同,打通“国产芯片-国产大模型-产业落地”的完整闭环,以自主可控的高性能算力,助力人工智能赋能千行百业。
关于多模态生成模型 MiniMax H3
MiniMax H3 支持文本、图片、音频和视频等多种输入形式,支持 2K 分辨率直出,可生成最长 15 秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。
在模型效果方面,MiniMax H3 具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。
在 Artificial Analysis 视频模型榜单中,MiniMax H3 在视频编辑能力项排名全球第一。
自成立以来,MiniMax 坚持文本与多模态模型并行自研,已先后开源三代 M 系列文本模型。H3 则是MiniMax推出的首款开源多模态生成模型。
MiniMax 借鉴了文本模型发展过程中已经被验证的方法,包括复杂问题拆解、Reasoning、Scaling Context 和 Muon 优化器等,并将其应用到多模态理解、数据构建和模型训练中。围绕不同任务的理解和指令遵循,MiniMax 对数据体系进行了多轮迭代,提升模型面对开放输入和复杂指令时的泛化能力。
MiniMax H3 视频生成价格为 0.8 元/秒(2K分辨率),仅为业内同类旗舰视频模型的三分之一。MiniMax 通过高压缩 Tokenizer 降低视频生成所需的 Token 数量,实现了成本优化与效率的提升。针对视频长度、分辨率和多模态理解与生成负载差异较大的特点,MiniMax 在异构训练、负载均衡和 GPU 利用效率等方面进行系统优化,在追求模型效果的同时控制训练和推理成本。
MiniMax H3 将业内多模态模型的竞争进一步带向效果、成本、开放性与生态协同的综合维度,丰富了模型企业与国产 AI 芯片软硬件协同生态。与此同时,MiniMax 多模态路线进入了模型能力、训练效率、开源生态和行业应用协同推进的新阶段。
模型开源地址:
huggingface.co/MiniMaxAI/MiniMax-H3
欢迎前往沐曦开发者社区Day 0版块获取推理镜像:
https://developer.metax-tech.com/softnova/Day0