8月3日,MiniMax正式开源新一代多模态生成模型MiniMax H3。壁仞科技基于SGLang推理框架,快速完成MiniMax H3在旗舰通用GPU产品壁砺™系列上的“Day0”适配与调优。广大开发者与用户可在第一时间完成部署,即刻享受MiniMax H3强大的图文音视频生成能力以及流畅的多模态交互体验。
MiniMax已先后开源三代M系列文本模型以及首款开源多模态生成模型H3。壁仞科技以软硬协同、全栈自研技术能力,高效完成M、H系列多款模型Day0级适配,持续领跑国产AI生态建设。
MiniMax H3:打破任务和模态边界
根据官方介绍,作为MiniMax从“特化任务模型”迈向“通用多模态智能”的重要探索,MiniMax H3不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。
MiniMax H3支持文本、图片、音频和视频等多种输入形式,支持2K分辨率直出,可生成最长15秒的音画内容。在模型效果方面,MiniMax H3具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。
在Artificial Analysis视频模型榜单中,MiniMax H3在视频编辑能力项排名全球第一。

国芯+国模,共建国产AI生态
本次Day0适配中,针对MiniMax H3文本、图像、视频与音频统一理解和生成能力,以及原生立体声音视频联合生成、最高2K分辨率和15秒视频输出等核心特性,壁仞科技基于生成式AI推理框架SGLang以及成熟的BIRENSUPA™软件栈,在壁砺™166M上快速完成模型适配与精度对齐。
同时,壁仞科技自研全栈多智能体平台SUPACODE™可自动解析Qwen3-VL编码器、H3-Omni Transformer、音视频VAE等关键模块,在此基础上打通SGLang多模态推理全链路,并围绕长序列注意力、Ulysses序列并行、All-to-All通信、音视频联合生成及显存分层调度开展针对性优化,高效支撑文生视频、多模态参考与编辑、动作迁移和原生音视频创作等场景。
此次适配充分展现了BIRENSUPA™软件栈以及壁砺™166M面对前沿模型架构的卓越迁移能力,为广告、电商、影视、游戏及数字内容创作提供了高效、可靠的国产算力部署方案。
当前,人工智能领域核心技术迭代与行业应用需求呈现双轮驱动、加速增长态势。为深度推动AI与经济社会各领域的广泛融合,壁仞科技作为国产算力领军企业,已率先实现近30款国产大模型的“Day0”级适配,降低开发者的部署门槛,让前沿AI能力更快触达千行百业。