MiniMax H3 open-source omni-modal model tops leaderboards, costs as low as 0.09 yuan/sec
MiniMax released MiniMax H3, an open-source omni-modal generative model that accepts text, images, audio, and video inputs and generates up to 15-second 2K video with native dual-channel audio. The model ranks first on Artificial Analysis video editing and Arena image-to-video leaderboards, and became the top trending model on Hugging Face within 24 hours, with over 100 partners adapting it. Third-party platforms like Metaso offer access at prices as low as 0.09 yuan per second for 768P generation, while a Python package ports the model to MLX for Apple Silicon.
Coverage timeline
MiniMax Blog
今天,我们正式发布 MiniMax H3。这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。

Simon Willison
PipeNetwork/minimax-h3-mlx MiniMax released MiniMax-H3 two days ago - they describe it as a "a general-purpose, omni-modal generative system", which in practice means it accepts text, images, audio and video and can use them to generate up to 15 second video clips with audio included. This Python package ports it to MLX for running on Apple Silicon. I got it running on my M5 Max MacBook Pro. I cloned the repo and ran the model like this: # First download the models uvx --from huggingface_hub hf download MiniMaxAI/MiniMax-H3 \ --include 'FL2VA/*' --exclude 'FL2VA/transformer/*' uvx --from huggingface_hub hf download pipenetwork/MiniMax-H3-MLX-8bit # Now run the prompt uv run --with mlx-vlm \ --with-requirements requirements.txt python scripts/generate.py \ "a rainbow colored skunk leaps over a mossy log in a supermarket" \ -o skunk.mp4 \ -c ~/.cache/huggingface/hub/models--MiniMaxAI--MiniMax-H3/snapshots/fa9c8ab1eaa21c8ae25e7e40b83b2e6002f340af/FL2VA \ -t ~/.cache/huggingface/hub/models
量子位量子位
等等,MiniMax H3不是刚发布吗?怎么就卷到几分钱的价格了…… 梦瑶 2026-08-05 21:47:51 来源: 量子位 MiniMax H3也能开箱即用了 梦瑶 发自 凹非寺 量子位 | 公众号 QbitAI 救啊……谁成想,AI视频新模型的几分钱时代来得这么快啊??? 文章链接: https://mp.weixin.qq.com/s/fuzTrFMIg5RvXmGzCUXpLQ 大家敢信,就上面这个AI搞笑短片,实际生成费用只用了7毛钱。。。 这不就前两天,MiniMax突袭发布了全新一代视频模型 MiniMax H3 。 文、图、音、视频这些多模态能力全方位next level,甚至模型一出,人家直接在Artificial Analysis榜单 霸榜第一 。 然后,整个AI圈直接炸了—— 是的,各种网友实测玩法卷得全网飞起,说真的,我已经很久没在AIGC圈看到这种场面了….. 但是吧,热闹归热闹,一个蛮扎心的事实是: 毕竟模型刚开源还没在官网全面上线,像部署环境、配置门槛、使用成本这些问题,还是现实存在的…… 比如,下面这位老哥,人家直接冲到官方评论区求配置要求,生怕自己硬件卡bug: 不得不承认,想试试新模型效果还得先研究怎么跑起来,「不敢用」确实也是摆在咱用户面前的一道难题。。。 然后,就在今天,还真让我发现了个好玩意儿。 秘塔AI ,就是之前Nano Banana 2平替玩法很火、专业资料搜索能力也很强的那个AI产品,也上线了MiniMax H3。 最关键的是,我发现我压根不用折腾部署,不用配置环境,不用任何软硬件接入要求。 直接打开网页,就能 直接上手开搓 的那种。 甚至,我看了一眼价格,2K方案的价格是 0.15元/秒。 768P方案甚至直接卷到了 0.09元/秒 ,差不多生成个5秒的视频,连五毛钱都用不到。。。 咋说呢,AI视频这波,是真的开始进入几分钱时代了…… 从复杂部署到直接生成,MiniMax H3也能开箱即用了! MiniMax H3模型,火,是真的火。 而且,这还是MiniMax的首个开源视频模型,含金量自然不用多说了。 还记得模型发布的那会儿,MiniMax H3就直接在新鲜出炉的Artificial Analysis榜单上,卷到了视频编辑的 Top1 。 (谷歌:真必须要把我的位置也放出来吗就说??) 如果要用一句话总结M

量子位量子位
MiniMax H3登顶开源社区第一,定义视频模型领域“斩杀线” 量子位的朋友们 2026-08-06 13:36:37 来源: 量子位 本周,MiniMax 正式开源新一代通用多模态生成模型 MiniMax H3,在 Artificial Analysis 视频编辑评测榜、Arena 图生视频排行榜中均位列全球第一,并获得 Stable Diffusion 创始人 Emad Mostaque、硅谷投资机构 a16z 合伙人 Justine Moore 等业内知名人士点赞。 目前,在开源社区 Hugging Face 上,MiniMax H3 热度已上升至第一名,超过 DeepSeek V4 Flash。 H3 在模型评测和开发者社区中的表现,反映出大模型竞争正逐步由单纯模型能力比拼转向生态能力竞争。对于开源模型而言,芯片适配、推理框架支持、开发者社区接入以及应用落地速度,正成为衡量其生态成熟度的重要指标。H3 开源 24 小时内即获超百家国内外合作伙伴首日适配及接入。从 DeepSeek 到 MiniMax H3,中国模型公司的开源范围正在从语言模型拓展到视频模型,H3 已成为中国开源 AI 向多模态领域延伸的标志性事件。 近期,杰富瑞重申 MiniMax 买入评级,目标价 1118 港元。杰富瑞最新研报显示,MiniMax H3 的推出进一步巩固 MiniMax 在 AI 视频生成领域的竞争地位,其成本优势将有助于拓展企业客户及加速商业化落地。花旗最新研报显示,MiniMax H3 具备商用级内容生成能力,对 MiniMax 维持买入评级。截至 5 日收盘时,MiniMax 涨幅超 10%。 本文由MiniMax提供,量子位获授权转载,观点归原作者所有。 版权所有,未经授权不得以任何形式转载及使用,违者必究。
