海螺3 武打 LoRA:三个文件,两个触发词
2026/08/20

海螺3 武打 LoRA:三个文件,两个触发词

海螺3(MiniMax H3)的武打 LoRA 有三个文件、两个触发词。步数最高的那个并不是最新版本——该用哪个,看你要的是什么。

我去下载海螺3(MiniMax H3)的武打 LoRA,本来以为就一个文件。仓库里躺着三个,而且步数最高的那个,并不是另外两个的新版本。

两个主力 checkpoint 的触发词不一样,要写的提示词结构不一样,训练素材也不是同一批。挂了这个、写的却是那个的提示词,你拿到的要么是 LoRA 没被激活时的弱先验,要么什么都没有——取决于你挂的是哪一个。

仓库里有什么

Jojocodex/minimax-h3-wushu-action-lora 是基于 Comfy-Org 的 MiniMax-H3 转换版训练的社区 LoRA,走 Apache-2.0。三个 checkpoint,每个 155 MB。两个 wushu_action 文件是 pruned 版,KungFu 那个文件名里没有 pruned 标记:

文件触发词步数
wushu_action_h3_lora_v5_3000_prunedwushu_action3000
wushu_action_h3_lora_v4_2000_prunedwushu_action2000
KungFu_MiniMaxH3_LoRA_step4500kungfu combat4500

三个文件共用一份 README,分成两节,而这两节之间并不总是自洽。

模型卡只写了 v5,v4 只出现在文件列表里,正文一个字没提。把 v5 当成在维护的那个、v4 当成留下的旧物就行,触发词在没有别的说明之前按同一个算。

KungFu 那个是另一条线。模型卡说它用另外收集的素材训练,它有自己的触发词和自己的提示词模板。把 4500 读成“比 3000 更新更好”,是这里最容易犯的错。很多人就是这么挂上文件,然后写了一段这个 checkpoint 根本没学过的提示词。

截至 2026 年 8 月 20 日,仓库显示月下载约 684、29 个 likes、2 个 Spaces,Hugging Face 页面上已经接入 WaveSpeed 做文生视频推理。这是个规模不大、但作者还在更新的社区项目,不是 MiniMax 官方发布。

两个 checkpoint 干的是两件事

想分清它俩,最直接的办法是看各自的提示词词汇在讲什么。

wushu_action 这边讲的是身体。重心转移、髋肩协同旋转、爆发式蹬腿、落地平衡、稳固步法、弓步。模型卡说得很直白:训练 caption 全部按“具体招式 + 身体协调 + 发力”的写法组织。

kungfu combat 这边讲的是画面。尘土与动态模糊、雾气缭绕的竹林、霓虹小巷、手持镜头抖动、摇臂扫拍、大片风格。同一个题材,完全另一套词汇。

两个没有高下之分。按这条片子哪一半必须立得住来挑:

  • 动作要真——一脚踢出去有重量,一拳打出去髋部跟得上,那就是 wushu_action
  • 画面要像电影——竹林里的武侠对决、霓虹底下的街头斗殴,那就是 kungfu combat

海螺3 武打 LoRA 的两套提示词结构对比:wushu_action 的四段式模板与 kungfu combat 的六段式模板

wushu_action 怎么写

触发词必须放最前面。训练数据里 FIGHT 类 caption 全部以它开头,模型已经把它和武术动作绑死了。不带它,LoRA 也还有一点动作先验,只是弱很多。

wushu_action, [动作主体] + [招式与发力]
+ [场景与镜头] + [可选画质词]

模型卡里的一个完整例子:

wushu_action, a wushu practitioner executing a rapid combination of
punches and kicks, powerful hip rotation and weight transfer, gym
background, full-body shot

第二段才是这个 LoRA 值钱的地方。performing a spinning kick 只是个标签;a spinning kick, explosive leg extension, balanced landing 讲的是这股力怎么发出来、又怎么卸掉。训练 caption 是按后一种写法组织的,所以提示词也照后一种写,才最贴近模型真正学到的东西。

模型卡关键词库里有三个短语几乎能扛住大半的活:

  • weight transfer 重心转移:出招时身体的重量往哪走
  • coordinated hip and shoulder rotation 髋肩协同旋转:力从哪来
  • grounded footwork 稳固步法:不让整个人飘起来

双人对打用 two fighters exchanging strikes,能把你来我往的关系带出来;想让拳头真的打在人身上,就加 realistic impact and recoil。兵器同理:先说是什么兵器,再说它在做什么——fighting with a sword, slashing and thrusting, with precise technique

kungfu combat 怎么写

这一节的数法跟上一节不一样。wushu_action 的“四段式”不含触发词,kungfu combat 的清单把触发词算作第一格。放到同一个基准上,是四格对六格:

kungfu combat, [主体] + [动作] + [场景环境] + [镜头语言]
+ [风格质感] + [画质词]

六格里有两格是新的。kungfu combat 把场景和镜头拆成了两格,另外多出“风格质感”这一格,wushu_action 根本没有。风格词在 wushu 那边也不是不能写,模型卡自己的剑术例句结尾就是 dark studio, dramatic lighting,只是得挤在场景那一段里。到了这边它有了独立的一格,能用的词也宽得多:wuxiagrittyanimefilm graingolden hourneon lights

模型卡第 2 节还提到这个触发词支持权重语法——激活感觉不够就写 (kungfu combat:1.2)。第 1 节没给 wushu_action 提这件事,不过权重是提示词解析器的功能、不是 checkpoint 的属性,所以两边都值得试。

那一节还有一处差别:kungfu combat 被写成“必须出现在提示词中,LoRA 才会被激活”,而 wushu_action 缺了触发词只是退化成较弱的先验。同样一条要求,忘了写的后果不一样。

kungfu combat, ancient Chinese wuxia style, two warriors in traditional
robes, flying kicks and sword clashes, bamboo forest, misty atmosphere,
slow motion impact, epic music vibe, cinematic composition

留意模型卡这条招牌例句里风格词实际的位置:第二格,不是第五格,而且整条提示词没有画质词。这个清单是“该写哪些东西”的核对表,不是例句必须遵守的顺序。也留意它几乎不写身体本身,撑起 wushu_action 的那套身体力学词汇在这里基本消失了。

慢动作这个坑

模型卡给 wushu_action 建议的负面提示词是 blurry, distorted, low quality, jittery motion, extra limbs, deformed hands, morphing bodies, inconsistent lighting, flickering, static pose, frozen motion

同一张卡的第 8 条例句,给空中击打要的是 slow motion feelkungfu combat 的武侠例句里,slow motion impact 也是正面词。

这不是自相矛盾。编排好的慢镜头是有意为之的电影手法;而模型下不了决心、一招打得黏黏糊糊,是失败。这两件事在画面上完全不像,写进提示词里却长得一模一样。所以你要的是哪一种,得说清楚;如果不是刻意要慢镜头,就把 frozen motion 留在负面词里。

关于负面词还有一点:模型卡说训练时负面提示词是空的,模型没学过负向概念。所以这里的负面词按“看见什么瑕疵补什么”来用,别当成每次都粘一整段的预防性咒语。

下载之前先看许可

LoRA 权重是 Apache-2.0。这管的是这个 adapter,不是它底下的基础模型——而限制正好在基础模型那边。

海螺3 社区许可把四个地区排除在本地使用之外:美国、欧盟、英国、韩国。人在这四个地方,就没有在本地跑 H3 权重的许可,也就同样没有在本地跑这个 LoRA 的许可——一个 Apache-2.0 的 adapter 离开它适配的基础模型是跑不起来的。在适用地区内,年营收 2000 万美元以下可以商用。完整条款见开源权重解读

这一条跟你做的是不是商业项目无关。先看清楚,再决定要不要下这 155 MB。

三次生成的流程

第一次——确认触发词生效。 一条短片、最精简的提示词、按你挂的 checkpoint 用对触发词。如果动作跟不挂 LoRA 的海螺3 没区别,那就是触发词漏了、拼错了,或者没放在最前面。先解决这个,别动别的。

第二次——把第二段写满。 同一个镜头,把发力描述认真写出来:什么招式、身体怎么协调、重心往哪走。这一段决定了你拿到的是一条能用的片子,还是一个挥胳膊的假人,也是最值得反复调的一段。

第三次——再上场景。 环境、镜头,kungfu combat 再加风格那一格。放到最后加的好处是:画面一变差,你知道是哪一步干的。

如果写完第二段拳头还是打不到人,先换 checkpoint,别急着再改一遍提示词。两个模型训练差异够大,一个提示词在这边不成立,不代表想法本身有问题。

说到底

三个文件、两个触发词、两套模板。wushu_action 的 v5 是身体力学模型,要的是招式和发力写得细;kungfu combat 的 4500 步是场面调度模型,要的是环境、镜头和风格。数字大的那个是另一次训练,不是升级。

两个都得把触发词放在最前面。剩下的字数花在该花的地方:一个花在身体力学,一个花在场面调度。

不想本地装环境的话,海螺3 视频生成器在云端跑的是标准模型,海螺3 提示词库里有可以直接改的现成结构。提示词结构本身看 H3 提示词格式指南,要从代码调用就看 MiniMax H3 API 指南。模型背景看海螺3 是什么

本文的 checkpoint 名称、触发词、步数、提示词模板和下载数据来自 Jojocodex/minimax-h3-wushu-action-lora 的模型卡与仓库,核对时间为 2026 年 8 月 20 日。这是一个 Apache-2.0 的社区 LoRA,不是 MiniMax 官方产品。基础模型的许可条款依据海螺3 社区许可整理。

免费试用

立即用 MiniMax H3 生成你的第一段视频

支持文生视频与图生视频,并提供可直接使用的提示词案例,帮助你快速开始创作。无需下载,打开浏览器即可使用。