Fun-ASR-Nano-2512 无法fp16模式推理 #2800
) |
Replies: 1 comment
|
更正一下之前的回复: 这个报错与 GPU 型号无关,根因是构造器中的 请先升级到包含 #2978 修复的版本(最早为 python -m pip install -U "funasr>=1.3.10"from funasr import AutoModel
model = AutoModel(
model="FunAudioLLM/Fun-ASR-Nano-2512",
hub="hf",
trust_remote_code=True,
device="cuda:0",
disable_update=True,
# 这里不要传 fp16=True、bf16=True 或 dtype=...
)
result = model.generate(
input="audio.wav",
batch_size=1,
language="中文",
itn=True,
bf16=True, # 精度参数放在 generate();音频编码器保持 FP32,LLM 使用 BF16
)
print(result[0]["text"])如果 GPU 不支持 BF16(例如 V100),请去掉 不建议改成 我用官方 checkpoint revision
因此,这个模型当前可靠的低精度方案是 BF16 仅用于 |
更正一下之前的回复:
dtype="bf16"不是AutoModel这条 PyTorch 推理路径的精度开关;也不要把fp16=True或bf16=True放在AutoModel(...)构造器中。这个报错与 GPU 型号无关,根因是构造器中的
fp16=True会把整个模型转成 FP16,其中包括必须保持 FP32 的 SenseVoice 音频编码器;输入和部分算子仍是 FP32,因此会出现Float/Halfdtype mismatch。请先升级到包含 #2978 修复的版本(最早为
1.3.10,当前为1.3.14),然后只在generate()阶段启用 BF16:python -m pip install -U "funasr>=1.3.10"