以前录发票:拍照→人工看→手动填表,一张票少说2分钟
现在:拍照→丢给多模态模型→JSON直接入库,5秒搞定
我用三款国产模型实测了发票结构化提取:
Step 3.7 Flash:5.6秒,1409 tokens,花费¥0.006
MiniMax M3:6.1秒,2216 tokens,花费¥0.0086
Qwen3.6-flash:7.38秒,2008 tokens,花费¥0.0075
三家提取结果全部正确✅
但差距在:
Token消耗:Step 3.7 Flash 最少,只有MiniMax的64%
响应速度:Step 3.7 Flash 最快
单次成本:不到1分钱
而且速度最快(15秒 vs 其他两家19-20秒),成本最低(¥0.025 vs ¥0.049-0.069)。
以前给AI口述流程容易出错,现在直接截图一步到位,这个效率提升是实打实的。












