SiliconFlow + Qwen ASR
使用 scripts/transcribe.py 做统一转写入口:
- 默认:SiliconFlow 优先,失败自动 fallback 到 Qwen
- 可强制指定 provider
- 输入支持本地文件或 URL
快速开始
# 1) 安装依赖
pip install requests
# 2) 配置密钥(建议都配)
export SILICONFLOW_API_KEY="sk-..."
export DASHSCOPE_API_KEY="sk-..."
# 3) 自动模式(推荐)
python scripts/transcribe.py /path/to/audio.mp3
python scripts/transcribe.py "https://example.com/audio.mp3"
常用命令
# 强制仅用 SiliconFlow
python scripts/transcribe.py audio.mp3 --provider siliconflow
# 强制仅用 Qwen
python scripts/transcribe.py audio.mp3 --provider qwen
# Qwen 国际站
python scripts/transcribe.py audio.mp3 --provider qwen --qwen-region intl
# Qwen 指定语种 + ITN
python scripts/transcribe.py audio.mp3 --provider qwen --language zh --enable-itn
在会话中处理语音消息的流程
- 拿到语音文件路径或语音URL。
- 执行:
python scripts/transcribe.py <audio>。 - 将输出文本直接用于总结、翻译、提炼行动项。
- 若日志出现
[WARN] SiliconFlow失败,表示已自动回退到Qwen并继续处理。
关键参数
--provider auto|siliconflow|qwen:选择调用策略(默认auto)--sf-model:SiliconFlow模型(默认FunAudioLLM/SenseVoiceSmall)--qwen-model:Qwen模型(默认qwen3-asr-flash)--qwen-region cn|intl:Qwen地域--language:Qwen已知语种时可指定--enable-itn:Qwen数字/日期规范化(中英文更有用)
参考资料
- references/api_reference.md