0 个
音频文件
—
总时长
—
转录引擎
—
识别语言
🎵
上传音频文件(支持批量)
点击或拖拽上传音频/视频文件
支持 1~20 个文件,音频(WAV/MP3/M4A/OGG/FLAC) 和 视频(自动提取音轨)
🧠
选择转录引擎
📖
whisper.cpp 参数速查
模型大小选择
tiny 75MB 快但不准,base 142MB 日常够用,small 466MB 推荐,medium 1.5GB 高精度,large-v3 2.9GB 最佳。语言参数
--language auto 自动检测,zh 中文,en 英语,ja 日语。指定语言可提升准确率。输出格式
txt 纯文本、srt 字幕、vtt Web字幕、json 结构化、csv 表格。多格式可同时输出
-osrt -otxt。音频预处理
whisper 要求 16kHz 单声道 WAV。用 FFmpeg 预处理:
-ar 16000 -ac 1 -c:a pcm_s16le 确保最佳识别率。