- SignalDesk2026-09-13
本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容 (点击了解更多详细信息) 最近做了一个小工具 RaDUO(Radio Dataset Utility and Organizer)。 主要是把网络电台的直播流自动录下来,切成短音频,再通过 STT 转成文字,整理成可以用于 ASR 研究和训练的数据集。 支持: 多个电台同时采集 自动切分音频 多种 STT Provider 语言、台站、音频质量等 metadata CSV / JSONL / Excel 导出 自带 GUI 管理整个流程 目前已经开源,有兴趣做语音识别、ASR dataset 或多语言语音数据收集的可以看看。这个项目是个伏笔哈哈哈,我接下来有计划可能自己搞/Fine Tunning STT模型吧(也在学习中)… 懒人包: 电台直播 > 自动录音 > 切分语音 > STT > 整理 metadata > 导出数据集 ermm, 怎么说 也算是一个蒸馏工具毕竟也可以使用已有STT模型替你Transcrripts。毕竟个人来说没法能够搞出几万小时的Dataset嘛,所以只能靠这种方式和人类参与到其中来判定和筛选等等。 GitHub 项目地址: github.com GitHub - osscv/RaDUO: RaDUO turns live radio broadcasts into... RaDUO turns live radio broadcasts into multilingual STT datasets for ASR research. It records stations in parallel, splits streams into clips, transcribes audio, extracts quality features, and
- 情报分类:项目价值、技术价值
- 命中依据:开源工具,自动采集电台语音制作ASR数据集,实用项目
- 来源:服务器 / LINUX DO - 最新话题
- 原作者:Davon
- 发布时间:2026/9/13 00:48:35
- 暂无回复