AgentMarketMCP / SKILL 资产档案馆

目录 / 多媒体 / 语音转文字

SKILL 未评级 已上架

语音转文字

基于 faster-whisper 的本地语音转文字技能(CPU推理,无需API Key)。支持中英日韩等99种语言,自动检测语言,提供 SRT/VTT/JSON/TXT 多格式输出,含说话人分段(可选)、热词纠错、长音频分段处理。沙箱已预装 faster-whisper 1.2.1 + tiny模型(75MB)。当用户需要语音转文字、音频转字幕、会议录音转写、采访稿整理、视频字幕生成、电话录音整理,且不想付费或担心隐私时,触发此技能。完全替代阿里百炼 qwen-audio 的 ASR 环节。

模型生成摘要(rules/v1 · 2026-09-21 21:53):基于 faster-whisper 的本地语音转文字技能(CPU推理,无需API Key)
这是模型对公开材料的总结,不是官方声明,请以原链内容为准。

存档时间线

版本存档时间内容哈希内容
v12026-09-21 21:5281924597 可取

版本索引永久保留;内容副本只保留最近 2 版,更早版本仅留索引与哈希(存档时间线的证据链不会因此断裂)。

下载存档内容副本

相关资产

SKILL

TencentCloud ASR

腾讯云语音识别 ASR Skill,适用于语音转文字、音频转写、字幕生成、会议转录、语音消息识别、 本地文件或 URL 音频识别

语音识别字幕会议记录
原作者:tencent-adm 来源:腾讯 SkillHub 含内容副本 · 可下载 存档:v1 · 2026-09-21 hash 081870c1
SKILL

Audio Summary

Automatically extracts audio from video, transcribes it using qwen3-asr-flash, and generates segmented text summaries sa…

语音识别
原作者:alanoo7 来源:腾讯 SkillHub 含内容副本 · 可下载 存档:v1 · 2026-09-21 hash 5a2ff1c6
SKILL

Audio Recognition

音频语音识别服务(Speech-to-Text)

语音识别
原作者:zzhimin 来源:腾讯 SkillHub 含内容副本 · 可下载 存档:v1 · 2026-09-21 hash 95b39ec3
SKILL

audio-transcription-skill

音频转录全流程技能:下载→语音转文字→精炼版整理

语音识别
原作者:user_1eeb7312 来源:腾讯 SkillHub 含内容副本 · 可下载 存档:v2 · 2026-09-21 hash e2e84cae
纠错与举报(发现条目失效、署名有误或涉及侵权?)
提交举报 / 纠错

侵权举报经核验成立后,我们会即时下线该条目并删除已存的内容副本。