登录
下载
Skill UI
浏览并发现
15730+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
TTS
,共找到
35
条记录
默认排序
最新上传
最多下载
ElevenLabs语音合成API指南
elevenlabs-hello-world
jeremylongshore/claude-code-plugins-plus-skills
224
本技能提供了一份完整的ElevenLabs语音合成API使用指南。内容涵盖使用TypeScript、Python和cURL等多种方式,实现文本到语音的高质量转换。用户可以学习如何精细控制语音参数、选择不同模型(如低延迟流式传输),适用于各类需要高质量语音内容生成的应用开发。
查看详情
ElevenLabs API认证与配置
elevenlabs-install-auth
jeremylongshore/claude-code-plugins-plus-skills
255
本指南详细介绍了如何在Node.js和Python环境中安装并配置ElevenLabs SDK。内容涵盖了如何使用环境变量设置API密钥、初始化客户端连接,并通过列出可用音色等方式进行连接验证。适用于所有需要集成高级文本转语音(TTS)或语音合成功能的开发场景。
查看详情
ElevenLabs本地开发环境搭建
elevenlabs-local-dev-loop
jeremylongshore/claude-code-plugins-plus-skills
81
本指南提供了一套专业、高效且成本可控的本地开发工作流,专为ElevenLabs的TTS/语音项目设计。核心功能包括SDK模拟(Mocking)以避免测试消耗配额,热重载支持,以及配额检查机制,确保开发过程稳定且经济。
查看详情
ElevenLabs生产部署检查清单
elevenlabs-prod-checklist
jeremylongshore/claude-code-plugins-plus-skills
169
这是一个用于将ElevenLabs TTS/语音集成安全部署到生产环境的完整清单。它系统地涵盖了API配置、健康状态检查、熔断器设置、监控和回滚等关键工程步骤,确保在上线语音功能时具备高度的稳定性和可靠性。
查看详情
ElevenLabs TTS生产级架构指南
elevenlabs-reference-architecture
jeremylongshore/claude-code-plugins-plus-skills
242
本文提供了一套生产级别的TTS/语音应用参考架构,基于ElevenLabs API。它涵盖了完整的项目结构设计、服务层(如TTS服务、语音管理、缓存)的最佳实践,包括环境配置管理、流式传输和多模型编排,适用于构建高可靠、可扩展的商业语音服务系统。
查看详情
ElevenLabs SDK最佳实践模式
elevenlabs-sdk-patterns
jeremylongshore/claude-code-plugins-plus-skills
240
本指南提供了用于ElevenLabs TTS服务的生产级设计模式,涵盖了从单例客户端管理、类型安全的语音服务封装、到复杂的错误分类和并发请求队列处理等最佳实践。适用于构建稳定、可靠、可扩展的语音AI应用。
查看详情
本地离线文本转语音与声音克隆
local-tts
jeremylongshore/claude-code-plugins-plus-skills
405
本技能基于VoxCPM2模型实现本地离线文本转语音合成。支持30种语言,提供三种先进模式:标准语音合成、描述式声音设计,以及从用户提供的参考音频进行声音克隆。所有处理均在本地设备上完成,无需任何API调用或网络连接,非常适合制作高质量的视频旁白、播客音频或语音消息。
查看详情
音频内容生成与合成
audio-jingle
nexu-io/open-design
146
这是一个专业的音频内容生成工具,能够根据需求生成高质量的配乐、片头、画外音和音效。它集成了多种主流AI模型,支持从简单的文本指令到复杂音乐结构(如情绪弧线)的完整流程,适用于市场营销、视频剪辑和多媒体内容制作。
查看详情
语音克隆实验室:生成可重用音色
voice-clone-lab
opensquilla/opensquilla
91
该功能提供专业的语音克隆服务,能够从本地音频样本创建并注册可重用的虚拟声音。它严格遵循“先征得同意”的工作流,必须获取发言人身份、使用范围和样本来源的明确同意。适用于需要品牌一致性、高性能TTS、虚拟人内容或专业配音的场景。
查看详情
专业文字转语音配音工作室
voiceover-studio
opensquilla/opensquilla
146
这是一个专业的文本转语音(TTS)配音系统,能够将任何书面文本转化为高质量、自然流畅的音频内容。它支持多种应用场景,包括播客旁白、产品解说、IVR提示和短视频配音。系统具备高级功能,可根据用户指定的目标语言、地域口音、情绪和语速进行优化,确保生成的音频在不同文化背景下都自然准确。
查看详情
语音实验设计与报告指南
interspeech-experiments
brycewang-stanford/Awesome-Journal-Skills
479
本指南详细介绍了语音处理领域(如自动语音识别、文本转语音、说话人验证等)实验设计、评估和报告的最佳实践。它涵盖了必须使用的核心指标、构建可靠基线、进行显著性检验(如自助法、置信区间)以及确保条件覆盖的各个方面,旨在提高学术论文的科学严谨性。
查看详情
上一页
1
2
3
语言
简体中文
English