algorithmic-art
Generate deterministic SVG algorithmic artwork. Invoke when the user asks for geometric,…
将文本合成为语音(TTS)。使用火山引擎豆包语音合成 API,支持流式合成、多种音色、语速/音调/音量调节、Markdown 过滤和 LaTeX 公式播报。当用户需要把文字转成语音、生成朗读音频、配音、旁白、播报,或提到「文字转语音」「TTS」「语音合成」「朗读」「配音」时使用本技能。
$ npx -y skills add bytedance/agentkit-samples --skill byted-text-to-speech --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/byted-text-to-speechContext preview
The summary Claude sees to decide when to auto-load this skill.
将文本合成为语音(TTS)。使用火山引擎豆包语音合成 API,支持流式合成、多种音色、语速/音调/音量调节、Markdown 过滤和 LaTeX 公式播报。当用户需要把文字转成语音、生成朗读音频、配音、旁白、播报,或提到「文字转语音」「TTS」「语音合成」「朗读」「配音」时使用本技能。
name: byted-text-to-speech version: 1.0.0 author: volcengine-speech-team description: 将文本合成为语音(TTS)。使用火山引擎豆包语音合成 API,支持流式合成、多种音色、语速/音调/音量调节、Markdown 过滤和 LaTeX 公式播报。当用户需要把文字转成语音、生成朗读音频、配音、旁白、播报,或提到「文字转语音」「TTS」「语音合成」「朗读」「配音」时使用本技能。 license: Complete terms in LICENSE homepage: https://www.volcengine.com/docs/6561/1257543
基于[火山引擎豆包语音合成](https://www.volcengine.com/docs/6561/1598757)(HTTP Chunked/SSE 单向流式-V3)将文本转为语音并保存为音频文件。
当用户有以下需求时,优先使用本 skill:
优先检查是否已配置以下凭证:
如果缺少凭证,打开 `references/setup-guide.md` 查看开通、申请和配置方式,并给予用户开通建议
| 参数 | 简写 | 必填 | 说明 | |------|------|------|------| | `--text` | `-t` | 是 | 要合成的文本内容 | | `--output` | `-o` | 否 | 输出音频文件路径(默认自动生成) | | `--speaker` | `-s` | 否 | 发音人,默认 `zh_female_vv_uranus_bigtts`,[音色列表](https://www.volcengine.com/docs/6561/1257544) | | `--format` | | 否 | 音频格式:`mp3`(默认)、`pcm`、`ogg_opus` | | `--sample-rate` | | 否 | 采样率,如 16000、24000(默认 24000) | | `--speech-rate` | | 否 | 语速 [-50, 100],100 代表 2.0 倍速,-50 代表 0.5 倍速,默认 0 | | `--pitch-rate` | | 否 | 音调 [-12, 12],默认 0 | | `--loudness-rate` | | 否 | 音量 [-50, 100],100 代表 2.0 倍音量,-50 代表 0.5 倍音量,默认 0 | | `--bit-rate` | | 否 | 比特率,对 mp3 和 ogg_opus 格式生效(如 64000、128000),默认 64000 | | `--filter-markdown` | | 否 | 过滤 markdown 语法(如 `**你好**` 读为"你好"),默认关闭 | | `--enable-latex` | | 否 | 启用 LaTeX 公式播报(使用 latex\_parser v2,自动开启 markdown 过滤),默认关闭 |
脚本输出 JSON,包含:
请将 `local_path` 或可访问的音频 URL 返回给用户,便于播放或下载。
按需打开以下文件,不必默认全部加载:
# 基本用法 python scripts/text_to_speech.py -t "欢迎使用火山引擎语音合成服务。" # 指定发音人与输出格式 python scripts/text_to_speech.py -t "这是一段测试语音。" -s zh_female_vv_uranus_bigtts -o output.mp3 --format mp3 # 指定语速与采样率 python scripts/text_to_speech.py -t "语速和音调可调。" --speech-rate 10 --sample-rate 16000
欢迎来到 AgentKit 代码工坊(Samples)仓库! AgentKit 是火山引擎推出的企业级 AI Agent 开发平台,为开发者提供完整的 Agent 构建、部署和运维解决方案。平台通过标准化的开发工具链和云原生基础设施,显著降低复杂智能体应用的开发部署门槛。 本代码库包含了一系列示例和教程,帮助您理解、实现和集成 AgentKit 的各项功能到您的应用中。
Generate deterministic SVG algorithmic artwork. Invoke when the user asks for geometric,…
Optimize code performance through iterative improvements (max 2 rounds). Benchmark execution…
根据文字描述生成视频,一个生成图片和视频的工作流技能。依赖 skills: byted-web-search, image-generate, video-generate。注意:此…
Manage AgentKit skills, SkillHub/skillhub, skill centers, and skill spaces. Use this skill…
Upload files or directories to TOS-compatible object storage for Volcano Engine or BytePlus…
根据用户的功能需求,完成与 VeADK-Go 相关的功能; 包括:直接根据需求生成 Agent;将Enio Agent转换为VeADK-Go Agent。