返回首页

AI 模型与处理说明

披露语音、音乐和声音克隆工具实际调用的模型、请求版本及发送的数据。

最近更新: 2026-09-25

工具使用哪些模型

Producer Tag AI 接入以下第三方服务,并非自行训练这些模型。下列名称及请求标识对应当前接入代码;请求版本不表示我们能够检查供应商的模型权重、内部修订或路由。供应商可能调整可用性或拒绝请求。

普通语音与女生声线水印

引擎:Microsoft Edge Read Aloud Neural TTS;供应商:Microsoft。

语音水印生成器与女生声线工具会将短语及所选声线标识发送至微软 Edge Read Aloud 语音服务。已配置的神经声线包括 en-US-JennyNeural、en-US-EmmaNeural 等;选择女生声线改变的是声线,而不是底层引擎。

该接入没有返回固定的底层模型发布版本,因此我们不会将它标称为某个 GPT、Gemini 或 ElevenLabs 模型。请求生成的是语音,而不是对用户上传人物声音的克隆。音效和导出转换在浏览器中另行处理。声线目录中的仅试听项目只是示例,不代表该供应商已支持在线生成。

AI 音乐制作人水印

AI 音乐工具通过 Kie.ai 分别请求以下两层音频:

  • 器乐层:Suno Sounds;接口标识 ai-music-api/sounds;请求版本 V5。音乐描述用于生成该层音频。
  • 口播层:ElevenLabs Multilingual v2;接口标识 elevenlabs/text-to-speech-multilingual-v2。提取出的水印短语用于语音合成,目前选择 Rachel 声线。

两层音频在浏览器中组合,并非通过 OpenAI 图片或视频模型生成。这里明确展示代码请求的音乐版本,即使供应商之后调整内部实现;这不构成对特定结果或持续可用性的保证。

声音克隆与克隆水印

声音克隆工具通过 Kie.ai 使用 Suno Voice:

  1. 提交的声音样本会上传至 Kie.ai 的文件处理基础设施,通过 ai-music-api/validation-phrase 获取验证短句。
  2. 独立验证录音、声音名称及验证任务引用会发送至 ai-music-api/create-voice 创建声音档案。该档案接口在本接入中没有披露独立模型发布版本。
  3. 生成旋律化或演唱型水印时,将短语、风格及供应商返回的声音 ID 发送至 ai-music-api/generate,请求 Suno V6,并使用 voice_persona。

创建声音档案与生成水印是两次独立的付费操作,目前各需 5 积分。发音、旋律及相似度可能变化;验证只是处理检查,不证明每一种用途都获得合法授权。仅可提交本人声音或说话人明确授权的录音。

数据、权利与限制

微软接收普通语音水印的文本及声线选择。Kie.ai 接收音乐或克隆流程所需的提示词、短语、录音及标识,并可能将请求交给相应上游服务。本站账号数据库保存必要任务、声音档案、授权确认及账单记录,生成音频也可能保存在浏览器本地作品库中。详情及删除限制见隐私政策。

我们不笼统承诺上游供应商绝不留存数据或用于其自身用途,其处理适用各自条款与实践。未经必要许可,不要提交保密录音或他人的声音。如对留存、训练用途或数据所在地有特定要求,请先联系 support@producertag.org 再提交。

这些公开音频流程不使用图片生成、照片动画或视频模型。供应商拥有更广泛的模型目录,不代表本站已启用其中的模型。结果必须符合内容规范;功能可用不等于获得商业授权,也不能替代发布前审核。

供应商文档

模型系列及接口术语可在 Kie.ai 文档索引、Suno 生成文档及 ElevenLabs Multilingual v2 文档核对。外部页面介绍供应商的能力,本站实际使用范围以上文的具体接入为准。