TTSFM:免费OpenAI兼容文本转语音服务,11种语音+6种格式全解析
TTSFM免费OpenAI兼容文本转语音服务11种语音6种格式全解析【免费下载链接】ttsfmTTSFM mirrors OpenAIs TTS service, providing a compatible interface for text-to-speech conversion with multiple voice options for free.项目地址: https://gitcode.com/gh_mirrors/tt/ttsfmTTSFM是一款免费的OpenAI兼容文本转语音API服务基于OpenAI的GPT-4o mini TTS技术提供完整的文本到自然语音转换解决方案。它构建在openai.fm后端之上提供强大的Python SDK、RESTful API端点和直观的Web playground让文本转语音功能的测试和集成变得简单高效。 TTSFM核心功能亮点TTSFM作为一款功能全面的文本转语音工具具备以下核心特性丰富语音选择提供11种OpenAI兼容语音alloy、ash、ballad、coral、echo、fable、nova、onyx、sage、shimmer、verse多样音频格式支持6种音频输出格式MP3、WAV、OPUS、AAC、FLAC、PCM灵活速度控制播放速度可在0.25x到4.0x之间调节满足不同场景需求长文本支持自动文本分割和音频合并轻松处理任意长度的内容实时流传输WebSocket支持实现音频生成的实时流式传输多端易用性提供Python SDK同步和异步客户端、CLI工具和Web交互界面便捷部署预构建Docker镜像支持快速部署和使用 11种语音特性全解析TTSFM提供11种各具特色的语音选项满足不同场景和偏好需求语音名称特点描述适用场景alloy中性、清晰的美式英语男声通用内容、技术文档ash温和、自然的美式英语女声故事讲述、播客ballad富有情感的抒情男声诗歌、情感内容coral活泼、年轻的女声儿童内容、教育材料echo低沉、有磁性的男声旁白、纪录片fable温暖、亲切的女声有声书、童话nova明亮、清晰的女声新闻播报、信息传递onyx深沉、有力的男声演讲、正式场合sage稳重、知性的女声教育内容、培训材料shimmer甜美、柔和的女声广告、促销内容verse富有韵律感的男声诗歌朗诵、押韵内容这些语音选项通过ttsfm/models.py文件中的Voice枚举类定义确保与OpenAI API的兼容性。 6种音频格式对比与应用TTSFM支持6种常用音频格式各有其特点和适用场景MP3最常用的压缩音频格式文件小且兼容性好适合大多数应用场景WAV无损音频格式质量高但文件较大适合需要编辑或高质量播放的场景OPUS高效压缩的音频格式适合网络传输和流媒体应用AAC常用于移动设备和视频中的音频格式平衡质量和文件大小FLAC无损压缩格式保留原始音频质量适合音乐类内容PCM原始音频数据无压缩适合专业音频处理格式支持通过ttsfm/models.py中的AudioFormat枚举类实现并通过ffmpeg进行格式转换处理。 快速开始使用指南安装方式Python包安装pip install ttsfm # 核心客户端 pip install ttsfm[web] # 核心客户端 Web/服务器依赖Docker镜像部署TTSFM提供两种Docker镜像变体以满足不同需求完整变体推荐docker run -p 8000:8000 dbcccc/ttsfm:latest包含ffmpeg支持所有高级功能全部6种音频格式速度调节0.25x - 4.0x格式转换长文本MP3和WAV自动合并精简变体 - ~100MBdocker run -p 8000:8000 dbcccc/ttsfm:slim最小化镜像不含ffmpeg基础TTS功能仅支持2种音频格式MP3、WAV长文本WAV自动合并无速度调节和格式转换功能简单使用示例Python客户端from ttsfm import TTSClient, AudioFormat, Voice client TTSClient() # 基本使用 response client.generate_speech( textHello from TTSFM!, voiceVoice.ALLOY, response_formatAudioFormat.MP3, ) response.save_to_file(hello) # 保存为 hello.mp3 # 带速度调节需要完整镜像 response client.generate_speech( textThis will be faster!, voiceVoice.NOVA, response_formatAudioFormat.MP3, speed1.5, # 1.5倍速度0.25 - 4.0范围 ) response.save_to_file(fast) # 保存为 fast.mp3命令行工具ttsfm Hello, world --voice nova --format mp3 --output hello.mp3REST APIOpenAI兼容# 基本请求 curl -X POST http://localhost:8000/v1/audio/speech \ -H Content-Type: application/json \ -d { model: tts-1, input: Hello world!, voice: alloy, response_format: mp3 } --output speech.mp3 深入了解与资源完整API参考和操作说明可在Web文档中查看或参见ttsfm-web/templates/docs.html架构概述和组件图可参考docs/architecture.md贡献指南请参阅CONTRIBUTING.mdTTSFM以MIT许可证发布详情请见LICENSE文件。注意本项目仅供教育和研究目的使用是openai.fm服务的逆向工程实现不应用于商业目的或生产环境。用户负责确保遵守适用法律和服务条款。【免费下载链接】ttsfmTTSFM mirrors OpenAIs TTS service, providing a compatible interface for text-to-speech conversion with multiple voice options for free.项目地址: https://gitcode.com/gh_mirrors/tt/ttsfm创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考