شروع به کار با هوش مصنوعی Fish Audio
Fish Audio یک پلتفرم هوش مصنوعی صوتی است که روی تولید و پردازش صدا تمرکز دارد و سرویسهایی مثل تبدیل متن به گفتار (TTS)، تبدیل گفتار به متن (STT)، شبیهسازی صدا (Voice Cloning) و ساخت Voice Agent ارائه میکند.
در حال حاضر، لیارا، مدلهای زیر از Fish Audio را در API خود پشتیبانی میکند:
- مدل fish-audio/s2-pro
- مدل fish-audio/s1
- مدل fish-audio/transcribe-1
پس از ایجاد سرویس هوش مصنوعی و دریافت baseUrl و ساخت کلید، میتوانید از مدلهای Fish Audio استفاده کنید.
اتصال به مدل های تبدیل متن به گفتار (TTS)
برای کار با مدلهای TTS میتوانید از ماژول openai استفاده کنید. در ادامه، مثالهای استفاده از مدلهای TTS آمده است:
پروژه کامل قطعه کد فوق در گیتهاب لیارا قابل مشاهده و استفاده است.
در قطعه کدهای فوق، بهجای BASE_URL، آدرس سرویس هوش مصنوعی خود را قرار دهید و بهجای LIARA_API_KEY، کلید API خود را وارد کنید. همچنین، بهجای TTS_MODEL_NAME، نام یکی از مدلهای TTS را قرار دهید.
اتصال به مدل های تبدیل گفتار به متن (STT)
برای کار با مدلهای TTS میتوانید از ماژول openai استفاده کنید. در ادامه، مثالهای استفاده از مدلهای TTS آمده است:
پروژه کامل قطعه کد فوق در گیتهاب لیارا قابل مشاهده و استفاده است.
در قطعه کدهای فوق، بهجای BASE_URL، آدرس سرویس هوش مصنوعی خود را قرار دهید و بهجای LIARA_API_KEY، کلید API خود را وارد کنید. همچنین، بهجای STT_MODEL_NAME، نام مدل STT و بهجای AUDIO_FILE، نام یا مسیر فایل صوتی موردنظر برای تبدیل گفتار به متن را قرار دهید.



