شروع به کار با هوش مصنوعی Microsoft
Microsoft یکی از بزرگترین شرکتهای فناوری جهان است که در حوزههایی مانند سیستمعامل، نرمافزارهای سازمانی، رایانش ابری، ابزارهای توسعه و هوش مصنوعی فعالیت میکند. محصولات شناختهشده این شرکت شامل Windows , Microsoft 365 , GitHub و Azure هستند و بخش مهمی از زیرساخت هوش مصنوعی آن نیز از طریق Microsoft Foundry و Azure ارائه میشود. مایکروسافت علاوه بر مدلهای اختصاصی خود مانند خانواده MAI و Phi، دسترسی به مجموعه گستردهای از مدلهای هوش مصنوعی شرکتهای دیگر را نیز در پلتفرم ابری خود فراهم میکند.
در حال حاضر، لیارا، مدلهای زیر از Microsoft را در API خود پشتیبانی میکند:
- مدل microsoft/mai-voice-2
- مدل microsoft/mai-voice-2-flash
- مدل microsoft/mai-transcribe-1.5
- مدل microsoft/mai-transcribe-2
پس از ایجاد سرویس هوش مصنوعی و دریافت baseUrl و ساخت کلید، میتوانید از مدلهای Microsoft استفاده کنید.
اتصال به مدل های تبدیل متن به گفتار (TTS)
برای کار با مدلهای TTS میتوانید از ماژول openai استفاده کنید. در ادامه، مثالهای استفاده از مدلهای TTS آمده است:
پروژه کامل قطعه کد فوق در گیتهاب لیارا قابل مشاهده و استفاده است.
در قطعه کدهای فوق، بهجای BASE_URL، آدرس سرویس هوش مصنوعی خود را قرار دهید و بهجای LIARA_API_KEY، کلید API خود را وارد کنید. همچنین، بهجای TTS_MODEL_NAME، نام یکی از مدلهای TTS و بهجای TTS_VOICE، نام Voice موردنظر را قرار دهید.
مقادیر قابل استفاده به عنوان متغیر TTS_VOICE
TTS_VOICE یک پارامتر در مدلهای TTS است که مشخص میکند مدل هوش مصنوعی با چه صدای از پیش تعریفشدهای متن را به گفتار تبدیل کند. هر Voice یک پروفایل صوتی مستقل است که ویژگیهایی مثل جنسیت صدا، لحن (Tone)، سرعت، حس بیان (Emotion)، لهجه و سبک صحبت کردن را تعیین میکند.
در حال حاضر، میتوانید مقدار متغیر TTS_VOICE را برای مدلهای مذکور، با مقادیر زیر پر کنید (بعد از # یکسری توضیحات راجع به هر Voice قرار گرفته است).
اتصال به مدل های تبدیل گفتار به متن (STT)
برای کار با مدلهای TTS میتوانید از ماژول openai استفاده کنید. در ادامه، مثالهای استفاده از مدلهای TTS آمده است:
پروژه کامل قطعه کد فوق در گیتهاب لیارا قابل مشاهده و استفاده است.
در قطعه کدهای فوق، بهجای BASE_URL، آدرس سرویس هوش مصنوعی خود را قرار دهید و بهجای LIARA_API_KEY، کلید API خود را وارد کنید. همچنین، بهجای STT_MODEL_NAME، نام مدل STT و بهجای AUDIO_FILE، نام یا مسیر فایل صوتی موردنظر برای تبدیل گفتار به متن را قرار دهید.



