شرکت OpenAI بهتازگی از دو مدل جدید و قدرتمند با نامهای GPT-transcribe و GPT-live-transcribe رونمایی کرده است. این مدلهای جدید بهطور اختصاصی برای پردازش دقیقتر و سریعتر صوت طراحی شدهاند.
مدل اول برای تبدیل متنِ فایلهای صوتی و مدل دوم برای ترنسکریپشن (تبدیل گفتار به نوشتار) بهصورت زنده و آنی بهینهسازی شدهاند. این یعنی دقتِ بالاتر و تأخیر کمتر در پروژههای مبتنی بر صدا! 🎙️✨
اگر برنامهنویس هستید یا در حوزه پردازش صوت فعالیت میکنید، پیشنهاد میکنم حتماً مستندات جدید را در وبسایت OpenAI بررسی کنید.
نویسی
منبع: Hacker News AI
