OpenAI مدل ترجمه real-time را راهاندازی کرد: شکستن موانع زبانی فوری
by needhelp
openai
translation
speech-to-speech
api
real-time-ai
عصر جدیدی برای ارتباطات بینزبانی
در ۷ می ۲۰۲۶، OpenAI یک مدل پیشگامانه ترجمه گفتار-به-گفتار real-time را رونمایی کرد که وعده میدهد نحوه ارتباط انسانها در سراسر زبانها را اساساً تغییر دهد. برخلاف pipelineهای ترجمه قبلی که ASR، MT و TTS را زنجیر میکردند، این مدل جدید ترجمه مستقیم گفتار-به-گفتار را در یک معماری یکپارچه انجام میدهد و به تأخیر end-to-end زیر ۳۰۰ میلیثانیه میرسد.
نتیجه ترجمه تقریباً آنی است که در مکالمه طبیعی به نظر میرسد. دو نفر که به زبانهای مختلف صحبت میکنند حالا میتوانند با تقریباً همان ریتم یک مکالمه بین دو گوینده بومی یک زبان صحبت کنند.
API: آماده برای توسعهدهندگان
curl https://api.openai.com/v1/audio/translations \ -H "Authorization: Bearer $OPENAI_API_KEY" \ -H "Content-Type: multipart/form-data" \ -F "audio=@conversation.wav" \ -F "source_language=ja" \ -F "target_language=en" \ -F "mode=streaming" \ -F "voice_preservation=true" \ -o translated_audio.wavAPI از حالتهای streaming، batch و simultaneous پشتیبانی میکند.
تأثیر صنعتی
| صنعت | مورد استفاده | تحول |
|---|---|---|
| پشتیبانی مشتری | مراکز تماس چندزبانه | یک تیم میتواند به پایگاه مشتری جهانی خدمت کند |
| بهداشت و درمان | ارتباط دکتر-بیمار | حذف نیاز به مترجم پزشکی |
| آموزش | کلاسهای جهانی | دورهها با صدای ترجمهشده real-time |
| سفر | اطلاعات real-time | چکاین هتل، سفارش رستوران بدون اصطکاک |
| سازمانی | جلسات بینالمللی | بدون نیاز به مترجم حرفهای برای ارتباط روزمره |