Google представил ИИ-синхронный перевод для Google Meet
На конференции Google I/O 2025 вчера представлена новая функция Google Meet: ИИ-переводчик, который в реальном времени переводит речь собеседника, сохраняя его голос, интонации и эмоциональную окраску. Технология, основанная на модели Gemini от DeepMind, уже доступна в бета-версии для подписчиков AI Pro и AI Ultra.
Это реальный аудио-аудио перевод с минимальной задержкой. Собеседник слышит перевод на свой язык - но голосом, тембром и интонацией собеседника - синтез речи работает на модели AudioLM, способной воспроизводить естественные речевые особенности.
Посмотрите видео - там две собеседницы общаются в Google Meet - одна на английском, а другая на испанском языке, и каждая слышит перевод на своем языке, он наложен на оригинальную речь, и задержка буквально 2-3 секунды. Правда, разработчики говорят, что технология еще несовершенна, и задержка может быть больше, и ошибки в контенте неизбежны, но уже выглядит впечатляюще.
Пока поддерживаются только английский и испанский языки, но в ближайшие недели планируется добавить итальянский, немецкий и португальский (для использования функции достаточно, чтобы хотя бы один участник видеозвонка был подписчиком AI Pro или Ultra).
Пока нет адаптации для тональных языков (того же китайского или вьетнамского, где интонация влияет на смысл), но для европейских языков скоро переговоры не будут проблемой. Иврит пока не заявлен, арабский есть в списке на ближайший год, но хотелось бы еще узбекский, таджикский, грузинский, казахский и прочие языки стран, пациенты которых ездят между странами и обращаются за телемедициной.
Ну и в целом в перспективе такая технология может существенно изменить способы коммуникации и в медицине, и в бизнесе, особенно если доучить модель специальной терминологии.
#ИИновости #ИИперевод #ИИвмедицине
👉 Подписаться на ИИ в медицине
Post #1228
2.37K