Google представил Gemini 3.5 Transcribe

Google объявил о выпуске Gemini 3.5 Transcribe. Это новейшая модель для преобразования речи в текст. Компания называет её самой точной системой распознавания речи. Модель обрабатывает более 85 языков. Удаляет слова-паразиты. Различает до трёх говорящих. Доступ к модели уже предоставлен разработчикам.

Где доступна модель

Gemini 3.5 Transcribe доступна в приложении Gemini для macOS. Пока только на английском языке. Также в функции голосового ввода на Gboard для Android. В некоторых странах, включая Россию. Google отмечает лучшие результаты в тестах.

Умная транскрибация

Ключевая особенность — умная транскрибация. Модель не просто записывает речь. Она понимает контекст. Устраняет самокоррекции и слова-паразиты. Автоматически форматирует текст. Распознаёт жаргон и нестандартные выражения. Благодаря пользовательскому словарю. Поддерживает более 85 языков. Различает до трёх говорящих в одном аудиофайле.

Доступ для разработчиков

Разработчики получают доступ через Gemini API. В Google AI Studio. И на платформе Google Antigravity. Для корпоративных пользователей доступна Gemini Enterprise Agent Platform.

Планы на интеграцию в Chrome

Google планирует интегрировать модель в браузер Chrome. Это позволит диктовать текст голосом в любом веб-интерфейсе. Удобно для работы и повседневного использования.

Что будет дальше

Google продолжит развивать Gemini 3.5 Transcribe. Появятся новые языки и функции. Модель станет точнее и быстрее. Как результат, распознавание речи станет ещё доступнее.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Остались вопросы по работе? Задайте любой интересующий вопрос нашему специалисту.

Заказать звонок
Max
Telegram