На главную

обработка речи

15 материалов по теме

OpenAI открыла полнодуплексный GPT‑Live‑1: ИИ теперь одновременно говорит и слушает

OpenAI открыла полнодуплексный GPT‑Live‑1: ИИ теперь одновременно говорит и слушает

OpenAI представила новую модель GPT‑Live‑1, способную вести диалог в реальном времени, обмениваясь голосом в обе стороны. Технология уже доступна разработчикам через API, открывая возможности для интерактивных приложений.

Сентябрь 2026: какие API‑сервисы выбрать — от Fable 5.1 до дешёвой Gemini Flash

Сентябрь 2026: какие API‑сервисы выбрать — от Fable 5.1 до дешёвой Gemini Flash

Новые версии моделей Fable, GPT‑6 Astra и Gemini 3.8 Flash вышли с разными тарифами. Разбираем, какие из них наиболее выгодны для разработки.

Microsoft запустила дешёвый сервис распознавания речи: 10 ¢/ч и в 10 раз быстрее решений OpenAI

Microsoft запустила дешёвый сервис распознавания речи: 10 ¢/ч и в 10 раз быстрее решений OpenAI

Новый инструмент от Microsoft обещает дешёвую и быструю расшифровку аудио. Стоимость обслуживания составляет десять центов за час, а скорость обработки в десятки раз превышает аналогичные предложения от OpenAI. Сервис ориентирован на разработчиков и корпоративных клиентов, которым важна эффективность и экономия.

Почему киты могут «превзойти» звук в воде: физики раскрыли механизм

Почему киты могут «превзойти» звук в воде: физики раскрыли механизм

Учёные из Пенсильванского университета обнаружили, что странные измерения скорости звука в записях китов объясняются отражением сигнала. Их выводы опубликованы в Physical Review E. Обычная теория относительности здесь не при чём.

Gemini Live выходит за пределы диалога: Android‑ассистент теперь исполняет команды

Gemini Live выходит за пределы диалога: Android‑ассистент теперь исполняет команды

Google расширил возможности Gemini Live, превратив его из простого чат‑бота в инструмент, способный выполнять действия в системе. На Android это значит управление приложениями, настройками и другими функциями по голосу. Пользователи получат более интерактивный опыт общения с ИИ.

Google Gemini: новая веха в истории ИИ

Google Gemini: новая веха в истории ИИ

Приложение Google Gemini набирает обороты и утверждает свое лидерство на рынке ИИ. Благодаря своей функциональности, оно стало неотъемлемой частью нашей жизни. Популярность приложения растет с каждым днем.

Умные мониторы от Asus

Умные мониторы от Asus

Новая функция управления яркостью мониторов Asus с помощью голоса или ИИ. Пользователи могут регулировать яркость с помощью голосовых команд или поручить эту задачу искусственному интеллекту.

Новый голосовой поиск от Google

Новый голосовой поиск от Google

Google обновляет голосовой поиск на Android, объединяя ИИ-режим, Search Live и поиск музыки. Это изменение направлено на улучшение пользовательского опыта. Обновление включает в себя новые функции и возможности.

Huawei представила новую модель openPangu 2.0 Pro

Huawei представила новую модель openPangu 2.0 Pro

Huawei представила новую модель openPangu 2.0 Pro, которая может конкурировать с другими известными моделями. Эта модель имеет ряд новых возможностей и улучшений. Huawei продолжает развивать свои технологии и предлагать новые решения на рынке.

Инвестиции в ИИ достигли трлн долларов

Инвестиции в ИИ достигли трлн долларов

Крупные технологические компании активно вкладывают средства в разработку искусственного интеллекта. Объем инвестиций уже превысил 1 трлн долларов. Это указывает на высокий интерес к потенциалу ИИ для бизнеса и общества.

Новое направление в общении с компьютерами

Новое направление в общении с компьютерами

Компания OpenAI планирует выпустить серию устройств, которые изменят способ взаимодействия людей с компьютерами. Это может стать новым этапом в развитии технологий.

Новые умные очки с ИИ и Wi-Fi

Новые умные очки с ИИ и Wi-Fi

Появились новые умные очки с поддержкой ИИ и точкой доступа Wi-Fi. Устройство стоит около 70 долларов и имеет интересный дизайн, вдохновленный Nokia Lumia.

Экономичные ИИ-модели от Microsoft

Экономичные ИИ-модели от Microsoft

Microsoft представила новые ИИ-модели для работы с изображениями и речью. Эти модели отличаются высокой эффективностью и экономичностью по сравнению с аналогами от OpenAI. Они предназначены для различных задач, включая обработку и анализ данных.

Anthropic расширяет возможности голосового режима

Anthropic расширяет возможности голосового режима

Anthropic открыла доступ к новому голосовому режиму, расширяя возможности своей модели. Это новое развитие в области машинного обучения и обработки речи.