Ssylka

Алгоритмы и мозг: расшифровка секретов речи

Недавнее исследование, опубликованное 7 марта в журнале Nature Human Behaviour, демонстрирует потенциал искусственного интеллекта в декодировании сложной мозговой активности, возникающей при повседневном общении.
Алгоритмы и мозг: расшифровка секретов речи
Изображение носит иллюстративный характер

Используемая модель Whisper преобразует аудиофайлы в текст посредством статистического сопоставления, не опираясь на заранее заданные языковые структуры, такие как фонемы или части речи. Несмотря на отсутствие явного программного обеспечения языковых признаков, модель самостоятельно выявляет сложные языковые паттерны.

Основной интерес исследования заключался в изучении механизмов человеческого восприятия и производства речи, а также в сопоставлении этих процессов с работой искусственных нейросетей. Ведущий автор исследования, Ариэль Голдштейн, отметил: «Результаты исследования свидетельствуют о том, что когнитивные процессы можно интерпретировать через призму статистических моделей».

Реальные данные для анализа были получены у четырех пациентов с эпилепсией, которым в рамках клинических показаний имплантировали от 104 до 255 электродов для мониторинга мозговой активности. Записи, охватывающие свыше 100 часов живой аудиокорреспонденции во время больничного пребывания, позволили изучить естественные процессы коммуникации вне лабораторных условий.

Анализ показал, что область верхней височной извилины активизируется при восприятии звуковой информации, в то время как нижняя лобная извилина отвечает за интерпретацию смысла. Наблюдалась четкая временная последовательность: сначала активировалась зона слухового восприятия, а затем – область смысловой обработки. Дополнительно отмечено, что некоторые участки мозга задействуются в функциях, не являющихся их основной специализацией, что подтверждает распределенную модель обработки информации.

Использование 80% записанного аудио для обучения модели Whisper позволило предсказывать мозговую активность для оставшихся 20% данных. Полученные результаты значительно превосходили показатели традиционных моделей, основанных на фиксированных языковых структурах, демонстрируя, что алгоритму удалось самостоятельно обнаружить и использовать ключевые языковые признаки.

Эксперты высоко оценили полученные данные. Леонард Шильбах из Мюнхенского центра нейронауки охарактеризовал исследование как прорыв, связывающий вычислительные модели преобразования звука в речь с функциями мозга, а ассоциированный профессор Гашпер Бегуш из Университета Калифорнии в Беркли подчеркнул, что сравнение биологических и искусственных нейронных сетей открывает новые перспективы в разработке экспериментальных методик.

Данное исследование демонстрирует, что современные языковые модели искусственного интеллекта способны не только эффективно обрабатывать речь, но и предоставлять уникальное окно в понимание нейронных механизмов человеческого общения, что может стать основой для усовершенствования технологий распознавания речи и создания вспомогательных коммуникационных устройств.


Новое на сайте

18884Знаете ли вы, что приматы появились до вымирания динозавров, и готовы ли проверить свои... 18883Четыреста колец в туманности эмбрион раскрыли тридцатилетнюю тайну звездной эволюции 18882Телескоп Джеймс Уэбб раскрыл тайны сверхэффективной звездной фабрики стрелец B2 18881Математический анализ истинного количества сквозных отверстий в человеческом теле 18880Почему даже элитные суперраспознаватели проваливают тесты на выявление дипфейков без... 18879Шесть легендарных древних городов и столиц империй, местоположение которых до сих пор... 18878Обзор самых необычных медицинских диагнозов и клинических случаев 2025 года 18877Критическая уязвимость CVE-2025-14847 в MongoDB открывает удаленный доступ к памяти... 18876Научное обоснование классификации солнца как желтого карлика класса G2V 18875Как безграничная преданность горным гориллам привела Дайан Фосси к жестокой гибели? 18874Новый родственник спинозавра из Таиланда меняет представления об эволюции хищников Азии 18873Как новая электрохимическая технология позволяет удвоить добычу водорода и снизить... 18872Могут ли ледяные гиганты Уран и Нептун на самом деле оказаться каменными? 18871Внедрение вредоносного кода в расширение Trust Wallet привело к хищению 7 миллионов... 18870Проверка клинического мышления на основе редких медицинских случаев 2025 года