Ssylka

Являются ли большие языковые модели дислексичными?

Люди и современные ИИ могут сталкиваться с похожими проблемами при обработке пространственной информации, когда традиционные культурные стандарты расходятся с их внутренними механизмами восприятия.
Являются ли большие языковые модели дислексичными?
Изображение носит иллюстративный характер

Личный опыт дислексии иллюстрирует запутанность в направлениях: в автомобиле случалась ситуация, когда вместо поворота налево совершался поворот направо – «Я сказал: влево!». При этом очевидно умение различать такие направления, как вверх и вниз или контрасты вроде чёрного и белого, не компенсирует затруднения в определении левого и правого.

Уже в школьные годы возникают трудности: буквы «b» и «d» выглядят схоже, хотя одна направлена влево, а другая – вправо, а алгебра и физика требуют последовательности действий, зависящей от левосторонних и правосторонних ориентиров. Вспоминается случай из первого курса в Стэнфорде, когда вместо «правого правила» использовалась левая рука. В то время как типичное представление о «внутреннем взоре» предполагает фиксированную перспективу за мостиком носа, у дислексиков образы воспринимаются как туманные облака, охватывающие всё пространство.

Подобные трудности наблюдаются и у мультимодальных больших языковых моделей. Недавнее исследование показало, что при чтении времени с аналогичных часов GPT-4o правильно определял время лишь в 8% случаев, Claude-3-5-sonnet – в 6%, а Gemini 2.0 достиг лучшего результата – 20%. Аналогичные проблемы возникают и при интерпретации календарей, где неустойчивость пространственных ориентиров приводит к ошибкам.

Контрастным примером служит исследование 2023 года, где 240 участников оценивали количество шариков в банке с ошибкой в 55%, тогда как ChatGPT 4 демонстрировал 42% погрешности. Несмотря на успехи в решении сложных задач по визуальному пространственному анализу, ИИ испытывают затруднения именно при выполнении традиционных культурных стандартов, таких как чтение часов.

В основе ошибок может лежать неоднозначная обработка пространственной информации: и люди-дислексики, и искусственный интеллект могут «видеть» циферблат, оценивая расстояние от цифры «2», что приводит к путанице между движением по часовой стрелке и против неё.

Особенности дислексии зачастую являются не только проблемой, но и источником творческого мышления. Исследования показывают, что дети с дислексией достигают значительно более высоких результатов в тестах на креативность, а многие взрослые профессионалы, благодаря уникальному способу восприятия, добиваются успехов в науке, искусстве, кино, литературе и спорте. Личный опыт, подтверждённый участием в разработке первого смешанного режима реальности совместно с Human Sensory Feedback Group в Исследовательской лаборатории ВВС, привёл к дальнейшей работе в VR, AR и AI.

Анализ различий в обработке визуальной и пространственной информации между человеческим восприятием и алгоритмами ИИ подчёркивает необходимость учитывать альтернативные когнитивные стратегии при решении задач, требующих жёстко закреплённой ориентации. Эти наблюдения позволяют глубже понять как ограничения, так и потенциал новых подходов в создании эффективных систем искусственного интеллекта.


Новое на сайте

19019Действительно ли «зомби-клетки» провоцируют самую распространенную форму эпилепсии и... 19018Генетический анализ мумий гепардов из саудовской Аравии открыл путь к возрождению... 19017Вредоносная кампания в Chrome перехватывает управление HR-системами и блокирует... 19016Глубоководные оползни раскрыли историю мегаземлетрясений зоны Каскадия за 7500 лет 19015Насколько глубоки ваши познания об эволюции и происхождении человека? 19014Как уязвимость CodeBreach в AWS CodeBuild могла привести к глобальной атаке через ошибку... 19013Затерянный фрагмент древней плиты пионер меняет карту сейсмических угроз Калифорнии 19012Генетические мутации вызывают слепоту менее чем в 30% случаев вопреки прежним прогнозам 19011Завершено строительство космического телескопа Nancy Grace Roman для поиска ста тысяч... 19010Вязкость пространства и фононы вакуума как разгадка аномалий расширения вселенной 19009Приведет ли массовое плодоношение дерева Риму к рекордному росту популяции какапо? 19008Как уязвимость CVE-2026-23550 в плагине Modular DS позволяет захватить управление сайтом? 19007Может ли уличная драка французского авантюриста раскрыть кризис американского гражданства... 19006Может ли один клик по легитимной ссылке заставить Microsoft Copilot и другие ИИ тайно... 19005Утрата истинного мастерства в эпоху алгоритмов и скрытые механизмы человеческого...