Ssylka

Современные тенденции и метрики качества машинного перевода

Машинный перевод прошел долгий путь развития от rule-based систем, основанных на лингвистических правилах, до статистических и нейронных подходов. Rule-based системы, несмотря на свою основательность, оказались сложными в масштабировании и адаптации к новым языкам, а также подвержены искажению смысла.
Современные тенденции и метрики качества машинного перевода
Изображение носит иллюстративный характер

Статистический машинный перевод (SMT) с использованием двуязычных корпусов стал следующим этапом, предложив более универсальный подход, но требующий огромных объемов данных. Современные системы машинного перевода, такие как Яндекс. Переводчик и Google Translate, перешли к нейронным моделям, делегируя задачи определения корректных форм и употреблений слов нейронным сетям, обученным на больших объемах текстов.

В последнее время наблюдается тенденция к использованию больших языковых моделей (LLM) для машинного перевода. LLM показывают неплохие результаты в общем машинном переводе и позволяют вносить корректировки в стилистику и другие особенности перевода. Однако LLM подвержены артефактам и галлюцинациям, а также требуют больших вычислительных ресурсов.

Оценка качества машинного перевода – сложная задача, поскольку содержит субъективную составляющую. Существуют референсные метрики, требующие наличия эталонного перевода для сравнения, и безреференсные метрики. Классические метрики, такие как BLEU и TER, подвергаются критике из-за своих конструктивных недостатков и слабой корреляции с экспертной оценкой. Нейронные метрики, такие как Comet, показывают более точные результаты, но также имеют свои ограничения, связанные с неинтерпретируемостью и доменоспецифичностью.


Новое на сайте

18604Является ли рекордная скидка на Garmin Instinct 3 Solar лучшим предложением ноября? 18603Могла ли детская смесь ByHeart вызвать национальную вспышку ботулизма? 18602Готовы ли банки доверить агентскому ИИ управление деньгами клиентов? 18601Как сезонные ветры создают миллионы загадочных полос на Марсе? 18600Как тело человека превращается в почву за 90 дней? 18599Как ваш iPhone может заменить паспорт при внутренних перелетах по США? 18598Мозговой шторм: что происходит, когда мозг отключается от усталости 18597Раскрыта асимметричная форма рождения сверхновой 18596Скидки Ninja: как получить идеальную корочку и сэкономить на доставке 18595Почему работа на нескольких работах становится новой нормой? 18594Записная книжка против нейросети: ценность медленного мышления 18593Растущая брешь в магнитном щите земли 18592Каким образом блокчейн-транзакции стали новым инструментом для кражи криптовалюты? 18591Что скрывается за ростом прибыли The Walt Disney Company? 18590Является ли ИИ-архитектура, имитирующая мозг, недостающим звеном на пути к AGI?