Ssylka

DeepSeek-R1: размышляющие ИИ-модели нового поколения

DeepSeek-R1 – это семейство моделей, использующих парадигму рефлексии, для улучшения рассуждений. Главной особенностью является использование "<think>" токенов, которые отображают ход мыслей модели, перед выдачей конечного результата. Модели обучаются с помощью дистилляции, где большая модель обучает меньшую на синтетических данных. Это позволяет создавать модели меньшего размера, сохраняя при этом высокую производительность.
DeepSeek-R1: размышляющие ИИ-модели нового поколения
Изображение носит иллюстративный характер

DeepSeek-R1 превосходит другие модели в задачах, требующих рассуждения, благодаря «цепочке размышлений». Но это приводит к многословным ответам, которые могут содержать избыточную информацию о ходе рассуждения. Данная особенность, впрочем, может быть полезной в приложениях RAG (Retrieval Augmented Generation), где процесс рассуждения позволяет отследить, как модель извлекает информацию из контекста.

Особого внимания заслуживает 1.58-квантованная версия, требующая в 6 раз меньше памяти без потери качества. Тем не менее, для запуска самой большой модели, даже с механизмом MoE, потребуется значительный объем оперативной памяти. Рекомендовано использование LM Studio или Ollama для удобства запуска и тестирования.

Важно отметить, что, как и другие языковые модели, DeepSeek-R1 подвержена предвзятости, так как обучается на данных, предоставленных людьми. При этом открытый исходный код модели позволяет пользователям самостоятельно проверять и настраивать ее под свои нужды. Модель может быть запущена даже на компьютерах с низкими ресурсами, используя llama.cpp, и через API-сервер, совместимый с OpenAI.


Новое на сайте

18663Масштабная кампания ShadyPanda заразила миллионы браузеров через официальные обновления 18662Как помидорные бои и персонажи Pixar помогают лидерам превратить корпоративную культуру 18661Как астероид 2024 YR4 стал первой исторической проверкой системы планетарной защиты и... 18660Агентные ИИ-браузеры как троянский конь новой эры кибербезопасности 18659Многовековая история изучения приливов от античных гипотез до синтеза Исаака Ньютона 18658Как выглядела защита от солнца римских легионеров в Египте 1600 лет назад? 18657Хакеры ToddyCat обновили арсенал для тотального взлома Outlook и Microsoft 365 18656Асимметрия безопасности: почему многомиллионные вложения в инструменты детекции не... 18655Как безопасно использовать репозитории Chocolatey и Winget, не подвергая инфраструктуру... 18654Масштабная утечка конфиденциальных данных через популярные онлайн-форматеры кода 18653Как расширение списка жертв взлома Gainsight связано с запуском вымогателя ShinySp1d3r 18652Как расширение Crypto Copilot незаметно похищает средства пользователей Solana на... 18651Как обновление политик безопасности Microsoft Entra ID в 2026 году искоренит атаки 18650Архитектурная уязвимость Microsoft Teams позволяет хакерам отключать защиту Defender 18649Вторая волна червеобразной атаки Shai-Hulud прорвала защиту экосистем npm и Maven