Сравнение Qwen 2.5 Coder и ChatGPT в задаче кодирования: поиск реальной экономии

Анализ производительности различных моделей Qwen 2.5 Coder и ChatGPT при конвертации кода в C показал, что модели Qwen с 3 млрд параметров не справляются с задачей, демонстрируя ошибки и неспособность исправить их даже после уточняющих запросов. Модели с 14 млрд параметров демонстрируют частичное понимание кода, но допускают ошибки в расчёте контрольной суммы.
Сравнение Qwen 2.5 Coder и ChatGPT в задаче кодирования: поиск реальной экономии
Изображение носит иллюстративный характер

Только модель Qwen 2.5 Coder с 32 млрд параметров в квантизации Q5_k_m достигает уровня, сравнимого с ChatGPT, исправив ошибку во втором запросе, но работает крайне медленно на мощном ПК. Квантизация Q4 ускоряет работу 32B модели, но снижает качество ответов.

Не специализированная модель Qwen2.5-72B-instruct, хотя и доступна онлайн, демонстрирует аналогичные ошибки, что и модели с 3 млрд параметров, что свидетельствует о недостатке специализированного обучения для задач кодирования.

Таким образом, на текущий момент, локальное использование моделей Qwen 2.5 Coder для экономии на подписке ChatGPT затруднительно из-за низкой производительности и нестабильности результатов. Для эффективной работы требуется более мощное оборудование, а не только специализированная модель.


Новое на сайте

19164Уязвимые обучающие приложения открывают доступ к облакам Fortune 500 для криптомайнинга 19163Почему ботнет SSHStalker успешно атакует Linux уязвимостями десятилетней давности? 19162Microsoft устранила шесть уязвимостей нулевого дня и анонсировала радикальные изменения в... 19161Эскалация цифровой угрозы: как IT-специалисты КНДР используют реальные личности для... 19160Скрытые потребности клиентов и преимущество наблюдения над опросами 19159Академическое фиаско Дороти Паркер в Лос-Анджелесе 19158Китайский шпионский фреймворк DKnife захватывает роутеры с 2019 года 19157Каким образом корейские детские хоры 1950-х годов превратили геополитику в музыку и... 19156Научная революция цвета в женской моде викторианской эпохи 19155Как новый сканер Microsoft обнаруживает «спящих агентов» в открытых моделях ИИ? 19154Как новая кампания DEADVAX использует файлы VHD для скрытой доставки трояна AsyncRAT? 19153Как новые китайские киберкампании взламывают госструктуры Юго-Восточной Азии? 19152Культ священного манго и закат эпохи хунвейбинов в маоистском Китае 19151Готовы ли вы к эре коэффициента адаптивности, когда IQ и EQ больше не гарантируют успех? 19150Иранская группировка RedKitten применяет сгенерированный нейросетями код для кибершпионажа
Ссылка