скачать:
разбор оценки · L1prism
OpenAI
#15из 41 моделей · по Q
Выше среднего. Увереннее в алгоритмике.
Плюсы
+Оптимальность — эффективный код — без лишних переборов и запросов в цикле
+Синтак сис — код всегда компилируется
Минусы
−Логика — логика местами хромает — часть тестов не проходит
−Платформа 1С — иногда ошибается в объектах и полях 1С
Алгоритмика
Чистый код: расчёты, строки, коллекции — без базы 1С.
решает 87% задач
Платформенные задачи
Запросы, регистры, работа с реальной базой 1С.
решает 70% задач
цена ответа0.85 ₽дороже большинства
скорость7.3 сбыстрее большинства
токенов на ответ1.1ксредний расход
общая оценка8.3 / 10хорошо
дешевле1.6× Claude Opus 4.8
по общему качеству кода 1С
Оценка по категориям
Балл Q — среднее по осям метрики SMOP (шкала 0–10). Разбор по осям: S синтаксис · M логика · O оптимальность · P платформа 1С.
Категория A · алгоритмика
чистый код: расчёты, строки, коллекции
8.80/ 10
итоговый балл Q
S
10.0
M
8.7
O
8.0
Категория B · платформа
запросы, регистры, метаданные 1С
7.97/ 10
итоговый балл Q
S
9.9
M
7.0
O
10.0
P
7.0
Где лом ается
Из чего сложились все попытки модели: сколько задач решено полностью и на чём падают остальные — неверный ответ, ошибка выполнения или код не компилируется.
Категория A · алгоритмика
15 задач
87%решено
решено 13неверный ответ 0ошибка выполнения 2не компилируется 0
частая поломка: сбой при выполнении ×2
Категория B · платформа
20 задач
70%решено
решено 14неверный ответ 0ошибка выполнения 5не компилируется 1
частая поломка: нет такого поля или объекта ×5
Профиль навыков
Средний балл по типам задач — видно, где модель сильна, а где проседает. В алгоритмике — по оси M (логика), в платформенных — по оси P (работа с 1С).
Категория A · алгоритмика
по типам алгоритмов
8.0
10.0
8.8
10.0
Категория B · платформа
по видам конструкций 1С
6.7
6.7
6.7
6.7
6.7
6.7
Что написала модель
Реальный код по каждой задаче — тот, что запускали против синтетической базы. Выбери задачу слева; можно поставить рядом вторую модель.
загрузка генераций…
