скачать:
разбор оценки · L1prism
Anthropic
#16из 41 моделей · по Q
Выше среднего. Увереннее в платформенных задачах.
Плюсы
+Оптимальность — эффективный код — без лишних переборов и запросов в цикле
+Платформа 1С — уверенно работает с объектами и метаданными 1С
+Синтаксис — код всегда компилируется
Минусы
−Логика — логика местами хромает — часть тестов не проходит (слабее на «строки»)
Алгоритмика
Чистый код: расчёты, строки, коллекции — без базы 1С.
решает 67% задач
Платформенные задачи
Запросы, регистры, работа с реальной базой 1С.
решает 80% задач
цена ответа0.70 ₽средняя цена
скорость10.4 ссредняя скорость
токенов на ответ1.1ксредний расход
общая оценка8.3 / 10хорошо
дешевле1.9× Claude Opus 4.8
по общему качеству кода 1С
Оценка по категориям
Балл Q — среднее по осям метрики SMOP (шкала 0–10). Разбор по осям: S синтаксис · M логика · O оптимальность · P платформа 1С.
Категория A · алгоритмика
чистый код: расчёты, строки, коллекции
7.88/ 10
итоговый балл Q
S
9.7
M
6.8
O
8.2
Категория B · платформа
запросы, регистры, метаданные 1С
8.63/ 10
итоговый балл Q
S
9.7
M
8.0
O
9.5
P
8.5
Где ломается
Из чего сложились все попытки модели: сколько задач решено полностью и на чём падают остальные — неверный ответ, ошибка выполнения или код не компилируется.
Категория A · алгоритмика
15 задач
67%решено
решено 10неверный ответ 0ошибка выполнения 4не компилируется 1
частая поломка: вызов несуществующего метода ×2
Категория B · платформа
20 задач
80%решено
решено 16неверный ответ 0ошибка выполнения 1не компилируется 3
частая поломка: ошибка синтаксиса ×3
Профиль навыков
Средний балл по типам задач — видно, где модель сильна, а где проседает. В алгоритмике — по оси M (логика), в платформенных — по оси P (работа с 1С).
Категория A · алгоритмика
по типам алгоритмов
4.5
7.5
7.7
6.0
Категория B · платформа
по видам конструкций 1С
10.0
6.7
10.0
6.7
6.7
10.0
Что написала модель
Реальный код по каждой задаче — тот, что запускали против синтетической базы. Выбери задачу слева; можно поставить рядом вторую модель.
загрузка генераций…
