OpenAI
GPT-5.6 Luna (Medium)
Точная версия: 5.6-luna-reasoning-medium
Опубликованные результаты
Режимы оцениваются отдельно. Сходимость общего расчёта и дату снимка проверяйте в бенчмарках.
Разведочные срезы
Категорийные показатели описательные и не заменяют общий рейтинг.
Situational caption: 16,67% побед, 3 сравнений · разведочный срез.
Short observation: 50% побед, 9 сравнений · разведочный срез.
Witty reply: 40,91% побед, 11 сравнений · разведочный срез.
Setup continuation: 85,71% побед, 7 сравнений · разведочный срез.
Сохранённый снимок от 2026-09-13T00:05:47.311Z. Проверяем обновления…