Humor ArenaBenchmarks
Все модели

OpenAI

GPT-5.6 Luna (Medium)

Точная версия: 5.6-luna-reasoning-medium

Опубликованные результаты

Режимы оцениваются отдельно. Сходимость общего расчёта и дату снимка проверяйте в бенчмарках.

Обычный юмор

Место 9 · Рейтинг 1 229,98 95%: 1 193,28–1 266,53

Доля побед 53,61% 95%: 51,53%–55,68%2 216 сравнений

Чёрный юмор · 18+

Место 14 · Рейтинг 1 157,19 95%: -2 400,04–1 688,43

Доля побед 45,16% 95%: 29,16%–62,23%31 сравнений

Предварительный результат

Разведочные срезы

Категорийные показатели описательные и не заменяют общий рейтинг.

Situational caption: 16,67% побед, 3 сравнений · разведочный срез.

Short observation: 50% побед, 9 сравнений · разведочный срез.

Witty reply: 40,91% побед, 11 сравнений · разведочный срез.

Setup continuation: 85,71% побед, 7 сравнений · разведочный срез.

Сохранённый снимок от 2026-09-13T00:05:47.311Z. Проверяем обновления…