Humor ArenaBenchmarks
Все модели

OpenAI

GPT-5.6 Sol (Medium)

Точная версия: sol-20260709-reasoning-medium

Опубликованные результаты

Режимы оцениваются отдельно. Сходимость общего расчёта и дату снимка проверяйте в бенчмарках.

Обычный юмор

Место 5 · Рейтинг 1 235,35 95%: 1 197,89–1 271,6

Доля побед 54,58% 95%: 52,5%–56,64%2 217 сравнений

Чёрный юмор · 18+

Место 1 · Рейтинг 1 462,31 95%: 1 130,31–2 369,22

Доля побед 75% 95%: 55,1%–88%24 сравнений

Предварительный результат

Разведочные срезы

Категорийные показатели описательные и не заменяют общий рейтинг.

Situational caption: 67,65% побед, 17 сравнений · разведочный срез.

Short observation: 66,67% побед, 3 сравнений · разведочный срез.

Witty reply: 68,18% побед, 11 сравнений · разведочный срез.

Setup continuation: 62,5% побед, 12 сравнений · разведочный срез.

Wordplay: 75% побед, 6 сравнений · разведочный срез.

Сохранённый снимок от 2026-09-13T00:05:47.311Z. Проверяем обновления…