5. Другой уровень.
— Terminal-Bench 2.0: 82.7% vs 75.1% у GPT-5.4
— SWE-Bench Pro: 58.6% — реальные GitHub-задачи с первого прохода
— FrontierMath Tier 4: 35.4% vs 27.1%
— Скорость не упала. Токенов тратит меньше.
Главное...
23 Apr
🤯 OpenAI выпустили GPT-5
23 Apr
🤯 OpenAI выпустили GPT-5

5. Другой уровень.
— Terminal-Bench 2.0: 82.7% vs 75.1% у GPT-5.4
— SWE-Bench Pro: 58.6% — реальные GitHub-задачи с первого прохода
— FrontierMath Tier 4: 35.4% vs 27.1%
— Скорость не упала. Токенов тратит меньше.
Главное...