НОВОСТИ

  • Рекомендации по выбору тарифов GPT-6: избегайте режима low, extra high — оптимальный баланс

    Анализ официальных графиков производительности линейки GPT-6 выявил неочевидные закономерности, важные для разработчиков и компаний.

    Основные выводы

    • Режим low не рекомендуется ни для одной модели: прирост качества при переходе на medium колоссален, а стоимость растёт незначительно.
    • Extra high — точка наилучшего соотношения цены и качества для Astra и Sol. Даёт заметный прирост по сравнению с high при умеренном повышении цены.
    • Режим max часто хуже extra high: наблюдается регрессия качества (вероятно, из-за «передумывания» модели).
    • GPT-6 Sol на medium ≈ GPT-5.6 на extra high: средний тариф нового поколения превосходит прежний флагман на максимальных настройках.
    • Astra low устарел: Sol на extra high превосходит его по качеству при лучшей цене, поэтому нет причин использовать Astra low.

    Странности зафиксированы и у Luna: на тесте Automation Bench режим high даёт лучший результат, чем extra high.

    Главный скачок качества происходит при переходе от low к medium. Дальше кривая выгоды выравнивается, а на max качество может падать.

  • OpenAI представила линейку GPT-6 Sol и Luna: фокус на соотношении цена/качество

    Параллельно с Opus 5.5 компания OpenAI анонсировала два новых модели — GPT-6 Sol и GPT-6 Luna. В отличие от флагманского GPT-6 Astra, новая линейка позиционируется как решение для массового использования с оптимальным балансом производительности и стоимости.

    Ценообразование

    • GPT-6 Sol: $2 за 1 млн входных / $10 за 1 млн выходных токенов — в два раза дешевле Opus 5.5.
    • GPT-6 Luna: ~1/20 стоимости Sol (примерно $0,10 в / $0,50 вых) — ультрабюджетный вариант.

    Производительность моделей GPT-6 в тесте Automation Bench

    Соотношение качества и стоимости на логарифмической шкале выглядит так:

    • GPT-6 Astra — лидер по качеству: около 40–45% при стоимости порядка $1,50.
    • GPT-6 Sol — около 35% качества за $0,20. Это примерно в семь раз дешевле Astra при сохранении около 90% её производительности.
    • GPT-6 Luna — около 20% качества за $0,01–0,02.

    Для 80–90% задач уровня Sol вполне достаточно, поэтому обращаться к более дорогой Astra нужно лишь в исключительных случаях.

  • Anthropic выпустила Opus 5.5: превосходит Fable 5.1 по качеству при половине стоимости

    Компания Anthropic представила новую версию флагманской модели — Opus 5.5. По данным бенчмарков, модель демонстрирует качество, сопоставимое с Fable 5.1, либо немного превосходит её, при этом стоимость использования составляет 50–60% от цены конкурента.

    Ключевые показатели

    • Agentic Coding Bench: 66,4% — лидирующий результат, опережающий Fable 5.1 и сравнимый с GPT-6 Astra.
    • Computer Use (визуальное распознавание интерфейсов): 89% по новому тесту «chartography» — значительный скачок по сравнению с Opus 5.0 и линейкой Fable.
    • Цена: $4 за 1 млн входных токенов и $20 за 1 млн выходных — в два раза дешевле Opus 5 и GPT-6 Astra.

    Новые возможности

    Модель проявила сильные навыки в пространственном мышлении и JavaScript. Пользователи создают на ней процедурные анимации и интерактивные визуализации, полностью написанные кодом — без участия видео-моделей. Примеры: генерация сложных движений, «построение Skyrim» по запросу, визуализация данных в реальном времени.

    Opus 5.5 не умеет генерировать видео напрямую, но может написать JavaScript-код, который рисует кадр за кадром любую анимацию.

    Это приближает момент когда рутинные задачи аниматоров и процедурных дизайнеров могут быть автоматизированы.