Этот конспект не сохранится

Закроешь вкладку — потеряешь. Зарегистрируйся — и он будет в библиотеке навсегда.

Telegram

Ваш конспект

YouTubeЧестный тест GPT 5.6: пора уходить с Claude?

🚀 Сравнение GPT 5.6 и Claude: тесты и вердикт

Ключевые тезисы:

  • OpenAI выпустила три новые модели GPT 5.6: Soul (флагман), Terra (средняя), Luna (быстрая и дешевая).
  • GPT 5.6 Soul напрямую конкурирует с Claude Fable, но стоит вдвое дешевле.
  • Модели стали эффективнее по токенам (делают ту же работу за меньший объем).
  • В тестах модели показали разные сильные стороны: GPT лучше в генерации изображений и дизайне, Claude — в некоторых аспектах кодинга и анализе багов.
  • Однозначного победителя нет — выбор зависит от конкретных задач.

🧠 Модели GPT 5.6

Вышло три модели:

  • GPT 5.6 Soul — флагманская, самая умная и дорогая. Для сложного кодинга, агентных задач, исследований.
  • GPT 5.6 Terra — средняя по качеству (как GPT 5.5), но вдвое дешевле.
  • GPT 5.6 Luna — самая быстрая и дешевая. Аналог Claude Haiku для простых задач.

Стоимость (за 1 млн токенов):

  • Soul: $5 (вход) / $30 (выход)
  • Terra: Вдвое дешевле Soul
  • Luna: $1
  • Claude Fable: $10 (вход) / $50 (выход) → вдвое дороже Soul

📊 Заявления OpenAI и мнение сообщества

  • Эффективность по токенам: Модели выполняют ту же работу, потребляя меньше токенов.
  • Бенчмарки по кодингу: Soul заняла первое место, немного обогнав Claude Fable. Однако в тестах на фикс реальных багов Claude набрал 80/100, а Soul — 65/100.
  • 💡 Мнение сообщества (из Telegram-канала):
    • GPT 5.6 «архитектурно мыслит неплохо», переосмысливает задачи.
    • На тарифе Pro «совсем другая песня» — ускоряет работу в разы.
    • Сильно умнее GPT 5.5 и, субъективно, «как будто и поумнее Fable».
    • Находит больше косяков в коде и лучше их аргументирует.
    • Продумывает сложные зависимые архитектуры и предлагает оптимизации.
    • ⚠️ Жрет много токенов (запускает сразу 2-3 субагента на задачи).
    • Для глубокого анализа лучше использовать очень высокий уровень рассуждения.

🧪 Практические тесты: 5 сценариев

🎨 1. Генерация красивого сайта «с нуля»

  • Промпт: «Сделай сайт уровня Awards».
  • Claude Fable: Создал сайт с анимациями, но не умеет генерировать изображения → использовал SVG-композиции. Результат: симпатично, но просто.
  • GPT (Codex): Сгенерировал полноценные изображения. Сайт получился с более проработанным визуалом, но со спорными элементами (горизонтальный скролл, странный шрифт).
  • ✅ Преимущество GPT: встроенная генерация изображений.

🏎️ 2. Создание сайта по дизайн-системе Tesla

  • Условие: Строго следовать предоставленному файлу дизайн-системы.
  • Claude Fable: Из-за отсутствия генерации изображений создал забавные примитивные иллюстрации, что испортило общее впечатление, хотя систему передал.
  • GPT: Сгенерировал качественные тематические изображения, получился гармоничный и премиальный лендинг.
  • 🏆 Победитель: GPT (визуальное превосходство).

📈 3. Создание презентации из объемного PDF

  • Задача: На основе 60-страничного доклада сделать стильную презентацию на 10-12 слайдов.
  • Claude Fable: Сделал ровную, четкую, легко редактируемую презентацию без визуальных излишеств.
  • GPT: Добавил графики и таблицы, визуально более проработанная.
  • ✅ Предпочтение автора: GPT (за визуальную составляющую).

🔍 4. Анализ конкурентов (стоматологии в Тюмени)

  • Задача: Найти клиники, проверить по чек-листу (сайт, скорость, цены, репутация по отзывам) и оформить в HTML-отчет.
  • GPT 5.6 (в браузере): Успешно справился: нашел клиники, проанализировал сайты и отзывы на Яндекс.Картах, сформировал отчет с рейтингом проблем.

🎮 5. Верстка 3D-браузерной игры (Fall Guys)

  • Цель: Создать игру с механиками Fall Guys.
  • Claude Fable: Визуально больше похоже на оригинал, меньше багов, но «дебильная» физика.
  • GPT: Прикольная заставка, но больше багов, странные модели персонажей.
  • 🏆 Победитель в этом тесте: Claude Fable (за меньшее количество багов и близость к оригиналу).

🎯 Итоговый вердикт

  • Однозначного победителя нет. Ситуация стала как «Месси или Роналду».
  • До выхода GPT 5.6 безоговорочным лидером был Claude.
  • Теперь модели находятся примерно на одном уровне, каждая со своими сильными сторонами:
    • GPT 5.6: Генерация изображений, работа с дизайном, визуализация данных.
    • Claude Fable: Возможно, лучше в анализе и исправлении багов в коде (по бенчмаркам), создании рабочих прототипов.
  • 💡 Важно: Мощная модель — не панацея. Для коммерческой работы необходимы также понимание структуры проектов, юридические знания, навыки продаж и работы с клиентами.
🤖 GPT 5.6 vs Claude: тесты и итоговый вердикт — конспект на EchoNote