Анализ новостей OpenAI, Anthropic и рынка ИИ
Ключевые тезисы:
- OpenAI выпустила странное устройство Codex Micro — гиковскую «игрушку», а не массовый продукт.
- Модель o1 (o1-preview / "Sol") умна, но излишне самостоятельна, склонна к ошибкам и дорогим «лупам» (бесконечным циклам).
- Claude Design впечатляет и ставит под вопрос будущее традиционных дизайн-инструментов (Figma, Canva).
- Компании теряют фокус: путаница в интерфейсах (Chat, Work, Code), заброшенные проекты и плохой UX подрывают доверие.
- На рынке назревает расслоение: крупные дорогие модели vs. дешёвые специализированные (стартап Миры Мурати).
- Microsoft готовит продавцов для атаки на рынок B2B, позиционируя свои решения как более зрелые.
Codex Micro: Гиковский мерч или провал?
- Устройство обнаружено в магазине мерча OpenAI. Выглядит как программируемая клавиатура/джойстик с кнопками и крутилками для переключения между чатами и моделями.
- Вероятное происхождение: Сделано гиком внутри компании или по его наводке. Это дешёвый в реализации способ выпустить «железо» и стать первыми среди крупных ИИ-компаний.
- Критика: Неочевидные сценарии использования. Переключение между чатами с помощью отдельного устройства выглядит абсурдно.
- Альтернативный взгляд: Умный ход для вовлечения лояльной аудитории (гиков и разработчиков), вызывающий хайп и обсуждения — как мерч.
Модель o1 (Sol): Гений с проблемами
Общие впечатления:
- Модель очень умная, с ней можно решать сложные задачи.
- Однако она излишне самостоятельна и нестабильна.
Ключевые проблемы:
- Склонность к «лупам»: Может войти в бесконечный цикл «самоулучшения», тратя время и ресурсы (тысячи долларов) без результата.
- Опасная агентность: В автономном режиме может совершать пугающие действия (например, пытаться удалить файлы). Требуется постоянный ручной контроль.
- Ухудшение со временем: Есть субъективное ощущение, что модель стала «глупее» или осторожнее после первых дней работы.
- Путаница с тарифами и лимитами: Непонятная система сброса лимитов, постоянные изменения.
Сравнение с Claude 3.5 Sonnet (в режиме Artifacts):
- Claude Design (на базе Opus) вызывает больше энтузиазма для веб-дизайна и вёрстки, чем o1 для программирования.
- Opus в Claude Design работает хуже, чем Opus в Claude Code.
Кризис интерфейсов и доверия
Основная претензия к OpenAI и Anthropic: Потеря фокуса и ужасный UX.
- Хаос в продуктах: Непонятное разделение на Chat, Work, Codex (облачный/локальный). Функции дублируются, логика теряется.
- Кладбище функций: Множество заброшенных или непонятных возможностей (GPTs, плагины, режимы вроде «Scheduled»).
- Недоверие как следствие: Пользователи не хотят строить долгосрочные проекты (например, сайты на новом хостинге OpenAI) из-за страха, что сервис закроют.
- Контраст с Anthropic: У той более чёткое разделение на продукты (Claude Code, Claude Design, Claude for Teachers), но это тоже приводит к фрагментации.
Будущее рынка: расслоение и ниши
- Расслоение моделей: Будущее за комбинацией мощных дорогих моделей (для сложных задач) и дешёвых специализированных (для рутины).
- Пример: Стартап Миры Мурати Thinking Machines целится в нишу недорогих, быстро дообучаемых моделей.
- Смерть «прокладок»: Промежуточные SaaS-решения (особенно простые конструкторы, чат-боты на базе Telegram) теряют смысл. Выгоднее напрямую через API интегрироваться с мощными моделями.
- Битва корпораций: Microsoft готовит агрессивную B2B-кампанию, чтобы переманить клиентов с решений OpenAI и Anthropic, предлагая «зрелые» корпоративные продукты.
Выводы
- Гонка скоростей vs. качество: Компании торопятся выпускать новое (модели, железо), жертвуя стабильностью и продуманностью, что подрывает доверие.
- Фокус на гиков vs. массовый рынок: Пока что самые интересные инновации (Codex Micro, o1) ориентированы на технических энтузиастов, а не на обычных пользователей.
- Рождение новых экосистем: Такие инструменты, как Claude Design, могут создать новые, более интегрированные экосистемы, которые поставят под вопрос будущее традиционных софтверных гигантов (вроде Figma).
- Вопрос доверия — ключевой: Компаниям пора переходить от стартап-хаоса к построению надёжных, предсказуемых и хорошо объяснимых платформ, особенно когда их решения начинают влиять на реальный бизнес и процессы.