Для многих пользователей именно ChatGPT стал первым знакомством с LLM — сервис привлёк огромную аудиторию практически сразу после запуска в 2022 году. Долгое время у него не было серьёзных конкурентов, пока в марте 2023-го Anthropic не выпустила Claude. С тех пор обе компании непрерывно улучшают модели и добавляют новые функции. Но поскольку возможности платформ во многом пересекаются — у обеих есть режим кодирования и отдельный рабочий режим — выбрать подходящий именно вам инструмент бывает непросто.

RixAiArt/ShutterstockИсточник изображения — engadget.com

В повседневных задачах разница между сервисами минимальна: любой из них подойдёт для написания кода, быстрых запросов, резюмирования документов, организации файлов и — если вдруг накатит вдохновение — для авторских колонок в стиле Германа Мелвилла.

А вот всё, что выходит за рамки рутины, требует более вдумчивого подхода: нужно понять, какая модель лучше соответствует именно вашему сценарию использования. И тут важно держать в голове одну оговорку: Claude и ChatGPT — это не отдельные модели, а продукты. Каждый запрос внутри может уходить к разным моделям и обвязке из инструментов, поэтому одни и те же слова «Claude» или «ChatGPT» на бесплатном и на топовом тарифе означают довольно разные вещи.

реклама кормит Уточку 🦆

Кто точнее — Claude или ChatGPT?

Измерить точность LLM непросто: однозначного ответа не существует, а на качество результата сильно влияют и конкретная модель, и сам запрос.

Среди флагманских моделей — Claude Fable 5 (Max) и GPT 5.6 Sol (Max) — Claude немного точнее, согласно бенчмарку AA-Omniscience Accuracy: 61 процент против 59 процентов соответственно. Разница настолько мала, что в повседневном использовании вы её вряд ли заметите. Независимый сводный индекс Artificial Analysis Intelligence Index рисует ту же картину — Fable 5 опережает Sol буквально на пункт, и доверительные интервалы этих оценок пересекаются, так что говорить об уверенной победе нельзя.

Но если вы не гонитесь за максимально мощными моделями, для большинства задач хватит среднего уровня: у Claude это Sonnet 5, у ChatGPT — 5.6 Terra. Здесь чаша весов склоняется в пользу ChatGPT: 5.6 Terra (Max) набирает 46 процентов, тогда как Claude Sonnet 5 (Max) — заметно меньше, всего 38 процентов.

Ещё один важный показатель точности — склонность модели к галлюцинациям. В идеале, если LLM не знает ответа, она должна прямо признать это, а не выдумывать информацию. За это отвечает бенчмарк AA-Omniscience Hallucination Rate, и здесь у Claude заметное преимущество: чем ниже балл, тем лучше. Claude Fable 5 набирает 55 процентов против 89 процентов у GPT 5.6 Sol. Разрыв ещё заметнее среди моделей среднего уровня: Claude Sonnet 5 показывает 37 процентов, тогда как ChatGPT 5.6 Terra — 85 процентов. Важно понимать механику: Claude достигает такого результата не тем, что «умнее» на каждом вопросе, а тем, что чаще отказывается отвечать, когда не уверен. Расплата за это — несколько процентных пунктов сырой точности. Для рискованных вопросов, где выдуманный ответ дороже честного «не знаю», такой размен обычно выгоден; для творческих задач он менее принципиален.

реклама кормит Уточку 🦆

Программирование: где сильнее каждый

Код — едва ли не самый частый рабочий сценарий для обеих платформ, и здесь однозначного победителя тоже нет. Результат раскалывается ровно по типу задачи, и каждая компания в своих материалах подсвечивает тот бенчмарк, где её модель сильнее.

  • SWE-bench Pro проверяет умение чинить реальные баги в существующих репозиториях: прочитать чужую кодовую базу, понять задачу из трекера и выдать рабочий патч. Это ближе всего к повседневной работе инженера — и здесь ведёт Fable 5 с результатом около 80 процентов. OpenAI собственную цифру Sol по этому тесту не публиковала, а по внешним оценкам она примерно на 15 пунктов ниже.
  • Terminal-Bench 2.1 оценивает работу в терминале: запуск команд, связывание инструментов, автономное доведение задачи до конца в оболочке. Это территория агентных сценариев, и здесь впереди GPT 5.6 Sol — около 89 процентов против примерно 83 у Fable 5.

Проще говоря: если ваша работа больше похожа на закрытие задач в живом репозитории — присмотритесь к Claude; если на управление терминалом и длинные агентные цепочки — к ChatGPT. Есть и второй слой: модель — это не весь инструмент. Вокруг GPT 5.6 Sol работает система Codex, вокруг Fable 5 — обвязка Claude Code, и в реальной разработке результат зависит от обоих слоёв. Одна и та же модель в разных «оболочках» может показывать заметно разные цифры, поэтому переносить бенчмарки напрямую на свой проект не стоит — надёжнее прогнать собственный тест на своих задачах.

Разнятся и деньги: по токенам Sol примерно вдвое дешевле Fable 5 на стандартной длине контекста, что для больших объёмов кодовой работы может перевесить разницу в паре процентов на бенчмарке. Правда, на очень длинных запросах у Sol включается надбавка за длинный контекст, и ценовое преимущество почти сходит на нет.

Контекст и длинные задачи

Обе флагманские модели в API работают с окном контекста порядка миллиона токенов при выводе до 128 тысяч — этого хватает, чтобы держать в поле зрения целую кодовую базу или объёмный набор документов. В обычном чате окно скромнее (около 200 тысяч токенов), так что для по-настоящему длинных материалов имеет смысл идти через API или профильные режимы. Claude при этом делает ставку на устойчивое удержание фокуса на очень длинных задачах, ChatGPT — на широту инструментов и по некоторым данным ещё больший запас по контексту. Для многочасовой автономной работы, где модель должна сама не терять нить, чаще выбирают Fable 5; для быстрого покрытия множества форматов в одном приложении — ChatGPT.

реклама кормит Уточку 🦆

Что умеет Claude, чего не умеет ChatGPT?

Есть разница и в том, для чего люди используют Claude и ChatGPT. Согласно отчёту Anthropic Economic Index за март 2026 года, 42 процента разговоров с Claude касались личного использования, а 45 процентов — работы (остальное пришлось на учебные задачи). Аналогичный отчёт OpenAI утверждает, что 70 процентов обращений к ChatGPT не связаны с работой.

Claude Cowork, выпущенный в январе 2026 года, умеет выполнять за пользователя задачи, основанные на знаниях, — например, наводить порядок в файлах. В нём можно создавать наборы инструкций — skills (навыки), которые вызываются прямо в разговоре с помощью слэша (/). Кроме того, Claude Artifacts мгновенно отображает фрагменты кода, одностраничные HTML-сайты, интерактивные React-компоненты и диаграммы — артефактами можно делиться и публиковать их в интернете.

ChatGPT тоже поддерживает skills, но реализация отличается: навыки ChatGPT доступны только отдельным пользователям в Codex и через API, а не в обычных чатах. Навыки Claude, напротив, можно использовать в чате, Claude Cowork и Claude Code. Эквивалент Artifacts в ChatGPT — Sites — рассчитан на бизнес-задачи и доступен только в Codex. При этом ChatGPT Sites не умеет получать живые данные, в отличие от Claude Artifacts, который делает это через подключённые приложения и коннекторы Model Context Protocol (MCP).

Есть функции, которые лучше реализованы у ChatGPT. В первую очередь это голосовой режим: ChatGPT звучит естественнее, и его можно перебивать и говорить поверх, не сбивая с мысли. Для помощи в реальном времени доступен режим живого видео Advanced Voice Mode — достаточно навести камеру на то, с чем возникла проблема. ChatGPT также умеет генерировать фотореалистичные изображения, тогда как Claude ограничивается диаграммами, графиками и интерактивной визуализацией на HTML и SVG.

Становится ли ChatGPT хуже в 2026 году?

Новые модели ChatGPT показывают результаты лучше предыдущих почти по всем бенчмаркам AA-Omniscience, однако общее впечатление от использования приложения, похоже, ухудшается. Если вам тоже так кажется — вам не показалось: есть области, где старые модели справлялись лучше новых.

Одна из таких областей — галлюцинации: тот же бенчмарк AA-Omniscience Hallucination Rate показывает, что у GPT-4o уровень галлюцинаций составлял 38 процентов против 89 процентов у GPT-5.6 Sol. OpenAI также добавила меры предосторожности, чтобы соответствовать возросшим требованиям индустрии, — из-за этого тон ответов может заметно меняться от версии к версии.

Кроме того, OpenAI начала показывать рекламу на бесплатном тарифе и в ChatGPT Go, тогда как Anthropic, наоборот, улучшила бесплатный тариф Claude, добавив больше функций и полностью отказавшись от рекламы. Учитывая, что компания теряет деньги даже на платящих клиентах, а глава OpenAI Сэм Альтман однажды назвал рекламу «крайней мерой», разумно предположить, что для пользователей бесплатного тарифа опыт использования ChatGPT может стать ещё хуже.

Есть и ещё одна причина, по которой часть пользователей ушла из ChatGPT, а загрузки Claude в это же время выросли. В феврале 2026 года сорвалась сделка Anthropic с Министерством обороны США: компанию признали риском для цепочки поставок из-за отказа допускать использование своих моделей для массовой внутренней слежки и полностью автономного оружия. Спустя несколько часов OpenAI объявила, что заключила с американским правительством аналогичную сделку — вместо Anthropic и с рядом оговорённых гарантий. Это решение подтолкнуло многих пользователей перейти на Claude: Anthropic стали воспринимать как более «этичную» компанию в сфере ИИ.

реклама кормит Уточку 🦆

Что изменилось этим летом

Расстановка сил в 2026 году меняется быстро, поэтому пара свежих штрихов к картине. Fable 5 вышел 9 июня, но уже 12 июня Anthropic временно приостановила доступ к нему, чтобы выполнить экспортные ограничения Министерства торговли США; после снятия ограничений доступ вернули 1 июля. Сейчас модель снова доступна в веб-версии, Claude Code, Cowork и через API.

А 24 июля Anthropic выпустила Claude Opus 5 — вдвое дешевле Fable 5 ($5 за миллион входных токенов и $25 за миллион выходных против $10 и $50) и с тем же окном контекста в миллион токенов. Opus 5 берёт первое место на собственном профильном бенчмарке Anthropic по агентному программированию, но при этом, по документации самой компании, не является её самой мощной моделью — этот статус остаётся за Fable 5. На практике это подталкивает к трёхуровневой стратегии: недорогая модель среднего уровня для рутины, Opus 5 для повседневной серьёзной работы и Fable 5 — для по-настоящему сложных многочасовых задач, где цена ошибки высока.

Сколько стоят Claude и ChatGPT

Бесплатные тарифы и Claude, и ChatGPT дают доступ только к моделям среднего уровня: Sonnet 5 у Claude и GPT-5.5 у ChatGPT. Разница в том, что в ChatGPT на бесплатном тарифе показывается реклама.

Платные тарифы Claude включают Pro за $20 в месяц ($17 в месяц при годовой оплате), Max 5x за $100 в месяц (лимиты в пять раз больше, чем у Pro) и Max 20x за $200 в месяц (лимиты в 20 раз больше, чем у Pro). Платные тарифы также открывают доступ к флагманским моделям и Claude Code. При этом у пользователей Pro биллинг для Fable 5 токен-ориентированный, а пользователи Max 5x и Max 20x могут потратить на Fable 5 до 50 процентов своего недельного лимита. Если лимит исчерпан, всегда можно докупить дополнительные кредиты на использование.

Ценообразование ChatGPT устроено похоже: есть тарифы за $20, $100 и $200 в месяц, которые дают увеличенные лимиты и доступ к флагманским моделям. Доступ к Codex бесплатный, но низкие лимиты делают его малополезным. В отличие от Claude, у ChatGPT есть ещё и тариф за $8 в месяц — он даёт повышенные лимиты, но реклама на нём всё равно остаётся.

Тем, кто строит на моделях свои продукты, интереснее цены API. У Claude это $10/$50 за миллион входных и выходных токенов у Fable 5, $5/$25 у Opus 5 и $2/$10 у Sonnet 5 (вводная цена до конца августа 2026 года, дальше $3/$15). У GPT 5.6 Sol — примерно $5/$30 на стандартной длине контекста, то есть на коротких запросах Sol дешевле, но на длинных надбавка почти стирает эту разницу.

Итог: кому что выбрать

Универсального победителя нет — есть удачные попадания под сценарий.

  • Claude стоит предпочесть, если вам важны минимум галлюцинаций и аккуратность, вдумчивая работа с текстом и большими документами, правки в реальных репозиториях и живые интерактивные артефакты, а также если вы уже завязаны на Claude Code.
  • ChatGPT выигрывает, когда нужен один инструмент «на всё»: естественный голос и живое видео, генерация фотореалистичных картинок, широкий набор инструментов, работа в терминале и агентные цепочки, а также самая низкая цена за токен на коротком контексте.
  • Совместный подход — часто самый разумный: держать оба сервиса под рукой и отправлять каждую задачу той модели, которая справляется с ней лучше.