ChatGPT 4.5: Обзор самой «человечной» модели OpenAI

Подробный разбор GPT‑4.5: что нового, как изменились точность, креативность и скорость, кому подойдёт модель и стоит ли переплачивать за Pro.

Что такое GPT‑4.5 и почему её называют «самой человечной»

27 февраля 2025 года OpenAI представила GPT‑4.5 (кодовое имя Oreon) — крупнейшую модель для чата на тот момент. В отличие от предшественников, фокус смещён с универсальности и скорости на глубину понимания контекста и естественность диалога. Разработчики сделали ставку на масштабирование обучения без учителя (unsupervised learning), что позволило модели лучше распознавать паттерны, улавливать нюансы и генерировать более осмысленные ответы.

По заявлениям OpenAI, GPT‑4.5 обладает повышенным «эмоциональным интеллектом» (EQ) — она точнее интерпретирует неявные намёки, уместно реагирует на эмоциональные запросы и может поддержать беседу, а не просто выдать сухую информацию. Например, на жалобу о проваленном экзамене модель не ограничивается списком советов, а сначала проявляет эмпатию и предлагает поговорить. Это качество особенно ценно в сценариях, где важна человеческая теплота: коучинг, поддержка, творческое взаимодействие.

При этом GPT‑4.5 не умеет «рассуждать» в том смысле, в каком это делают модели o1 или o3‑mini. Она не строит цепочку мыслей перед ответом, а полагается на интуитивное знание, накопленное во время предобучения. Это делает её быстрой в простых задачах, но менее подходящей для сложных математических или логических головоломок.

Как изменилась точность и количество галлюцинаций

Одно из главных улучшений GPT‑4.5 — значительное снижение галлюцинаций (ситуаций, когда модель выдаёт выдуманные факты). В тесте SimpleQA, который проверяет способность отвечать на простые фактические вопросы, точность модели составила 62,5% против 38,6% у GPT‑4o. Доля галлюцинаций снизилась до 37,1% — для сравнения, у GPT‑4o этот показатель был 59,8%, а у o3‑mini — 80,3%.

Это стало возможным благодаря комбинации масштабирования предобучения и новых техник пост-обучения. Модель научилась лучше отличать известные факты от неизвестных и чаще честно отвечать «я не знаю», вместо того чтобы придумывать правдоподобный ответ. Для задач, где ложь недопустима (юридические консультации, медицинские справки, фактчекинг), это серьёзный шаг вперёд.

Однако важно понимать: 37% галлюцинаций — всё ещё много. Модель может ошибаться в редких или узкоспециализированных темах. Поэтому критически важные данные всегда стоит перепроверять.

Скорость работы и доступность модели

GPT‑4.5 — очень крупная и вычислительно затратная модель. Как следствие, она работает заметно медленнее GPT‑4o. Пользователи на Reddit и X сравнивают её с «черепахой, которая тащит за собой сервер». Время генерации ответа может быть в 2–3 раза выше, чем у предшественницы, особенно на сложных запросах.

На момент запуска модель была доступна только подписчикам ChatGPT Pro за $200 в месяц. Через неделю доступ получили пользователи тарифов Plus и Team, а ещё через неделю — Enterprise и Edu. При этом OpenAI предупредила, что не планирует делать GPT‑4.5 заменой GPT‑4o в API из-за высокой стоимости инференса. Разработчикам стоит учитывать, что цена запросов к GPT‑4.5 будет существенно выше.

Также стоит отметить технические ограничения: модель не поддерживает Voice Mode, видео и демонстрацию экрана в ChatGPT. Зато она умеет работать с файлами, изображениями и canvas для кода и текста.

Сравнение с GPT‑4o и o3‑mini: бенчмарки и реальные задачи

OpenAI опубликовала результаты стандартных тестов, которые показывают сильные и слабые стороны GPT‑4.5.

  • GPQA (научные вопросы): GPT‑4.5 — 71,4%, GPT‑4o — 53,6%, o3‑mini (high) — 79,7%. Модель заметно лучше предшественницы, но уступает специализированной «рассуждающей» модели.
  • AIME ’24 (математика): GPT‑4.5 — 36,7%, GPT‑4o — 9,3%, o3‑mini — 87,3%. В математике прогресс огромен по сравнению с GPT‑4o, но до o3‑mini далеко.
  • MMMU (мультимодальные задачи): GPT‑4.5 — 74,4%, GPT‑4o — 69,1%. Улучшение есть, но не революционное.
  • MMLU (многоязычное понимание): GPT‑4.5 — 85,1%, GPT‑4o — 81,5%. Модель стала лучше работать с разными языками.
  • SWE-Bench Verified (программирование): GPT‑4.5 — 38,0%, GPT‑4o — 30,7%, o3‑mini — 61,0%. В коде прогресс есть, но o3‑mini остаётся лидером.

В тестах на убеждение (Persuasion Tests) GPT‑4.5 обошла o1 и o3‑mini, что подтверждает её превосходство в задачах, требующих эмоционального интеллекта и манипуляции текстом.

На практике пользователи отмечают, что GPT‑4.5 пишет более естественные и креативные тексты, лучше понимает контекст и реже «забывает» детали из начала диалога. Однако для сложных научных расчётов или оптимизации кода лучше использовать o3‑mini.

Креативность и эмоциональный интеллект: что говорят пользователи

Отзывы первых тестировщиков единодушны: GPT‑4.5 заметно превосходит предшественниц в творческих задачах. Пользователи отмечают, что модель генерирует тексты, которые «будто написаны живым человеком с чувством юмора и тонким пониманием контекста». Она успешно справляется с написанием сценариев, созданием маркетинговых текстов, генерацией идей для дизайна.

Один из примеров: пользователь попросил модель помочь написать сценарий для короткометражки — за 20 минут GPT‑4.5 предложила неожиданные сюжетные повороты, которые автор сам бы не придумал. Другой тестировщик отметил, что модель исправила баг в коде на Python, который GPT‑4o пропустила, хотя процесс занял больше времени.

Эмоциональный интеллект проявляется в умении модели улавливать настроение собеседника. Если пользователь расстроен, GPT‑4.5 сначала выразит сочувствие, а потом предложит помощь, а не сразу выдаст сухой список решений. Это делает её незаменимой для коучинга, психологической поддержки и обучения.

Однако есть и обратная сторона: из-за акцента на безопасность и этичность модель иногда становится чересчур осторожной, избегая прямых ответов на спорные вопросы. Это может раздражать пользователей, которым нужны факты без «воды».

Программирование и технические задачи: прогресс и ограничения

В задачах программирования GPT‑4.5 показывает улучшение по сравнению с GPT‑4o, но уступает специализированным моделям вроде o3‑mini. На бенчмарке SWE-Bench Verified результат вырос с 30,7% до 38,0%, а на SWE-Lancer Diamond — с $138 750 до $186 125 (метрика оценивает экономическую ценность решённых задач).

Пользователи отмечают, что код, сгенерированный GPT‑4.5, чище и содержит меньше ошибок. Модель лучше понимает намерения разработчика и реже «уходит в сторону». Однако из-за медленной генерации процесс отладки может затянуться. Для быстрых правок или простых скриптов GPT‑4o остаётся более практичным выбором.

Важно: GPT‑4.5 не поддерживает режим рассуждений, поэтому для сложных алгоритмических задач, требующих пошагового анализа, лучше использовать o3‑mini или o1. Модель также слабее в математике — это подтверждают результаты AIME ’24 (36,7% против 87,3% у o3‑mini).

Безопасность и этичность: новые методы обучения

OpenAI уделила особое внимание безопасности GPT‑4.5. Модель обучалась с использованием новых техник супервизии, которые дополняют традиционные методы — supervised fine-tuning (SFT) и reinforcement learning from human feedback (RLHF). Компания провела серию тестов в соответствии с Preparedness Framework, чтобы проверить устойчивость модели к взлому, генерации вредоносного контента и другим рискам.

Результаты показали, что масштабирование парадигмы GPT (unsupervised learning) способствует улучшению показателей безопасности. Модель реже генерирует оскорбительные или опасные ответы, лучше фильтрует запрещённый контент. Однако некоторые пользователи жалуются на излишнюю осторожность: GPT‑4.5 может отказаться отвечать на безобидные вопросы, если они сформулированы двусмысленно.

OpenAI опубликовала подробный system card с результатами всех тестов. Разработчикам и корпоративным клиентам стоит ознакомиться с этим документом перед внедрением модели в production.

Кому подойдёт GPT‑4.5 и стоит ли переплачивать

GPT‑4.5 — нишевый продукт, несмотря на громкие заявления. Она идеальна для задач, где важны креативность, эмоциональный интеллект и точность фактов:

  • Писатели, сценаристы, маркетологи — для генерации текстов, сценариев, рекламных материалов.
  • Коучи, психологи, преподаватели — для создания поддерживающего диалога, адаптивных учебных материалов.
  • Разработчики, работающие над сложными многошаговыми проектами — модель лучше понимает контекст и реже ошибается в коде.

Однако для быстрых ответов, математических расчётов или научных задач GPT‑4.5 уступает более лёгким и специализированным моделям. Высокая цена ($200/мес для Pro) и медленная скорость делают её непрактичной для повседневного использования.

Если вы готовы ждать несколько секунд ради более качественного и «человечного» ответа — GPT‑4.5 оправдает ожидания. Если же вам нужна скорость и универсальность — лучше остаться на GPT‑4o или использовать o3‑mini для сложных задач.

Будущее GPT‑4.5: что дальше

OpenAI рассматривает GPT‑4.5 как исследовательскую предварительную версию, а не финальный продукт. Компания продолжит дорабатывать модель, внедрять новые функции и улучшать скорость. В будущем планируется упростить пользовательский интерфейс, чтобы ИИ «просто работал» без необходимости выбирать модель вручную.

Важно: GPT‑4.5 — последняя модель от OpenAI, которая не имеет встроенной функции рассуждений. Все будущие флагманские модели будут сочетать масштабирование предобучения (как в GPT‑4.5) с цепочками мыслей (как в o1). Это означает, что GPT‑4.5 — переходный этап, а не конечная точка.

Разработчикам стоит учитывать, что модель может быть недоступна в API в долгосрочной перспективе из-за высокой стоимости. OpenAI призывает сообщество тестировать GPT‑4.5 и делиться обратной связью, чтобы помочь определить, стоит ли продолжать её поддержку.

Вопросы и ответы

Чем GPT‑4.5 отличается от GPT‑4o?

GPT‑4.5 — более крупная модель, оптимизированная для глубины понимания контекста и естественности диалога. Она точнее, реже галлюцинирует, обладает более высоким эмоциональным интеллектом и креативностью. Однако работает медленнее и стоит дороже. GPT‑4o быстрее и дешевле, но уступает в точности и «человечности».

Почему GPT‑4.5 называют «самой человечной» моделью?

Благодаря масштабированию обучения без учителя модель научилась лучше распознавать неявные намёки, улавливать эмоциональный фон и реагировать уместно. Она может проявить эмпатию, поддержать беседу и предложить неожиданные творческие идеи, что делает взаимодействие более похожим на общение с человеком.

Сколько стоит ChatGPT 4.5 и где его можно попробовать?

На старте модель доступна только подписчикам ChatGPT Pro за $200 в месяц. Через неделю после запуска доступ получили пользователи Plus и Team, а ещё через неделю — Enterprise и Edu. В API модель доступна разработчикам на всех платных тарифах, но стоимость запросов выше, чем у GPT‑4o.

Правда ли, что GPT‑4.5 медленнее GPT‑4o?

Да, это подтверждают и пользователи, и косвенные данные. Из-за большого размера и вычислительной сложности модель генерирует ответы в 2–3 раза медленнее GPT‑4o. Для задач, где скорость критична, лучше использовать более лёгкие модели.

Подходит ли GPT‑4.5 для программирования?

Модель показывает улучшение по сравнению с GPT‑4o: код чище, меньше ошибок, лучше понимание контекста. Однако она уступает специализированным моделям вроде o3‑mini, особенно в сложных алгоритмических задачах. Для быстрых правок или простых скриптов GPT‑4o остаётся более практичным выбором.

Какие ограничения есть у GPT‑4.5?

Модель не поддерживает Voice Mode, видео и демонстрацию экрана. Она не умеет «рассуждать» (строить цепочку мыслей), поэтому слабее в математике и научных задачах. Также она может быть излишне осторожной из-за усиленных фильтров безопасности.

Стоит ли переходить на GPT‑4.5 с GPT‑4o?

Если ваши задачи требуют высокой точности фактов, креативности и эмоционального интеллекта — да, особенно если вы готовы платить $200/мес и мириться с медленной скоростью. Для повседневного использования, быстрых ответов или математических расчётов GPT‑4o или o3‑mini будут более практичными.