7 августа 2025 года вышла новая фронтирная модель GPT-5 и показала самые передовые результаты на актуальных бенчмарках. Кажется, что это было вчера. И это действительно было практически «вчера».
А прямо сейчас, почти год спустя, GPT-5.6 Sol уничтожает ту передовую модель по всем сохранившимся тестам. И даже эти тесты слабо передают весь масштаб прогресса и разницу между моделями, которые теперь выходят почти каждый месяц. Причём становятся всё дешевле и дешевле.
Когда бенчмарков уже мало
В какой-то момент сравнение баллов начинает работать хуже. Цифры растут, названия тестов меняются, но из таблицы трудно понять, что именно теперь способна делать модель.
Совсем недавно внутренняя модель OpenAI самостоятельно решила почти 80-летнюю задачу Эрдёша о единичных расстояниях. Решение проверили внешние математики. А вскоре OpenAI представила ещё десять результатов по открытым математическим задачам: где-то модели удалось полностью решить проблему, где-то — существенно продвинуться в поиске решения. Безумие.
Математический результат можно долго проверять и обсуждать. Но сам факт уже трудно игнорировать: модели начинают заходить в области, где готового ответа не существует.
Именно такие примеры передают скорость происходящего лучше очередных процентов на графике. Когда модель работает с задачей, которая оставалась открытой десятилетиями, разговор уже выходит далеко за пределы генерации текстов и картинок.
Цена эксперимента
Модель уровня GPT-5 сейчас можно без особых проблем запустить на железе за 20–30 тысяч долларов. Это колоссальный прогресс. А через год уже текущие модели могут подешеветь ещё на порядок.
Самое важное здесь даже не абсолютная цена. Важнее направление: возможности, которые недавно находились только внутри крупнейших лабораторий, постепенно становятся доступными небольшим командам и отдельным людям.
При этом модели уже покрывают огромный класс прикладных задач: генерацию изображений, видео и текстов, программирование, анализ данных, поиск решений и оптимизацию процессов. Одна и та же система может участвовать почти во всей цепочке создания нового продукта — от идеи до работающего прототипа.
Раньше между мыслью и её проверкой стояли деньги, специалисты и месяцы работы. Теперь главным ограничением всё чаще становится способность человека понять, что именно он хочет сделать и зачем.
Хрупкая надежда
Каждый раз, думая об этом, сложно представить, куда мы дойдём в итоге. И тут, конечно, можно рассуждать о том, что всё это приведёт нас к чему-то ужасному — и наверняка приведёт. Но происходящее также даёт некоторую надежду и оптимизм. Потому что, если убрать и эти прорывы, останутся военные конфликты и бестолковые политические решения, которые гарантированно ведут нас к несчастью.
У меня есть хрупкая надежда, что, возможно, всё это сможет как-то «расшевелить» текущий миропорядок и трансформировать общество во что-то новое. Дать людям больше автономии и творческих возможностей.
Теперь, чтобы попробовать какую-то свою идею или проект, уже не нужно набирать людей и команду разработчиков. Ты просто берёшь и за вечер получаешь не идеальный, но уже рабочий прототип решения. Тебе проще понять и оценить его пользу и перспективы. Это невероятная роскошь, которой раньше не было.
Конечно, снижение порога работает в обе стороны. Создавать станет проще всем, поэтому сам факт создания продукта будет значить меньше. Вырастет ценность вкуса, способности выбирать направление, замечать реальные проблемы и доводить начатое до результата. Инструменты станут доступнее, а конкуренция — жёстче.
Выводов особо нет. Просто хотелось сказать, что нас ждут невероятные изменения, оценить которые пока слишком трудно. Нужно к ним готовиться. Стабильности точно не будет. И я не могу уверенно сказать, что это плохо.