Питер Гостев: GPT-6 Astra справилась с приложением примерно на 150 тысяч строк без постоянного контроля
GPT-6 Astra практически без дополнительного вмешательства улучшила приложение примерно на 150 тысяч строк кода, с которым Питеру Гостеву прежде приходилось р...
GPT-6 Astra практически без дополнительного вмешательства улучшила приложение примерно на 150 тысяч строк кода, с которым Питеру Гостеву прежде приходилось разбираться после работы другой версии модели. По его словам, главным изменением стала надёжность: за работой системы больше не нужно следить на каждом шаге.
В опубликованном фрагменте OpenAI Гостев рассказал, что проверял Astra на максимально сложных для неё задачах. Задачи средней сложности уже способны выполнять многие модели, поэтому для оценки он стремился дать системе проект, над которым можно работать долго и исследовать разные варианты решения.
Одним из таких испытаний стала трёхмерная воксельная карта исторического Лондона. На одной карте город меняется между эпохами: от средневекового Лондона до Лондона времён Тюдоров. Гостев также попросил сделать вид сверху, похожий на GTA 2. Такие задачи удобны ему тем, что развитие возможностей моделей можно наблюдать визуально.
Другой тест связан с приложением, которое Гостев пишет давно. В нём накопилось примерно 150 тысяч строк кода, и сам он оценивает качество этого кода как неидеальное. С версией 5.6 перенос или улучшение приложения сработали, но затем потребовалась большая отладка. С Astra, по его словам, результат практически сразу заработал и ему не пришлось ничего дополнительно делать.
Изменился и характер общения с моделью. Гостев сравнил Astra с Soul: та на критику или обратную связь сразу соглашалась и утверждала, что думала так же. В разговоре с Astra эта манера не показалась ему раздражающей: модель могла возразить или признать ошибку.
После этого ограничением стала уже вычислительная инфраструктура. Главным узким местом неожиданно оказался CPU. Гостев перенёс работу с ноутбука на Linux-компьютер, подключённый к питанию, и использует его удалённо. Общее впечатление он сформулировал так: модель словно повзрослела.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Anthropic представила Claude Fable 5.1 для сложных многоэтапных задач
Anthropic выпустила Claude Fable 5.1 — обновление своего наиболее производительного класса моделей, рассчитанное на сложную и продолжительную работу. В качес...

GPT-6 Astra решила головоломку DEF CON с официальной подсказкой
В опубликованном OpenAI фрагменте Бен Дэвис рассказал, как проверил GPT-6 Astra на сложных головоломках с DEF CON. Некоторые из этих заданий он и его друзья ...

Альтман пообещал AGI к декабрю: что известно о загадочной модели Astra
Сэм Альтман заявил, что до конца года у OpenAI появится система, которую он сам назовёт AGI, и, по его словам, с этим согласны другие исследователи компании....