GPT-6 Astra решила головоломку DEF CON с официальной подсказкой

В опубликованном OpenAI фрагменте Бен Дэвис рассказал, как проверил GPT-6 Astra на сложных головоломках с DEF CON. Некоторые из этих заданий он и его друзья ...

Aravana··1 мин

В опубликованном OpenAI фрагменте Бен Дэвис рассказал, как проверил GPT-6 Astra на сложных головоломках с DEF CON. Некоторые из этих заданий он и его друзья пытались решить несколько дней. Модель справилась с двумя задачами, успеха на которых Дэвис не ожидал.

Одна из головоломок представляла собой набор кубиков Рубика, расположенных в необычной сетке три на четыре. Участникам требовалось изучить эту конструкцию и извлечь из неё зашифрованное сообщение. Astra получила правильное решение три раза из трёх.

У результата есть существенная оговорка: модели понадобилась официальная подсказка от авторов головоломки. По словам Дэвиса, ту же подсказку получила и его команда во время работы над заданием. После её предоставления Astra смогла добраться до окончательного ответа. Таким образом, речь идёт не о решении задачи полностью без внешней помощи, а о способности использовать тот же дополнительный ориентир, который был доступен людям.

Дэвис особенно отметил подход модели к продолжительной работе над сложными задачами. Astra формулирует гипотезу, поручает другому агенту проверить её, оценивает результат и продолжает поиск. Для параллельной работы у неё есть десять слотов, которые могут занимать вспомогательные агенты, тогда как основной агент координирует их действия.

Такое устройство превращает решение головоломки не в одну попытку угадать ответ, а в управляемый процесс: несколько направлений проверки запускаются одновременно, а результаты возвращаются главному агенту. Дэвис подчеркнул, что модель особенно хорошо показывает себя, когда получает явные инструкции о том, как организовать эту работу и координировать агентов.

Демонстрация не доказывает, что Astra способна самостоятельно справиться с любой задачей DEF CON: в показанном случае использовалась официальная подсказка, а видео описывает результаты конкретной проверки. Однако три успешных решения одной и той же головоломки и ещё одна неожиданно решённая задача показывают, как агентная оркестрация может помогать модели последовательно разбирать сложные многоэтапные проблемы.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

WeatherNext 3 учится предсказывать погоду напрямую по спутниковым снимкам

WeatherNext 3 учится предсказывать погоду напрямую по спутниковым снимкам

За несколько дней до выхода урагана «Мелисса» на Ямайку модель Google DeepMind показывала, что ещё не набравший силу атмосферный вихрь может превратиться в у...

·2 мин
OpenAI представила ChatGPT Work на базе GPT-6 Astra

OpenAI представила ChatGPT Work на базе GPT-6 Astra

Запрос на подготовку стратегической презентации для руководства о запуске платежного продукта в Великобритании стал центральным примером в новом 56-секундном...

·1 мин
Google DeepMind составила карту всех 9 млрд однонуклеотидных изменений человеческого генома

Google DeepMind составила карту всех 9 млрд однонуклеотидных изменений человеческого генома

Google DeepMind рассчитала потенциальное молекулярное воздействие всех девяти миллиардов возможных однонуклеотидных изменений человеческого генома. Результат...

·1 мин