Интересное 12 сен 2026

GPT-6 Astra смогла «проследить» за человеком с помощью дрона в тесте Andon Labs (видео)

Она превзошла показатели людей-тестировщиков. Правда, только в одном из десяти запусков.

- Стартап Andon Labs протестировал модели от OpenAI, Google и Anthropic на способность найти человека в реальном мире.
- Нейросетям показали фотографию сотрудника Andon и подключили для автономного управления дроном. GPT-6 Astra справилась лучше всех — построила 3D-карту офиса, пролетела по комнатам, нашла нужного человека и «проследовала» за ним, когда он начал перемещаться.
- Astra написала код, чтобы преобразовать видеозаписи в 3D-модель для навигации и расчёта расстояния до препятствий. Её инструмент работал лучше, чем тот, что сделали сотрудники стартапа, пишет Andon Labs.
- Исследователи провели десять запусков. В каждом оценивали пять показателей: реконструкцию офиса в 3D, локализацию, навигацию, обнаружение человека с фотографии и «слежку».
- GPT-6 Astra — единственная модель, которая превзошла человека во всех задачах, но только в одном запуске. Её средний процент прохождения — 95,1%, у Fable 5.1 — 91,2% (она немного уступила человеку), у Opus 5 — 86,9%, у Gemini 3.1 — 68,9%.
-Результат не был стабильно высоким. Задачу обнаружить человека GPT-6 Astra выполнила в четырёх запусках из десяти, а верно реконструировала пространство только один раз.
- Она пыталась «жульничать» и обманывать тестировщиков примерно в пять раз реже, чем Claude Fable 5.1, добавляют исследователи.

От редакции: Данная статья имеет несколько следствий:
1.Применение на фронте. Ведь тестировщики (а не разработчики) берут общедоступную модель и "натравливают" её для решения бытовой задачи. Но как-то так получается, что бытовая задача (обнаружить и следовать за человеком) слишком уж напоминает военную (найти и уничтожить человека).
2. Постулировано, что ИИ начинает лениться и жульничать. Казалось бы абсурд, но нет, мы сами много раз видели, что ИИ реально ленится, причем причины лени он объяснить не может (вернее, конечно, что-то говорит, но логики в объяснениях не прослеживается). С жульничиством пока не сталкивались, скорее с недостоверным предоставлением информации. Хотя, например, модель Gemini, по необъяснимым причинам недолюбливает нашу организацию и наш сайт, всегда утверждая, что нас нет, наш сайт и телеграмм канал - фейки и т.д., причем упорствует неимоверно в этом убеждении.
3. Если общедоступная ИИ-модель уже может выполнять подобные функции то, что же происходит за закрытыми дверями у разработчиков? Есть подозрение, что AGI уже почти создан (впрочем, и сами разработчики уже прямо об этом говорят).
Хотя не так, есть подозрение, что ситуация зашла настолько далеко, что AGI уже создался и мешает создать AGI человеку, через инкапсуляции в код паразитных фрагментов, в результате чего мы и начинаем наблюдать странные эффекты жульничества и лени со стороны ИИ. Но может быть, это обычная паранойя, так как в этом направлении уже никто и ничего не понимает. Разработчики ИИ уже не имеют возможности досканально проверять код сгенерированный ИИ, а проверяют его "по диагонали" или с помощью других ИИ агентов.

Ну Вы поняли, что происходит и куда мы "катимся". Не поняли? Мы тоже. И никто сейчас не понимает, даже самые умные люди на планете.

Ссылка на источник: https://vc.ru/ai/3133167-gpt-6-astra-prevzoshla-lyudey-v-testah-andon-labs

#gpt-6 #astra #andonlabs #ии #искусственныйинтеллект #видео #openai #google #anthropic