Reddit
GPT-6 Astra: не столько «AGI», сколько серьёзное испытание для агентов, управляющих компьютером
Анализ запуска GPT-6 Astra показывает, что модель нацелена на практические задачи, сочетающие рассуждения, код, инструменты и взаимодействие с интерфейсом: браузерные операции, исследования, документы, CRM и длительные профессиональные процессы. Бенчмарки не дают однозначной победы: Astra показывает сильные результаты на FrontierMath Tier 4 и ARC-AGI-3, но в индексе Artificial Analysis набирает 61 балл, уступая в некоторых конфигурациях, а в Coding Agent Index — 67, что выше Sol, но ниже Fable 5.1. Автор предлагает оценивать модель по реальным рабочим процессам и стоимости за принятый результат, а не по маркетинговым заявлениям об AGI.
score 40r/artificial