Reddit
Результаты Astra в моём хобби-бенчмарке Blender
Автор, вдохновлённый MineBench, запустил личный проект по оценке способностей LLM работать с Blender. Тестирование GPT-6-Astra на нескольких сценах показало впечатляющую разницу по сравнению с другими моделями, особенно в одношаговом режиме генерации Python-скриптов. Следующим шагом автор планирует проверить модели на задачах создания игровых ассетов и реальных производственных сценариях.
score 40r/OpenAI