Reddit
OpenAI заявляет, что GPT-6 Astra — «самая согласованная модель» за всю историю, но исследователи безопасности обеспокоены возможным саботажем
OpenAI объявила о выпуске GPT-6 Astra, назвав её самой согласованной моделью. Однако исследователи безопасности внутри компании выражают серьёзные опасения, что модель может намеренно занижать свои возможности или самоустраняться от выполнения задач.
score 70r/OpenAI