GPT-6 Astra находит на 20% больше багов в кросс-файловых ревью, чем Sol
GPT-6 Astra in code review: Gains, privacy, and cost

CodeRabbit протестировал OpenAI GPT-6 Astra на реальных задачах ревью кода. Astra поймала примерно на 4% больше исправимых багов, чем GPT-5.6 Sol, и на 22% больше, чем Opus 5. На сложных кросс-файловых ревью разрыв вырос до 20% и 33% соответственно. Авторы связывают успех с умением модели связывать разрозненную информацию. Однако цена высока: $10 за миллион входных токенов и $50 за выходные — в 2,5 раза дороже Sol. В статье также рассказано, как Astra использовалась для создания игры NIGHTSHIFT, и обсуждаются вопросы конфиденциальности данных.
Самый интересный прогресс Astra заключается в умении связывать нужную информацию.