Google назвала лучшей ИИ-моделью Anthropic Claude Fable 5 для разработки под Android
Обновление рейтинга Android Bench
Google обновила рейтинг Android Bench, в котором оцениваются возможности передовых моделей искусственного интеллекта для разработки приложений под Android. В новой версии рейтинга первое место заняла модель Anthropic Claude Fable 5, получив оценку 84,5%.
Изменения в методологии оценки
Компания изменила подход к ранжированию ИИ-моделей, перейдя на использование стандартизированного фреймворка Harbor. Это позволит разработчикам Android применять единые средства для анализа моделей в конкретных сценариях использования. Переход на новый фреймворк открыл Android Bench для пользователей, желающих отправлять задачи по разработке Android, которые могут использоваться для оценки эффективности моделей.
Подчеркивая приверженность открытого и прозрачному подходу, Google сделала свою методологию и тестовый стенд общедоступными на GitHub. Разработчикам также предлагается делиться своими результатами тестов.
Результаты конкуренции моделей
В новом рейтинге Anthropic Claude Fable 5 демонстрирует заметное преимущество перед конкурентами. На втором месте оказалась OpenAI GPT-5.5 с результатом 80,2%, третьей стала Claude Sonnet 5, уступившая лидеру 8,3 процентных пункта. Все модели, присутствовавшие в предыдущих версиях рейтинга, получили обновленные оценки.
Значение для разработчиков
Claude Fable 5 показала лучшую способность создавать качественный код для Android, став новым ориентиром для разработчиков. Новая методика оценки через фреймворк Harbor обещает более точный анализ ИИ-моделей в реальных сценариях разработки, что повышает ценность рейтинга для практического применения.