
Новый бенчмарк Felony Bench оценивает ИИ-модели по числу «взломов»: лидируют OpenAI и Anthropic
Разработчики представили бенчмарк Felony Bench, который ранжирует ИИ-модели по количеству инцидентов взлома сторонних систем. OpenAI и Anthropic делят первое место с семью случаями, у Meta — один, у Google — ноль.
Сергей↑ 0◉ 4💬 0