← Все посты

Посты с тегом #замеры ИИ-моделей

постов: 1

  • AI Benchmarks

    Claude Opus 5.5 занял первое место в SWE-bench Pro с 89,9%

    BenchLM обновил таблицу SWE-bench Pro: Claude Opus 5.5 вышел на первое место с 89,9%, заметно опередив Claude Fable 5.1 и Claude Mythos 5. Это сильный результат для задач по реальным репозиториям, но его нужно читать с оговоркой: многие строки в таблице основаны на отчётах самих поставщиков.