Китайская компания Z.ai анонсировала обновление своей флагманской модели GLM-5.1, которая заняла первое место в бенчмарке SWE-Bench Pro для сложных инженерных задач, набрав 58,4 балла. Это превзошло результаты таких моделей, как GPT-5.4 (57,7), Claude Opus 4.6 (57,3) и Gemini 3.1 Pro (54,2). Основное внимание в обновлении уделяется концепции, позволяющей модели избегать застоя и эффективно решать задачи, анализируя результаты на протяжении множества итераций.
В ходе тестирования GLM-5.1 успешно справилась с несколькими сценариями: она создала веб-приложение в стиле Linux, реализовала поиск ближайших соседей на Rust и оптимизировала GPU-ядер. Особенно впечатляющим стало достижение 21,5 тысячи запросов в секунду в бенчмарке VectorDBBench, что в шесть раз превышает предыдущий рекорд. Несмотря на некоторые ограничения, команда Z.ai уверена в потенциале модели для дальнейших улучшений, что делает GLM-5.1 интересной для разработчиков.

