Мы решили проверить, какая из моделей ИИ справляется с реальными задачами, и запустили пять раундов стресса-тестов. Каждый тест выявил уникальные черты этих моделей.
Первое задание заключалось в философском вопросе, где Claude Opus 4.6 показал наибольшую глубину размышлений. Во втором тесте ChatGPT 5.2 продемонстрировал предельную точность, правильно посчитав 127 точек на графике.
Третий тест выявил противоречивые результаты, и тут не было явного победителя. В четвертом раунде ChatGPT и Claude успешно решили сложное судоку. Наконец, финальное задание с созданием игры оказалось сильной стороной Claude, который предложил самую креативную реализацию.
Итоги сравнения показывают, что ChatGPT лучше в мультимодальности и универсальности, а Claude excels в глубине и креативности. Теперь выбор зависит от конкретных задач, так как каждая модель имеет свои сильные стороны.
