AI GUIDEПартнёрский материал

GPT 6.1 Soul против Claude Sonnet 5.5: сравнение игр и сайтов

Ссылка партнёрская: цена для вас не меняется, проект получает вознаграждение.

Коротко

Что важно знать до подписки

Сравнение GPT 6.1 Soul и Claude Sonnet 5.5 на 3D-автомате, инсектарии, шутере, игре-пиццерии и сайтах. Итоги основаны на наблюдениях автора; показатели расхода токенов неоднозначны.

Разбор от редакции

К выводам ↓

GPT 6.1 Soul и Claude Sonnet 5.5 автор использовал для создания интерактивных игр и сайтов по запросу. В этих запусках Claude, по его оценке, чаще точнее попадал в механику заданий, а GPT сделал более интерактивный 3D-автомат.

Как проходило сравнение GPT 6.1 Soul и Claude Sonnet 5.5

Автор проверял модели на пяти задачах: 3D-автомате с напитками, инсектарии, 2D-шутере, игре-пиццерии и сайте. Для генерации он выбрал режим рассуждений High, а не максимальный уровень. По его объяснению, так тест ближе к обычному использованию: автор предполагал, что максимальный режим мог израсходовать лимиты до завершения всех заданий.

Это сравнение показывает результаты конкретных запусков, а не неизменные свойства моделей. Автор сам оценивал готовые страницы и игры, а часть показаний о токенах и лимитах не смог однозначно интерпретировать. В тесте не проверяли бэкенд-разработку.

Что важнее при выборе модели: скорость или точность выполнения запроса? В этом наборе задач критерии расходились: более быстрая генерация не всегда давала более подходящую игру.

3D-автомат: GPT выиграл за счёт работающих кнопок

В версии GPT можно было внести условную сумму, выбрать напиток и запустить покупку: доступная бутылка выкатывалась, а окошко автомата открывалось. Если напиток купить было нельзя, действие не срабатывало.

В версии Claude автор не смог обнаружить работающий интерактив: нажатия на кнопки ничего не делали. Внешний вид аппарата и бутылок показался ему примерно сопоставимым с результатом GPT. Победу в этой категории он отдал GPT за интерактивность, а не за визуальное превосходство.

Показания о расходе токенов в этом задании оказались противоречивыми: интерфейс показывал для GPT 133 тыс. токенов, другой показатель составлял 2,87 млн, а для Claude автор назвал 250 тыс. Он не смог определить, какой цифре доверять. В обоих интерфейсах отображались примерно одинаковые доли пятичасового и недельного лимитов. Без понимания, что именно измерял каждый показатель, эти цифры нельзя считать точным сравнением расхода.

Для прототипирования эта разница важна: аккуратная картинка ещё не означает, что пользователь может выполнить основное действие. В таком тесте стоит отдельно проверять ключевой сценарий, а не ограничиваться первым визуальным впечатлением.

Инсектарий: визуальная оценка и спорные показатели токенов

В инсектарии GPT разместил бабочек, палочника, богомола и дополнительные детали вокруг сцены. Автор отметил, что часть элементов выглядела странно, в частности богомол, но объектов было заметно много. Бабочки и изображения насекомых у Claude показались автору интереснее; странность в изображении богомола он заметил и там.

По показаниям интерфейсов, GPT использовал около 1,3 млн токенов, а Claude примерно 640 тыс. Автор счёл Claude экономнее по этому параметру, однако уточнил, что доли израсходованных лимитов различались не настолько заметно. Это наблюдение по интерфейсу, а не независимо проверенный замер.

2D-шутер: Claude показался динамичнее

В игре GPT автор отметил смену оружия и локаций, а также танк и разных противников. Темп показался ему медленным, враги быстро стали однообразными, а босс появился слишком рано. Чтобы добраться до него, приходилось повторно проходить базовые участки.

В игре Claude автор увидел более насыщенный бой: противники спускались на парашютах, дроны взрывались при падении, появлялись машинка и враги, бросавшие бочки. В игре были аптечки и контрольные точки. По впечатлению автора, она была сложнее и динамичнее, но до босса он не дошёл: прохождение показалось слишком продолжительным.

Такая оценка зависит от предпочтений игрока. Более сложный шутер с большим числом событий может выглядеть убедительнее, но простая и короткая игра бывает удобнее для быстрой демонстрации механики. В тесте Claude получил преимущество в оценке автора за насыщенность и разнообразие.

Игра-пиццерия: Claude точнее выполнил запрос

В варианте GPT игровой процесс был устроен как кликер: игрок выбирал ингредиенты и следил за приготовлением. Автор ожидал более ручную механику с большим столом и самостоятельным добавлением продуктов, поэтому посчитал, что результат хуже соответствует запросу.

Версия Claude позволяла раскатывать тесто, добавлять ингредиенты в заданных количествах и отправлять пиццу в печь. Игроку нужно было следить за выпеканием: если вынуть пиццу слишком рано, она оставалась сырой, а при долгом ожидании сгорала. Автор проверил этот сценарий и отметил, что пицца действительно сгорела. Звуковое сопровождение и анимация дополняли механику.

В этом задании автор оценил результат Claude выше за соответствие описанной игре. По его оценке, GPT вместо ожидаемой игры также сделал сайт. Вариант Claude автор счёл удачной основой для доработки, но это не подтверждает, что продукт уже готов к публикации или коммерческому использованию.

Сайты: функциональность против ясности подачи

На сайте GPT автор нашёл инфографику и настройку цвета 3D-объекта. По его оценке, страница хорошо подстраивалась под разные размеры экрана, но содержала мало информации. Он допускал, что мог не обнаружить все разделы.

Сайт Claude включал звуковое сопровождение, меню, контактную форму и интерактивную подачу материалов. В разделах были сведения о сайтах, стоимости и проектах. Однако назначение страницы и принцип работы некоторых интерактивных элементов автору были понятны не до конца. Визуальная насыщенность сама по себе не гарантирует ясного пользовательского сценария.

Для практической оценки сайта полезно разделять три вопроса: правильно ли он отображается на разных экранах, работают ли элементы интерфейса и понимает ли посетитель, что ему предлагают. GPT получил положительную оценку автора за адаптацию и визуальные детали, а Claude за количество интерактивных функций. Эти наблюдения не дают однозначного вывода о превосходстве одного сайта по всем критериям.

Время и расход ресурсов: почему цифры требуют осторожности

Автор привёл отдельные замеры времени: в одном случае GPT выполнял задачу 11 минут, а Claude около 14–15 минут. В комментариях к этому сравнению он также назвал для GPT расход около 1,8 млн токенов. Однако автор оговорился, что путался в процентах лимита и называл их ориентировочно. Эти цифры нельзя свести в точный рейтинг эффективности.

Сколько токенов потребуется для похожего проекта в следующий раз? По этому тесту точно ответить нельзя: показания интерфейсов оказались неоднозначными, а результат зависит от задания и этапов генерации. Для собственного сравнения лучше запускать обе модели с одинаковым описанием и настройками, записывать время и расход по одним и тем же полям интерфейса, а затем вручную проверять работу функций.

Итог сравнения GPT 6.1 Soul и Claude Sonnet 5.5

По итоговой оценке автора Claude выиграл почти все категории, кроме 3D-автомата. Он лучше соответствовал запросу в игре-пиццерии, а его шутер показался автору динамичнее и разнообразнее. Обе модели продемонстрировали полезные особенности при создании сайтов, но часть интерфейса Claude была не вполне понятной, а сайт GPT выглядел малонаполненным.

Этот вывод отражает мнение автора по ограниченному набору заданий, а не универсальный рейтинг моделей. Для быстрого прототипа с конкретной механикой результаты теста дают основания попробовать Claude Sonnet 5.5. Если приоритетом служит работающая интерактивность простого объекта, тест автомата показывает сильную сторону GPT 6.1 Soul. Перед выбором для реального проекта стоит отдельно проверить код, доступность функций, адаптивность и поведение каждого сценария.

Короткий вывод: в этом сравнении Claude чаще точнее попадал в игровую задачу, GPT убедительнее справился с автоматом, а цифры токенов и лимитов остались ориентировочными.

Сравните модели перед запуском

Тарифы, лимиты и список моделей — на стороне сервиса. Если что-то разойдётся с описанным здесь, напишите: поправим материал и проставим новую дату проверки.

Открыть каталог моделей

Ссылка партнёрская: цена для вас не меняется, проект получает вознаграждение.

GPT 6.1 Soul Claude Sonnet 5.5 сравнение нейросетей вайб-кодинг генерация игр ИИ создание сайтов ИИ

Редакция «SEO Разум»

Разбираем SEO и нейросети на практике: проверяем сервисы на своих проектах, сверяем цены и лимиты с первоисточниками и пишем то, что можно применить в тот же день.

📚 Справочник по SEO и ИИ 🔄 Материалы обновляются 🕐 Обновлено: 4 октября 2026

Читать по теме

Весь раздел →