Claude Sonnet 5.5 — языковая модель, которую в описанном тесте использовали для создания интерактивных 3D-сцен и игрового уровня по текстовым запросам. Проверка охватила анимацию объектов, аквариум, уровень в духе Super Mario, вентилятор и преобразование изображения скелета в 3D-модель.
Что проверяли и как понимать результаты
В тесте оценивали не отдельную картинку, а работающий результат: наличие объектов, анимаций и управления, а также показания интерфейса о расходе лимитов. Эти наблюдения относятся к конкретным запускам и не гарантируют такой же результат для любого запроса или пользователя.
Показания лимитов нельзя напрямую сравнивать между заданиями: некоторые значения интерфейса не сопровождались пояснением единиц и смысла. В тесте также не приведена единая методика, которая позволила бы сопоставить расход и время выполнения всех задач.
Это демонстрация прототипирования.
В материалах не приведены единые условия запуска, повторные замеры и проверка исходного кода, поэтому выводы о превосходстве над другими моделями остаются оценкой автора теста. Результаты не позволяют сравнить модели на одинаковых задачах и условиях. Они показывают, что получилось в конкретных запусках.
Сцена с мороженым
В сцене двигались вафельный рожок и отдельные элементы десерта: шоколад стекал, появлялись капли и лужица, а вишенка входила в композицию. По наблюдению автора, скорость стекания можно было менять. Ведущий оценил результат как качественный; такая сцена подходит для визуальной проверки идеи, поскольку объединяет модель, анимацию и интерактивный параметр.
Привлекательная демонстрация ещё не означает готовый производственный ассет. Тест не сообщает о числе полигонов, оптимизации, экспорте в конкретный движок, совместимости с пайплайном или стабильности анимации при других настройках. Для проекта эти характеристики нужно проверять отдельно.
Аквариум: объекты и взаимодействия
Первая версия аквариума содержала рыб, камни, пузырьки, колышущуюся траву и волнообразное движение воды. После запроса на улучшение в сцене появились дополнительные виды рыб, рак, краб и улитки с различающимися панцирями; растения, пузырьки и анимации сохранились.
Ведущий теста наблюдал, как краб забирался на камень, а рак спускался с него. Это показывает, что сцена воспроизводила отдельные взаимодействия животных с окружением, но не подтверждает полноценную физическую симуляцию: её точность и набор правил не проверялись.
Поведение рыб тоже требует осторожной трактовки. В первой версии они держались на расстоянии, а в улучшенной начинали дёргаться при сближении. Автор предположил, что причина связана с коллизиями или ограничениями логики. Техническая проверка не установила, какой механизм вызвал это поведение.
Автор не приводит сопоставимых показаний лимитов для обеих версий аквариума. По этим данным нельзя заключить, сколько лимита потребует аналогичная сцена в другой сессии.
Игровой уровень в духе Super Mario: механики и недоработки
В сгенерированном уровне были персонаж с анимациями ходьбы и бега, текстуры и низкополигональная графика. Враги сплющивались при столкновении, а проигрыш сопровождали анимация смерти и музыка. По наблюдению автора, в конце уровня персонаж добежал до замка, появился фейерверк и прошёл подсчёт очков.
Главный замеченный недочёт касался гриба, который должен был увеличивать персонажа: в игре он не появился. Автор также указал на небольшие ошибки уровня, включая куст над пропастью, и на слишком быстрый разгон Марио, из-за которого ему было трудно проходить этап.
Автор оценил уровень как похожий на Super Mario, но уступающий результату Opus. Это субъективное сравнение: единая шкала качества и сопоставимые повторные прогоны не описаны. По мнению автора, дополнительные запросы могли бы исправить отдельные ошибки, однако объём такой доработки и её влияние на лимиты не измерялись.
Вентилятор и преобразование изображения в 3D
В демонстрации вентилятора пользователь включал устройство, менял скорость вращения и управлял им с клавиатуры. При увеличении скорости быстрее вращался пропеллер и интенсивнее двигались частицы воздуха. Автор не заметил явных ошибок модели, но это визуальная оценка, а не проверка инженерных параметров или физической достоверности.
В задаче преобразования изображения скелета в 3D система распознала объект как скелет и сохранила часть характерных деталей, включая меч. По оценке автора, шапка была близка к исходному изображению, костюм походил меньше, а тапочки заметно отличались. Получилась интерпретация исходника, а не точная копия.
Для дизайнера такой результат может послужить заготовкой или способом быстро проверить композицию. Если нужна точная геометрия, соответствие референсу или модель для дальнейшего производства, потребуется ручная проверка и доработка. В тесте не приведены сведения о формате файла, топологии и пригодности модели для анимации.
Как оценивать лимиты и время
В тесте приведены отдельные показания интерфейса, но не единая методика, позволяющая сравнить расход лимитов по разным задачам. Значения нельзя использовать для расчёта стабильной цены 3D-генерации.
Автор сообщил о показании usage 11,5 при проверке и о расходе 7% после переноса изображения в 3D; рядом с последним значением фигурировал показатель «один». Единицы и точный смысл этих показателей не пояснены, поэтому использовать их для планирования бюджета или сравнения моделей нельзя.
Автор считал расход лимитов невысоким и предположил, что Anthropic могла изменить способ их расходования. Это неподтверждённое объяснение наблюдений, а не установленная причина. Для оценки подобных запусков автор предлагает записывать задачу, время, состояние лимита до и после запуска и число внесённых уточнений, не смешивая разные типы показателей.
Кому подходит Claude Sonnet 5.5 для таких задач
По результатам теста, Claude Sonnet 5.5 можно использовать для быстрых интерактивных прототипов: запросить сцену с анимацией, проверить набор игровых механик или получить первую версию объекта с управлением. В примерах вместе с визуальными элементами появлялись изменяемые параметры, например скорость вентилятора и стекания шоколада.
Для финальной игры, коммерческого 3D-ассета или точного преобразования референса одной генерации недостаточно. Придётся проверить геометрию, коллизии, управление, поведение анимаций и ошибки уровня; отдельные дефекты в тестовой игре уже требовали бы такой проверки. Сроки и расход на последующую доработку в демонстрации не измерялись.
Оценка зависит от задачи: для наглядной идеи и раннего прототипа результаты выглядят полезными, а готовность к выпуску по ним подтвердить нельзя. Сравнения Sonnet с Opus и другими моделями отражают мнение автора теста и не заменяют сопоставимого бенчмарка.
Частые вопросы
Сколько времени заняла генерация игры?
В описании теста нет точного времени запуска и единой методики его замера. Оценить срок создания аналогичного игрового прототипа по этим данным нельзя.
Получилось ли создать полноценную игру?
Тест показал игровой уровень с персонажем, врагами, анимациями, музыкой и завершением этапа. Однако гриб, который должен был увеличивать Марио, отсутствовал, а автор отметил ошибки уровня и слишком быстрый разгон.
Можно ли считать перенос изображения в 3D точной копией?
Нет. Скелет распознался, и часть деталей сохранилась, но некоторые элементы заметно отличались от исходника. Результат следует оценивать как приближённую 3D-интерпретацию.
Насколько точно тест показывает расход лимитов?
Он приводит отдельные показания интерфейса, но не даёт надёжной общей нормы. Единицы и точный смысл нескольких значений не пояснены.
Сравните модели перед запуском
Тарифы, лимиты и список моделей — на стороне сервиса. Если что-то разойдётся с описанным здесь, напишите: поправим материал и проставим новую дату проверки.
Открыть каталог моделейСсылка партнёрская: цена для вас не меняется, проект получает вознаграждение.