Конвейер разработки игр с ИИ-агентами

Система превращает задание на игровую функцию в план, распределяет работу между ИИ-агентами со своими ролями, собирает изменения в изолированной среде, проверяет результат тестами и снимками экрана и объединяет только то, что прошло проверку.

Собственная разработка · прототип
ТипСобственная разработка
Ролей в студии100
ДвижокGodot 4
Роль NKDLАрхитектура и разработка
Команда разбирает документы за столом

Задача

ИИ-модели уже умеют писать код игр, но принимать их работу без контроля нельзя. Модель может «починить» тест вместо кода, засчитать пустой прогон как успешный или сломать то, что уже работало.

Цель — производственный конвейер, где каждое изменение проходит те же проверки, что и в студии: план, реализация в отдельной ветке, тесты, визуальная проверка и только потом слияние.

Решение

01

Роли и план

100 профилей ролей: от директора и продюсера до программиста и тестировщика. Задание превращается в план и граф задач с зависимостями.

02

Изолированное исполнение

Каждая задача выполняется в своей ветке Git. В контейнере разрешён только заданный список команд, доступа к секретам нет, версия движка зафиксирована.

03

Проверка качества

Функциональные тесты, визуальная проверка снимка экрана и до трёх попыток исправления. Исполнитель не может переписать тесты под себя.

04

Бюджет и журнал

Учёт затрат на модели, неизменяемый журнал событий и консоль управления на русском языке.

Как работает

От задания до слияния

Каждый шаг сохраняется, поэтому после сбоя работа продолжается с последней проверенной точки, а не начинается заново.

01

Задание

Описание функции на обычном языке.

02

План

Спецификация и граф задач по ролям.

03

Реализация

Изолированные ветки и контейнеры для каждой задачи.

04

Проверка

Тесты, снимки экрана, регрессия, исправления.

05

Слияние

В основную ветку попадает только прошедшее проверки.

Задание: «добавить двойной прыжок» · граф задачДемо-данные
Задач в графе6
Слито в основную ветку3
Попыток исправления1 из 3
Затраты на моделив пределах бюджета
ЗадачаРольПроверкаСтатус
Спецификация механикиГеймдизайнерревью ведущегоПринято
Логика прыжкаПрограммист геймплеятесты 12 из 12Слито
Анимация и эффектТехнический художникпроверка снимка экранаИсправление 1 из 3
Регрессия уровня 1Инженер по тестированиюстарые тесты + новыеЖдёт анимацию

Исполнитель не может изменить тесты, которые проверяют его же работу. Спорный результат визуальной проверки получает статус «не определено», а не «прошло».

Что нашёл аудит

Нулевой код завершения больше не считается успехом. Раньше движок мог завершиться «без ошибок», не выполнив ни одного теста. Теперь без отчёта о тестах результат не принимается.

Проверяющий не может подогнать проверку. Роль, которая могла переписать и код, и тесты ради «зелёного» результата, убрана. Исправления делает только владелец задачи в пределах своих файлов.

Сбой одного этапа не останавливает всё. Ошибки изолируются, а пауза и возобновление корректно восстанавливают прерванные задачи.

Качество

01

56 автотестов

Серверная часть: ложные успехи, некорректные ответы моделей, повторные попытки, визуальные проверки, полный прогон с исправлениями.

02

Детерминированный режим

Для тестов ответы моделей заменяются фиксированными, а движок и проверки работают по-настоящему.

03

Наблюдаемость

Метрики, логи, трассировки и оповещения настроены заранее.

04

Архитектурные решения

Ключевые решения по надёжности и песочнице исполнения зафиксированы в документах.

Технологии

PythonFastAPIPostgreSQLTemporalRedisMinIONext.jsDockerGodot 4Grafana
Обсудим задачу

Нужна система с ИИ-агентами, которой можно доверять?

Проектируем процессы, где ИИ делает работу, а код проверяет результат: песочница, тесты, журнал и понятные границы полномочий.