Конвейер разработки игр с ИИ-агентами
Система превращает задание на игровую функцию в план, распределяет работу между ИИ-агентами со своими ролями, собирает изменения в изолированной среде, проверяет результат тестами и снимками экрана и объединяет только то, что прошло проверку.

Задача
ИИ-модели уже умеют писать код игр, но принимать их работу без контроля нельзя. Модель может «починить» тест вместо кода, засчитать пустой прогон как успешный или сломать то, что уже работало.
Цель — производственный конвейер, где каждое изменение проходит те же проверки, что и в студии: план, реализация в отдельной ветке, тесты, визуальная проверка и только потом слияние.
Решение
Роли и план
100 профилей ролей: от директора и продюсера до программиста и тестировщика. Задание превращается в план и граф задач с зависимостями.
Изолированное исполнение
Каждая задача выполняется в своей ветке Git. В контейнере разрешён только заданный список команд, доступа к секретам нет, версия движка зафиксирована.
Проверка качества
Функциональные тесты, визуальная проверка снимка экрана и до трёх попыток исправления. Исполнитель не может переписать тесты под себя.
Бюджет и журнал
Учёт затрат на модели, неизменяемый журнал событий и консоль управления на русском языке.
От задания до слияния
Каждый шаг сохраняется, поэтому после сбоя работа продолжается с последней проверенной точки, а не начинается заново.
Задание
Описание функции на обычном языке.
План
Спецификация и граф задач по ролям.
Реализация
Изолированные ветки и контейнеры для каждой задачи.
Проверка
Тесты, снимки экрана, регрессия, исправления.
Слияние
В основную ветку попадает только прошедшее проверки.
| Задача | Роль | Проверка | Статус |
|---|---|---|---|
| Спецификация механики | Геймдизайнер | ревью ведущего | Принято |
| Логика прыжка | Программист геймплея | тесты 12 из 12 | Слито |
| Анимация и эффект | Технический художник | проверка снимка экрана | Исправление 1 из 3 |
| Регрессия уровня 1 | Инженер по тестированию | старые тесты + новые | Ждёт анимацию |
Исполнитель не может изменить тесты, которые проверяют его же работу. Спорный результат визуальной проверки получает статус «не определено», а не «прошло».
Что нашёл аудит
Нулевой код завершения больше не считается успехом. Раньше движок мог завершиться «без ошибок», не выполнив ни одного теста. Теперь без отчёта о тестах результат не принимается.
Проверяющий не может подогнать проверку. Роль, которая могла переписать и код, и тесты ради «зелёного» результата, убрана. Исправления делает только владелец задачи в пределах своих файлов.
Сбой одного этапа не останавливает всё. Ошибки изолируются, а пауза и возобновление корректно восстанавливают прерванные задачи.
Качество
56 автотестов
Серверная часть: ложные успехи, некорректные ответы моделей, повторные попытки, визуальные проверки, полный прогон с исправлениями.
Детерминированный режим
Для тестов ответы моделей заменяются фиксированными, а движок и проверки работают по-настоящему.
Наблюдаемость
Метрики, логи, трассировки и оповещения настроены заранее.
Архитектурные решения
Ключевые решения по надёжности и песочнице исполнения зафиксированы в документах.
Технологии
Нужна система с ИИ-агентами, которой можно доверять?
Проектируем процессы, где ИИ делает работу, а код проверяет результат: песочница, тесты, журнал и понятные границы полномочий.

