Компания «Татнефть» планирует внедрить закрытую ИИ-платформу для разработчиков, которая будет работать без подключения к интернету. Система сможет генерировать и проверять код, создавать тесты и документацию, а также помогать сотрудникам разбираться со старой кодовой базой.
Платформу развернут в дата-центрах компании на серверах с ускорителями NVIDIA Tesla H100 NVL. Использоваться должны российские решения из реестра отечественного ПО. Языковая модель будет работать локально, а данные не должны покидать защищённый контур.
ИИ должен поддерживать C#, JavaScript, TypeScript, Java, Python, Go, PHP, SQL и Bash, а также работать с кодовыми базами объёмом от 1 млн строк. Для поиска информации предусмотрен RAG, который позволит модели обращаться к внутренней документации и исходному коду.
Одной из задач станет работа с legacy-кодом, который может оставаться без полноценной документации годами. По словам руководителя департамента автоматизации бизнес-процессов и ИИ Hybrid Андрея Храмцова, именно здесь эффект от такой системы может оказаться заметнее, чем при обычной генерации кода.
«У компании такого возраста есть легаси, которое держится на двух-трёх людях, а документация утеряна лет пятнадцать назад. Ассистент, проиндексировавший этот код, сокращает вход в систему с месяцев до недель», — отметил эксперт.
Система будет записывать действия пользователей и поддерживать разграничение доступа. Корпоративная база знаний должна храниться в зашифрованном виде. При обнаружении уязвимости поставщик должен выпустить исправление в течение семи рабочих дней.
«Татнефть» рассчитывает использовать платформу для сотен разработчиков. Автодополнение строки кода должно занимать не более секунды, генерация блока до 50 строк — до 10 секунд. Опытную эксплуатацию планируют начать до 1 декабря 2026 года.
В первый год проект может обойтись в 400–600 млн рублей. При этом закрытый контур не исключает утечки данных через сотрудников, резервные копии или уязвимости программного обеспечения.
Использование российской платформы не означает полного технологического импортозамещения. Для работы системы «Татнефти» всё равно потребуются зарубежные ускорители, а языковая модель может быть создана на базе открытых зарубежных моделей.