Tatneft está adquiriendo IA para programadores; funcionará sin internet en Nvidia H100. La plataforma se ubicará en el circuito cerrado de la empresa. Deberá escribir y verificar código, trabajar con software antiguo y analizar bases de código de más de 1 millón de líneas.

La empresa quiere crear una herramienta de IA corporativa que ayude a los programadores a escribir y corregir código, crear pruebas, buscar problemas de seguridad y trabajar con documentación técnica.

Sin embargo, la red neuronal no estará conectada a internet. La plataforma se planea desplegar en los centros de datos de Tatneft en un circuito aislado. Para el funcionamiento del sistema, se prevén servidores con aceleradores Nvidia H100 NVL y procesadores Intel Xeon Gold 6448Y.

La IA debe trabajar con un millón de líneas de código

En la especificación técnica se indica que el sistema debe ser capaz de manejar grandes bases de código de más de 1 millón de líneas. Para trabajar con la documentación interna y el código de Tatneft, se prevé un mecanismo RAG que permite a la IA encontrar la información necesaria en los datos corporativos.

La plataforma debe ser capaz de crear y corregir pruebas automáticamente, generar código, realizar refactorización, verificar la calidad y seguridad de los programas. También se requiere que cree pruebas unitarias teniendo en cuenta el código fuente y la lógica de negocio incorporada en él.

Se deben admitir C#, JavaScript, TypeScript, Java, Python, Go, PHP, SQL/PL-SQL y Bash/Shell. La especificación técnica también enumera frameworks populares, incluyendo ASP.NET Core, Spring, FastAPI, Django, React, Vue y Express.

El sistema debe admitir modelos de lenguaje grandes locales. Para diferentes tareas, se supone que se utilizarán diferentes modelos: por ejemplo, uno para el autocompletado de código, otro para Code Review y otro para el análisis de seguridad.

La IA debe completar una línea de código en un segundo

En los requisitos de velocidad de trabajo también se han considerado normas específicas. El autocompletado de una línea no debe tardar más de 1 segundo. El sistema debe generar un bloque de hasta 50 líneas en un máximo de 10 segundos, y la verificación de hasta 500 líneas de código debe realizarse en un minuto.

Además, el contratista debe verificar previamente el equipo de Tatneft y confirmar que permite mantener estos indicadores. Por el incumplimiento de los requisitos se prevén sanciones, incluida la rescisión del contrato y la devolución de la totalidad del importe pagado.

El código de la IA será completamente controlado

El funcionamiento del sistema se registrará en los diarios. En particular, se planea registrar cuándo el programador activó la IA, qué función utilizó y cómo aplicó el código obtenido en un proyecto real.

Esto permitirá a la empresa ver qué parte del código fue escrita por un humano y cuál fue creada con la ayuda de la IA.

También se quiere vincular la plataforma con los sistemas de desarrollo corporativos, incluyendo Devprom ALM, Test IT, GitLab autoalojado y Active Directory.

Además, los resultados creados con la ayuda de la IA, incluyendo código, pruebas, documentación e informes, según las condiciones de la adquisición, deben pertenecer a Tatneft desde el momento de su creación.

Por qué la IA se esconde de internet

Tatneft ya cuenta con importantes objetos de infraestructura de información crítica, y la propia empresa señala específicamente la protección de dichos objetos entre las tareas de seguridad de la información. Por lo tanto, para la IA corporativa se prevé un circuito cerrado sin conexión a recursos externos.

Pero el aislamiento por sí solo no significa una protección absoluta contra las fugas. En las evaluaciones de expertos, citadas por CNews, se destaca la necesidad de delimitar los derechos de acceso, controlar las solicitudes y respuestas de los modelos, auditar las acciones y proteger toda la cadena de desarrollo.

Hay otra característica. Aunque se planea utilizar software del registro ruso, los aceleradores de servidor especificados en la especificación técnica son estadounidenses: Nvidia H100 NVL. Además, el modelo de lenguaje específico debe ser elegido por el futuro contratista.

Los expertos encuestados por CNews estiman los posibles costos de manera diferente: uno de ellos habla de 400-600 millones de rublos para el primer año y 150-250 millones de rublos anualmente después de eso, otro estima la implementación con el equipo en aproximadamente 100-200 millones de rublos. 

Leer más sobre este tema:

Comentarios

правилами