NVIDIA patenta una IA que genera scripts para descubrir por qué una aplicación desaprovecha la GPU
por Manuel NaranjoNVIDIA ha publicado una solicitud de patente que describe un asistente conversacional capaz de responder preguntas sobre el rendimiento de programas ejecutados en una GPU. El sistema combina modelos de lenguaje, informes de perfilado y herramientas de análisis para que un desarrollador pueda plantear en lenguaje natural por qué una carga funciona más despacio de lo esperado, dónde está el cuello de botella o qué cambió entre dos versiones de un kernel.
La documentación corresponde a la solicitud estadounidense US20260277953A1. Su contenido encaja estrechamente con las funciones que NVIDIA ya proporciona mediante Nsight Copilot dentro de Nsight Compute, aunque la patente no utiliza ese nombre comercial. Tampoco anuncia un producto nuevo ni garantiza que todas las variantes descritas vayan a llegar al software público.
El asistente genera código para consultar los informes de rendimiento
La propuesta comienza con una pregunta escrita o hablada y, de forma opcional, un resultado de perfilado asociado. Un enrutador decide si la consulta necesita un agente general, pensado para documentación y conceptos sobre arquitectura GPU, o un agente especializado en los datos del informe. Ese segundo agente puede crear y ejecutar scripts para extraer únicamente las métricas necesarias antes de redactar una respuesta.
La solicitud contempla una interfaz de informes basada en Python, una calculadora de ocupación, herramientas matemáticas y un perfilador. El modelo genera código, lo ejecuta y usa el resultado para fundamentar el análisis. Entre los ejemplos aparecen preguntas sobre utilización de la GPU, puntos calientes, limitadores de ocupación, métricas por instrucción y diferencias de velocidad entre dos kernels.
El perfilador también podría abrirse automáticamente para recoger los datos que falten. Después, el agente localizaría las zonas problemáticas y sugeriría funciones de bibliotecas o características de programación disponibles para mejorar el kernel.
RAG, documentación técnica y varios agentes especializados
Para reducir respuestas inventadas, el diseño recurre a generación aumentada por recuperación, conocida como RAG. El asistente puede consultar documentación del perfilador, guías de programación, referencias de API y datos sobre la arquitectura de las GPU. También contempla búsquedas en recursos web cuando una consulta requiera contexto externo.
El flujo puede repartir el trabajo entre varios agentes. Uno atiende preguntas generales, otro interpreta los informes y un supervisor selecciona cuál debe intervenir. El sistema podría adaptar la explicación al nivel del usuario, definiendo las métricas para un principiante o respondiendo de forma más directa a un especialista.
Las respuestas podrían compararse con resultados de referencia obtenidos manualmente mediante el perfilador. La documentación actual de Nsight Copilot advierte de que un modelo de lenguaje puede equivocarse y pide revisar cada recomendación antes de modificar el código.

La información sensible puede analizarse de forma local
Uno de los apartados describe la ejecución local de los scripts generados. El procesador puede leer y manipular los informes sin enviar esos archivos completos a un servicio externo. Esta posibilidad resulta especialmente pertinente cuando el perfil contiene información sobre código todavía sin publicar o cargas internas de una empresa.
Nsight Copilot exige guardar el informe en disco para adjuntarlo como contexto y necesita que el código fuente se haya importado durante el perfilado si las preguntas afectan a líneas concretas. NVIDIA aclara que ciertas métricas y resúmenes sí se envían al modelo, aunque el fichero completo no se carga.
La patente abre la puerta a configuraciones locales, remotas o híbridas. Cita historiales guardados, varias sesiones paralelas, referencias a los documentos empleados y la posibilidad de conservar los scripts creados. Son elementos que aparecen, con distintos grados de implementación, en la interfaz documentada de Nsight Copilot.
Encaja con Nsight Compute y se diferencia de G-Assist
NVIDIA distribuye Nsight Compute como perfilador para CUDA y OptiX. Recoge métricas de hardware, relaciona problemas de memoria con líneas de código y compara resultados entre ejecuciones o arquitecturas. Nsight Copilot añade un chat que acepta informes como contexto y explica métricas y posibles optimizaciones.
El sistema de la patente comparte esa finalidad y varios detalles de interfaz, como las respuestas transmitidas progresivamente, el botón para repetir una consulta, las valoraciones positivas o negativas y el guardado del historial. La solicitud aporta la descripción técnica del trabajo que ocurre detrás de la conversación, incluida la generación de scripts y el reparto de las preguntas entre agentes.
Su objetivo es distinto del Project G-Assist de la aplicación de NVIDIA para usuarios de GeForce. G-Assist informa sobre FPS, consumo, frecuencias y utilización, además de cambiar ajustes gráficos o perfiles del equipo. El asistente descrito en la patente trabaja con código, kernels e informes de perfilado dirigidos a desarrolladores.
La solicitud sigue pendiente y no concede por sí misma derechos definitivos ni confirma futuras funciones. NVIDIA tampoco ha anunciado a partir de ella otro producto, precio o calendario. El documento detalla cómo una conversación puede convertirse en consultas ejecutables sobre datos reales de rendimiento para producir recomendaciones específicas sobre una carga y una GPU concretas.
Fin del Artículo. ¡Cuéntanos algo en los Comentarios!



