Ask HN: ¿Alguien ha enviado una aplicación auto-modificable con LLMs?
Ask HN: Has anyone shipped a self-modifying application with LLMs?
Estoy preguntando si alguien ha desarrollado una aplicación que pueda modificarse a sí misma usando modelos de lenguaje grandes (LLMs). En lugar de depender de plugins predefinidos, imagino una aplicación con un cuadro de prompt que permita a los usuarios generar extensiones dinámicamente, como 'hazme un panel de UI con botones que haga X'. Me pregunto si esto ya se ha implementado en algún producto o empresa, y si es viable generar extensiones con acceso a APIs seguras en un entorno sandbox, en lugar de modificar el código fuente real.
Sí, de hecho, en mi cuenta de GitHub compartí un IDE auto-modificable (puede autodestruirse). Puedes conectar un modelo a través de una clave de OpenRouter o Anthropic, y crear tickets para que un LLM 'se ponga manos a la obra' editando el propio IDE. Todo el código del IDE es editable dentro del propio IDE.
Podría decirse que eso es lo que hacen herramientas de BI como Tableau y Looker. O usos avanzados de Excel, con los que un LLM puede ayudar. El usuario tiene datos y quiere dividirlos y verlos de una manera específica, y tener algunos controles para jugar con ellos y encontrar respuestas a preguntas como científico de datos.
He estado pensando en tener algún tipo de entorno donde el modelo de lenguaje pueda modificar la aplicación en tiempo real mientras se ejecuta. Le pregunté a ChatGPT y dijo recarga en caliente en un navegador, pero no es a lo que me refiero. Me refiero a aplicaciones de escritorio de alto rendimiento en tiempo real que el usuario pueda pedir que cambien la aplicación en tiempo real mientras se ejecuta. Lo más cercano que vi fue algo llamado VibeOS, pero eso es un sistema operativo completo.
Existe desde hace décadas: https://www.youtube.com/watch?v=eEz08IlcNMg
Creo que te refieres a Smalltalk o cualquier otro lenguaje de programación basado en imágenes.
Necesitarías el código fuente de la pila, algo como la pila de OLPC donde tienes el código fuente de todo lo que se ejecuta y luego pegarlo a un LLM.