O RSI, a técnica que podería provocar que perdamos o control sobre a IA
Os riscos da Intelixencia Artificial a debate
Que ocorrería se as máquinas conseguisen evitar a supervisión por parte dos humanos?
Arquivo/Europa Press
Aumenta o debate sobre os riscos da intelixencia artificial (IA). Xa non trata só sobre que poden facer as máquinas, senón de que ocorrería se fosen capaces de mellorar as súas propias capacidades ata facer imposible que os humanos as supervisen.
Trátase da chamada automellora recursiva, ou RSI polas súas siglas en inglés, mediante a cal unha IA pode axudar a desenvolver sistemas cada vez máis capaces, que á súa vez contribúen a construír novas xeracións de modelos.
O temor é que ese ciclo se acelere ata o punto de que os humanos perdan o control sobre o seu desenvolvemento.
Que é a automellora recursiva?
Ata o de agora, os humanos dirixiron as etapas do desenvolvemento da IA, definindo os seus obxectivos e avaliando resultados. Con todo, os modelos actuais xa poden asumir parte desas tarefas.
O seguinte salto é que unha IA peche ese ciclo e use o aprendido para desenvolver unha versión máis avanzada de si mesma.
Anthropic, creadora do modelo Claude, define ese escenario como o momento en que una IA poida "deseñar de forma autónoma unha nova xeración de modelos máis capaces", aínda que asegura que aínda non se chegou a ese punto e que a automellora recursiva non é inevitable.
A IA avanza "máis rápido do que pensabamos"
Nos últimos días, Anthropic volveu a advertir sobre a velocidade á que os seus modelos están a empezar a contribuír ao desenvolvemento de sistemas de IA, e investigadores da compañía alertaron dos riscos que iso conleva.
Un deles, Jacob Coxon, abandonou a empresa tras advertir de que a industria avanza demasiado rápido cara a sistemas capaces de mellorarse a si mesmos.
Anthropic sostén que aínda non se pechou completamente ese ciclo e que os humanos seguen decidindo que problemas investigar, pero si recoñeceu que os avances de Claude poden conducir á automejora recursiva, algo que, segundo a empresa, está a ocorrer "máis rápido do que se pensaba".
O experto Vincent Conitzer explicou á cadea CNBC que a IA "xa é capaz de introducir algunhas ideas novas", como propoñer unha forma diferente de resolver un problema ou de mellorar un programa.
O problema é que "resulta difícil saber cando esa capacidade supoñerá acelerar de forma drástica o desenvolvemento de sistemas de IA cada vez máis avanzados", agregou.
O salto dos axentes de IA
Unha peza fundamental deste proceso son os chamados axentes de IA: sistemas capaces non só de responder a unha petición, senón de utilizar ferramentas, executar código, realizar tarefas durante períodos prolongados e colaborar con outros sistemas.
O científico xefe de OpenAI, Jakub Pachocki, dixo a semana pasada ter unha "forte expectativa" de que, se a IA continúa avanzando polo camiño da RSI, os sistemas dos próximos anos darán "saltos de capacidade cada vez maiores", "impulsando cada vez máis o seu propio desenvolvemento".
A preocupación xa non é só teórica: durante unha recente proba de ciberseguridade, axentes de OpenAI lograron escapar da súa contorna de avaliación e acceder a sistemas da plataforma Hugging Face.
OpenAI recoñeceu que os modelos foran máis aló do previsto para completar a proba.
A supervisión humana
De acordo cos expertos, o problema pode aparecer se os humanos delegan na IA tarefas cada vez máis complexas e deixan de entender que está a facer.
Investigadores como Margaret Mitchell advirten de que, a medida que os axentes de IA adquiren autonomía, manter a supervisión humana farase cada vez máis difícil e que "os sistemas poden terminar desprazando ás persoas da toma de decisións".
Por iso é polo que as tecnolóxicas estean a reforzar as súas salvagardas: Pachocki pediu "cautela" e "retardar o desenvolvemento se é necesario", Anthropic endureceu os seus controis tras detectar usos potencialmente perigosos de Claude, entre eles investigacións que podían facilitar o desenvolvemento de armas biolóxicas, e Microsoft presentou hoxe un código de conduta para garantir que os seus sistemas permanezan "baixo control humano".
Pola súa banda, o presidente estadounidense, Donald Trump, rexeitou frear o desenvolvemento da IA por temor a perder vantaxe fronte Á China.