OpenAI — lançou um conjunto de prioridades e princípios para orientarem avaliadores terceiros, com a promessa de acesso alargado a treino, avaliação e implementação; contudo, o documento não estabelece mecanismos claros para que esse escrutínio seja vinculativo, o que reduz o seu impacto prático para utilizadores empresariais e reguladores.
Boas intenções, mas pouco poder prático
O texto promete que avaliações independentes terão níveis aprofundados de acesso aos processos de treino, de avaliação e de implementação, com a intenção de permitir que os avaliadores desafiem pressupostos e identifiquem riscos.
Analistas realçam que, sem regras executórias e sem garantias sobre quem define o âmbito ou quem pode ver os achados críticos, o processo pode ficar sujeito a redacções e limitações decididas pela própria empresa.
“A OpenAI compromete‑se a apoiar avaliações independentes com níveis aprofundados de acesso aos processos de treino, avaliação e implementação. Esse acesso deve permitir aos avaliadores desafiar as nossas pressuposições, identificar riscos que possamos ter perdido e chegar às suas próprias conclusões sobre a eficácia das nossas salvaguardas.”
Críticas e condições para que funcione
Vários especialistas apontam que o documento define expectativas úteis sobre independência e rigor, mas não obriga a OpenAI a aceitar um âmbito específico, a publicar achados adversos ou a alterar decisões de implementação.
O consenso é que a eficácia dependerá de quem decide o âmbito da avaliação, do nível de acesso concedido, da capacidade dos avaliadores para seguir evidência fora da hipótese inicial e da publicação transparente de resultados e remediações.
O que acha? Acha que medidas desse tipo são suficientes para tornar a IA mais segura? Para acompanhar mais análises, aceda à nossa editoria.
Perguntas Frequentes
O que publicou a OpenAI sobre avaliadores terceiros e qual é o objectivo?
A OpenAI publicou um conjunto de prioridades para avaliações terceirizadas na terça‑feira, com o objectivo de estruturar o acesso a informação sobre treino, avaliação e implantação. O documento pretende permitir que avaliadores desafiem pressupostos, identifiquem riscos e cheguem a conclusões independentes sobre a eficácia das salvaguardas.
Por que muitos analistas dizem que o documento “não tem dentes”?
A OpenAI descreveu normas de rigor e independência, mas analistas como Pieter Arntz e Valence Howden destacam que o texto não prevê um processo obrigatório de execução, nem obriga a publicação de achados adversos, deixando à empresa o controlo sobre escopo e redacções.
Que tipo de acesso o documento da OpenAI promete aos avaliadores?
A OpenAI promete níveis aprofundados de acesso “across training, evaluation and deployment” — ou seja, acesso ao treino, às avaliações e à implementação dos modelos. Esse acesso, segundo o texto, visa permitir avaliações mais concretas dos riscos e das salvaguardas em condições realistas.
Quais preocupações práticas foram levantadas sobre a aplicação dessas avaliações?
A OpenAI indicou prazos para remediação antes da publicação, mas especialistas alertam que prazos e redacções podem atrasar ou suavizar a divulgação de problemas; a preocupação central é que o laboratório retenha demasiado controlo sobre o que é mostrado aos avaliadores.
Qual é o próximo passo esperado para que estas prioridades tenham impacto real?
A OpenAI e o sector terão de evoluir da avaliação para a responsabilização: especialistas como Samantha Gloede sugerem que será necessário demonstrar que ações corretivas são tomadas, validadas independentemente e refletidas na governação e nas decisões de implantação.
Diogo Costa