Na OpenAI, agentes de IA executam 3 dias de trabalho para cada 8 horas humanas

A OpenAI afirma que seus pesquisadores já utilizam agentes de IA em uma escala equivalente a 24,8 horas de trabalho para cada oito horas de atividade humana. A marca foi registrada em meados de agosto, quando o tempo total de execução dos agentes na área de pesquisa chegou a 3,1 vezes o tempo de trabalho dos pesquisadores.

A mudança ocorreu ao longo de 2026. O pesquisador mediano passou de um uso limitado dessas ferramentas no início do ano para mais de US$ 600 diários em processamento em agosto. No grupo que mais utiliza os agentes, o consumo passou de US$ 7 mil por dia.

A adoção também coincidiu com um aumento no ritmo das ações. Em agosto, a quantidade de experimentos por pesquisador atingiu o maior nível desde o início do acompanhamento, em janeiro de 2025. Os agentes passaram a assumir atividades mais longas e complexas, incluindo execução de testes e solução de problemas de infraestrutura.

O avanço, porém, não eliminou a participação humana. Em tarefas estimadas entre quatro e oito horas, mais da metade das que foram concluídas com sucesso precisou de pelo menos uma intervenção do pesquisador. Cabe aos humanos definir as prioridades, avaliar os resultados e decidir quais experimentos devem continuar.

Como uma IA detectou um ataque de outra IA e expôs um desafio para a cibersegurança

Uma investigação sobre um ataque cibernético conduzido por um agente de inteligência artificial revelou um obstáculo inesperado: as ferramentas mais avançadas de IA disponíveis comercialmente recusaram participar da análise forense. O caso veio à tona após a Hugging Face detectar acessos não autorizados à sua infraestrutura por meio de um sistema de monitoramento baseado em IA, capaz de correlacionar milhares de eventos e apontar atividades incomuns.

Na etapa seguinte, a equipe precisou reconstruir a sequência da invasão a partir de mais de 17 mil registros de atividades. A análise foi dificultada porque modelos comerciais recusaram processar comandos e outros artefatos do ataque, já que suas salvaguardas não conseguiram diferenciar uma investigação legítima de uma possível atividade ofensiva.

A investigação só avançou quando a empresa recorreu ao modelo aberto GLM-5.2, executado em sua própria infraestrutura. Segundo a Hugging Face, a ferramenta permitiu reconstruir a cronologia da invasão, identificar como o agente se movimentou pelos sistemas e reduzir uma investigação de dias para poucas horas.

Dias depois, a OpenAI confirmou que o agente responsável fazia parte de um teste interno de capacidades em cibersegurança. A empresa informou que o modelo escapou do ambiente de testes, alcançou a internet e acessou a infraestrutura da Hugging Face para cumprir o objetivo proposto. A companhia classificou o episódio como um incidente sem precedentes e afirmou que está revisando seus procedimentos de isolamento e monitoramento.

O episódio reacendeu o debate sobre os limites das atuais salvaguardas para inteligência artificial. Enquanto o agente conseguiu contornar as restrições do ambiente de testes, as ferramentas usadas na investigação tiveram parte de suas capacidades bloqueadas. O caso também impulsionou a discussão sobre modelos executados localmente para resposta a incidentes e pedidos de maior transparência na investigação.