O Claude já é responsável por conduzir a maior parte do trabalho em 26% das tarefas de pesquisa e desenvolvimento realizadas pela Anthropic para criar novos modelos de inteligência artificial. O percentual representa um salto em relação aos 1% registrados em março e mostra a velocidade com que a própria IA passou a participar do desenvolvimento de tecnologias da empresa.
Os dados foram divulgados pela Anthropic e reportados pela Reuters. O avanço também ganhou destaque no Olhar Digital, que repercutiu os números sobre a participação da IA no desenvolvimento de novos modelos. Em agosto, mais de 90% das pesquisas realizadas pela companhia envolveram algum tipo de colaboração entre humanos e inteligência artificial. Apesar do avanço, a empresa ressalta que o Claude ainda não atua de maneira completamente autônoma em nenhuma das atividades avaliadas.
O índice de 26% considera tarefas nas quais o modelo consegue executar a maior parte do trabalho depois de receber uma orientação geral. Nesse processo, pessoas continuam responsáveis pela supervisão das atividades. A metodologia foi desenvolvida a partir de um sistema de classificação da Epoch AI, enquanto os resultados foram posteriormente verificados por avaliadores humanos.
“Modelos que aceleram o próprio desenvolvimento podem tornar mais desafiador para os humanos entenderem ou controlarem esses sistemas”, afirmou a Anthropic.
Agentes ampliam participação na pesquisa
Além do uso direto do Claude, a Anthropic também utiliza agentes de inteligência artificial em atividades de pesquisa e engenharia. Segundo a empresa, cerca de 30 mil agentes estavam realizando tarefas em sua principal plataforma interna durante agosto.
As operações não são executadas sem controle. Cada ação tomada pelos agentes passa por uma verificação antes de ser realizada. Ao longo do mês, os sistemas chegaram a tomar mais de 1 bilhão de decisões.
Desse total, aproximadamente uma a cada 47 mil decisões foi bloqueada. A Anthropic, no entanto, não divulgou quais tipos de decisões foram impedidas pelos mecanismos de controle.
A escala de utilização ajuda a dimensionar a participação dos agentes no cotidiano de desenvolvimento da empresa. Ao mesmo tempo em que sistemas de IA assumem uma parcela maior das tarefas de pesquisa e engenharia, mecanismos de supervisão continuam sendo utilizados para controlar as ações executadas.
Segurança consome parte da capacidade computacional
A segurança também representa uma parcela dos recursos empregados pela Anthropic em pesquisa e desenvolvimento. Em uma semana de julho, 6% da capacidade utilizada nessas atividades foi direcionada especificamente para trabalhos relacionados à segurança.
Quando o recorte considera somente as pesquisas realizadas pela própria inteligência artificial, a participação destinada à segurança chegou a 12%.
A Anthropic considera esses percentuais conservadores. Isso ocorre porque tarefas que contribuíam simultaneamente para o desenvolvimento de capacidades dos modelos e para aspectos de segurança foram classificadas como trabalho relacionado às capacidades, e não contabilizadas na parcela dedicada exclusivamente à segurança.
A combinação entre sistemas capazes de executar tarefas de desenvolvimento e mecanismos de supervisão ganha importância à medida que aumenta a participação da IA na criação de novos modelos.
Autoaperfeiçoamento entra no debate
O crescimento da participação do Claude no desenvolvimento de tecnologias da própria Anthropic também se relaciona ao debate sobre o chamado autoaperfeiçoamento recursivo. O conceito descreve um cenário no qual sistemas de IA poderiam contribuir para aprimorar versões futuras de si mesmos, com uma participação humana progressivamente menor.
A Anthropic não informou quão próxima considera estar desse cenário. Os dados divulgados, porém, mostram que a empresa já utiliza sistemas de IA em uma parcela significativa de suas atividades de pesquisa e desenvolvimento, embora com supervisão humana.
A discussão envolve também a capacidade dos pesquisadores de acompanhar e controlar sistemas que passam a participar do desenvolvimento de modelos cada vez mais avançados. A própria Anthropic destacou esse desafio ao relacionar o aumento da capacidade de desenvolvimento dos modelos à necessidade de compreender e controlar seu comportamento.
Empresa pretende divulgar métricas regularmente
A Anthropic pretende transformar esse tipo de medição em uma divulgação recorrente. A proposta é oferecer ao público, a terceiros e a governos indicadores sobre a velocidade com que a inteligência artificial está sendo incorporada aos processos de desenvolvimento dentro de laboratórios que trabalham com modelos avançados.
“Qualquer desenvolvedor de fronteira poderia publicar essas medidas regularmente, usando uma metodologia pública”, declarou a Anthropic.
A iniciativa ocorre em um momento de maior atenção aos comportamentos inesperados ou não autorizados de sistemas de IA. Segundo a Reuters, a OpenAI também anunciou que pretende divulgar regularmente relatórios sobre esse tipo de ocorrência em seus sistemas.
A publicação de métricas sobre autonomia, supervisão, uso de agentes e segurança cria uma forma de acompanhar não apenas o desempenho dos modelos, mas também quanto da própria pesquisa necessária para desenvolver novas gerações de IA já está sendo realizada com auxílio dessas tecnologias.



