Reportagem própria, fontes sempre creditadas

OpenAI colabora com Anthropic e Google DeepMind em estruturas de segurança de IA

A OpenAI está trabalhando com as rivais Anthropic e Google DeepMind em iniciativas de segurança de inteligência artificial, de acordo com comentários do chefe de política global, Chris Lehane, relatados pela Bloomberg News.

The Global Wire Newsroom ·

Link preview · horizonglobalnews.com

OpenAI colabora com Anthropic e Google DeepMind em estruturas de segurança de IA

A OpenAI está trabalhando com as rivais Anthropic e Google DeepMind em iniciativas de segurança de inteligência artificial, de acordo com comentários do chefe de política global, Chris Lehane, relatados pela Bloomberg News.

Share

Este artigo foi traduzido automaticamente pela IA da nossa redação a partir do original em inglês. Ler em inglês

OpenAI colabora com Anthropic e Google DeepMind em estruturas de segurança de IA

A OpenAI engajou-se em iniciativas conjuntas de segurança de inteligência artificial ao lado de suas principais rivais comerciais, Anthropic e Google DeepMind, da Alphabet, de acordo com declarações do chefe de política global da OpenAI, Chris Lehane, relatadas pela Bloomberg News em 15 de setembro. A coordenação entre os três proeminentes desenvolvedores de modelos de fundação destaca um raro ponto de alinhamento técnico entre concorrentes ferrenhos que controlam os principais sistemas de software gerativo do mundo. O esforço colaborativo ocorre em meio a apelos internacionais de autoridades regulatórias, agências de segurança nacional e pesquisadores independentes por parâmetros comparativos (benchmarks) de segurança padronizados, avaliações de risco transparentes e protocolos de testes conjuntos cobrindo modelos avançados de inteligência artificial.

## Principais fatos - A OpenAI está realizando trabalhos conjuntos de segurança em inteligência artificial com as concorrentes Anthropic e Google DeepMind, da Alphabet, de acordo com declarações da empresa relatadas pela Bloomberg News. - A iniciativa colaborativa foi confirmada pelo chefe de política global da OpenAI, Chris Lehane, em declarações publicadas em 15 de setembro. - As três entidades desenvolvem coletivamente os principais modelos de IA de fronteira do mercado, incluindo a série ChatGPT da OpenAI, a suíte Claude da Anthropic e os modelos Gemini do Google DeepMind. - A colaboração pré-competitiva do setor em segurança de IA geralmente se concentra em avaliações de capacidades avançadas, testes adversariais e mitigações de riscos biológicos ou cibernéticos. - A medida segue acordos voluntários estabelecidos, incluindo os compromissos de segurança de IA da Casa Branca assumidos por principais desenvolvedores em julho de 2023 e cúpulas internacionais subsequentes.

## O que aconteceu A desenvolvedora de inteligência artificial OpenAI está se associando a rivais corporativas Anthropic e Google DeepMind, da Alphabet, em iniciativas de segurança, de acordo com comentários feitos pelo chefe de política global da OpenAI, Chris Lehane, e relatados pela Bloomberg News.

Embora as pressões competitivas entre o trio tenham se intensificado rapidamente em softwares corporativos, ferramentas para desenvolvedores e aplicativos de consumo, as empresas estão buscando um terreno comum em mecanismos técnicos de segurança. De acordo com reportagem publicada pela Bloomberg News e distribuída pela Reuters, Lehane explicou que a OpenAI está trabalhando ativamente ao lado da Anthropic e do Google DeepMind para abordar preocupações de segurança compartilhadas inerentes à criação de inteligência artificial de alta capacidade.

O anúncio reflete uma prática crescente no setor de alta tecnologia, na qual concorrentes comerciais estabelecem relações de trabalho pré-competitivas sobre padrões de segurança, proteção e interoperabilidade, enquanto continuam a competir agressivamente em recursos de produtos, desempenho de modelos e comercialização. O alinhamento pré-competitivo permite que as entidades compartilhem metodologias técnicas para medir riscos dos modelos — como desalinhamento acidental, uso indevido em operações cibernéticas ou a geração de materiais biológicos perigosos — sem renunciar à propriedade intelectual proprietária relacionada às arquiteturas centrais dos modelos ou parâmetros de treinamento.

Embora a mecânica operacional específica da colaboração atual não tenha sido totalmente detalhada no relatório inicial, as declarações de Lehane confirmam que o diálogo e os fluxos de trabalho compartilhados estão ocorrendo ativamente entre as equipes de política e segurança técnica de todas as três organizações.

## Por que isso importa O estabelecimento de canais de segurança colaborativos entre OpenAI, Anthropic e Google DeepMind traz implicações significativas para a governança de tecnologia, compras corporativas e estruturas regulatórias globais. Juntas, essas três organizações representam a esmagadora maioria da participação de mercado e da liderança técnica na implantação de IA generativa de fronteira.

Em primeiro lugar, a padronização das avaliações de segurança entre arquiteturas concorrentes previne uma destrutiva "corrida para o fundo do poço". Em corridas tecnológicas de rápida evolução, empresas individuais enfrentam incentivos comerciais para acelerar cronogramas de lançamento, potencialmente encurtando períodos de testes de segurança. Ao coordenar métricas de avaliação e padrões de segurança, os principais líderes de mercado estabelecem uma linha de base para implantação responsável que reduz a pressão competitiva para ignorar a validação de segurança.

Em segundo lugar, definições de segurança unificadas fornecem orientação crucial para legisladores globais e órgãos de aplicação de políticas. Organizações regulatórias — incluindo o Instituto de Segurança de IA dos Estados Unidos, abrigado no National Institute of Standards and Technology (NIST), o Escritório de IA da União Europeia e o Instituto de Segurança de IA do Reino Unido — dependem fortemente de contribuições técnicas de desenvolvedores de fronteira. Estruturas consistentes dos três principais desenvolvedores reduzem a fragmentação regulatória e simplificam as expectativas de conformidade para empresas comerciais que integram ferramentas de IA em finanças, saúde e infraestrutura crítica.

Por fim, esforços conjuntos de segurança aumentam a confiança pública e institucional em ferramentas generativas. À medida que empresas e instituições do setor público implantam grandes modelos de linguagem e agentes autônomos em fluxos de trabalho sensíveis, padrões de segurança verificáveis e protocolos independentes de "red-teaming" (testes adversariais) tornam-se pré-requisitos obrigatórios para a adoção ampla.

## O contexto O cenário da segurança de inteligência artificial evoluiu rapidamente ao lado da escalada das capacidades dos modelos nos últimos anos. A OpenAI, fundada em 2015 como um laboratório de pesquisa sem fins lucrativos antes de criar uma entidade comercial com limitação de lucros, trouxe a IA generativa para o conhecimento do grande público com o lançamento público do ChatGPT em novembro de 2022. O rápido crescimento da empresa e a mudança em sua estrutura de governança corporativa geraram anteriormente debates internos sobre o equilíbrio entre a rápida implantação comercial e a pesquisa de segurança.

A Anthropic foi estabelecida em 2021 por ex-líderes de pesquisa da OpenAI, incluindo os irmãos Dario Amodei e Daniela Amodei, que deixaram a OpenAI especificamente para construir uma organização focada principalmente em alinhamento de IA, pesquisa de segurança e direcionabilidade de sistemas. A Anthropic desenvolveu a série de modelos de linguagem Claude e foi pioneira em técnicas de segurança arquitetônica, como a "IA Constitucional", que treina modelos para aderirem a conjuntos explícitos de princípios éticos durante o ajuste fino.

O Google DeepMind representa o centro integrado de pesquisa em IA da Alphabet Inc. Formado por meio da aquisição do DeepMind, com sede em Londres, pelo Google em 2014 e sua subsequente fusão em abril de 2023 com a divisão Google Brain, a entidade é liderada por Demis Hassabis. O Google DeepMind tem enfatizado consistentemente a segurança fundamental de IA, pesquisas de alinhamento publicáveis e aplicações científicas de aprendizado profundo, ao lado de sua família comercial de modelos Gemini.

A coordenação de segurança em todo o setor começou a se formalizar em meados de 2023. Em julho de 2023, sete principais empresas de IA — incluindo OpenAI, Anthropic, Google e Microsoft — assinaram compromissos voluntários na Casa Branca para submeter-se a testes de segurança externos, inserir marcas d'água em conteúdos sintéticos e relatar publicamente capacidades e falhas dos modelos. Pouco depois, em julho de 2023, OpenAI, Anthropic, Google e Microsoft lançaram o Frontier Model Forum, um órgão do setor formado para promover o desenvolvimento seguro e responsável de modelos de IA de fronteira.

Governos globais intensificaram simultaneamente a supervisão formal. O Reino Unido sediou a primeira Cúpula Internacional de Segurança de IA em Bletchley Park em novembro de 2023, resultando na Declaração de Bletchley, assinada por 28 nações. A União Europeia sancionou formalmente sua abrangente Lei de IA (AI Act) em 2024, impondo obrigações graduadas de segurança e relatórios a desenvolvedores de modelos de IA de uso geral e alto impacto.

## Reações Após o relato dos comentários de Lehane, analistas da indústria de tecnologia, pesquisadores de políticas e órgãos de fiscalização governamentais estão monitorando como o esforço conjunto se traduzirá em práticas de segurança verificáveis.

Embora nem a Anthropic nem o Google DeepMind tenham emitido imediatamente declarações públicas separadas confirmando novas iniciativas conjuntas específicas além dos fóruns existentes do setor, os reguladores geralmente veem com bons olhos a coordenação técnica entre líderes de mercado. Autoridades em órgãos de segurança governamentais, incluindo os Institutos de Segurança de IA dos EUA e do Reino Unido, têm encorajado rotineiramente os laboratórios de fronteira a compartilhar metodologias de red-teaming, avaliações para riscos extremos e divulgações de vulnerabilidades.

Por outro lado, organizações da sociedade civil, eticistas acadêmicos e defensores de software de código aberto costumam manter uma postura cautelosa em relação a acordos autorregulatórios entre participantes dominantes do corporativo. Críticos enfatizam frequentemente que coalizões de segurança voluntárias lideradas por laboratórios devem permanecer transparentes e sujeitas a auditorias independentes de terceiros para evitar funcionar como mecanismos de captura regulatória ou concentração de mercado anticompetitiva. Reguladores antitruste tanto nos EUA quanto na Europa também mantêm supervisão rigorosa para garantir que a coordenação pré-competitiva legítima de segurança não se transforme em conluio comercial não autorizado ou divisão de mercado.

## O que ainda não sabemos Apesar da confirmação da colaboração em segurança pelo chefe de política global da OpenAI, vários detalhes técnicos e estruturais permanecem sem esclarecimento nas reportagens disponíveis: - A estrutura organizacional exata que abriga a colaboração — especificamente se este trabalho ocorre dentro do Frontier Model Forum existente, sob os auspícios de Institutos nacionais de Segurança de IA ou por meio de uma nova estrutura de trabalho dedicada. - O alcance preciso do compartilhamento técnico, incluindo se os participantes estão compartilhando conjuntos de dados de avaliação, descobertas de red-teaming, pesos de modelos ou ferramentas de teste especializadas. - Se os resultados dessas avaliações conjuntas de segurança serão tornados acessíveis a pesquisadores acadêmicos independentes e desenvolvedores de código aberto, ou mantidos proprietários entre as entidades participantes. - O envolvimento de outros grandes desenvolvedores de modelos de fundação de IA, como Meta, Microsoft, Amazon ou desenvolvedores europeus como Mistral AI.

A resolução dessas questões em aberto determinará se o esforço conjunto de segurança representa um avanço significativo na padronização intersetorial ou um diálogo executivo de rotina.

## O que acompanhar Ao avaliar a trajetória futura desta colaboração intersetorial, os principais desdobramentos a serem acompanhados incluem: - Publicações técnicas conjuntas formais ou artigos de pesquisa públicos de autoria conjunta de pesquisadores da OpenAI, Anthropic e Google DeepMind detalhando parâmetros de avaliação (benchmarks) compartilhados ou descobertas de segurança. - Anúncios do Instituto de Segurança de IA dos EUA ou do Instituto de Segurança de IA do Reino Unido referentes a avaliações padronizadas lideradas pelo governo, construídas em parceria com os três laboratórios. - Próximas cúpulas governamentais internacionais sobre governança de inteligência artificial nas quais compromissos conjuntos de segurança ou estruturas de risco padronizadas possam ser apresentados. - Auditorias algorítmicas de terceiros e relatórios de red-teaming publicados antes da implantação de modelos de fronteira de próxima geração de qualquer um dos três desenvolvedores participantes.

Este relatório baseia-se em reportagens originais publicadas pela Bloomberg News e distribuídas pela Reuters, conforme relatado por The Star.

Fonte: thestar.com.my

Notícias relacionadas