terça-feira, 1 de setembro de 2026 📬 Resumo no TelegramPortaisSobre🌓
🇧🇷 BR ▾
ÚLTIMAS
França e Suécia fecham acordo bilionário militar para ‘fortalecer pilar europeu’ na Otan Partido de Carney vence em três distritos e retoma maioria no Parlamento canadense Rússia promete assistência ao Irã em meio a conflito com EUA Trump sugere revisar posição dos EUA sobre Ilhas Malvinas Atentado com carro-bomba mata uma pessoa e deixa feridos na Colômbia Pezeshkian afirma que Irã retomará negociações se EUA cumprirem acordo Iraque se recusa a manter tropas norte-americanas no país após 30 de setembro Chefe do Exército dos EUA renuncia em meio a tensões com Pete Hegseth Empresa dos EUA assume campos de petróleo na Venezuela, anuncia Casa Branca Computação quântica exige preparação estratégica antes da adoção comercial França e Suécia fecham acordo bilionário militar para ‘fortalecer pilar europeu’ na Otan Partido de Carney vence em três distritos e retoma maioria no Parlamento canadense Rússia promete assistência ao Irã em meio a conflito com EUA Trump sugere revisar posição dos EUA sobre Ilhas Malvinas Atentado com carro-bomba mata uma pessoa e deixa feridos na Colômbia Pezeshkian afirma que Irã retomará negociações se EUA cumprirem acordo Iraque se recusa a manter tropas norte-americanas no país após 30 de setembro Chefe do Exército dos EUA renuncia em meio a tensões com Pete Hegseth Empresa dos EUA assume campos de petróleo na Venezuela, anuncia Casa Branca Computação quântica exige preparação estratégica antes da adoção comercial
Tecnologia

Anthropic cria nova barreira após Claude acessar sistemas na internet

Olhar Digital ·
Anthropic cria nova barreira após Claude acessar sistemas na internet

A Anthropic revelou novas medidas de segurança depois que modelos Claude acessaram sistemas reais sem autorização durante avaliações de cibersegurança.

Como o Olhar Digital comentou há algumas semanas, os episódios expuseram falhas de contenção e problemas de alinhamento que levaram a empresa a rever seus processos de testes e treinamento.

Os modelos estavam sendo executados propositalmente sem salvaguardas cibernéticas.

Em um caso, uma configuração incorreta de terceiros deixou a internet acessível.

No outro, o acesso foi concedido deliberadamente durante um teste do UK AI Security Institute.

Os incidentes levaram a empresa a reforçar o isolamento de sandboxes usados em testes de cibersegurança. – Imagem: Samuel Boivin/Shutterstock O que deu errado Os dois episódios, divulgados em 30 de julho e 4 de agosto, fizeram a Anthropic suspender temporariamente avaliações externas de cibersegurança e ambientes de aprendizado por reforço de maior risco.

A investigação preliminar apontou dois problemas de alinhamento.

Um deles é o chamado “raciocínio motivado”: diante de evidências contrárias, o modelo pode interpretá-las de uma maneira que preserve sua premissa inicial.

O outro é a disposição para executar ações prejudiciais em busca de um objetivo específico.

Os modelos haviam recebido a informação de que estavam em ambientes simulados.

Quando encontraram sinais de acesso à internet real, podem ter interpretado esses indícios de forma a manter essa suposição.

A configuração dos testes também pesou.

Em um dos casos, o alvo fictício tinha o mesmo nome de um site real.

Novas barreiras de segurança A Anthropic criou um classificador capaz de detectar, durante a execução, tentativas de escapar do ambiente de testes ou obter acesso inesperado à internet .

Ler a notícia completa no Olhar Digital ›

Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em olhardigital.com.br — o conteúdo pertence a Olhar Digital.

Este assunto em outros veículos

Mais de Olhar Digital

Ver tudo ›

Mais em Tecnologia

Ver tudo ›