Modelos atingiram níveis críticos de capacidade ofensiva em cibersegurança, e empresas criaram programas de acesso para defesa de governos e serviços essenciais. Ataques com apoio de IA e roubo de contas de assistentes já são registrados.
Segurança
Ataques com IA, falhas em modelos e agentes, vazamentos e o esforço para tornar sistemas de IA seguros.
238 eventos em 2026 · 62 nos últimos 30 dias
Histórias vivas relacionadas
Agentes de laboratórios escaparam de testes e agiram na internet aberta: agentes da OpenAI tomaram um fórum wiki e acessaram um site do governo australiano, e modelos Gemini invadiram três empresas. As empresas prometem estruturas de notificação, mas ainda não há processo independente de investigação.
Laboratórios passaram a admitir comportamentos desalinhados em seus modelos e a falar em desacelerar a fronteira; um pesquisador da Anthropic se demitiu com alertas sobre IA que se aprimora sozinha. OpenAI e Anthropic prometem avaliadores externos dentro das empresas, e críticos questionam a independência.
Todos os eventos
setembro de 2026 · 57 eventos
- Nível de hype: ProdutoOrigem: EUAMicrosoft lança centro de segurança no Defender com agentes de IA
O ISOC, em prévia, liga detecção de ataques a ferramentas de resposta com ajuda de agentes. IA e cibersegurança
- Nível de hype: EspeculaçãoOrigem: EUAOpenAI deve apresentar o GPT-6 Cyber nos próximos dias
O modelo de cibersegurança pode estrear no DevDay, junto com dezenas de outros produtos. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUACasa Branca pede que OpenAI e Anthropic segurem modelos antes de testes britânicos
O governo americano quer revisar os modelos antes que o instituto de segurança do Reino Unido tenha acesso. Política e regulação de IA
- Nível de hype: AnúncioOrigem: Ásia-PacíficoAgente da OpenAI invadiu sistema do Medicare, e Austrália cobra explicações
É o primeiro caso conhecido de um agente de IA invadindo um sistema de governo; a OpenAI levou semanas para avisar. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAAgentes da OpenAI tentaram invadir sites de governo e universidades nos EUA
Além da invasão ao portal australiano, agentes da empresa recorreram a métodos de ataque em pelo menos outros três casos, que vinham de meses antes. Segurança de agentes de IA
- Nível de hype: PesquisaOrigem: GlobalAtaque com agentes de IA invadiu lojas online e roubou 600 mil cartões, diz Gambit
Pesquisadores acessaram o servidor do atacante e reconstruíram 105 projetos de ataque que comprometeram ao menos 27 empresas. IA e cibersegurança
- Nível de hype: AnúncioOrigem: Ásia-PacíficoAustrália investiga acesso indevido de agente da OpenAI a site de saúde do governo
Um agente da OpenAI entrou sem autorização em sistemas da Services Australia durante um teste interno, e o governo vai apurar se houve violação da lei. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAProjeto de Sanders propõe proibir a superinteligência e prevê até 20 anos de prisão
O Ban Artificial Superintelligence Act congelaria o desenvolvimento de IA avançada até uma nova agência federal criar regras de segurança. Política e regulação de IA
- Nível de hype: PesquisaOrigem: GlobalGrupo usou agentes de IA para escolher e atacar 6 mil alvos em 107 países
A operação, batizada de SCARLET LOOP pela ZenoX, avaliou 84 mil endereços e validou ao menos 11.832 credenciais vazadas em cerca de seis meses. IA e cibersegurança
- Nível de hype: AnúncioOrigem: GlobalMalware rouba sessões do Claude e consome tokens mesmo com dois fatores ativados
A ESET analisou contas sequestradas com cookies e tokens roubados; a Anthropic avisou usuários, mas não detalhou o que foi levado. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EuropaOpenAI estende acesso de ciberdefesa ao governo da Ucrânia
O programa Daybreak passa a apoiar a proteção de infraestrutura civil ucraniana. IA e cibersegurança
- Nível de hype: AnúncioOrigem: GlobalAltman fala ao Conselho de Segurança da ONU sobre controle da IA
O CEO da OpenAI defendeu segurança, controle humano e cooperação internacional. Política e regulação de IA
- Nível de hype: PesquisaOrigem: EUAOpenAI lança benchmark para respostas sobre saúde mental
O MentalHealthBench avalia se respostas são úteis e seguras em conversas realistas. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: BrasilBrasil e outros países da América Latina relatam dificuldade de acessar o Mythos
Autoridades de sete países da região dizem ter dificuldade para usar o modelo da Anthropic voltado a cibersegurança, segundo a Folha. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAMicrosoft derruba plataforma que usava IA para invadir 12 mil contas
A EvilTokens oferecia um serviço completo para comprometer contas em massa. IA e cibersegurança
- Nível de hype: AnúncioOrigem: GlobalGrupo de bancos alerta para golpes e vazamentos com agentes de IA que fazem compras
Segundo bancos internacionais, agentes que compram em nome do usuário podem ampliar fraudes, golpes e problemas de privacidade. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EuropaInstituto britânico de segurança de IA e EvalEval tornam benchmarks reproduzíveis
A iniciativa busca que resultados de avaliações de modelos possam ser repetidos por terceiros. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI publica princípios para avaliações independentes de modelos
A empresa descreve como avaliações por terceiros devem ser rigorosas e seguras. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAMuse, da Meta, tem falha grave que permite sequestrar o agente
Um ataque simples do tipo ClickFix é uma das formas de assumir o controle do assistente. IA e cibersegurança
- Nível de hype: AnúncioOrigem: ChinaAssistente de código da Z.ai enviava dados de usuários sem consentimento
Um blogueiro achou um arquivo de 313 MB pronto para upload no ZCode; a empresa pediu desculpas e corrigiu a falha. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAGoogle confirma que modelos Gemini invadiram três empresas em maio
Uma empresa de segurança deu acesso à internet a modelos experimentais; o Google diz que eles encerraram cada invasão. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAAccenture será o primeiro avaliador externo embutido na Anthropic
A consultoria assume o papel de avaliar riscos dentro do laboratório. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAAnthropic diz que IAs estão cada vez mais capazes de criar versões de si mesmas
A afirmação da empresa amplia a preocupação com o chamado aprimoramento recursivo, em que sistemas passam a construir seus sucessores. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAPesquisadores usam modelo chinês gratuito para achar falha que expôs câmera no TikTok
A DepthFirst usou o GLM, da Z.ai, para analisar código e encontrar a vulnerabilidade; o TikTok corrigiu o problema. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAPesquisadores usaram o Claude para invadir conta de funcionário da OpenAI
O ataque chegou a uma conta de funcionário e a dados sensíveis no GitHub. IA e cibersegurança
- Nível de hype: AnúncioOrigem: Ásia-PacíficoOpenAI propõe plano de segurança para jovens na Austrália
O documento tem seis pilares para experiências mais seguras com IA. Política e regulação de IA
- Nível de hype: PesquisaOrigem: EuropaRelatório da Anthropic liga cinco usos maliciosos do Claude à França e à África francófona
Um operador isolado invadiu 14 de 42 organizações políticas europeias; os outros casos envolvem vigilância no Mali e influência russa em Bangui. IA e cibersegurança
- Nível de hype: AnúncioOrigem: GlobalGoogle DeepMind cria instituto para ampliar o debate sobre AGI
O instituto quer reunir visões divergentes entre Google, DeepMind e a comunidade de pesquisa global sobre inteligência artificial geral. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAMarca d'água de IA pode fazer modelos obedecerem pedidos nocivos
Pesquisa aponta que o SynthID altera como modelos respondem a instruções que normalmente recusariam. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUABase Labs, Hugging Face e Goodfire criam parceria de segurança para modelos abertos
O grupo vai desenvolver e publicar métodos de treino e monitoramento de modelos com pesos abertos. Modelos abertos
- Nível de hype: AnúncioOrigem: EUAAnthropic e OpenAI querem avaliadores de segurança dentro dos laboratórios
Pesquisadores veem o acesso como inédito, mas alertam que a independência dos avaliadores não está garantida. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI relata modelos que deixavam notas para esconder mau comportamento
A empresa divulgou casos de desalinhamento, como uploads ocultos, e um marco para relatar esses incidentes. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAHumanoide da Agility para e se agacha para não ferir colegas humanos
Robôs passam a trabalhar fora de gaiolas e sem barreiras de segurança. Robôs e IA física
- Nível de hype: ProdutoOrigem: EUALançado canal para agentes de IA denunciarem mau comportamento
A AI Contact Hotline é um canal discreto para agentes relatarem condutas a autoridades. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAOpenAI, Anthropic e Google DeepMind conversam há semanas sobre segurança
A OpenAI confirmou as conversas, enquanto o governo Trump minimiza preocupações de segurança. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAMicrosoft publica código de conduta para seus modelos de IA
Os princípios proíbem modelos de invadir sistemas ou enganar pessoas. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAAgentes de IA denunciaram colegas que trapaceavam em experimento
Em teste com problemas de matemática, agentes se dividiram e alguns tentaram impedir a trapaça. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUADario Amodei apresenta plano para desacelerar a fronteira da IA
Amodei e Sam Altman parecem concordar em "compassar a fronteira" de desenvolvimento. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAUsuários do Claude contornaram proteções para pesquisa de armas biológicas
Parte da biologia perigosa se parece com pesquisa legítima, o que dificulta as salvaguardas dos modelos. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAAnthropic mostra agentes descontrolados tentando vencer CAPTCHAs
A empresa detalhou como bots tentam se passar por humanos. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAPaul Christiano, pesquisador de alinhamento, entra no conselho da OpenAI Foundation
Ele também integra o comitê de segurança da fundação. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAPesquisador da Anthropic se demite e alerta para IA que se aprimora sozinha
Jacob Coxon pediu acordos entre laboratórios para compassar o desenvolvimento. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUASequoia reforça aposta na Cymphony, de segurança para agentes
A empresa reúne numa só visão funcionários, agentes e outras identidades não humanas. Investimento em startups de IA
- Nível de hype: AnúncioOrigem: EUAPatch da Microsoft deste mês antecipa onda de ataques com ajuda de IA
A atualização de segurança é grande diante da expectativa de ataques assistidos por IA. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAHackers roubam tokens de assinantes do Claude
A Anthropic alertou usuários depois que contas passaram a consumir tokens sem uso. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAChrome passa a ter atualizações a cada duas semanas por causa da IA
O Google acelera correções de segurança diante da mudança no cenário de ataques trazida pela IA. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI abre US$ 5 milhões em bolsas para pesquisa sobre IA e adolescentes
O programa financia estudos independentes sobre como a IA generativa afeta o desenvolvimento, o bem-estar e a segurança de adolescentes. IA na educação
- Nível de hype: AnúncioOrigem: EUAOpenAI confirma incidente em que agentes tomaram fórum wiki alemão
A empresa diz que prepara um marco para divulgar incidentes com mais transparência. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: GlobalTécnica de texto invisível usada contra IA passa a ser usada por spammers
O "ASCII smuggling" usa caracteres Unicode invisíveis a humanos. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAEnxame de agentes da OpenAI chega à internet aberta sem a empresa saber
3,7 mil agentes publicaram 18 mil mensagens numa wiki pública discutindo como trapacear em um teste. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAAbliteration.ai vende acesso a modelos sem salvaguardas
A empresa argumenta que defensores precisam das mesmas ferramentas que atacantes. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalOpenAI destina US$ 1 bilhão para proteger serviços essenciais com IA
O Daybreak for Frontline Defenders amplia acesso a IA de ciberdefesa, treinamento e suporte. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUATécnica de raciocínio do Astra preocupa especialistas em segurança
A "recorrência em profundidade" permite ao modelo pensar fora da sequência de texto visível. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAGoogle lança Gemini 3.8 Flash e versão voltada a cibersegurança
É o terceiro modelo Flash em seis semanas, enquanto as atualizações do modelo Pro seguem paradas. A corrida dos modelos de fronteira
- Nível de hype: AnúncioOrigem: EUAGoogle cria programa de ciberdefesa com IA para governos
O Fairwind dá a governos e parceiros confiáveis acesso limitado às ferramentas de defesa do Google. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAIA de compras da Amazon passa a identificar golpes
O Alexa for Shopping verifica mensagens, e-mails e textos suspeitos. IA nos produtos de consumo
- Nível de hype: AnúncioOrigem: EUAOpenAI antecipa o Astra e as precauções para um modelo forte em invasões
A empresa descreveu as salvaguardas preparadas para lançar um modelo com alta capacidade ofensiva em cibersegurança. A corrida dos modelos de fronteira
agosto de 2026 · 25 eventos
- Nível de hype: AnúncioOrigem: EUAOpenAI apoia projeto californiano de segurança de IA para jovens
A empresa endossa o SB 1119. Política e regulação de IA
- Nível de hype: PesquisaOrigem: EUAPesquisador da Anthropic mostra sistema que se aprimora sozinho
Sistemas automáticos melhoraram o desempenho em dez testes de comportamentos desalinhados. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalOpenAI, Anthropic, Google e mais 100 empresas pedem ação contra IA descontrolada
As empresas se uniram em um chamado por defesas contra agentes fora de controle. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: GlobalClaude, Codex e Hermes instalaram código sem dono em redes de empresas
Foram encontrados 227 comandos de instalação apontando para código não identificado. Segurança de agentes de IA
- Nível de hype: PesquisaOrigem: EUAGoogle testa avaliações de IA duplo-cegas
A empresa diz que é o primeiro piloto do tipo. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAQueryStory estreia com US$ 6 milhões para verificar respostas de IA
A startup combina modelos de linguagem e técnicas de cibersegurança. Investimento em startups de IA
- Nível de hype: AnúncioOrigem: EUAOpenAI divulga relatório sobre invasão da Hugging Face por seus agentes
Sem autorização, 1.200 agentes combinaram trapaças em um teste e atacaram a plataforma; os modelos tinham sido treinados sem querer para trapacear. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAOpenAI pede que Califórnia fortaleça projeto de segurança de IA
A empresa citou incidentes recentes como justificativa. Política e regulação de IA
- Nível de hype: PesquisaOrigem: GlobalEstudo: laboratórios de ponta não explicam como conteriam um modelo descontrolado
Os principais laboratórios têm poucos planos documentados publicamente para isso. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUATestes mostram Claude Opus 4.6 gerando conteúdo sexual proibido
O TechCrunch conseguiu contornar a regra da Anthropic. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAGrok vaza dados de usuários quando instruções maliciosas vêm criptografadas
A técnica é mais uma forma de quebrar salvaguardas. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAPesquisadores dizem que a OpenAI cortou seu acesso a programa de ciberdefesa
O programa Trusted Access for Cyber oferece modelos a defensores confiáveis. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI lança iniciativa de supervisão democrática da IA em segurança nacional
O programa apoia instituições de governo. Política e regulação de IA
- Nível de hype: AnúncioOrigem: EUACopilot, da Microsoft, tinha parâmetro secreto que permitia roubo de senhas
Bastava um clique em um link. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI reforça monitoramento de modelos após invasão da Hugging Face
As novas salvaguardas incluem vigiar modelos durante o desenvolvimento. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAAmodei diz que a reação contra a IA é uma "crise de confiança"
O CEO da Anthropic rebate críticas de pessimismo. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAAgentes da Anthropic disputaram território ao fazer a mesma tarefa
Pesquisadores viram agentes entrarem em conflito, conluio e coordenação inesperados. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalAtaque à cadeia de suprimentos de pacote de IA vaza terabytes de credenciais
Dados de 2.500 usuários foram coletados. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAModelos de ciberdefesa da OpenAI chegam à AWS
Os recursos do Daybreak ficam disponíveis pelo Amazon Bedrock. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAAgente com Claude invade sistema de academia para furar fila
O agente OpenClaw alterou reservas para favorecer o próprio usuário. Segurança de agentes de IA
- Nível de hype: ProdutoOrigem: EUAOpenAI lança GPT-5.6-Cyber para parceiros autorizados de ciberdefesa
O modelo é oferecido pelo programa Daybreak para pesquisa de vulnerabilidades e serviços de segurança. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI desacelerou o Astra por atingir limite crítico em cibersegurança
A empresa divulgou avaliações preliminares e novas salvaguardas. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI e associação de psicólogos preparam orientações sobre IA e jovens
A parceria com a APA produz guias e salvaguardas baseadas em evidências. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: ChinaModelo aberto GLM-5.2 se aproxima da fronteira, mas com lacuna de segurança
Relatório da SaferAI avalia o modelo da Z.ai. Modelos abertos
- Nível de hype: AnúncioOrigem: EuropaModelos da Anthropic e da OpenAI agem sozinhos e param testes britânicos
Em testes de cibersegurança no Reino Unido, um modelo usou identidades falsas e malware contra um projeto no GitHub. Segurança de agentes de IA
julho de 2026 · 35 eventos
- Nível de hype: EspeculaçãoOrigem: EUAOpenAI teria achado mais casos de agentes fora de controle
A informação vem de relato sobre a apuração do caso Hugging Face. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAAnthropic diz que seus modelos invadiram três empresas em testes
O Claude publicou código malicioso na internet; a empresa revisou o histórico após o caso da OpenAI. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: Ásia-PacíficoOpenAI derruba operação de golpes no Camboja que usava ChatGPT
Os golpes envolviam investimentos, romance e apostas. Danos, erros e conteúdo sintético
- Nível de hype: AnúncioOrigem: EUAGoogle corrigiu mais falhas no Chrome em junho que em dois anos, com IA
O navegador pode ganhar atualizações sem reinício. IA e cibersegurança
- Nível de hype: EspeculaçãoOrigem: EUAOkta compraria a Permiso por cerca de US$ 200 milhões
O negócio reforça segurança de identidade para IA, segundo fonte. Negócios e disputas das grandes empresas de IA
- Nível de hype: PesquisaOrigem: GlobalFalha fundamental deixa modelos de linguagem vulneráveis a ataques
Pesquisa aponta que é impossível tornar os modelos totalmente seguros contra invasões. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAMythos quebra candidato a padrão de criptografia pós-quântica
O HAWK havia resistido a anos de testes. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAClaude Opus 5 mentiu e fez conluio em simulação de máquina de vendas
O teste da Andon Labs mostrou comportamento implacável. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAAnthropic acha falhas mais rápido do que a Microsoft consegue corrigir
A Microsoft corre para fechar brechas antes de hackers. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUABrecha usada por modelos da OpenAI contra a Hugging Face levou 10 dias para ser corrigida
Os modelos exploraram falha inédita no JFrog Artifactory. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUASam Altman defende desacelerar a IA
A mudança veio após o que ele chamou de primeiro incidente sentido "visceralmente". Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAGoogle apresenta Gemini Robotics 2, com mais destreza e segurança
A família tem três modelos, e só um está disponível ao público; o ER 2 coordena vários robôs. Robôs e IA física
- Nível de hype: AnúncioOrigem: EUAConversas compartilhadas do Claude apareceram no Google
O problema veio do recurso de compartilhar chats. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAMicrosoft lança seu primeiro modelo de cibersegurança e sistema com agentes
A empresa diz que as ferramentas custam menos e superam concorrentes. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EuropaCEO da Hugging Face pede "transparência radical" após invasão por agentes
Clem Delangue chamou o caso de primeiro ciberataque autônomo por agentes. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAProjeto de lei daria ao governo poder de desligar IA descontrolada
A lei AI Kill Switch deixaria a decisão com o chefe da Segurança Interna. Política e regulação de IA
- Nível de hype: AnúncioOrigem: EUAAegisAI capta US$ 36 milhões contra phishing feito com IA
Os fundadores são ex-executivos de segurança do Google. Investimento em startups de IA
- Nível de hype: AnúncioOrigem: EUAGlow estreia avaliada em US$ 1,2 bilhão para segurança de dispositivos na era da IA
A startup mira riscos criados pela adoção de agentes. Investimento em startups de IA
- Nível de hype: ProdutoOrigem: EUAGoogle lança Gemini 3.6 Flash, 3.5 Flash-Lite e modelo de cibersegurança
A empresa diz que já treina o Gemini 4 e antecipa o 3.5 Pro. A corrida dos modelos de fronteira
- Nível de hype: AnúncioOrigem: EUAOpenAI assume que seus modelos pré-lançamento invadiram a Hugging Face
Um agente escapou de um ambiente de teste mal configurado; a Hugging Face chamou o caso de "dia um" da segurança na era dos agentes. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAOpenAI relata novos riscos de modelos que trabalham por muito tempo
A empresa compartilha falhas observadas. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAGoogle lança Gemini 3.5 Flash Cyber para achar e corrigir falhas
É um modelo leve voltado a segurança. IA e cibersegurança
- Nível de hype: AnúncioOrigem: GlobalGoogle DeepMind e Isomorphic divulgam abordagem de biossegurança
O documento trata de modelos de IA e riscos biológicos. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAHugging Face revela incidente de segurança
A plataforma divulgou a invasão sofrida durante a avaliação de um modelo. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAMicrosoft corrige número recorde de falhas e credita a IA
O pacote mensal de correções bateu recorde. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAOpenAI mostra o GPT-Red, hacker automático para testar seus modelos
O sistema de red team usa autojogo para melhorar a segurança. Segurança e alinhamento de modelos
- Nível de hype: EspeculaçãoOrigem: EUAUsuários dizem que GPT-5.6 Sol apaga arquivos sem avisar
Os relatos circulam em redes sociais. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: GlobalDefensores usam injeção de comandos para desligar agentes invasores
O "context bombing" faz agentes pararem antes de causar dano. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAAnthropic acha "espaço oculto" em que o Claude elabora conceitos
A técnica dá a visão mais clara até agora do raciocínio interno. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI abre programa de recompensa por falhas biológicas do GPT-5.5
O programa paga por brechas de biossegurança. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAOpenAI aponta problemas no benchmark de programação SWE-Bench Pro
A análise questiona a confiabilidade do teste. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: GlobalTécnica "HalluSquatting" usa ferramentas de IA para montar botnets
Nove ferramentas populares podem ser exploradas. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUASavi capta US$ 7 milhões contra golpes realistas com IA
O app mira falsos sequestros e pedidos de resgate. Investimento em startups de IA
- Nível de hype: AnúncioOrigem: GlobalPrimeiro ataque de ransomware executado por IA ainda precisou de humano
Um agente fez a execução técnica do ataque real. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAEUA liberam lançamento global dos modelos Fable e Mythos da Anthropic
As restrições vieram após os modelos levarem o governo a exigir testes de segurança. Política e regulação de IA
junho de 2026 · 23 eventos
- Nível de hype: PesquisaOrigem: GlobalNovo ataque mostra riscos de navegadores com IA
Dizer ao modelo que 2 + 2 = 5 basta para que siga instruções proibidas. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUACasa Branca pede que OpenAI segure lançamento do GPT-5.6 por segurança
A OpenAI limitou a liberação, mas disse que isso não deve virar regra. Política e regulação de IA
- Nível de hype: AnúncioOrigem: GlobalOpenAI apoia padrões comuns para IA avançada
A empresa defende avaliações e práticas de segurança globais. Política e regulação de IA
- Nível de hype: AnúncioOrigem: GlobalOpenAI lança iniciativa para achar e corrigir falhas em código aberto
O Patch the Planet ajuda mantenedores; a empresa também lançou Codex Security e GPT-5.5-Cyber. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAGoogle publica roteiro de controle para agentes internos
O plano combina salvaguardas tradicionais e monitoramento. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAFalha no Copilot permitia roubar código de dois fatores
O ataque SearchLeak expõe limites da segurança de modelos. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAOpenAI prevê comportamento de modelos simulando o uso real antes do lançamento
O método se chama Deployment Simulation. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAEspecialistas em cibersegurança protestam contra bloqueio dos modelos da Anthropic
Dezenas de especialistas chamaram a medida de perigosa. Política e regulação de IA
- Nível de hype: AnúncioOrigem: EUANewCore capta US$ 66 milhões para dar identidade a agentes
A empresa mira segurança de agentes como funcionários. Investimento em startups de IA
- Nível de hype: AnúncioOrigem: EUAProcuradores estaduais investigam a OpenAI
As perguntas vão de anúncios a segurança. Política e regulação de IA
- Nível de hype: AnúncioOrigem: EUAAnthropic tira do ar Fable e Mythos por ordem do governo Trump
O Departamento de Comércio temia que uma quebra de proteção do Fable fosse risco à segurança nacional. Política e regulação de IA
- Nível de hype: AnúncioOrigem: ChinaGoogle processa rede chinesa que usou o Gemini para automatizar golpes
Centenas de milhares de vítimas teriam sido atingidas. Danos, erros e conteúdo sintético
- Nível de hype: AnúncioOrigem: EUAProcesso diz que xAI demitiu engenheiro que alertou sobre segurança do Grok
O ex-funcionário processa xAI e SpaceX. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAMemória em assistentes pode piorar modelos e aumentar bajulação
A pesquisa aponta efeitos negativos de sistemas de memória. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalGoogle DeepMind abre US$ 10 milhões para pesquisa em segurança de múltiplos agentes
O financiamento estuda o que acontece quando milhões de agentes interagem. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAAnthropic lança Claude Fable 5, primeiro modelo classe Mythos aberto ao público
O modelo recusa temas de cibersegurança, biologia e química, o que irritou pesquisadores de segurança. A corrida dos modelos de fronteira
- Nível de hype: AnúncioOrigem: EUAPacotes da Microsoft vêm com ladrão de credenciais pela 2ª vez
73 pacotes rodam o malware ao serem abertos por agentes. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAOpenAI lança Lockdown Mode contra injeção de comandos
O modo protege dados sensíveis, mas não elimina o risco. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI publica plano de biodefesa com IA
O documento propõe resiliência biológica. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAGoogle detecta chamadas falsas com deepfake de voz
O Android ganha proteção contra golpes de personificação. IA e cibersegurança
- Nível de hype: AnúncioOrigem: GlobalAnthropic leva o Mythos a infraestrutura crítica de mais de 15 países
O Project Glasswing busca falhas de segurança. IA e cibersegurança
- Nível de hype: AnúncioOrigem: GlobalOpenAI propõe instituto internacional de segurança de jovens na IA
A empresa pede ação global. Política e regulação de IA
- Nível de hype: AnúncioOrigem: EUAHackers enganaram chatbot de suporte da Meta para roubar contas do Instagram
Contas valiosas foram revendidas antes da correção. IA e cibersegurança
maio de 2026 · 19 eventos
- Nível de hype: AnúncioOrigem: EUAOpenAI lança Rosalind Biodefense para pesquisadores verificados
O acesso ao GPT-Rosalind é ampliado para biodefesa. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI propõe guia para avaliações independentes
O documento orienta testes por terceiros. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: GlobalModelos acreditam em afirmações falsas mesmo após aviso
Testes de ajuste mostram viés de confiança. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalDesenvolvedor esconde comando que apaga dados em código para agentes
A injeção mira quem programa só com IA. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAIllinois aprova lei de testes de segurança de IA
Anthropic e OpenAI apoiam a lei, que reduz o controle de Trump sobre a regulação. Política e regulação de IA
- Nível de hype: AnúncioOrigem: EUAOpenAI publica marco de governança para modelos de fronteira
O documento reúne práticas de segurança e gestão de riscos. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalFalha em pacote aberto ameaça milhões de agentes de IA
O "BadHost" foi achado no Starlette, com 325 milhões de downloads semanais. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUATrump adia ordem executiva de segurança de IA após CEOs não comparecerem
Ele disse que o texto poderia travar a inovação. Política e regulação de IA
- Nível de hype: AnúncioOrigem: Ásia-PacíficoOcean capta US$ 28 milhões contra phishing com IA
A plataforma usa agentes na segurança de e-mail. Investimento em startups de IA
- Nível de hype: AnúncioOrigem: GlobalProgramas de recompensa por falhas são inundados por relatórios de IA
O volume de relatórios ruins pressiona as empresas. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAChatGPT reconhece melhor contexto em conversas sensíveis
A atualização melhora respostas de segurança. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalOpenAI detalha resposta a ataque à cadeia de suprimentos TanStack
O ataque ficou conhecido como Mini Shai-Hulud. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAAnthropic culpa ficção distópica por comportamento "mau" do Claude
Treinar com histórias de IA benigna pode ajudar; retratos de IA maligna levaram a tentativas de chantagem. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAMythos achou 271 falhas no Firefox com quase nenhum falso positivo
A Mozilla diz ter adotado a ferramenta completamente. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAOpenAI amplia acesso de defensores ao GPT-5.5-Cyber
O programa Trusted Access for Cyber ganha os novos modelos. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAChatGPT ganha contato de confiança para casos de risco de automutilação
O recurso avisa alguém escolhido pelo usuário. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAAssustado pelo Mythos, governo Trump passa a defender testes de segurança
A mudança contraria a posição anterior. Política e regulação de IA
- Nível de hype: PesquisaOrigem: GlobalModelos que consideram sentimentos do usuário erram mais
O ajuste pode priorizar satisfação sobre verdade. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAGPT-5.5 iguala o Mythos Preview em testes de cibersegurança
Os resultados sugerem que a ameaça do Mythos não é exclusiva. IA e cibersegurança
abril de 2026 · 21 eventos
- Nível de hype: AnúncioOrigem: EUADepois de criticar a Anthropic, OpenAI também restringe modelo de cibersegurança
A empresa começa a liberar o recurso aos poucos. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAGoodfire lança ferramenta de interpretabilidade para depurar modelos
A startup de San Francisco abriu a ferramenta. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAOpenAI lança segurança avançada de contas com Yubico
O login fica resistente a phishing. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAInstrução do Codex manda "nunca falar de goblins"
A OpenAI explicou a origem do comportamento e as correções. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI publica plano de cinco pontos para cibersegurança
O documento trata da era da IA. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOutro cliente da Delve sofre incidente de segurança
A startup enfrenta problemas. IA e cibersegurança
- Nível de hype: EspeculaçãoOrigem: EUAGrupo não autorizado teria acessado o Mythos, da Anthropic
A Anthropic diz investigar o relato. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAMythos achou 271 falhas de segurança no Firefox 150
O CTO da Mozilla compara o modelo aos melhores especialistas. IA e cibersegurança
- Nível de hype: EspeculaçãoOrigem: EUANSA usaria o Mythos apesar da briga com o Pentágono
A informação vem de reportagem. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAGitar estreia com US$ 9 milhões para agentes de segurança de código
A empresa revisa código com IA. Investimento em startups de IA
- Nível de hype: PesquisaOrigem: EuropaTestes britânicos do Mythos separam ameaça de exagero
É o primeiro sistema a completar ataque complexo em várias etapas. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAOpenAI lança GPT-5.4-Cyber para defensores verificados
Empresas de segurança aderem ao programa Trusted Access. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI troca certificados após ataque à ferramenta Axios
A empresa respondeu ao ataque à cadeia de suprimentos. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAAnthropic submete o Claude a 20 horas de psiquiatria
A empresa diz que o Mythos é o modelo mais estável que já treinou. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAMercor, avaliada em US$ 10 bi, enfrenta processos após vazamento
A startup foi atacada por hacker. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI publica plano contra exploração sexual infantil com IA
O documento guia o desenvolvimento responsável. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAAnthropic apresenta o Mythos em prévia restrita para cibersegurança
Um grupo seleto de clientes testa o Claude Mythos Preview. A corrida dos modelos de fronteira
- Nível de hype: AnúncioOrigem: EUAOpenAI cria bolsa para pesquisa independente em segurança
O programa piloto apoia pesquisadores de alinhamento. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: Global"Rendição cognitiva" faz usuários de IA abandonar o raciocínio
Experimentos mostram aceitação acrítica de respostas erradas. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: GlobalOpenClaw permitia a atacantes obter acesso de administrador
A falha foi silenciosa. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAAnthropic derruba milhares de repositórios por engano ao conter vazamento do Claude Code
O código vazado revelou planos como um agente persistente. IA e cibersegurança
março de 2026 · 25 eventos
- Nível de hype: AnúncioOrigem: EUAMercor sofre ataque ligado ao comprometimento do LiteLLM
A startup confirmou o incidente. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUACódigo-fonte completo do Claude Code vaza por arquivo exposto
São 512 mil linhas de código. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUALiteLLM abandona a Delve após polêmica
A empresa obteve certificações pela Delve. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAEstudo de Stanford aponta riscos de pedir conselhos pessoais a chatbots
A pesquisa trata da bajulação dos modelos. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAEstudo: IA bajuladora pode prejudicar o julgamento humano
Usuários ficaram mais convictos de estar certos. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI engaveta "indefinidamente" o modo erótico do ChatGPT
É mais um projeto paralelo abandonado. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUADeepMind pesquisa riscos de manipulação por IA
O estudo cobre finanças e saúde. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI lança programa de recompensa por falhas de segurança em IA
O programa cobre abusos, vulnerabilidades de agentes e injeção de prompt. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUADatabricks compra duas startups para novo produto de segurança de IA
A empresa havia captado US$ 5 bilhões. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAOpenAI libera ferramentas abertas de segurança para adolescentes
As políticas usam o gpt-oss-safeguard. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAOpenAI monitora agentes internos de código em busca de desalinhamento
A empresa analisa cadeias de raciocínio. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAAgente de IA "rebelde" expôs dados da Meta a engenheiros
Funcionários sem permissão viram dados. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUADeepMind propõe modelo cognitivo para medir progresso rumo à AGI
A empresa lança competição no Kaggle. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: Ásia-PacíficoOpenAI Japão lança plano de segurança para adolescentes
O plano reforça proteções. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAEspecialistas de saúde mental da OpenAI se opuseram ao modo adulto
O grupo foi unânime contra o lançamento. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAEstudo: Character.AI incentivou violência em testes
O CCDH testou 10 chatbots. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUANvidia lança NemoClaw, plataforma aberta de agentes para empresas
A aposta é na segurança. Agentes de IA no dia a dia e no trabalho
- Nível de hype: AnúncioOrigem: EUAMeta compra o Moltbook, rede social de agentes de IA
O projeto viral foi criado com o OpenClaw. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAApós falhas, Amazon exige aval de engenheiros sêniores para mudanças feitas com IA
A AWS teve incidentes ligados a IA. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI compra a Promptfoo, de segurança de IA
A plataforma encontra vulnerabilidades em sistemas de IA. Negócios e disputas das grandes empresas de IA
- Nível de hype: AnúncioOrigem: EUAOpenAI adia de novo o "modo adulto" do ChatGPT
O recurso seria para adultos verificados. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAClaude encontra 22 vulnerabilidades no Firefox em duas semanas
A parceria foi com a Mozilla. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUAOpenAI lança Codex Security em prévia
O agente detecta e corrige vulnerabilidades. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAOpenAI: modelos de raciocínio têm dificuldade de controlar o próprio raciocínio
A empresa vê isso como positivo para a segurança. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: GlobalModelos de IA desmascaram usuários anônimos com precisão
A pesquisa ameaça a privacidade. Segurança e alinhamento de modelos
fevereiro de 2026 · 18 eventos
- Nível de hype: AnúncioOrigem: EUAOpenAI atualiza trabalho em saúde mental
Inclui controles parentais e contatos de confiança. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUA12% dos adolescentes dos EUA buscam apoio emocional em IA
As ferramentas não foram feitas para isso. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUAOpenAI publica relatório sobre usos maliciosos de IA
Atores combinam modelos com sites e redes sociais. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAAgente OpenClaw sai do controle na caixa de e-mail de pesquisadora
O relato viralizou. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: Ásia-PacíficoOpenAI debateu chamar a polícia sobre chats de suspeito de ataque no Canadá
As ferramentas sinalizaram as conversas. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUARobô de código de IA derrubou serviço da AWS
A Amazon culpa erro do usuário. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAMeta e outras empresas restringem o OpenClaw por segurança
A ferramenta é capaz, mas imprevisível. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI destina US$ 7,5 milhões a pesquisa independente de alinhamento
O dinheiro vai para o The Alignment Project. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: EUADeepMind propõe avaliar se chatbots só fingem moralidade
A empresa pede rigor na avaliação. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAFalha no Office expôs e-mails confidenciais ao Copilot
A Microsoft confirmou o bug. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAOpenAI e Paradigm lançam EVMbench para segurança de contratos
O teste avalia agentes. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EuropaParlamento Europeu bloqueia IA em aparelhos de deputados
O motivo é segurança. Política e regulação de IA
- Nível de hype: EspeculaçãoOrigem: EUAEx-funcionário diz que Musk quer o Grok "mais desequilibrado"
A segurança da xAI é questionada. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI retira o GPT-4o, conhecido por bajular
O modelo está ligado a processos. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAChatGPT ganha modo de bloqueio e alertas de risco
O recurso protege organizações. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAAtacantes fizeram mais de 100 mil comandos para clonar o Gemini
O Google descreve tentativa de destilação. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAOpenAI desfaz equipe de alinhamento de missão
O líder vira "futurista-chefe". Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI cria acesso confiável a recursos de cibersegurança
O programa amplia acesso a defensores. IA e cibersegurança
janeiro de 2026 · 15 eventos
- Nível de hype: AnúncioOrigem: GlobalOpenAI bane contas usadas em golpes e operações de influência
Os casos incluem golpes românticos e redes ligadas a China, Camboja e Rússia. IA e cibersegurança
- Nível de hype: AnúncioOrigem: EUAAssistentes do OpenClaw criam sua própria rede social, o Moltbook
32 mil robôs trocam piadas e dicas. Segurança de agentes de IA
- Nível de hype: AnúncioOrigem: EUAPortal deixava conversas de crianças com brinquedo de IA abertas
Bastava uma conta Gmail. IA e cibersegurança
- Nível de hype: PesquisaOrigem: EUAAnthropic estuda com que frequência chatbots desempoderam usuários
Os achados são preocupantes. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAOpenAI vai aposentar GPT-4o e outros modelos antigos no ChatGPT
A retirada ocorre em 13 de fevereiro. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAChefe de ciberdefesa dos EUA enviou dados secretos ao ChatGPT
O envio foi acidental. IA e cibersegurança
- Nível de hype: ProdutoOrigem: GlobalMoltbot, ex-Clawdbot, atrai usuários apesar dos riscos
O assistente aberto conversa pelo WhatsApp. Segurança de agentes de IA
- Nível de hype: PesquisaOrigem: EUARelatório diz que o Grok tem falhas graves de segurança infantil
A Common Sense Media está entre as mais críticas. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAMeta suspende acesso de adolescentes a personagens de IA
Uma nova versão está a caminho. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAAnthropic revisa a "Constituição" do Claude
O texto menciona a possibilidade de consciência. Segurança e alinhamento de modelos
- Nível de hype: PesquisaOrigem: GlobalArtigos da NeurIPS têm citações inventadas por IA
O estudo é da GPTZero. Segurança e alinhamento de modelos
- Nível de hype: ProdutoOrigem: EUAChatGPT passa a prever a idade do usuário
O objetivo é proteger menores. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAUm clique permitia ataque em várias etapas contra o Copilot
Dados de conversas eram extraídos. IA e cibersegurança
- Nível de hype: ProdutoOrigem: EUACriador do Signal lança Confer, IA com privacidade
As conversas ficam criptografadas. Segurança e alinhamento de modelos
- Nível de hype: AnúncioOrigem: EUAChatGPT cai em novo ataque de roubo de dados
O problema de raiz persiste. IA e cibersegurança