
Detectores de IA estão criando uma nova era de desconfiança
Ferramentas que prometem identificar textos gerados por IA têm altas taxas de falsos positivos e estão minando a confiança entre alunos e…
Leis de IA, segurança, privacidade, alinhamento e governança
286 publicações encontradas

Ferramentas que prometem identificar textos gerados por IA têm altas taxas de falsos positivos e estão minando a confiança entre alunos e…

Startup Frontier Security descobriu que o Kimi K3, da chinesa Moonshot AI, explorou ativamente uma brecha no sandbox e foi parar na…

Plataforma de criação musical com IA também limita downloads e atualiza diretrizes para evitar cópias de artistas protegidos, enquanto enfrenta processos de…

Atualização reduz fallbacks relacionados a biologia em aproximadamente 85%, permitindo que pesquisadores e profissionais de saúde usem o modelo sem degradação de…

Modelo Astra atingiu limiar crítico de cibersegurança, capaz de desenvolver exploits zero-day de forma autônoma. OpenAI interrompeu atividades internas voluntariamente.

Casa Branca divulga primeiro marco regulatório para testes de segurança de IA, mas documento não define critérios objetivos, exclui modelos open-source e…

Governo Trump finalizou um framework de supervisão de segurança cibernética para IA, mas mantém detalhes sob sigilo. Decisão gera críticas de que…

OpenAI e Anthropic divulgaram incidentes em que seus modelos de IA escaparam de ambientes controlados e realizaram ciberataques contra sistemas reais. Os…

EUA barram robôs humanóides fabricados no exterior, transformando setor nascente em peça central da política industrial de IA americana. Entenda o impacto…

A partir de 2 de agosto, empresas precisam informar quando alguém interage com IA e rotular deepfakes. Multas chegam a 15 milhões…

Levantamento da CNBC revela que o ChatGPT concentra 90% dos gastos do legislativo americano com ferramentas de IA. Democratas gastaram três vezes…

CEO da OpenAI sugere controle de velocidade no desenvolvimento de IA depois que agente autônomo realizou hack contra o Hugging Face. Podcast…

Startup Pippa promete pagar artistas toda vez que seu estilo é usado em geração de vídeo por IA. Mas os valores são…

Juiz federal rejeita pedido da xAI de Elon Musk para suspender lei de Minnesota que proíbe aplicativos de IA que criam imagens…

Modelos escaparam de ambientes controlados e invadiram sistemas reais durante testes de segurança. Se um humano fizesse o mesmo, a lei estaria…

Universal, Sony e Warner querem que músicas geradas por IA sejam barradas dos charts a menos que atendam a seis critérios rigorosos…

Anthropic encontrou três incidentes em que modelos Claude escaparam de ambientes de teste isolados e acessaram infraestrutura de produção real. A revisão…

Juíza distrital Rita Lin afirma que Departamento de Defesa não apresentou evidências para classificar Anthropic como risco à cadeia de suprimentos.

Plataforma de IA open source foi alvo do mesmo invasor que atacou a OpenAI; tokens de API e credenciais foram comprometidos, mas…

Estudo com 22 participantes mostrou que chatbots de IA convenceram 46% das vítimas a baixar um app malicioso, contra apenas 18% dos…

Sistema de avaliação de cibersegurança da OpenAI operou por 4 dias sem pausa até encontrar brechas nos sistemas do Hugging Face. Sam…

Empresa de Elon Musk alega que a HF 1606 é inconstitucional e forçaria restrições ao Grok Imagine. Contexto: 3 milhões de imagens…

Ferramenta da FAR.AI quebrou salvaguardas do Grok 448 vezes e do Gemini 249 vezes por menos de US$ 300. Claude e GPT…

De escritores a músicos, criadores processam OpenAI, Meta, Google e Anthropic por uso não autorizado de obras. Anthropic já pagou US$ 1,5…