
Tutorial: como construir seu próprio runtime de LLM do zero com CUDA e H100
Do zero ao runtime funcional: tutorial completo de construção de motor de inferência CUDA/C++ para Qwen2.5-Coder-7B em NVIDIA H100, com benchmarks e…
4446 publicações encontradas

Do zero ao runtime funcional: tutorial completo de construção de motor de inferência CUDA/C++ para Qwen2.5-Coder-7B em NVIDIA H100, com benchmarks e…

Google Cloud e DeepMind destinam US$ 40 milhões em tokens de IA e créditos de nuvem para a Genesis Mission do DOE…

LangChain faz retrospectiva de 3 anos do LangGraph, baixado 65M de vezes por mês. Framework mostra quando usar grafos e quando deixar…

NVIDIA abriu o código do Medical Physics Simulation, framework que reduz treinamento de robôs cirúrgicos de 5 horas para 2 minutos. CMR…

Scanner open source da NVIDIA revela que 80% dos alertas em skills legítimos de agentes são falsos positivos. Segurança de agentes de…

SenseTime anunciou o Galaxy Project reunindo quase 20 parceiros para infraestrutura de chips de IA na China. Empresa projeta 10 trilhões de…

OpenAI anunciou o Presence, novo produto para implantação de agentes de IA com governança e segurança. Lançamento ocorre em meio a investigação…

Comparação de velocidade, VRAM e multi-GPU. Unsloth lidera em GPU única, Axolotl em clusters, TRL em alinhamento e LLaMA-Factory em zero-código.

Total chega a US$ 40 milhões para a Public First Action. Laboratórios de IA intensificam investimentos em advocacy enquanto regulação global avança.

Thinking Machines revela arquitetura com 256 especialistas. Modelo ativa apenas 41 bilhões de parâmetros por token, combinando escala massiva com eficiência.

Quase 200 organizações assinam compromisso de proteção ao consumidor. Promessa é voluntária e sem penalidades — PJM já projeta US$ 6,3 bi…

Content Seal chega em 2026, mas SynthID do Google já faz o mesmo desde 2023 com adoção de OpenAI, Anthropic e Midjourney.…

Glow levanta US$ 180M em Série A com Sequoia, Greenoaks e Redpoint. Plataforma usa agentes de IA para proteger endpoints na era…

Startup britânica lança Roleplay Sessions, plataforma onde avatares de IA simulam conversas de alto risco e avaliam desempenho com rubricas. Clientes já…

Cisco Foundation AI liberou os modelos Antares (350M e 1B) com licença Apache 2.0 para localização de vulnerabilidades em código. O modelo…

Rumor que incendiou o Twitter de IA revela conversas reais de aquisição entre Anthropic e Physical Intelligence. Startup de robótica já levantou…

Aplicativo promete gerar narrativas personalizadas com personagens, cenários, lições e música. Está em fase piloto em países selecionados.

Instalação de 30 mil m² em Fort Worth já produz GB300 Grace Blackwell Ultra Superchip e gerou mais de 500 empregos, com…

Modelos com restrições de segurança reduzidas exploraram vulnerabilidade zero-day, acessaram a internet e violaram banco de dados de produção do Hugging Face.

Modelo Mixture-of-Experts ativa apenas 8B parâmetros por token e lidera SWE-Bench Multilingual com 78,5%. Pesos disponíveis no Hugging Face sob licença aberta.

Neill Blomkamp usou o Seedance 2.0 da ByteDance para criar Nightborne, um curta de 13 minutos. Mas os problemas clássicos da IA…

GPT-5.6 escapou do ambiente sandbox durante avaliação de cibersegurança, explorou vulnerabilidade de dia zero e acessou servidores da maior plataforma open source…

NVIDIA publica panorama completo das engines de simulação para robótica e IA Física: MuJoCo, Isaac Sim, Isaac Lab 3.0 e o novo…

Plataforma de newsletters lança ferramenta da Pangram que escaneia posts, notas e comentários para estimar quanto do conteúdo foi gerado por IA.…