
Detectando alucinações em LLMs com GraphEval e Python
Aprenda a usar o GraphEval e Python para detectar alucinações em LLMs de forma determinística combinando inteligência artificial simbólica e conexionista.
35 publicações encontradas

Aprenda a usar o GraphEval e Python para detectar alucinações em LLMs de forma determinística combinando inteligência artificial simbólica e conexionista.

Em experimento controlado, self-critique em loops de agente não fez melhor que não fazer nada. Já um verificador determinístico ancorado na fonte…

Engenheiros estão gastando até US$ 10.000 por semana em tokens de IA. O tokenminning propõe roteamento inteligente e compactação de contexto para…

Seis lições práticas sobre parsing de perguntas em RAG que a maioria dos tutoriais ignora: estruture a pergunta antes de buscar. Com…

Testes mostram que LLMs convergem para as mesmas respostas: '7' como número aleatório, 'Time is a river' como metáfora. A startup Springboards…

Pesquisador transpõe método de handover 6G (ILCP) para agentes LLM: comprimir estado latente entre agentes elimina o cold-start e a reconstrução de…

Novo modelo open-weight da NVIDIA separa contexto e difusão em duas torres, retendo 98,7% da qualidade autorregressiva com o dobro da vazão…

Agentes de IA baseados em grandes modelos de linguagem (LLMs) frequentemente falham porque suas instruções — ou "skills" — são modificadas…

O que separa um protótipo de LLM de um sistema em produção não é a qualidade do modelo, mas a confiabilidade da…

A renomada autora de O Conto da Aia e O Assassino Cego, Margaret Atwood, não poupou críticas à inteligência artificial durante sua…

Connor Christou, fundador da Keragon, usou o Claude da Anthropic para processar exames, dados de wearables e literatura médica durante seu tratamento…
Se você vem acompanhando a evolução dos modelos de linguagem, já deve ter notado uma mudança fundamental: os LLMs deixaram de ser…

Startup de Miami afirma ter resolvido o gargalo da atenção densa em transformers. Modelo SubQ seria 56x mais rápido e processa 12x…

A startup americana Subquadratic saiu do modo stealth no mês passado com uma afirmação ambiciosa: resolveram o gargalo matemático que tem limitado…

AWS SageMaker AI agora emite mais de 100 métricas detalhadas de inferência com dashboard integrado no CloudWatch, cobrindo saúde de GPU, latência…

Há um ano, Simon Willison definiu agentes de IA com uma das descrições mais claras até hoje: "Um agente LLM executa ferramentas…

Modelos de linguagem grandes (LLMs) com contexto longo enfrentam um gargalo de memória que não tem nada a ver com os pesos…

Enquanto empresas investem centenas de milhões de dólares em ferramentas de IA para codificação, marketing e atendimento ao cliente, uma nova obsessão…
Para quem trabalha com grandes modelos de linguagem (LLMs) em instâncias GPU da AWS, o tempo de carregamento do modelo na memória…
Contexto e importância da avaliação de LLMs O avanço das Large Language Models (LLMs) tem impulsionado a adoção de aplicações de inteligência…
DoorDash avança na personalização dinâmica com modelos de linguagem de grande escala Na busca por transformar a experiência do consumidor, DoorDash…
O distanciamento do Vale do Silício em relação ao consumidor comum Em um artigo recente do The Verge, a jornalista Elizabeth Lopatto…
A AWS lançou o ToolSimulator, um framework de simulação de ferramentas baseado em grandes modelos de linguagem (LLM) integrado ao Strands Evals…
Meta lança abordagem Just-in-Time para testes de software com IA A Meta anunciou uma inovação significativa na área de testes automatizados para…