
AWS amplia avaliação de agentes entre frameworks, mas telemetria incompleta ainda bloqueia resultados
AgentCore Evaluations passa a tratar seis frameworks e uma rota genérica, mas depende de spans reconhecidos e telemetria completa.
Ler matériaBastidores da IA
Atualizações e notícias sobre inteligência artificial, modelos e ferramentas.

AgentCore Evaluations passa a tratar seis frameworks e uma rota genérica, mas depende de spans reconhecidos e telemetria completa.
Ler matéria
Programa financiará avaliações independentes e abertas sobre bem-estar em conversas com IA, mas ainda não é certificação nem prova de segurança.
Ler matéria
A OpenAI diz ter bloqueado contas usadas para promover uma operação de influência ligada à Rússia. Entenda o papel do ChatGPT, a infraestrutura e os limites do alcance.
Ler matéria
Admin plugin reúne consultas e ações administrativas em uma conversa, sem ampliar as permissões do usuário.
Ler matéria
A marca-d'água textual do Claude será invisível e estatística. Entenda o que ela indica, seus limites e o que ainda falta para a detecção.
Ler matéria
O primeiro chip próprio de inferência da OpenAI aparece com ganhos de eficiência e latência, mas os resultados ainda não equivalem a disponibilidade para clientes.
Ler matéria
A OpenAI diz ter interrompido por duas semanas o treinamento por reforço de modelos avançados. Parte voltou, mas a maior rodada planejada continua suspensa.
Ler matéria
OpenAI e CodeAI planejam programas de alfabetização em IA para estudantes e professores, mas ainda faltam calendário, alcance e métricas.
Ler matéria
Google anunciou resumos, painéis por prompts e benchmarking no Ads e Analytics, mas o Ask Advisor segue em beta para contas em inglês.
Ler matéria
A OpenAI anunciou anúncios do ChatGPT em 31 mercados europeus. Entenda planos afetados, privacidade, controles e o que ainda não foi confirmado.
Ler matéria