Para quem programa
Guias, kits e infraestrutura para desenvolvedores e equipes técnicas. Se você só usa IA, pode pular esta seção.
Segunda-feira, 21 de setembro
- Para quem programa
NVIDIA detalha como avaliar agentes de IA pela conclusão de tarefas, não por chamadas isoladas
Guia técnico da NVIDIA defende medir agentes pelo resultado final e pelo rastreamento por etapa, com exemplos como BFCL, E2E e o benchmark PinchBench.

- Para quem programa
xAI disponibiliza Grok 4.6 no Amazon Bedrock com 500 mil tokens de contexto
O modelo passa a estar acessível no Bedrock com quatro níveis de raciocínio, suporte ao Converse e acesso via bedrock-mantle e bedrock-runtime, além de inferência entre…

- Para quem programa
BMW Group detalha detecção diária de anomalias de custo em 14 mil contas na nuvem
A plataforma CLEA usa Prophet e AWS Step Functions para comparar gastos previstos e reais e alertar responsáveis quando há desvio relevante.

- Para quem programa
Posit detalha como rodar o Positron no Amazon SageMaker AI
Guia mostra um fluxo no SageMaker Studio com Athena, R, Python, um endpoint em tempo real e relatório em Quarto, tudo em um espaço controlado.

- Para quem programa
Benchling detalha arquitetura na AWS para isolar código de IA em milhares de clientes
Guia mostra como a Benchling usa o Amazon Bedrock AgentCore Code Interpreter em VPC, DNS Firewall e políticas de endpoint para limitar acesso a dados e bloquear…

- Para quem programa
EXL detalha solução de IA na AWS para revisar sinistros médicos mais rápido
A EXL mostra como sua solução Medical IDP na AWS extrai, resume e consulta registros médicos, com validação humana para resultados de baixa confiança.

- Para quem programa
NVIDIA detalha como usar o Earth-2 para ajustar previsões do tempo com observações locais
O guia mostra como incorporar medições de satélites, radares e sensores próprios em modelos do Earth2Studio para atualizar previsões regionais e globais.

- Para quem programa
Cloudflare torna geral o suporte a Python no Workers
A plataforma passa a aceitar Python de forma oficial e integrada a serviços como Workers AI, R2, D1 e Hyperdrive, além de frameworks web populares.

Domingo, 20 de setembro
- Para quem programa
Hugging Face detalha tokenizers v1, com encode 3 a 30 vezes mais rápido que a v0.23
A versão candidata do tokenizers v1 mantém os mesmos IDs de saída da v0.23 e traz ganhos de desempenho medidos em testes no Apple M4 Max.

Sexta-feira, 18 de setembro
- Para quem programa
SageMaker AI detalha 13 capacidades de inferência
Em um post de revisão, a Amazon descreve 13 capacidades de inferência adicionadas ao SageMaker AI em 2026, entre endpoints gerenciados e HyperPod Inference.

- Para quem programa
NVIDIA detalha o AIPerf, sucessor do GenAI-Perf, para medir LLMs em servidores
O guia explica como o AIPerf mede latência e vazão sem virar o gargalo do teste e compara um cenário fixo com outro em que as requisições variam.

- Para quem programa
AWS detalha a disponibilidade do Kimi K3 da Moonshot AI no Amazon Bedrock
Modelo aberto chega ao Bedrock com visão nativa, 1 milhão de tokens de contexto e cache explícito de prompts; há perfis global e para os EUA.

- Para quem programa
AWS mostra como migrar agente de IA multi-modelo para o Bedrock AgentCore
Guia da AWS detalha a migração de um agente de saúde do ECS com Fargate para o Bedrock AgentCore runtime, mantendo a lógica e a divisão entre três modelos.

- Para quem programa
AWS detalha novo runtime do AgentCore com inicialização mais previsível e memória sob demanda
O Amazon Bedrock AgentCore runtime passa a recuperar memória quando a sessão libera recursos e mantém o tempo de inicialização mais estável, segundo a AWS.

- Para quem programa
AWS detalha seis habilidades para agentes de código implantarem modelos Hugging Face no SageMaker AI
Em uma publicação, a AWS mostra como seis skills open source ajudam agentes como Kiro e Claude Code a escolher o contêiner certo, aplicar padrões de produção e evitar…

- Para quem programa
AWS detalha SageMaker HyperPod Inference Gateway para rotear inferência em EKS
O add-on usa sinais de GPU em tempo real para encaminhar requisições ao pod mais adequado e, segundo a AWS, pode reduzir em até 82% a latência do primeiro token.

Quinta-feira, 17 de setembro
- Para quem programa
Amazon detalha o Connect Talent, ferramenta de IA para entrevistas e avaliações em escala
A empresa diz que o Connect Talent ajuda equipes de recrutamento a conduzir entrevistas e avaliações com IA, enquanto o recrutador mantém a decisão final sobre a…

- Para quem programa
AWS detalha escolha de vetor para Bedrock Knowledge Bases e compara três opções
Post usa benchmarks no OpenSearch Serverless para mostrar como latência, custo e qualidade variam entre OpenSearch, Aurora PostgreSQL com pgvector e S3 Vectors.

- Para quem programa
AWS detalha guia para métricas de Git no QuickSight com pipeline serverless
O material mostra como montar um pipeline serverless para coletar métricas de GitHub e GitLab e exibi-las em dashboards do Amazon QuickSight, com apoio ao acompanhamento…

- Para quem programa
Wood Mackenzie detalha APEX, plataforma compartilhada de agentes sobre Amazon Bedrock AgentCore
A empresa mostra como unificou em uma só base identidade, observabilidade, memória e governança para três aplicações internas, evitando que cada time monte sua própria…
