Para quem programa
Guias, kits e infraestrutura para desenvolvedores e equipes técnicas. Se você só usa IA, pode pular esta seção.
Segunda-feira, 14 de setembro
- Para quem programa
AWS e Databricks detalham como automatizar reposição com previsão de demanda
A solução conecta um agente do Databricks ao Amazon Quick para comparar demanda prevista com oferta de fornecedores e abrir pedidos ou exceções conforme o caso.

- Para quem programa
Perplexity detalha Portable Computer no Windows com GPUs NVIDIA RTX
A Perplexity mostra como usar o Portable Computer, versão local do agente Perplexity Computer, em PCs Windows com GPUs RTX, preservando dados no dispositivo e pedindo…

Sexta-feira, 11 de setembro
- Para quem programa
AWS detalha monitoramento duplo para agentes em produção com AgentCore e DevOps Agent
A empresa mostra como combinar avaliação contínua de qualidade com investigação automática de incidentes em sistemas multiagente, usando um exemplo de reservas aéreas…

- Para quem programa
AWS compara custo real de modelos OpenAI no Bedrock, além do preço por token
Um guia da AWS detalha um benchmark de código aberto que mede custo por resposta correta, trajetória de agentes e qualidade de entregas em cinco modelos OpenAI.

- Para quem programa
AWS detalha como criar apps MCP com widgets HTML no Amazon Bedrock AgentCore
Guia mostra como publicar MCP Apps com interfaces ricas no Bedrock AgentCore, com um exemplo que funciona em hosts compatíveis como ChatGPT e Claude.

Quinta-feira, 10 de setembro
- Para quem programa
Amazon SageMaker detalha roteamento por prefixo para reduzir latência em LLMs
O recurso direciona pedidos com o mesmo início de prompt para a mesma instância e, em testes com Llama 3.1 70B, elevou os acertos de cache e reduziu o TTFT.

- Para quem programa
AWS detalha uso do Marengo Embed 3.0 no Amazon Bedrock Knowledge Bases
Guia da AWS mostra como configurar o Marengo Embed 3.0 no Bedrock para buscar trechos de vídeo, imagem e áudio por linguagem natural.

- Para quem programa
Amazon Quick fica disponível no desktop para macOS e Windows e ganha feed de atividades no celular
A AWS diz que o Quick agora está disponível no desktop e mostra um feed móvel que reúne sinais de e-mail, calendário, CRM e mensagens em uma fila priorizada.

- Para quem programa
NVIDIA detalha otimizações do NIM para Nemotron 3 Ultra em 4xB200
A NVIDIA mostra como o NIM 2.0.12, no Nemotron 3 Ultra rodando em quatro GPUs B200, chega a 2,5 vezes mais usuários por sistema na taxa de 50 TPS por usuário.

- Para quem programa
AWS detalha tutorial com Quick Automate para transformar questionários RFI em CSV
Guia mostra como usar o Amazon Quick Automate para ler planilhas de RFI no S3, estruturar perguntas em linguagem natural e gerar CSV, com possibilidade de ajuste por…

- Para quem programa
AWS detalha detector de PII que usa qualquer LLM no Amazon Bedrock
Ferramenta baseada em instruções no prompt identifica dados pessoais sem retreinamento e foi comparada com nove detectores em cinco bases públicas.

- Para quem programa
AWS detalha métrica AEM para avaliar erros em conversas de agentes de IA
O artigo apresenta a Agent Evaluation Metric, que mede correção por turno em agentes de múltiplas etapas e separa o erro de origem dos efeitos em cascata.

- Para quem programa
AvioBook detalha protótipo no Amazon Bedrock AgentCore para analisar atrasos em voos
O Connected Analytics foi prototipado sobre o AgentCore para responder, em linguagem natural, a perguntas sobre dados operacionais do AvioBook Connect com evidências e…

- Para quem programa
NVIDIA e Palantir detalham uso de Nemotron para alocação de materiais na cadeia de suprimentos
A publicação mostra como a NVIDIA e a Palantir combinaram Foundry, cuOpt e o modelo Nemotron 3.5 Lightning para registrar decisões de alocação e apoiar planejadores com…

Quarta-feira, 9 de setembro
- Para quem programa
AWS detalha como implantar o Qwen3.8-2.4T-A95B no SageMaker HyperPod
Guia da AWS mostra como rodar o modelo aberto de 2,4 trilhões de parâmetros da Alibaba no HyperPod, com vLLM, quantização NVFP4 e endpoint compatível com a OpenAI.

- Para quem programa
NVIDIA detalha quando separar o encoder de visão acelera IA multimodal no Dynamo
Guia da NVIDIA explica quando a técnica EPD vale a pena no Dynamo e cita testes com ganhos de até 5x no TTFT e 7x no tempo total.

- Para quem programa
CUDA Toolkit 13.4 amplia suporte ao Windows on Arm e ao controle de GPUs compartilhadas
A NVIDIA detalha o CUDA Toolkit 13.4, com suporte ao Windows on Arm, preview da arquitetura Rubin e mudanças em MPS, memória e ferramentas.

- Para quem programa
Heurist Finance usa Amazon Bedrock AgentCore para comprar dados premium por consulta
A Heurist detalha como construiu o Heurist Finance sobre o Amazon Bedrock AgentCore, combinando compra de dados por consulta, análise isolada e trilha de auditoria por…

- Para quem programa
AWS detalha container Ray Serve para inferência e mostra migração a partir do TorchServe
O post apresenta o Ray Serve Deep Learning Container, imagem pré-testada para servir modelos com GPU, e mostra uma implantação do Qwen3-VL-2B no Amazon EKS com uma GPU.

Terça-feira, 8 de setembro
- Para quem programa
OpenAI detalha GPT-6 Astra no Amazon Bedrock para tarefas empresariais e de software
O modelo já pode ser usado no Bedrock via APIs, com janela de até 1 milhão de tokens, caching explícito e novas extensões para ChatGPT Work.
