Primeira páginaDiário da IA

Para quem programa

Guias, kits e infraestrutura para desenvolvedores e equipes técnicas. Se você só usa IA, pode pular esta seção.

287 notícias · página 6 de 15

Segunda-feira, 14 de setembro

  1. Para quem programa

    AWS e Databricks detalham como automatizar reposição com previsão de demanda

    A solução conecta um agente do Databricks ao Amazon Quick para comparar demanda prevista com oferta de fornecedores e abrir pedidos ou exceções conforme o caso.

    AWS2 min de leitura

  2. Para quem programa

    Perplexity detalha Portable Computer no Windows com GPUs NVIDIA RTX

    A Perplexity mostra como usar o Portable Computer, versão local do agente Perplexity Computer, em PCs Windows com GPUs RTX, preservando dados no dispositivo e pedindo…

    NVIDIA2 min de leitura

Sexta-feira, 11 de setembro

  1. Para quem programa

    AWS detalha monitoramento duplo para agentes em produção com AgentCore e DevOps Agent

    A empresa mostra como combinar avaliação contínua de qualidade com investigação automática de incidentes em sistemas multiagente, usando um exemplo de reservas aéreas…

    AWS2 min de leitura

  2. Para quem programa

    AWS compara custo real de modelos OpenAI no Bedrock, além do preço por token

    Um guia da AWS detalha um benchmark de código aberto que mede custo por resposta correta, trajetória de agentes e qualidade de entregas em cinco modelos OpenAI.

    AWS2 min de leitura

  3. Para quem programa

    AWS detalha como criar apps MCP com widgets HTML no Amazon Bedrock AgentCore

    Guia mostra como publicar MCP Apps com interfaces ricas no Bedrock AgentCore, com um exemplo que funciona em hosts compatíveis como ChatGPT e Claude.

    AWS2 min de leitura

Quinta-feira, 10 de setembro

  1. Para quem programa

    Amazon SageMaker detalha roteamento por prefixo para reduzir latência em LLMs

    O recurso direciona pedidos com o mesmo início de prompt para a mesma instância e, em testes com Llama 3.1 70B, elevou os acertos de cache e reduziu o TTFT.

    AWS2 min de leitura

  2. Para quem programa

    AWS detalha uso do Marengo Embed 3.0 no Amazon Bedrock Knowledge Bases

    Guia da AWS mostra como configurar o Marengo Embed 3.0 no Bedrock para buscar trechos de vídeo, imagem e áudio por linguagem natural.

    AWS2 min de leitura

  3. Para quem programa

    Amazon Quick fica disponível no desktop para macOS e Windows e ganha feed de atividades no celular

    A AWS diz que o Quick agora está disponível no desktop e mostra um feed móvel que reúne sinais de e-mail, calendário, CRM e mensagens em uma fila priorizada.

    AWS1 min de leitura

  4. Para quem programa

    NVIDIA detalha otimizações do NIM para Nemotron 3 Ultra em 4xB200

    A NVIDIA mostra como o NIM 2.0.12, no Nemotron 3 Ultra rodando em quatro GPUs B200, chega a 2,5 vezes mais usuários por sistema na taxa de 50 TPS por usuário.

    NVIDIA1 min de leitura

  5. Para quem programa

    AWS detalha tutorial com Quick Automate para transformar questionários RFI em CSV

    Guia mostra como usar o Amazon Quick Automate para ler planilhas de RFI no S3, estruturar perguntas em linguagem natural e gerar CSV, com possibilidade de ajuste por…

    AWS2 min de leitura

  6. Para quem programa

    AWS detalha detector de PII que usa qualquer LLM no Amazon Bedrock

    Ferramenta baseada em instruções no prompt identifica dados pessoais sem retreinamento e foi comparada com nove detectores em cinco bases públicas.

    AWS2 min de leitura

  7. Para quem programa

    AWS detalha métrica AEM para avaliar erros em conversas de agentes de IA

    O artigo apresenta a Agent Evaluation Metric, que mede correção por turno em agentes de múltiplas etapas e separa o erro de origem dos efeitos em cascata.

    AWS2 min de leitura

  8. Para quem programa

    AvioBook detalha protótipo no Amazon Bedrock AgentCore para analisar atrasos em voos

    O Connected Analytics foi prototipado sobre o AgentCore para responder, em linguagem natural, a perguntas sobre dados operacionais do AvioBook Connect com evidências e…

    AWS2 min de leitura

  9. Para quem programa

    NVIDIA e Palantir detalham uso de Nemotron para alocação de materiais na cadeia de suprimentos

    A publicação mostra como a NVIDIA e a Palantir combinaram Foundry, cuOpt e o modelo Nemotron 3.5 Lightning para registrar decisões de alocação e apoiar planejadores com…

    NVIDIA2 min de leitura

Quarta-feira, 9 de setembro

  1. Para quem programa

    AWS detalha como implantar o Qwen3.8-2.4T-A95B no SageMaker HyperPod

    Guia da AWS mostra como rodar o modelo aberto de 2,4 trilhões de parâmetros da Alibaba no HyperPod, com vLLM, quantização NVFP4 e endpoint compatível com a OpenAI.

    AWS2 min de leitura

  2. Para quem programa

    NVIDIA detalha quando separar o encoder de visão acelera IA multimodal no Dynamo

    Guia da NVIDIA explica quando a técnica EPD vale a pena no Dynamo e cita testes com ganhos de até 5x no TTFT e 7x no tempo total.

    NVIDIA2 min de leitura

  3. Para quem programa

    CUDA Toolkit 13.4 amplia suporte ao Windows on Arm e ao controle de GPUs compartilhadas

    A NVIDIA detalha o CUDA Toolkit 13.4, com suporte ao Windows on Arm, preview da arquitetura Rubin e mudanças em MPS, memória e ferramentas.

    NVIDIA2 min de leitura

  4. Para quem programa

    Heurist Finance usa Amazon Bedrock AgentCore para comprar dados premium por consulta

    A Heurist detalha como construiu o Heurist Finance sobre o Amazon Bedrock AgentCore, combinando compra de dados por consulta, análise isolada e trilha de auditoria por…

    AWS2 min de leitura

  5. Para quem programa

    AWS detalha container Ray Serve para inferência e mostra migração a partir do TorchServe

    O post apresenta o Ray Serve Deep Learning Container, imagem pré-testada para servir modelos com GPU, e mostra uma implantação do Qwen3-VL-2B no Amazon EKS com uma GPU.

    AWS2 min de leitura

Terça-feira, 8 de setembro

  1. Para quem programa

    OpenAI detalha GPT-6 Astra no Amazon Bedrock para tarefas empresariais e de software

    O modelo já pode ser usado no Bedrock via APIs, com janela de até 1 milhão de tokens, caching explícito e novas extensões para ChatGPT Work.

    AWS2 min de leitura