Primeira páginaDiário da IA

Arquivo

Todas as notícias, da mais recente para a mais antiga.

1.729 notícias · página 6 de 87

Segunda-feira, 21 de setembro

  1. Para quem programa

    Posit detalha como rodar o Positron no Amazon SageMaker AI

    Guia mostra um fluxo no SageMaker Studio com Athena, R, Python, um endpoint em tempo real e relatório em Quarto, tudo em um espaço controlado.

    AWS2 min de leitura

  2. Para quem programa

    Benchling detalha arquitetura na AWS para isolar código de IA em milhares de clientes

    Guia mostra como a Benchling usa o Amazon Bedrock AgentCore Code Interpreter em VPC, DNS Firewall e políticas de endpoint para limitar acesso a dados e bloquear…

    AWS2 min de leitura

  3. Para quem programa

    EXL detalha solução de IA na AWS para revisar sinistros médicos mais rápido

    A EXL mostra como sua solução Medical IDP na AWS extrai, resume e consulta registros médicos, com validação humana para resultados de baixa confiança.

    AWS2 min de leitura

  4. Para quem programa

    NVIDIA detalha como usar o Earth-2 para ajustar previsões do tempo com observações locais

    O guia mostra como incorporar medições de satélites, radares e sensores próprios em modelos do Earth2Studio para atualizar previsões regionais e globais.

    NVIDIA2 min de leitura

  5. Ciência e saúde

    Multiverse Computing detalha poda de LLMs como problema de física estatística e cita ganho de 23 pontos

    Em artigo no Hugging Face, a empresa descreve o CBO, que trata a escolha de blocos de transformers como um sistema de spins e relata melhora de quase 23 pontos no MMLU…

    Hugging Face2 min de leitura

  6. Para quem programa

    Cloudflare torna geral o suporte a Python no Workers

    A plataforma passa a aceitar Python de forma oficial e integrada a serviços como Workers AI, R2, D1 e Hyperdrive, além de frameworks web populares.

    Cloudflare1 min de leitura

  7. Novas IAs

    SpaceXAI detalha Grok 4.7, modelo para codificação com preço a partir de US$ 2 por milhão de tokens

    A empresa diz que o Grok 4.7 trabalha melhor em tarefas longas, custa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, e já pode ser usado em…

    xAI2 min de leitura

  8. Para usar

    Muse, app de IA da Meta, supera o ChatGPT nos primeiros 12 dias, segundo a Apptopia

    Estimativas da Apptopia indicam 1,8 milhão de downloads do Muse em iOS nos EUA e Canadá, acima dos 1,3 milhão do ChatGPT no mesmo intervalo inicial.

    TechCrunch1 min de leitura

Domingo, 20 de setembro

  1. Para quem programa

    Hugging Face detalha tokenizers v1, com encode 3 a 30 vezes mais rápido que a v0.23

    A versão candidata do tokenizers v1 mantém os mesmos IDs de saída da v0.23 e traz ganhos de desempenho medidos em testes no Apple M4 Max.

    Hugging Face2 min de leitura

Sexta-feira, 18 de setembro

  1. Para quem programa

    SageMaker AI detalha 13 capacidades de inferência

    Em um post de revisão, a Amazon descreve 13 capacidades de inferência adicionadas ao SageMaker AI em 2026, entre endpoints gerenciados e HyperPod Inference.

    AWS2 min de leitura

  2. Para quem programa

    NVIDIA detalha o AIPerf, sucessor do GenAI-Perf, para medir LLMs em servidores

    O guia explica como o AIPerf mede latência e vazão sem virar o gargalo do teste e compara um cenário fixo com outro em que as requisições variam.

    NVIDIA2 min de leitura

  3. Para quem programa

    AWS detalha a disponibilidade do Kimi K3 da Moonshot AI no Amazon Bedrock

    Modelo aberto chega ao Bedrock com visão nativa, 1 milhão de tokens de contexto e cache explícito de prompts; há perfis global e para os EUA.

    AWS1 min de leitura

  4. Para quem programa

    AWS mostra como migrar agente de IA multi-modelo para o Bedrock AgentCore

    Guia da AWS detalha a migração de um agente de saúde do ECS com Fargate para o Bedrock AgentCore runtime, mantendo a lógica e a divisão entre três modelos.

    AWS2 min de leitura

  5. Para quem programa

    AWS detalha novo runtime do AgentCore com inicialização mais previsível e memória sob demanda

    O Amazon Bedrock AgentCore runtime passa a recuperar memória quando a sessão libera recursos e mantém o tempo de inicialização mais estável, segundo a AWS.

    AWS2 min de leitura

  6. Para quem programa

    AWS detalha seis habilidades para agentes de código implantarem modelos Hugging Face no SageMaker AI

    Em uma publicação, a AWS mostra como seis skills open source ajudam agentes como Kiro e Claude Code a escolher o contêiner certo, aplicar padrões de produção e evitar…

    AWS2 min de leitura

  7. Trabalho e dinheiro

    Google amplia equipe do AI & Economy para estudar impacto da IA em empregos e produtividade

    O programa AI & Economy do Google ganhou novos conselheiros acadêmicos e dois diretores para analisar adoção global da IA, mercado de trabalho e crescimento econômico.

    Google1 min de leitura

  8. Para quem programa

    AWS detalha SageMaker HyperPod Inference Gateway para rotear inferência em EKS

    O add-on usa sinais de GPU em tempo real para encaminhar requisições ao pod mais adequado e, segundo a AWS, pode reduzir em até 82% a latência do primeiro token.

    AWS2 min de leitura

  9. Para usar

    Google mostra como estilistas criaram ferramentas no Flow para a NYFW

    Jane Wade e Sergio Hudson co-criaram no Google Flow recursos para visualizar looks e simular passarelas, com apoio do Google Envisioning Studio e do Labs.

    Google2 min de leitura

  10. Para usar

    SpaceXAI detalha o Grok Voice Transcribe 2.0, com mesma tarifa e melhor transcrição

    A empresa publicou detalhes do Grok Voice Transcribe 2.0, que segundo testes internos e públicos supera a versão 1.0 e mantém os preços de US$ 0,10 e US$ 0,20 por hora.

    xAI2 min de leitura

  11. Novas IAs

    TypeSafe AI detalha Jev, modelo que devolve probabilidades para automação de software

    O sistema não gera texto: ele retorna decisões calibradas e a empresa diz que isso o torna rápido, barato e útil para tarefas como classificação e revisão de comandos.

    TechCrunch2 min de leitura