Hoje o dinheiro fala mais alto: a AMD topou apostar bilhões na Anthropic pra brigar de igual com a Nvidia. Mas o que me deixou de olho foi ver o mercado tremer com os gastos da Alphabet em IA, sinal de que essa conta está ficando salgada pra todo mundo. E lá no fundo, achei uma pesquisa sobre roteamento de modelos que pode economizar uns trocados de quem paga API por aqui no Brasil.
AMD Investe até US$ 5 Bilhões na Anthropic
A AMD anunciou um investimento de até US$ 5 bilhões na Anthropic, além de um acordo para fornecer até 2 gigawatts de GPUs Instinct MI450 usando o novo sistema Helios. A primeira etapa, de 1 gigawatt, deve entrar em operação no primeiro semestre de 2027.
Por aqui: esse tipo de mega-acordo de chips e computação entre gigantes americanos acirra a disputa global por GPUs, o que pode encarecer ou atrasar o acesso a infraestrutura de nuvem para empresas brasileiras que treinam ou rodam modelos de IA.
Fonte: The Verge
01
Dow Jones Futuro Recua com Temores sobre Gastos da Alphabet com IA
O balanço da Alphabet veio acima do esperado, mas o forte aumento nos gastos com infraestrutura de IA ofuscou os resultados e derrubou o futuro do Dow Jones.
Por aqui: a nervosismo dos investidores americanos com o custo bilionário da corrida por IA tende a contagiar o Ibovespa e o câmbio, encarecendo o capital disponível para startups brasileiras de tecnologia.
Fonte: InfoMoney
02
Substack Adiciona Detector de Texto Escrito por IA
A Substack passou a usar a tecnologia da empresa Pangram para estimar quanto de um post, nota ou comentário foi gerado ou assistido por IA, começando pela web e pelo app iOS.
Por aqui: criadores brasileiros que publicam newsletters na Substack podem ver seus textos rotulados por IA, o que muda a relação de confiança com leitores e pode influenciar como eles divulgam o uso de ferramentas de IA na produção do conteúdo.
Fonte: The Verge
03
Tesouro dos EUA Ameaça Sanções após Acusação contra a Moonshot
O Tesouro americano ameaçou aplicar sanções depois que a Casa Branca acusou a chinesa Moonshot de ter destilado o modelo Fable, da Anthropic, intensificando o debate sobre modelos abertos chineses.
Por aqui: a escalada da briga geopolítica entre EUA e China por IA pode limitar o acesso de empresas brasileiras a modelos abertos chineses baratos, hoje uma alternativa comum para cortar custos de infraestrutura de IA por aqui.
Fonte: TechCrunch
Roteamento de Consultas para LLMs Sensível à Latência em Cargas de Trabalho Dinâmicas
O estudo propõe um sistema de roteamento de consultas para LLMs que considera não só custo e precisão, mas também a latência real sentida pelo usuário, algo ignorado pelas políticas comuns de balanceamento de carga como round-robin.
Por aqui: empresas brasileiras que combinam vários modelos de IA via API podem usar esse tipo de roteamento inteligente para cortar custos de nuvem sem deixar o app mais lento para o usuário final.
Fonte: arXiv