Após comunicar resultados financeiros em alta na semana passada, a Google Cloud coloca o foco na infraestrutura de IA e numa procura por TPU que descreve como sem precedentes. A empresa destaca uma transição da indústria para uma «era da inferência», com cargas que exigem mais computação, e afirma que o seu catálogo de chips, desenvolvido internamente ao longo de décadas, procura impulsionar esta nova etapa da IA, combinando desempenho e controlo de custos em aceleradores especializados (Ironwood) e CPUs de uso geral eficientes (Axion).
A Google Cloud anunciou a disponibilidade geral do Ironwood, o seu TPU de sétima geração, juntamente com novas instâncias baseadas em Axion Arm para uso geral. No âmbito da aceleração, o Ironwood estará disponível de forma generalizada nas próximas semanas. De acordo com os dados fornecidos, oferece até dez vezes o desempenho máximo do TPU v5p e mais de quatro vezes o desempenho por chip em treinamento e inferência em relação ao TPU v6e (Trillium). A Google apresenta o Ironwood como o seu TPU personalizado mais potente e eficiente em termos energéticos até à data.
A proposta de escala é outro dos eixos. Um superpoder de Ironwood pode integrar até 9.216 chips interligados por ICI (Inter-Chip Interconnect) a 9,6Tb/s, com até 1,77 petabytes de memória HBM partilhada, o que visa reduzir os estrangulamentos de dados em modelos de grande dimensão. Este design, orientado para que milhares de chips se comuniquem com baixa latência e alta largura de banda, visa facilitar a implementação de cargas de treino e inferência especialmente exigentes.
Na computação de uso geral, a Google expande o Axion com novas máquinas virtuais. A instância N4A entra em pré-visualização e, de acordo com o Google, supera em mais do dobro o desempenho de máquinas x86 comparáveis da geração atual; além disso, a primeira instância bare-metal desta família, C4A metal, estará disponível em breve em pré-visualização. A empresa posiciona estas opções como base para aplicações de IA que requerem CPUs eficientes e uma relação preço-desempenho otimizada.
A nota incorpora dados de adoção antecipada por parte dos clientes. A Anthropic prevê aceder a até um milhão de TPUs para executar os seus modelos Claude; na Axion, a Vimeo registou uma melhoria de 30% no desempenho do N4A para a sua transcodificação principal e a ZoomInfo quantificou uma melhoria de 60% na relação preço-desempenho para cargas-chave de processamento de dados. Estes casos de uso ilustram a orientação do Ironwood para cargas de inferência e treino em grande escala e do Axion N4A para tarefas intensivas em CPU.
Em termos de planeamento, o Ironwood estará disponível para o público em geral nas próximas semanas, enquanto o N4A já está em pré-visualização e o C4A metal será incorporado a esta fase em breve, de acordo com o calendário comunicado pela empresa.







