Snapdragon — a próxima plataforma móvel premium foi apresentada em partes pela Qualcomm antes do evento principal, e o recado é claro: o foco agora é manter mais dados e poder de inferência perto do processador para viabilizar IA persistente e de baixa latência nos aparelhos.
Oryon a 5GHz e FlexCache: aposta no desempenho sustentado
A nova CPU Oryon alcança picos de 5GHz com um projeto de oito núcleos (dois Prime a 5GHz e seis Performance), segundo a fabricante. Esse salto chama atenção, mas a grande novidade é o FlexCache, que permite que núcleos compartilhem dinamicamente um pool de cache.
Ao alocar cache conforme a carga, o FlexCache reduz viagens à memória principal, beneficiando jogos, multitarefa e pipelines de IA que exigem conjuntos de trabalho maiores e acesso rápido a dados.
A arquitetura Hexagon passa a oferecer 50% mais memória compartilhada e aceleração para contextos de até 32K, visando raciocínio de longo contexto e agentes concorrentes.
GPU, NPU e memória local: estrutura pensada para agentes
A Adreno ganha núcleos matriciais dedicados e 18MB de High-Performance Memory (HPM) para reduzir latência em renderização e compute gráfico. A integração do Adreno Neural Fusion combina super-resolução por IA, processamento neural e geração de frames em uma mesma pipeline.
No lado da IA, o Hexagon foi reestruturado com um Element Accelerator otimizado para cargas tipo transformer, aceleração de KV-cache e suporte a Mixture-of-Experts (MoE) — exemplo citado: modelos de 30 bilhões de parâmetros que ativam cerca de 3 bilhões por passo, reduzindo custo de memória e computação.
O que você acha? Você acredita que a arquitetura descrita vai tornar experiências de IA no celular realmente mais úteis e eficientes? Para acompanhar mais, acesse nossa editoria.
Perguntas Frequentes
O que o Snapdragon anunciado traz de novo para a CPU e desempenho?
O Snapdragon traz a CPU Oryon com picos de 5GHz, em um layout de oito núcleos (dois Prime e seis Performance), e introduce o FlexCache, que permite compartilhar dinamicamente um pool de cache entre núcleos. Isso reduz acessos à memória externa e melhora o desempenho sustentado em jogos, multitarefa e pipelines de IA.
Como a GPU Adreno vai ajudar tarefas de IA e gráficos?
O Snapdragon incorpora núcleos Adreno Matrix dedicados e 18MB de Adreno HPM para armazenamento local de tiles e buffers. A plataforma une isso ao Adreno Neural Fusion, que, em testes internos, chegou a reduzir consumo de energia em até 40% em demos gráficas, prometendo eficiência em neural rendering e frame generation.
O que a nova Hexagon NPU permite para modelos de linguagem e agentes on-device?
O Snapdragon inclui um Hexagon NPU redesenhado com um Element Accelerator para transformers, 50% mais memória compartilhada e suporte a contextos de até 32K. A arquitetura mira Mixture-of-Experts de até 30 bilhões de parâmetros (com ~3 bilhões ativados por etapa) e reivindica ganho de até 50% em pre-fill para modelos INT4 versus a geração anterior.
Rafael Menezes