GPU
A GPU é um processador de milhares de núcleos que executa cálculos em paralelo, e é o que tornou viável treinar e rodar modelos de IA. Na medicina, sustenta a análise de imagem e o processamento de grandes volumes de dados. Suas restrições reais são custo, consumo de energia e memória de vídeo disponível — o dado clínico que passa por ela é que responde à LGPD.
Definição
A GPU (Graphics Processing Unit, ou Unidade de Processamento Gráfico) é um processador especializado projetado para realizar cálculos matemáticos em larga escala de forma paralela. Originalmente desenvolvida para renderização de gráficos em tempo real em jogos e aplicações visuais, a GPU evoluiu para se tornar o coração computacional da inteligência artificial (IA) moderna, especialmente no aprendizado profundo e no treinamento de redes neurais artificiais. Diferente da CPU tradicional, que processa tarefas sequencialmente com poucos núcleos potentes, a GPU possui milhares de núcleos menores otimizados para operações vetoriais e matriciais simultâneas, ideais para os algoritmos de aprendizado de máquina. Empresas como NVIDIA® dominam o mercado, com arquiteturas como Ampere, Hopper e Blackwell impulsionando a ascensão da NVIDIA.
Relevância para o Médico e Aplicações Práticas
Para o médico moderno, a GPU é essencial na adoção de IA na prática clínica, conforme explorado na Aula 1: introdução à IA para médicos. Ela acelera o processamento de grandes volumes de dados médicos, como imagens de ultrassom, tomografias e ressonâncias, permitindo diagnósticos mais rápidos e precisos via modelos de IA. Aplicações práticas incluem:
- Análise de imagens médicas: é a GPU que torna viável treinar e rodar modelos de detecção de lesão em tomografia, ressonância e ultrassom — o que na CPU levaria semanas de treinamento cabe em dias.
- A GPU que você usa sem ver: ao conversar com o ChatGPT®, o Gemini® ou o Gemini Notebook, o médico não opera GPU nenhuma — ela está do outro lado, no data center do fornecedor, processando o prompt e devolvendo a resposta. A conta de energia e de hardware é de quem hospeda o modelo.
- A GPU que fica com você: só quando o modelo roda na própria máquina — em IA local, por privacidade — é que a placa passa a ser problema seu, e aí a memória de vídeo vira o fator limitante.
Médicos no perfil Médico Curador ou inovador (cinco perfis médicos com IA) beneficiam-se diretamente, avançando no letramento em IA e na curva S de adoção.
Mecanismos Técnicos
As GPUs operam via computação paralela, executando milhares de threads simultaneamente. Tecnologias-chave incluem:
- CUDA® (Compute Unified Device Architecture): plataforma NVIDIA para programação paralela em GPUs.
- Tensor Cores: núcleos dedicados à multiplicação de matrizes, a operação que domina o aprendizado profundo. É onde a distância para a CPU deixa de ser de vezes e passa a ser de ordens de grandeza.
- Integração com Frameworks: bibliotecas como TensorFlow e PyTorch usam a GPU para a retropropagação em redes neurais.
Uma placa de data center atual, como a NVIDIA B200 da geração Blackwell, carrega 192 GB de memória de alta banda — é o que permite manter na memória um modelo com janela de contexto ampla. Vale a ressalva: mais GPU não reduz alucinação. A alucinação nasce do modelo e do dado de treino, não do silício; hardware melhor só a produz mais rápido.
O salto de 2012, quando a equipe de Geoffrey E. Hinton venceu a ImageNet com o AlexNet, só foi possível porque a rede foi treinada em GPUs. É a origem direta da linha que desemboca nos Nobéis de 2024.
Limitações e Considerações
Apesar de poderosas, GPUs apresentam desafios:
- Custo e acessibilidade: placas de ponta custam milhares de dólares; soluções em nuvem (ex.: AWS com VPC) mitigam, mas geram despesas recorrentes.
- Consumo Energético: alto TDP (ex.: 700W+), impactando sustentabilidade e custos operacionais.
- GIGO e Viés: dados ruins levam a modelos falhos; siga os seis assassinos do aprendizado de IA.
- Privacidade e Regulamentação: processamento de dados sensíveis exige conformidade com LGPD, GDPR e HIPAA. Use VPN ou VPC para segurança, alinhado à lei do fluxo de dados.
- Síndrome da bola de cristal: não substitui o raciocínio analítico humano; valide as respostas com cadeia de pensamento e metaprompting reflexivo.
Em resumo, GPUs são infraestrutura crítica (por que a tecnologia perturba), mas demandam higiene de contexto e treinamento, como na Aula 2: modelos comerciais — conhecer e escolher.
Para rodar modelo na própria máquina
O fator que manda é a memória de vídeo (VRAM), não a velocidade da placa: o modelo precisa caber nela inteiro. Na geração atual de consumo, a linha RTX 50 dá conta de modelos de porte médio — a 5090, com 32 GB, roda inferência local na faixa dos 20 bilhões de parâmetros. Placas com 8 GB rodam apenas modelos pequenos e quantizados.
Ferramentas como o Ollama® e o LM Studio® acessam a placa via CUDA. As especificações por etapa estão em hardware para IA médica.
Referências
- NVIDIA. Blackwell Architecture — especificações da B200. Documentação técnica, 2026.
- Krizhevsky A, Sutskever I, Hinton GE. ImageNet classification with deep convolutional neural networks. NeurIPS 2012.
- Curso Medicina com IA — Instituto Carlos Stéfano / Xdiag Tecnologias, 2026.
Relacionadas
- CPU — o contraste que explica por que a GPU existe na IA.
- CUDA — a camada que tornou a GPU programável para fora dos gráficos.
- A Ascensão da NVIDIA — como o chip de jogo virou infraestrutura.
- IA local — quando vale rodar o modelo na própria máquina.
- Aprendizado Profundo — o que a GPU tornou viável.
- Hardware para IA médica — as especificações práticas por etapa.