GPU

A GPU é um processador de milhares de núcleos que executa cálculos em paralelo, e é o que tornou viável treinar e rodar modelos de IA. Na medicina, sustenta a análise de imagem e o processamento de grandes volumes de dados. Suas restrições reais são custo, consumo de energia e memória de vídeo disponível — o dado clínico que passa por ela é que responde à LGPD.

Verbete da wiki do curso Medicina com IA · atualizado em

Definição

A GPU (Graphics Processing Unit, ou Unidade de Processamento Gráfico) é um processador especializado projetado para realizar cálculos matemáticos em larga escala de forma paralela. Originalmente desenvolvida para renderização de gráficos em tempo real em jogos e aplicações visuais, a GPU evoluiu para se tornar o coração computacional da inteligência artificial (IA) moderna, especialmente no aprendizado profundo e no treinamento de redes neurais artificiais. Diferente da CPU tradicional, que processa tarefas sequencialmente com poucos núcleos potentes, a GPU possui milhares de núcleos menores otimizados para operações vetoriais e matriciais simultâneas, ideais para os algoritmos de aprendizado de máquina. Empresas como NVIDIA® dominam o mercado, com arquiteturas como Ampere, Hopper e Blackwell impulsionando a ascensão da NVIDIA.

Relevância para o Médico e Aplicações Práticas

Para o médico moderno, a GPU é essencial na adoção de IA na prática clínica, conforme explorado na Aula 1: introdução à IA para médicos. Ela acelera o processamento de grandes volumes de dados médicos, como imagens de ultrassom, tomografias e ressonâncias, permitindo diagnósticos mais rápidos e precisos via modelos de IA. Aplicações práticas incluem:

  • Análise de imagens médicas: é a GPU que torna viável treinar e rodar modelos de detecção de lesão em tomografia, ressonância e ultrassom — o que na CPU levaria semanas de treinamento cabe em dias.
  • A GPU que você usa sem ver: ao conversar com o ChatGPT®, o Gemini® ou o Gemini Notebook, o médico não opera GPU nenhuma — ela está do outro lado, no data center do fornecedor, processando o prompt e devolvendo a resposta. A conta de energia e de hardware é de quem hospeda o modelo.
  • A GPU que fica com você: só quando o modelo roda na própria máquina — em IA local, por privacidade — é que a placa passa a ser problema seu, e aí a memória de vídeo vira o fator limitante.

Médicos no perfil Médico Curador ou inovador (cinco perfis médicos com IA) beneficiam-se diretamente, avançando no letramento em IA e na curva S de adoção.

Mecanismos Técnicos

As GPUs operam via computação paralela, executando milhares de threads simultaneamente. Tecnologias-chave incluem:

  • CUDA® (Compute Unified Device Architecture): plataforma NVIDIA para programação paralela em GPUs.
  • Tensor Cores: núcleos dedicados à multiplicação de matrizes, a operação que domina o aprendizado profundo. É onde a distância para a CPU deixa de ser de vezes e passa a ser de ordens de grandeza.
  • Integração com Frameworks: bibliotecas como TensorFlow e PyTorch usam a GPU para a retropropagação em redes neurais.

Uma placa de data center atual, como a NVIDIA B200 da geração Blackwell, carrega 192 GB de memória de alta banda — é o que permite manter na memória um modelo com janela de contexto ampla. Vale a ressalva: mais GPU não reduz alucinação. A alucinação nasce do modelo e do dado de treino, não do silício; hardware melhor só a produz mais rápido.

O salto de 2012, quando a equipe de Geoffrey E. Hinton venceu a ImageNet com o AlexNet, só foi possível porque a rede foi treinada em GPUs. É a origem direta da linha que desemboca nos Nobéis de 2024.

Limitações e Considerações

Apesar de poderosas, GPUs apresentam desafios:

Em resumo, GPUs são infraestrutura crítica (por que a tecnologia perturba), mas demandam higiene de contexto e treinamento, como na Aula 2: modelos comerciais — conhecer e escolher.

Para rodar modelo na própria máquina

O fator que manda é a memória de vídeo (VRAM), não a velocidade da placa: o modelo precisa caber nela inteiro. Na geração atual de consumo, a linha RTX 50 dá conta de modelos de porte médio — a 5090, com 32 GB, roda inferência local na faixa dos 20 bilhões de parâmetros. Placas com 8 GB rodam apenas modelos pequenos e quantizados.

Ferramentas como o Ollama® e o LM Studio® acessam a placa via CUDA. As especificações por etapa estão em hardware para IA médica.

Referências

  • NVIDIA. Blackwell Architecture — especificações da B200. Documentação técnica, 2026.
  • Krizhevsky A, Sutskever I, Hinton GE. ImageNet classification with deep convolutional neural networks. NeurIPS 2012.
  • Curso Medicina com IA — Instituto Carlos Stéfano / Xdiag Tecnologias, 2026.

Relacionadas

  • CPU — o contraste que explica por que a GPU existe na IA.
  • CUDA — a camada que tornou a GPU programável para fora dos gráficos.
  • A Ascensão da NVIDIA — como o chip de jogo virou infraestrutura.
  • IA local — quando vale rodar o modelo na própria máquina.
  • Aprendizado Profundo — o que a GPU tornou viável.
  • Hardware para IA médica — as especificações práticas por etapa.