Tudo que você precisa saber sobre GPU, LLMs e IA

Tudo que você precisa saber sobre GPU, LLMs e IA

Author: Wellington Cruz September 2, 2026 Duration: 1:51:25

GPU, LLMs e infraestrutura de IA: esses três termos estão na boca de todo mundo, mas poucos conseguem explicar o que de fato acontece por baixo do capô quando você roda um modelo de linguagem ou monta um pipeline de inteligência artificial. Se você já tentou rodar um LLM localmente e se perguntou por que sua máquina não aguenta, ou ficou com o olho arregalado na fatura do cloud depois de escalar um agente, este episódio foi feito exatamente para você. O Wellington Cruz traz uma conversa que vai do zero ao avançado, desmistificando de vez por que a GPU virou o coração da IA moderna, como funciona o processamento paralelo de redes neurais e o que separa uma implementação mediana de uma absurdamente eficiente.O convidado desta vez é Jomar Silva, Developer Relations Manager da NVIDIA para a América Latina e um dos profissionais mais afiados do Brasil quando o assunto é computação acelerada. Ao longo de quase duas horas, Jomar explica desde os fundamentos de redes neurais e multiplicação de matrizes até temas como transformers embarcados em hardware, a arquitetura Grace Blackwell, o framework NIM para inferência de LLMs, fine tuning de SLMs, a tecnologia DeepStream para visão computacional e o DGX Spark como workstation definitiva para desenvolvimento de IA. O papo também passa por casos reais de empresas brasileiras que estão usando clusters de GPU para revolucionar finanças e saúde, além de dicas práticas de como acessar modelos no build.nvidia.com para testar, experimentar e prototipar sem gastar nada. Um dos momentos mais reveladores é quando Jomar mostra como trocar um simples import em Python pode acelerar um algoritmo em 450 vezes, sem tocar em uma linha de lógica.Jomar Silva é engenheiro eletrônico, programador desde os 12 anos e uma das vozes mais respeitadas no ecossistema de desenvolvedores de IA na América Latina. Se você é desenvolvedor, arquiteto de soluções, gestor de tecnologia ou simplesmente um entusiasta que quer entender como o mundo da inteligência artificial funciona de verdade, este episódio vai mudar a forma como você enxerga infraestrutura de IA. ConvidadosJomar Silvahttps://www.linkedin.com/in/homembit/00:00:00 Teaser: O que você vai aprender sobre GPUs e LLMs hoje00:00:46 Apresentação: Jomar Silva, Dev Relations da NVIDIA para a América Latina00:05:23 Caso Real: Rodando LLMs em Casa e o Problema de Custo na Nuvem00:09:33 O Segredo da Performance: Software Otimizado + GPU (TensorRT, NIM e VLLM)00:22:36 Por Que a GPU Domina a IA? CPU vs GPU e o Poder do Paralelismo00:26:40 Como Funciona uma Rede Neural: Pesos, Treinamento e Overfitting00:36:55 IA Generativa e LLMs: De GANs ao Transformer que Virou Hardware00:43:00 A História da NVIDIA com a IA: Da AlexNet à Doação para a OpenAI00:51:13 Infraestrutura Enterprise: GPUs na Nuvem, MIG, NVLink e Grace Blackwell01:04:53 DGX Spark: O Supercomputador de IA que Cabe na Mochila01:14:39 IA Agêntica na Prática: Jarvis, Bruce e o Futuro dos Agentes Locais01:26:59 Repatriar ou Nuvem? Como Reduzir Custo de Token com Infraestrutura Própria01:34:16 Demo ao Vivo: Explorando o build.nvidia.com e Deployando Modelos com Docker01:41:55 Startups Brasileiras que Estão Revolucionando com IA (Biofy, Ne Space, Forlex)01:47:58 Dicas Finais: Como Montar seu Homelab de IA e Próximos PassosLinksStanford CME295: Transformers and Large Language Models: https://www.youtube.com/playlist?list=PLoROMvodv4rOCXd21gf0CF4xr35yINeOyBuild Nvidia: https://build.nvidia.com/Youtube: https://youtu.be/xASPRR1kntQOutras plataformas: https://linktr.ee/pptnaocompila Acompanhe nas redesInstagram e Twitter: @pptnaocompilaLinkedIn: https://www.linkedin.com/company/pptnaocompila Criação e Apresentação: Wellington Cruz - https://www.linkedin.com/in/wellingtoncruz/


Você já parou para pensar em quantas decisões técnicas são, na verdade, conversas sobre pessoas, carreiras e o futuro do nosso trabalho? É nesse espaço que PPT Não Compila | Tecnologia, IA e Programação se encontra. Produzido pelos Estúdios Voz, este podcast mergulha nas questões que realmente importam para quem vive de código, dados e infraestrutura. A cada episódio, a conversa vai além das tendências quentes para examinar o impacto prático delas no dia a dia. Ouvimos discussões aprofundadas sobre desenvolvimento de software, os desafios éticos e práticos da inteligência artificial, a complexidade da segurança cibernética e os detalhes da infraestrutura em nuvem. Mas o que dá o tom especial é a maneira como esses temas se entrelaçam com a vida profissional real. Não é raro uma análise sobre uma nova ferramenta de IA vir acompanhada de uma reflexão sincera sobre como isso muda as habilidades demandadas no mercado, ou um debate técnico sobre cibersegurança levantar questões sobre negociação salarial para especialistas. É para quem entende que a carreira em tecnologia é um projeto em constante compilação, cheio de bugs a resolver e novas versões a lançar. Se você busca um conteúdo que respeita sua inteligência e trata a profissão com a profundidade que ela merece, encontrará um lar neste podcast. A proposta é clara: oferecer um diálogo honesto que ajuda a decifrar não apenas os sistemas, mas também o caminho para construir uma trajetória mais sólida e consciente nesse universo em ritmo acelerado.
Author: Language: pt-br Episodes: 50

PPT Não Compila | Tecnologia, IA e Programação
Podcast Episodes
DevEx: O Desenvolvedor no Centro da Tempestade da IA [not-audio_url] [/not-audio_url]

Duration: 1:33:37
A experiência do desenvolvedor nunca foi tão central quanto agora. No meio de toda a euforia em torno da inteligência artificial, das promessas de produtividade e das métricas que surgem a cada semana, existe um profissi…
IA no Design: Ferramenta Real ou Armadilha Criativa? [not-audio_url] [/not-audio_url]

Duration: 1:46:59
A inteligência artificial está transformando o design — mas será que está de vez ou apenas criando uma nova ilusão de produtividade? Essa é a tensão que move este episódio do PPT não Compila. Se você trabalha com tecnolo…
Porquê ter MDM e Governança antes de escalar o uso de IA [not-audio_url] [/not-audio_url]

Duration: 1:44:26
Toda empresa quer escalar o uso de inteligência artificial, mas poucas param para fazer a pergunta que realmente importa: os dados estão prontos para isso? A verdade é que MDM e governança de dados deixaram de ser temas…
Como letrar equipes não técnicas e ter ganho real com IA [not-audio_url] [/not-audio_url]

Duration: 1:43:36
Letrar equipes não técnicas para o uso de inteligência artificial deixou de ser um diferencial e passou a ser uma necessidade urgente. Enquanto as áreas de TI debatem ferramentas, homologações e governança, o restante da…
Como Criar Times de Alta Performance em Tecnologia [not-audio_url] [/not-audio_url]

Duration: 1:40:32
Criar e gerir times de alta performance em tecnologia nunca foi tão desafiador — e tão urgente. Num cenário em que a inteligência artificial redefine funções, processos e expectativas a uma velocidade sem precedente, a p…
Blockchain na Saúde: Como salvar vidas com Open Source [not-audio_url] [/not-audio_url]

Duration: 1:49:47
O sistema de saúde brasileiro tem um problema que quase ninguém discute abertamente: seus dados clínicos estão presos em gavetas, CDs e sistemas incompatíveis de hospitais que você mal se lembra de ter visitado. Prontuár…
Governança de Dados no Agro: Do IoT ao Self-Service com IA [not-audio_url] [/not-audio_url]

Duration: 1:22:46
Governança de dados no agronegócio ainda soa como ficção científica para muita gente, mas enquanto você lê isso, colhedoras sensorializadas estão gerando torrentes de dados em tempo real em fazendas do tamanho de três ci…
Modernização de Legado na CCEE: Arquitetura, Decisões e Lições [not-audio_url] [/not-audio_url]

Duration: 1:34:24
Modernizar uma aplicação de missão crítica que movimenta bilhões de reais por mês, funciona impecavelmente há mais de uma década e sustenta o mercado de energia elétrica do Brasil inteiro — sem parar nada, sem derrubar n…