A história de Linus Torvalds: o hobby que virou o kernel

A história de Linus Torvalds: o hobby que virou o kernel

Em 25 de agosto de 1991, um estudante de 21 anos em Helsinque avisou o grupo comp.os.minix que estava fazendo “um (livre) sistema operacional (só um hobby, não vai ser grande e profissional como o gnu)”. Trinta e cinco anos depois, o kernel que nasceu desse hobby roda a maior parte dos servidores, praticamente todo … Read more

Google TPUs: arquitetura, gerações e modelos

Google TPUs: architecture, generations, and models

Por volta de 2013 o Google fez a conta que assustou Mountain View: se cada usuário Android usasse o comando de voz da Busca por três minutos ao dia, em CPU x86, a empresa teria de dobrar os data centers só para inferência. GPU de consumo ainda era placa de jogo adaptada. A resposta foi … Read more

Como a DeepSeek reescreveu o Transformer

Como a DeepSeek reescreveu o Transformer

Em janeiro de 2025 a DeepSeek soltou o R1 (e, semanas antes, o V3) competindo com o1 e GPT-4o em raciocínio — com uma fração do custo de treino e de inferência. Os pesos saíram abertos. O truque não é um truque de dataset: é uma reescrita do miolo do Transformer, o Multi-Head Latent Attention … Read more

A história do Nintendo 64

A história do Nintendo 64

No começo dos anos 1990 o videogame doméstico ainda era pixel e plano. A Nintendo não foi para o CD de 32 bits: fechou com a Silicon Graphics, miniaturizou uma estação de trabalho de Hollywood e lançou um console de 64 bits em cartucho. Este texto segue o documentário History of Nintendo 64 1993-Today, do … Read more

Servidor de IA recondicionado com 64 GB de VRAM

Servidor de IA recondicionado com 64 GB de VRAM

VRAM dita o modelo. Qwen denso 27B–32B, Llama 70B quantizado, Mixtral 8×7B — isso pede 32 a 64 GB, não os 24 GB de uma 4090. O engenheiro Donato Capitella, com a Bargain Hardware, montou um Supermicro recondicionado com quatro GPUs de datacenter (64 GB no total) por cerca de £2.000 e mediu V100, P100 … Read more

Como funcionam as placas de vídeo

Como funcionam as placas de vídeo

Quantos cálculos uma placa de vídeo faz por segundo para desenhar um frame de Cyberpunk ou para treinar uma rede? O canal Branch Education desmontou uma RTX 3090 — no sentido literal — e reconstruiu o die GA102 em 3D. Este texto segue o vídeo How do Graphics Cards Work? Exploring GPU Architecture. A geração … Read more

Machine Learning de ponta a ponta

Machine Learning de ponta a ponta

Programar é: dados + regras → resposta. Precificar casa, reconhecer cara, entender português — regras manuais não dão conta. O Machine Learning inverte a conta: dados + respostas de exemplo → o modelo (as regras). Este texto segue o curso How Machine Learning Works, End to End do KodeKloud: da planilha ao ChatGPT, o ciclo … Read more

Deep Learning para iniciantes

Deep Learning para iniciantes

O Deep Learning Crash Course for Beginners do Jason Dsouza no freeCodeCamp é o mapa do território: o que é DL, como a rede aprende, o vocabulário (loss, Adam, epoch) e as três famílias de arquitetura. Este texto compacta o curso. A conta por baixo — MatMul, GPU — está no GPU vs TPU; o … Read more

O que é uma rede neural?

O que é uma rede neural?

Reconhecer um 3 rabiscado em 28×28 pixels é instantâneo para você. Escrever um if/else que faça o mesmo — curva aqui, haste ali, e se estiver torto? — é um inferno. A rede neural do vídeo But what is a neural network?, do 3Blue1Brown (Grant Sanderson), desmonta isso: não é mágica, é uma função com … Read more

Vaultwarden: Bitwarden self-hosted no Linux

Vaultwarden: Bitwarden self-hosted no Linux

O Vaultwarden é um servidor compatível com os clientes oficiais do Bitwarden, escrito em Rust. Cabe num Raspberry Pi, gasta dezenas de MB de RAM e libera no self-host o que o Bitwarden oficial cobra: TOTP, Send, organizações, emergency access. Não é o Bitwarden Inc. — é o projeto da comunidade (ex-bitwarden_rs), AGPL-3.0, hoje na … Read more