vLLM: servindo LLMs no Linux com alta vazão — história, instalação e primeiros passos

vLLM: servindo LLMs no Linux com alta vazão — história, instalação e primeiros passos

Se você já rodou um LLM local com Ollama ou llama.cpp, sabe que funciona muito bem — para uma ou duas pessoas. Quando a demanda vira uma API que precisa atender dezenas de requisições simultâneas, o jogo muda: a GPU fica ociosa esperando, a memória se fragmenta e a vazão despenca. É exatamente esse problema … Read more

Python do Básico ao Profissional

Python do Básico ao Profissional

Python do básico ao profissional, no Linux, começa no terminal — não numa playlist de 2017. Em setembro de 2026 a série estável é o 3.14 (3.14.7 em 5 de agosto); o 3.15 já está em release candidate. A lista … Read more