Trilha de aprendizagem
Stacks de construção e serving
Domine o software que de fato executa o Qwen3.8-27B — PyTorch, Transformers, vLLM, SGLang, TensorRT-LLM, llama.cpp, Ollama, MLX e Modular MAX — e saiba qual deles cada situação pede.
Stacks de construção e serving
Domine o software que de fato executa o Qwen3.8-27B — PyTorch, Transformers, vLLM, SGLang, TensorRT-LLM, llama.cpp, Ollama, MLX e Modular MAX — e saiba qual deles cada situação pede.
- 09.01PyTorch: o runtime de referência→
- 09.02O ecossistema Hugging Face Transformers→
- 09.03torch.compile e CUDA graphs→
- 09.04vLLM→
- 09.05SGLang→
- 09.06TensorRT-LLM→
- 09.07llama.cpp e GGUF→
- 09.08Ollama e runners locais→
- 09.09MLX→
- 09.10Modular MAX e Mojo→
- 09.11Serving na nuvem→
- 09.12Escolhendo o seu stack→