Publicado em 3 de fevereiro de 2026, o livro da Manning percorre programação CUDA para GPUs NVIDIA, dos primeiros kernels a Flash Attention, e menciona profiling com Nsight Compute.
Publicado em 3 de fevereiro de 2026, o livro da Manning “CUDA for LLMs” apresenta programação CUDA para GPUs NVIDIA, começando por kernels e avançando a recursos de LLMs, como Flash Attention. A prévia também menciona profiling com Nsight Compute; o material é voltado a engenheiros interessados em programação e análise de desempenho em nível de GPU.
Para confirmar o escopo e os tópicos, consulte a descrição e a prévia do livro na página da editora e compare com a edição disponível. Se usar IA para estudar o conteúdo, não envie código, dados ou documentos internos sem autorização: aplique a política da organização e use dados fictícios ou anonimizados quando possível.