Blog
LLMs & Texto
Kernel Forge: um arcabouço de agentes para geração e otimização de kernels CUDA baseada em LLMs
arXiv:2607.24762v1 Tipo de anúncio: novo Resumo: Modelos de aprendizado de máquina estão cada vez mais embutidos em softwares do dia a dia, e a maior parte de seu tempo de execução é gasta em um pequeno conjunto de kernels de computação, como multiplicação de matrizes, convolução e normalização. Otimizar esses kernels é uma das formas mais diretas de reduzir latência e custo, mas isso tradicionalmente exigiu engenheiros especialistas para escrever à mão código de GPU de baixo nível. Sistemas agênticos construídos sobre grandes modelos de linguagem (LLMs) agora podem gerar e otimi...
arXiv cs.AI
·Joshua Brodsky, Dhravid Kumar, Savini Kashmira, Jayanaka Danatanarayana, Jason Mars, Krisztian Flautner, Lingjia Tang
·