Documentación de Waffuru

ワッフル

Herramientas de bajo nivel para ejecutar modelos rápido en el hardware que ya tienes. Elige un componente para leer su documentación.

Docs

Butter

Derrite la latencia con una inferencia local ultrafluida. Una biblioteca de inferencia LLM ligera para Apple Silicon, construida sobre kernels Metal precompilados de Iron. Sin Python, sin MLX, sin JIT.

Docs

Iron

Un DSL de kernels en Rust. Imprime matemáticas puras directamente en silicio de alto rendimiento: una sola definición compila a Metal, CUDA, HIP y Vulkan.

waffuru.ai · github.com/waffuruai