Documentation Waffuru

ワッフル

Des outils bas niveau pour exécuter des modèles rapidement sur le matériel que vous possédez déjà. Choisissez un composant pour lire sa documentation.

Docs

Butter

Faites fondre la latence avec une inférence locale ultra-fluide. Une bibliothèque d'inférence LLM légère pour Apple Silicon, bâtie sur les noyaux Metal précompilés d'Iron. Sans Python, sans MLX, sans JIT.

Docs

Iron

Un DSL de noyaux en Rust. Gravez les mathématiques brutes directement dans du silicium haute performance : une seule définition compile vers Metal, CUDA, HIP et Vulkan.

waffuru.ai · github.com/waffuruai