Magnitude : moteur d'inférence auto-optimisé pour agents IA
Original : Launch HN: Magnitude (YC S25) – Self-optimizing inference engine for agents
Pourquoi c'est important
L'inférence locale optimisée réduit la dépendance aux API cloud pour les agents IA autonomes.
Magnitude (YC S25) lance un moteur d'inférence open source qui compile et optimise ses kernels directement sur le matériel de l'utilisateur. Compatible Apple Silicon, NVIDIA, AMD et CPU, il affiche des performances jusqu'à 2x supérieures à llama.cpp, selon ses créateurs.
Magnitude est un moteur d'inférence open source conçu spécifiquement pour les agents IA. Contrairement aux solutions génériques, il compile et ajuste ses kernels au moment de l'installation selon le matériel détecté — Apple Silicon, GPU NVIDIA ou AMD, voire un simple CPU. Le projet revendique des vitesses d'exécution jusqu'à deux fois supérieures à llama.cpp sur les modèles open source.
L'intégration avec les agents existants (Pi, OpenCode, Hermes, Codex, entre autres) se fait en un clic. Le projet, incubé chez Y Combinator (promotion S25), est disponible sur GitHub sous licence Apache 2.0 et comptabilise déjà 5 700 étoiles. Des versions bureau sont disponibles pour macOS, Windows et Linux.