Magnitude: エージェント向け自己最適化推論エンジン
Judul asli: Launch HN: Magnitude (YC S25) – Self-optimizing inference engine for agents
Mengapa Ini Penting
ローカルLLM推論の速度格差を埋め、クラウド依存を減らす動きが加速する
YC S25発のMagnitudeが、ローカルAIモデルをllama.cppより最大2倍高速化するオープンソース推論エンジンをGitHubで公開。Apple Silicon、NVIDIA、AMD、CPUに対応。
Magnitude(YCombinator S25バッチ)は、AIエージェント向けのオープンソース推論エンジンをリリースした。最大の特徴は「自己最適化」機能で、各ユーザーのハードウェアに合わせてカーネルをコンパイル・チューニングし、llama.cppと比較して最大2倍の推論速度を実現するという。
Apple Silicon、NVIDIA GPU、AMD GPU、そしてCPUのみの環境にも対応。Pi、OpenCode、Hermes、Codexといった既存のAIエージェントとワンクリックで接続できる設計になっており、macOS・Windows・Linux向けデスクトップアプリも提供する。GitHubでは公開から短期間で5,700スターを獲得し、フォーク数も397に達している。ライセンスはApache-2.0を採用。ローカル推論の普及を阻む「速度の壁」に正面から挑む製品として、オープンソースコミュニティから注目を集めている。