Magnitude: エージェント向け自己最適化推論エンジン

Judul asli: Launch HN: Magnitude (YC S25) – Self-optimizing inference engine for agents

Mengapa Ini Penting

ローカルLLM推論の速度格差を埋め、クラウド依存を減らす動きが加速する

YC S25発のMagnitudeが、ローカルAIモデルをllama.cppより最大2倍高速化するオープンソース推論エンジンをGitHubで公開。Apple Silicon、NVIDIA、AMD、CPUに対応。

Magnitude(YCombinator S25バッチ)は、AIエージェント向けのオープンソース推論エンジンをリリースした。最大の特徴は「自己最適化」機能で、各ユーザーのハードウェアに合わせてカーネルをコンパイル・チューニングし、llama.cppと比較して最大2倍の推論速度を実現するという。

Apple Silicon、NVIDIA GPU、AMD GPU、そしてCPUのみの環境にも対応。Pi、OpenCode、Hermes、Codexといった既存のAIエージェントとワンクリックで接続できる設計になっており、macOS・Windows・Linux向けデスクトップアプリも提供する。GitHubでは公開から短期間で5,700スターを獲得し、フォーク数も397に達している。ライセンスはApache-2.0を採用。ローカル推論の普及を阻む「速度の壁」に正面から挑む製品として、オープンソースコミュニティから注目を集めている。

Sumber

github.com — Baca artikel asli →