
2026/10/01 2:37
Magnitute(YC S25):エージェント向け自己最適化推論エンジンの発売
RSS: https://news.ycombinator.com/rss
要約▶
Japanese Translation:
Magnitude は、AI エージェント向けにハードウェア固有で自動的にパフォーマンスを最適化するためのオープンソース推論エンジンです。デバイス上でカスタムカーネルを直接コンパイルし、人気のあるモデルファミリーのために手動でチューニングされたルーチンを採用することで、open モデルが llama.cpp より最大 2 倍高速に動作することを可能にし、Apple Silicon ではデコーディングが最大 92% 高速化され、CUDA システムでは 19% の性能向上を達成します。デスクトップアプリは macOS、Windows、Linux を問わず、Apple Silicon、NVIDIA、AMD GPU、または CPU という多様なハードウェアに対応し、固定的な最低要件を設けていません。
ワンクリックでの統合により、Pi、OpenCode、Hermes、Codex、OpenClaw、Claude Code、Oh My Pi、Cline など人気のあるエージェントに接続でき、他のエージェントは OpenAI 互換 API を介して接続できます。エンジンでは、タスク完了時に自動的にメモリーを解放し、共有プレフィックスキャッシュを使用してスローダウンを防ぐことで、同時負荷下での安定性を維持します。エージェントあたりのメモリー消費量を 27% 削減し、高度な AI をプライベートに実行するためのハードウェアの障壁を低下させます。Apache 2.0 ライセンスの下でリリースされた Magnitude は無料で、ダウンロード後はインターネット接続が不要であり、データはローカルマシン上に保持され、macOS、Windows、Linux 向けに直接提供されており、別途 CLI インストールが必要ありません。
本文
Magnitude:ハードウェアに最適化された高速オープンソース推論エンジン
Magnitude は、利用者の特定のハードウェアに合わせて自律的に最適化するオープンソース推論エンジンです。デバイス上でカーネルをコンパイルおよびチューニングするため、既存のソリューションと比較して最大 2 倍の速度を発揮します。
🚀 主な特徴
- 圧倒的な高速処理
- Magnitude は、llama.cpp よりも最大 2 倍高速に動作します。
- Metal(Apple Silicon)でのデコード:92% の高速化
- CUDA(NVIDIA GPU)でのデコード:19% の高速化
- Magnitude は、llama.cpp よりも最大 2 倍高速に動作します。
- ハードウェア特化型最適化
- モデルを実行する前に、実際のデバイス上でカーネルをコンパイル・チューニングします。
- 配布済みの汎用カーネル(llama.cpp, Ollama, LM Studio など)とは異なり、ご使用のチップに完全に適応しています。
- 柔軟なリソース管理
- エージェントごとのメモリ使用量を 27% 削減。
- エージェントが停止すると、直ちにメモリを解放します。
- 高負荷タスクへの対応
- セッション間でプレフィックスキャッシュを共有し、速度低下を防ぎます。
- 並列セッション処理において高速な性能を発揮します。
- 広範なモデル対応
- 人気のあるオープンウェイトファミリー向けに手動最適化されたカーネルを内蔵しています。
- 詳細なモデルリストは
で確認可能です。magnitude.dev/models
🎮 エージェント連携機能
- ワンクリック接続
- Pi, OpenCode, Hermes, Codex, OpenClaw, Claude Code, Oh My Pi, Cline などのエージェントを即座に接続できます。
- 他エージェントとの互換性
- Magnitude で動作させられないエージェントも、OpenAI 互換 APIを通じて接続可能です。
- 無料かつプライバシー重視
- トークン料は発生しません。
- データは一切外部へ送信されません(Apache 2.0 ライセンス)。
📥 インストール方法
- Magnitude のデスクトップアプリをダウンロードし、インストールします。
- アプリを開き、「Discover」から推奨モデルを選択してダウンロードします。
- 「Connections」セクションでエージェントを追加し、すぐに使用を開始できます。
💡 ヒント: デスクトップアプリには CLI ツールが標準搭載されており、別途インストールする必要はありません。
❓ FAQ(よくある質問)
Magnitude とは何ですか?
ハードウェアに合わせて自律的に最適化されるオープンソース推論エンジンです。デスクトップアプリとして提供され、オープンソースモデルを実行するとともに、各種エージェントとの接続を一元管理します。
なぜ llama.cpp、Ollama、LM Studio よりも高速ですか?
- llama.cpp / Ollama / LM Studio: ハードウェアの多様性を考慮して、事前に多数の環境向けにコンパイルされたカーネルを配布しています。
- Magnitude: 実際のデバイス上でオンザフライでカーネルをコンパイル・チューニングするため、ご使用のチップに対して最適化されています。
どのようなハードウェアが必要ですか?
特定の最低要件はありません。以下のいずれかの構成で動作します。
- Apple Silicon搭載システム
- NVIDIA GPU搭載システム
- AMD GPU搭載システム
- CPU 専用システム
- メモリ容量に応じたモデル実行:
- 小型マシン:軽量モデル
- 大容量メモリマシン:大型モデル
どのオペレーティングシステムに対応していますか?
- macOS
- Windows
- Linux
プライバシーは確保されていますか?
はい、完全なプライバシーを保障しています。
- プロンプト、ファイル、モデルデータはすべてご自身のマシン上に留まります。
- モデルがローカルでダウンロードされた後、インターネット接続は不要です。