無限パラメータLLM:ライブデータから重みを生成・適応させる

2026/09/18 1:55

無限パラメータLLM:ライブデータから重みを生成・適応させる

RSS: https://news.ycombinator.com/rss

要約

Japanese Translation:

本テキストでは、「無限パラメータ LLM」と呼ばれる画期的なアーキテクチャを紹介しています。このアーキテクチャは、静的な事前学習やプロンプトコンテキストに依存するのではなく、ランタイムデータを直接ウェイトに書き込むことでライブインタラクションから学習することを可能にする設計です。これは、従来のモデルにおいてウェイトがトレーニング後にフリーズされ、ユーザーの訂正やランタイムで供給される知識がプロンプト内に限定され各リクエスト後に破棄されてしまうという根本的な課題に対応するものです。Mixture-of-Experts (MoE) アーキテクチャに触発され、このシステムは、固定されたバンクにウェイトを格納する代わりに、コンパクトなハイパーネットワークを用いてランタイムデータを共有ベースネットワークの低ランク変調に変換します。以前のプロトコルではコンテキストを読み取り一度で出力をフリーズしていたウェイトジェネレータとは異なり、この手法はセッション中を通じてジェネレータの潜在コードに対するベイジアン信念を維持・更新し、効果的なウェイトが単一のコンテキスト読み取り後に固定されるのではなく、進化する信念から再導出できるようにしています。知識や振る舞いをウェイトに格納することで、このアーキテクチャは進行する会話から導出された実質的に無限のコンパイル可能なウェイトを実現します。このような動的な更新は以下の大きな利点をもたらします:限られたコンテキストウィンドウを解放し、アモルタイゼーションによって不要な計算資源の使用を削減し、情報が複数のターンにわたって持続を保証し、文脈内使用よりも優れた汎化能力を可能にする可能性があります。著者はこの機能を文脈内学習および検索に対して直接テストするための評価プロトコルを定式化しています。提出履歴によると、本ドキュメントは Jinli Hu 博士により作成され、[v1]として Wed, 16 Sep 2026 15:49:34 UTC に提出され、ファイルサイズは 50 KB です。

Text to translate:

The text introduces the "Infinite-Parameter LLM," a groundbreaking architecture designed to learn from live interactions by writing runtime data directly into weights, rather than relying solely on static pretraining or prompt context. This approach addresses the critical limitation of conventional models where weights are frozen after training, causing user corrections and knowledge supplied at runtime to be confined to prompts and discarded after each request. Inspired by Mixture-of-Experts (MoE) architectures, the system employs a compact hypernetwork to translate run-time data into low-rank modulations of a shared base network instead of storing weights in a fixed bank. Unlike prior weight generators that read context once and freeze their output, this method maintains and updates a Bayesian belief over the generator's latent code continuously during a session, allowing effective weights to be re-derived from an evolving belief rather than being fixed after a single context read. By storing knowledge and behavior in weights, the architecture achieves effectively infinite compileable weights derived from ongoing conversations. This dynamic updating offers significant advantages: it frees up limited context windows, reduces unnecessary compute usage through amortization, ensures information persists across multiple turns, and potentially enables better generalization than in-context use. The authors specify an evaluation protocol to test this capability directly against in-context learning and retrieval. Submission history indicates the document was authored by Jinli Hu Dr, submitted as [v1] on Wed, 16 Sep 2026 15:49:34 UTC, with a file size of 50 KB.

本文

無限パラメータ LLM:ライブインタラクションからの学習による次世代アーキテクチャ

抄録と背景

  • スケーリング則に基づき、パラメータ数や学習データの増加に伴いモデルの能力が向上することを確認。
  • 専門家ミックス(MoE) アーキテクチャはこの則を拡張し、驚くべき成果を挙げてきた。
    • 静的な事前学習データのみを用い、膨大なパラメータバンクのうち各トークンごとに一部だけを活性化させる方式である。
  • しかし、実用環境ではトレーニングセットに含まれていないライブインタラクションのデータ(ユーザー提供事実や訂正など)が重要である。
  • 従来の固定重みモデルはこれらのデータを学習できず、知識をプロンプトに記述して再読する一時的な方法に依存している。

提案:Infinite-Parameter LLM

我々は「ライブインタラクションからの学習を実行し、その結果を重みに書き込む」アーキテクチャを提案する。このモデルは以下の特徴を持つ。

アーキテクチャ概要

  • MoE のインスピレーション を受け入れ、無限パラメータ大規模言語モデル を実現。
  • 構造:コンパクトなハイパーネットワークが実行時データに基づき、共有ベースネットワークへの低ランクモジュレーションを生成。
    # コンセプト的な仕組みの簡易表現
    current_weights = shared_parameter_bank + hyper_network(live_interaction_data)
    
  • フォワード・フィード重み は固定されたバンクではなく、ライブデータから動的に生成される。

学習メカニズムの違い

従来のアプローチInfinite-Parameter LLM
ジェネレータが文脈を一度読み取り後で凍結(固定)ベイズ的信念を持ってジェネレータの潜在コードを更新
オンラインでの信念更新なしオンライン更新による継続的学習
一度読み取った重みはセッション中固定セッション進行に伴い、発展する信念から重みを再導出
メモリフットプリントのみが固定実質的に無限のコンパイル可能重み数を実現

メリットと利点

  • プロンプト依存性の排除: 知識や振る舞いを「プロンプト」ではなく「重み」として保持。
    • 計算コストの削減
    • コンテキストウィンドウの解放
  • 持続性: ターンを超えた知識の蓄積と維持が可能。
  • 汎化性能: 文脈内学習(In-Context Learning)よりも優れた汎化能力を発揮。

評価プロトコル

この特性を厳密に検証するために、以下の観点で評価を行う評価プロトコルを定義する。

  1. 文脈内学習に対する比較検証
  2. 検索機能に対する効果の検証

同じ日のほかのニュース

一覧に戻る →

2026/09/18 5:36

Bend:CPU と GPU で証明により AI のミスをブロックする言語

## Japanese Translation: ## まとめ: Bend は、数学的証明をネイティブマシンコードに直接コンパイルすることで AI 生成のエラーを排除することを目的とした高性能プログラミング言語です。従来のランタイムチェックに依存する言語とは異なり、Bend は論理検証をコンパイル段階に統合し、速度を損なうことなく安全性を確保します。Python の構文の利便性と C レベルのパフォーマンス(1 コアでほぼ C と同じ速度、GPU では最大 100 倍高速)を統合し、CPU および GPU 双方での並列性を自動的に管理しつつ、スレッドやロックを必要とせず実行します。これは、アフィン依存型理論(BendTT)と専用の証明システムである `LAWS.bend` を組み合わせるユニークなアーキテクチャによって実現されています。これらのルールは人工知能エージェントが従う絶対的制約を定義し、一般的なバグが実行前に統合されることを数学的に防止します。Lean や Rocq に似る専門の型チェッカーである `PROOF.bend` が使用され、中規模なコードベースでは 1 秒未満でこれらの法の遵守を確認します。高度な証明アシスタントに着想をうけながら実行向けに最適化された Bend は、Linux および macOS 上でバックエンドタスク向けの安全かつ高速な AI 開発を可能にします。この技術を効果的に導入するためには、`curl -fsSL https://bend-lang.com/install.sh | sh` を使用してインストールし、`bend guide` コマンドを利用し、プロジェクトのドキュメント(例:`AGENTS.md`)に特定の検証指示を統合し、コードが宣言された法に準拠していることを確認するために `PROOF.bend` を実行する必要があります。主な機能には C 相当の速度、CUDA 並列性、Lean スタイルの証明、Python 構文が含まれます。プロジェクトが進化するにつれて、バグ報告を通じてその成長に貢献することをユーザーは推奨されます。

2026/09/18 6:13

bonsai 2 27B:サイズが 9 倍小さくても損失のない圧縮を実現

## 日本語翻訳: PrismML は、Qwen3.8 27B をベースとした現時点で最も高性能なモデルである Ternary Bonsai 2 27B をリリースしました。このモデルは、NVIDIA RTX 5090(最大 143 トークン/秒)や Apple M5 Max(46.8 トークン/秒)のようなコンシューマー向けハードウェアでの効率的なデプロイを目的として設計されています。モデルは{-1, 0, +1}の値を持つトライナリ重みと FP16 グループ別スケーリングを採用しており、フルプレシジョン版よりも 5.9GB のフットプリントで 9 倍以上小さく、かつ論理推論、数学、コーディング、指示に従うこと、ビジョン、エージェント型ツールの使用にわたる総合ベンチマークスコア(83.9 ポイント)において Qwen3.8 27B の 98.2% を達成しています。 262K トークンのコンテキストウィンドウとテキストおよび画像入力のネイティブサポートを備えた改良されたアーキテクチャに基づいた Ternary Bonsai 2 は、論理推論、コーディング、マルチモーダルワークフローにおいて強力なパフォーマンスを発揮しながら、通常誤差が累積しやすい領域でフルプレシジョンの能力を保持します。CUDA を通じて NVIDIA GPU や MLX を通じて Apple デバイス上で動作し、カスタムロービットカーネルを活用することで、小型モデルに比べエネルギー効率(RTX 4090 で 0.714 mWh/トークン)が優れており、運用コストを大幅に削減します。Apache 2.0 ライセンスの下でリリースされており、今日から完全な重みとホワイトペーパーが利用可能です。カリフォルニア工科大学の研究者らによって設立され、Khosla Ventures、Cerberus、Google の支援を受けた PrismML では、contact@prismml.com で連絡し、チーム協力によるモデルの適応化をサポートしています。

2026/09/18 1:25

ヒスター:閲覧したページや保存したファイルのためのプライベート検索エンジン

## Japanese Translation: Hister は、ユーザーのプライバシーをデフォルトで最優先する、訪問した Web ページおよびローカルファイルを対象とした、プライベートでローカルホストされた検索エンジンです。フルコンテンツをインデックス化し、必要不可欠なファビコンのみをダウンロードしますが、クラウドやテレメトリサービスにデータを送信することはありません。Hister は Linux、macOS、Windows、Docker、Nix 環境をシームレスにまたいで動作し、バイナリ(必要に応じて名義を変更)、Homebrew、Docker、または Nix を通じてインストールできます。プロジェクトは Go 1.26、npm、C コンパイラーの構築(`./manage.sh build`)を必要とし、AGPLv3 ライセンスの下で公開されています。Hister を使用するには、`./hister.exe listen`(Windows)または Linux/macOS における同等のコマンドを実行してローカルサーバーを開始し、ターミナルを開いたまま `http://127.0.0.1:4433` でインターフェースにアクセスします。Firefox または Chrome の拡張機能を通じてブラウザと統合して訪問したページを自動的に保存でき、Web インターフェース、TUI、コマンドライン、MCP を介した AI アシスタントを含む代替クライアントもサポートしています。高度な検索機能には、フィールドフィルタ、フレーズ、ワイルドカード、否定、エイリアス、結果の優先順位、および履歴またはディレクトリ用のインポートオプションが含まれ、設定された埋め込みエンドポイントによるオプショナルな意味検索も提供します。共有サーバー上での多ユーザー構成をサポートし、厳格なローカルデータ主権を遵守しています。開発者はビルド指示を `asciimoo/hister` リポジトリで確認でき、コミュニティサポートは Discord、IRCNet(`#hister`)、バグ報告用の GitHub issues、および `CONTRIBUTING.md` と `SECURITY.md` ドキュメントを通じて利用可能です。

無限パラメータLLM:ライブデータから重みを生成・適応させる | そっか~ニュース