分類したり、ハルシネーションを起こしたりしないでください。

2026/08/11 5:50

分類したり、ハルシネーションを起こしたりしないでください。

RSS: https://news.ycombinator.com/rss

要約

日本語訳:

本テキストは、AI モデルを膨大で高価な法的カテゴリリストに負担をかけずに商品をよりスマートに分類する手法を提案しています。少数の Large Language Models(LLM)が強制的に数百通りの厳格なオプションから選択させ、それにより誤りや高い技術的複雑さを引き起こすのではなく、本システムはこれらのモデルに独自の妥当なカテゴリパスを発明させることを可能にします。例えば、モデルは剛性的なデータベース用語ではなく「Furniture / Living Room」といった提案を行うかもしれません。この発明の重要な革新点は、この創造的なステップがルールを無視することを意味するわけではない点であり、生成と厳格な語彙強制を分離することでコストを削減することにあります。裏側では、本システムはこれらに発明された名前を、Wayfair WANDS データセットなどのデータから構築したインメモリのセットに含まれる実際の用語と比較するためにベクトル埋め込みマッチングという技術を使用して、幻覚(ハルシネーション)を自動的に正しい法的分類に変換します。これにより、企業は複雑なスキーマの更新が必要なことなく、厳格な法的基準に従いつつ、より小型で安価なモデルを使用することができます。

本文

構造化出力とハルシネーション:LLM での大規模カテゴリ分類戦略

問題の背景と現状

  • 定着しつつある技術: LLM を用いた商品や検索クエリの分類は既に一般的になりつつあります。
  • 残る課題: LLM の出力を**システムが許容する厳密な用語(=正式なタクソノミー上の用語)**に制限する手法は、依然として困難です。
    • 例:ブランド名、色、カテゴリなどへの制約が必要です。
  • 実用的な課題例 (Wayfair データセット):
    • クエリ「木製のコーヒーテーブル」を適切な数百種類のカテゴリに分類する必要があります。
    • カンデイト例:
      • Furniture / Office Furniture / Desks
      • Furniture / Living Room Furniture / Coffee Tables & End Tables / Coffee Tables
      • Furniture / Living Room Furniture / Coffee Tables & End Tables / End & Side Tables
      • Décor & Pillows / Decorative Pillows & Blankets / Throw Pillows
      • 他多数

従来のアプローチ:構造化された出力

  • 手法: プロバイダに対し、許可された値のリストに限定する指示を与えます。
  • 実装例 (Pydantic): 巨大な
    Literal
    タイプで許可値を定義します。
from typing import Literal
from pydantic import BaseModel, Field

FullyQualifiedClassifications = Literal[
    'Furniture / Bedroom Furniture / Beds & Headboards / Beds',
    'Furniture / Living Room Furniture / Chairs & Seating / Accent Chairs',
    'Rugs / Area Rugs',
    # ... (実際には 500 行近い項目を追加)
]

class QueryClassification(BaseModel):
    """
    家具系 e コマース向けの検索クエリの構造化表現。
    カテゴリおよびサブカテゴリを追加します。
    """
    classifications: list[FullyQualifiedClassifications] = Field(
        description="商品に対する可能な分類"
    )

# 実行例
response = client.responses.parse(
    model="gpt-5.4-mini",
    input="クエリ「brown coffee table」を分類してください。",
    text_format=QueryClassification,
)

print(response.output_parsed.message)
# 出力: Furniture / Living Room Furniture / Coffee Tables & End Tables / Coffee Tables
  • 課題:
    • スケーリング時にコスト削減が困難です(安価・軽量モデルでの運用に限界)。
    • 送信サイズの上限により、巨大な許可リストを送信するのが非現実的です。

新しいアプローチ:ハルシネーションと埋めベクトル検索

LLM の分類を滑らかに実現するための新しいパターンが存在します。

ステップ 1: 架空の分類案生成 (Hallucination)

  • LLM に、実際には存在しない(仮想の)分類案を作成させます。
  • スキーマや巨大なリストを送信する必要がありません。
hallucination_prompt = f"""
あなたの課題は、検索クエリに最も適する、これまで見たことのない新しい家具・ホームグッド、またはハードウェアに関する分類案を作成することです。

商品の分類例は以下の通りです:

Furniture / Living Room Furniture / Coffee Tables & End Tables / Coffee Tables
Décor & Pillows / Decorative Pillows & Blankets / Throw Pillows
Furniture / Bedroom Furniture / Dressers & Chests
Kitchen & Tabletop / Kitchen Organization / Food Storage & Canisters
School Furniture and Supplies / School Furniture / School Chairs & Seating / Stackable Chairs
Baby & Kids / Toddler & Kids Bedroom Furniture / Kids Beds

以下が分類を行うクエリです:

brown coffee table
"""

response = client.responses.parse(
    model="gpt-5.4-mini",
    input=hallucination_prompt,
    text_format=list[str], # 自由なテキスト出力を許可
)
  • 生成結果:
    Furniture / Living Room / Tables / Coffee
    など、実際のタクソノミーにない表現が出力されます。
  • 表面的には役に立たなさそうに見えますが、重要な次のステップへと繋がります。

ステップ 2: ベクトル検索によるマッピング

  • 生成された架空の分類を、正規の用語体系へ変換・解決します。

  • 実装プロセス:

    1. メモリ内に「実際の分類(Wayfair のタクソノミー)」に対応する**埋めベクトル (Embeddings)**セットを作成します(MiniLM を使用など)。
    2. LLM が生成した架空のテキストも同様に埋めベクトル化します。
    3. 架空のベクトルと実際の各分類のベクトルの**内積 (dot product)**を計算します。
    4. 最も類似度が高いものを探し出し、正規のカテゴリへとマッピングします。
  • 最終的なマッピング結果:

    • 入力:
      Furniture / Living Room / Tables / Coffee
      (架空)
    • 出力:
      Furniture / Living Room Furniture / Coffee Tables & End Tables / Coffee Tables
      (正規)

まとめとメリット

  • コスト効率: 妄想(hallucination)タスクを安価で単純な LLM に割り当てる可能です。
  • スケーラビリティ: 毎回スキーマや巨大なリストを LLM に送信する必要がありません。
  • 精度: 正確なカテゴリへマッピングし、既存の構造化出力手法と同様の結果を得られます。

関連イベント情報 ベクトル検索、ハイブリッド検索、および独自のベクトルデータベース構築に関する一連のイベント「Vectors Week」にご参加ください。

同じ日のほかのニュース

一覧に戻る →

2026/08/15 0:00

Qwen 3.8 27B

## Japanese Translation: Qwen3.8 は、コーディング、プロフェッショナルなワークフロー、研究、長期的なエージェントタスクにおいて大幅な性能向上をもたらす、Qwen3.5 の機能に継承する最新オープンモデルです。コンパクトな Qwen3.8-27B バリエーションは、複雑な多段階実行のためのネイティブのビジョン・ランゲージ理解を備えています:STEM 図や数時間の動画を処理し、環境からのフィードバックを取り扱い、`preserve_thinking` を介して履歴メッセージにわたる思考を保持します。性能は、SWE-bench Pro で 61.7、Terminal Bench 2.1 (Terminus) で 73.0、LiveCodeBench v6 で 90.3、OSWorld-Verified で 84.3、MathVision および OmnilDocBench で 90% 超のスコアを含む強力なベンチマーク結果によって検証されています。 アーキテクチャにおいて、モデルは YaRoPE スケーリングによる拡張性を通じてネイティブに 262k トークンのコンテキストウィンドウをサポートし、最大 100 万トークンまで拡張可能です。`enable_thinking`(デフォルトでオン)と `reasoning_effort`(xhigh/medium/low)によって制御される柔軟な推論モードを提供します。推奨サンプリングパラメータはモードごとに異なります:思考モードでは temperature=1.0、top_p=0.95、top_k=20、min_p=0.0 を使用し、指示モードでは temperature=0.7、top_p=0.80、presence_penalty=1.5 を使用し、思考を無効にするためのオプションの追加ボディ調整が可能です。 本番デプロイメントは、SGLang、vLLM、TokenSpeed、Qwen Cloud API との互換性を通じて簡素化されており、高スループットシナリオには専用サービングエンジンが推奨されます。数時間のビデオ処理については、`video_preprocessor_config.json` の `longest_edge` を 469,762,048(224k ビデオトークン)に設定します。全体として、Qwen3.8 は深い歴史的文脈と長期間にわたる自律的な意思決定を可能にし、既存の画像/ビデオ分析パイプラインとシームレスに統合されます。

2026/08/15 5:46

研究がコーヒー摂取量と代謝健康および性ホルモンの関連性を示唆

## Japanese Translation: 大学のウェブサイトは、主要な学術および行政リソースにユーザーを接続する包括的なポータルとして機能します。構造的には、生化学・分子医学学部、教育学・心理学学部、人文科学部、医学部、情報技術電気工学部、理学部、技術学部、オウルビジネススクールなどの特定ファカルティへの直接ナビゲーションを提供するとともに、「Oula-Finna」図書館システムをはじめとする重要なサポーツサービスにアクセスすることを可能にします。この図書館システムでは、サービス、コレクション、施設、ガイド、連絡先時間などへのアクセスが提供されています。さらに、ニュース、出願、研究、協力、寄付、キャンパス、キャリア、連絡先情報、登記所、中央アーカイブなどのセクションも利用可能です。ウェブサイトはまた、大学ランキングを際立たせて表示しています。これらの多様な要素を統合することによって、ウェブサイトはステークホルダーが特定の機関データおよびサービスを見つけるために効率よく動作し、内部ナビゲーションおよび外部エンゲージメントのための重要なハブとなっています。

2026/08/15 0:03

私が大切にしている本7冊:なぜか大好きだからです。

## Japanese Translation: **改善された要約:** 本文の主な焦点は、作家の机周および棚に配置され、インスピレーションと参照のための詳細な物品リストにある。このキュレートのコレクションは古典文学や神学から数学論理、児童書、デジタルツールまで多様な分野を繋ぎ合わせている。著者は実用性やテーマ的な深さに基づいて特定の版を残しており、例えばロジェの類語辞典第 4 版は時間概念(例:優先度、同時性)の簡潔な分類のために保持されているが、サイズのため第 8 版は遠い棚に移されており使用されていない。他の注目すべき作品には、サウス・トマス・ブラウンの『Pseudodoxia Epidemica』があり、これはロジェのスペースに置かれ、蝗虫やピタゴラスのタブーなどに関する話題が論じられている;ボッカッチョの『デカメロン』(1348 年の黒死病を背景とし、ダンテと比較される);そして『フレゲからゲーデルへ』という数学論理論文集が含まれている。リストにはさらに、ヨハネス・コメニウスの挿絵入り児童書『Orbis Sensualium Pictis』(1658 年)、特定の記事に関する注釈を付した大型文字の NIV 聖書、ベリー公の中世『Belles Heures』、そして 8mm バックアップテープや韓国式麻雀カードのような個人的な文脈を持つ物品も含まれている。最後に、GNU Emacs や Blosxom ソフトウェアなどの実用的なデジタルツールに加え、ドラフト作成およびテキスト修正のために GNU grep およびその他のユーティリティのコレクションも含まれている。

分類したり、ハルシネーションを起こしたりしないでください。 | そっか~ニュース