A と An の違い

2026/09/20 5:41

A と An の違い

RSS: https://news.ycombinator.com/rss

要約

Japanese Translation:

2026 年 9 月 16 日、本プロジェクトは英語の不定冠詞「a」と「an」を習得するための definitive guide(決定版ガイド)を提供し、「選択は発音 entirely に依存しており、綴りには依存しない」という点を明確にします。基本的な原則は、単語の最初の音を聴くことであり、例えば「unicorn」は母音文字「u」で始まっても子音音('Y')で始まるため「a」を使い、「hour」は黙字の「h」があるにも関わらず母音音('OW')で始まるため「an」を使います。著者は LLM を一切使用せず、32,455 の単語を手動で 1 日かけて分析し、可視化を作成することでこの則を検証しました。この厳密な人間主導の分析により、標準的な音に基づくロジックからの例外として特定された単語はわずか 129 語に過ぎることが明らかになりました。これらの知見を実装するため、著者は一般的なヒューリスティックエラーを修正した後、正しい冠詞の選択を自動化する実用的な関数

a_or_an(word)
を開発しました。頻繁な文法課題に対する正確なアルゴリズム的な解決策を慎重な人間分析を通じて提供することで、本プロジェクトは学習者も開発者も両方にとって信頼できるツールを提供します。

本文

不定冠詞「a」と「an」の使い分け:母音例外のデータ分析

問題背景

英語で不定冠詞を使用する場合、原則として頭文字が子音であれば

a
、母音であれば
an
を用います
。しかし、発音による例外が多く存在します。

  • 例文
    • ア・ラクーン(狸):
      a raccoon
    • アン・アップル(りんご):
      an apple

単純な判断法の限界

単語の頭文字が母音か子音かをテキストベースで判定するだけでは不十分です。

  • 発音が子音から始まる例
    • unicorn
      (ユニコーン): 頭文字は
      u
      ですが、発音は
      /ju/
      から始まり子音
      /j/
      でスタートします。→ 「an unicorn」
    • hour
      (アワー): 頭文字は
      h
      ですが、発音は
      /aʊ/
      から始まり母音で始まります。→ 「an hour」

データ分析の結果

単語の最初の 2 文字パターンを用いて判定ルールを作成し、全データを可視化・分析しました。

主要発見

  • 例外は極めて稀である
    • 調査対象:32,455 の単語
    • 例外が必要な単語数:わずか 129
    • 大部分の単語は、頭文字(または最初の発音)だけで簡易的に判定可能です。

コード実装のポイント

特定の単語に対する冠詞選択ロジックを実装する際の考慮点です。

def select_article(word):
    """
    単語に対して適切な不定冠詞('a' または 'an')を選択する関数
    
    Args:
        word (str): 対象の単語
        
    Returns:
        str: 選択された冠詞 ('a' または 'an')
    """
    # ここで簡易的なルール(例:最初の文字が母音か?発音規則含むか?)
    # を適用し、例外ケース(129 語)を特定して返す
    
    # 注意:単純な文字判定だけでは不正確であるため、
    # 発音ルールのテーブル参照や例外リストチェックが必要になる場合があります。
    return 'a' if simple_rule_check(word) else 'an'

考察と LL Mへの提案

今回の分析は単発的なデータ処理であり、保守性を最優先する必要はありませんが、将来的には以下の点を考慮すると有益です。

  • トライ木などのアルゴリズムで判定ロジックをさらに最適化する余地がある。
  • cmudict辞書データの解析や d3.jsによる可視化手法の再学習も検討可能な領域です。
  • 大規模言語モデル(LLM)を活用し、発音規則と例外リストを組み合わせたより堅牢な実装を検討しても良い可能性があります。

同じ日のほかのニュース

一覧に戻る →

2026/09/19 19:46

1 年前に RL を用いた非自己回帰型決定モデルを構築した

## Japanese Translation: 本テキストは、エンタープライズワークフローを悩ませてきた高遅延と幻覚(ハルシネーション)のリスクを排除することを目的として設計された画期的な完全にオープンソースの AI モデル「Laya」を紹介する。標準的な生成型大規模言語モデルがしばしば 500〜2,000 ミリ秒の遅延を経験するのに対し、Laya は単一の GPU で顕著な 32.8 ms の遅延を実現し(バッチ処理された質問の場合には 7.2 ms)、これを達成するためには形式自由なテキスト生成を完全に回避し、代わりに辞書からオプションを選択する「choice」命令、順序付けされた評価基準レベルを割り当てる「score」命令、および真理値論理によって有用でない出力を示す「noul」という 3 つの特定の決定プリミティブのみを通じて構造化データのみを出力することを行っている。この建築学的なシフトは、ルーティングやスパム検出などの重要なタスクに対して瞬時に数学的に校正された確率を確保し、100 言語以上をカバーしている。TypeSafe の「Jev」といったプロプライエタリ競合製品に優越するように開発された Laya は、企業がローカルで展開することを可能にし、API 手数料と運用コストを大幅に削減する。将来的な改良により、現在のトークン予算の制限を超えたより大きなオプションセットを処理することが予想され、英語専用モデルに見られる一般的な失敗がないグローバルかつマルチスキーマの意思決定のための堅牢なソリューションとなるだろう。

2026/09/19 18:20

生成 AI で作られたポスターがひどいものに終わる必要はありません。

## Japanese Translation: チャットGPT は、AI アートにしばしば関連づけられる反復的・一般的な外見を避け、独自で高品質なポスターデザインを容易に生成できます。初期の要求では標準的なテンプレートが生成される場合もありますが、具体的な指示を与えることで、文脈に応じたテキストオーバーレイ付きのバウハウス幾何学や日本のミニマリズムなど、多様な芸術スタイルを解き放つことができます。以前の批評において「すべての AI 画像は同一である」と主張されていた点とは対照的に、洗練されたプロンプティングは、鑑賞者が直ちに機械生成であると特定しにくい独自性のある視覚コンテンツの作成が可能であることを証明しています。さらに、Claude や Gemini などの他の高度なモデルも、編集可能なテキスト層を含む PDF や HTML ファイルといった実用的に使用可能な形式を出力し、デザイナーが必要なグラフィックアセットを素早く取得する際に実践的な利便性を提供します。これらの成功した結果を他者が再現できるようにするために、著者は様々なポスタースタイルを網羅した 100 の即座に使用できるプロンプトのカタログを編纂しました。このリソースにより、各新しいプロジェクトに対して複雑な手動指示を必要とせずに、多様な視覚コンテンツを迅速に生成できるようになります。結局のところ、効果的なプロンプティングは、AI を退屈なデフォルトの源から、実世界のデザイン基準を満たすプロフェッショナルでユニークなグラフィックを作成する強力なツールへと変革します。

2026/09/20 5:00

インターネット検閲を測定し、最大級のオープンデータセットに貢献しましょう。

## 日本語訳: オニー・プローブは、インターネット検閲に関する世界の最大のオープンデータセットの中核を成すものであり、主に異なる国でどの特定のウェブサイトやアプリがブロックされているかを検証することを目的として設計されています。该软件の核心には、WhatsApp、Facebook Messenger、Telegram などの主要プラットフォームが利用者のネットワーク上でアクセス可能であることを確認するテストが含まれています。さらに重要なのは、M-Lab と共同で作成された標準化された測定方法である NDT テストを活用して、一般インターネットの速度と安定性を評価することです。このツールは Linux および macOS で動作し、個人の利用者がデジタル自由の解決策(例えば回避アプリ)が実際にはローカルの制限に対して機能しているかどうかを検証する能力を付与します。個人の検証を超えて、オニー・プローブ は研究者や組織に、世界の検閲トレンドを追跡するための不可欠なデータを提供します。M-Lab と協力することで、オープンソースコミュニティ全体で一貫性のある信頼できるパフォーマンス指標が確保されています。