ASD-STE100 シンプル英語でドキュメント強制を行うエージェントスキル

2026/07/31 4:34

ASD-STE100 シンプル英語でドキュメント強制を行うエージェントスキル

RSS: https://news.ycombinator.com/rss

要約

Japanese Translation:

AminBlg/SimpleEnglish
スキルは、LLM に ASD-STE100 シンプルテクニカル英語規格を適用し、航空宇宙業界で 1983 年以来開発されてきた制御された言語を用いて技術ドキュメントの曖昧さを排除することを強制します。本スキルは Cursor、VS Code Copilot、Claude Code、Gemini CLI を含む各種 AI ハーネスと互換性があり、
npx skills add AminBlg/SimpleEnglish
を使用してインストールするか、ターミナルサポートがない環境では特定のプロンプトファイルを介して直接適用できます。本規格は、指示あたりの最大 20 語(1 語=1 つの意味)、単数形時制、能動 voice、"might" や "should" などの保留語を除外することといった厳格な制約を強制します。6 つのモデルを対象としたベンチマークでは、このスキルを適用することでベースラインエージェントとの比較において規則違反が 72.9% 減少し、出力トークンも減少することが示されました(ベースラインエージェントは本来、架空の規則番号を発明したり、過度に長い文を書く傾向があります)。本スキルはエラーメッセージ、インシデント報告書、リリースノートに対して特化された適応版を提供しますが、マーケティングコピーやブログ記事の作成はその範囲から明確に除外されています。非公式に開発され MIT ライセンスの下で提供されている本プロジェクトは、特定の技術的問題に対する TDD(テスト駆動開発)手法を用いてその有効性を評価し、教育資料において固有の仕様テキストを複製することはありません。

本文

ASI: 航空宇宙標準英語(ASD-STE)エージェントスキル

📌 概要

ASI (ASD-STE) は、航空宇宙業界の技術マニュアルに基づいた文体を強制するエージェントスキルです。1983 年以来、整備士の誤読を防ぐために採用された管理言語であり、AI が生成する低品質な出力(「AI スラップ」)を自然に排除します。

✨ 対応環境

このスキルは「エージェントスキル標準」を採用する全ての開発環境に対応しています。

  • 対応ツール: Claude Code, Cursor, VS Code Copilot, OpenAI Codex, Gemini CLI, Goose, OpenCode など(25 以上のツール対応)
  • 構成要件: 単一のフォルダ構成で、外部依存ライブラリ不要
  • ライセンス: MIT ライセンス

🔥 ベフォー・アフター比較

左側:スキル未使用時の出力 | 右側:ASI を適用した後の出力

カテゴリ❌ スキル未使用時✅ ASI 適用後
機能説明
sqlpipe
の堅牢なアーキテクチャを活用することで、Postgres テーブルを S3 にシームレスに同期でき...設定のオーバーヘッドは最小限で済みます。着手前に、AWS 認証情報の正しく設定されていることを確認してください...
sqlpipe は Postgres テーブルを S3 にコピーします。 必要なのは単一の設定ファイルだけです。開始前に、AWS 認証情報が正しいか確認してください。もし正しくない場合、S3 側ではアップロード拒否(権限エラー)を起こします。
エラーメッセージOops!接続確立中にエラーが発生しました。認証情報が正しく設定されていることを確認して再度お試しください...データベースへの接続に失敗しました: ユーザー「app」のパスワードが正しくありませんでした。DB_PASSWORD を正しい値に設定してから再度接続してください。
インシデントレポート利用者にサービスのアクセスを阻害した可能性がある問題を特定しました。ご不便をおかけし心よりお詫び申し上げます...UTC 14:02 から 14:31 の間、要求の約 12% が失敗しました。 14:00 にキャッシュウォームアップステップが削除されたデプロイが発生し、14:27 にロールバックを行いました

💡 詳細: 対象は README、エラーメッセージ、インシデントレポート、リリースノートなど多岐にわたります(

examples/before-after.md
を参照)。


📦 インストール手順

1. CLI を使用する場合

以下のコマンドを実行してください。

npx skills add AminBlg/SimpleEnglish

動作:

  • skills CLI
    はエージェント(Claude Code、Cursor など)を検出し、選択した対象のみインストールします。
  • お試し運用: インストール前に
    npx skills use AminBlg/SimpleEnglish@simple-english
    で試せます。

2. プロンプトファイルによる適用

SKILL.md
のサポートがない場合は、以下のファイルをシステムプロンプトに貼り付けてください。

  • 推奨場所:
    • prompts/system-prompt.md
    • .cursorrules
    • AGENTS.md
  • 短縮版: 予算を抑えたい場合は、約60 トークン程度の短縮版もあります。指示に「simple-english(簡略化英語)で再作成してください」と含めるだけで十分です。

3. ターミナルがない場合(Web クライアント)

プラットフォーム設定手順
Claude.ai (有料プラン)1. SKILL.md をダウンロード・保存
2. 「設定」→「機能」でコード実行をオン
3. 「設定」→「カスタマイズ」→「スキル」でファイルをアップロード
4. トグルをオン(自動適用)
ChatGPT1. プロンプト版を使用
2.
prompts/system-prompt.md
を「設定」→「パーソナライゼーション」→「カスタム指示」に貼り付け
3. または、プロジェクト/カスタム GPT の指示欄に貼り付け
Gemini1. Gem を作成
2. プロンプトをその指示欄に貼り付け
その他チャットボット
prompts/system-prompt.md
を添付・貼り付け、「これを書くすべてのテキストに応用してください」と指示

📏 規則の概要

ASI は、1983 年に記述された53 の番号付き規則9 のセクションで構成されています。読者が文脈の曖昧さに苦しむことを防止する目的です。

主要な規制ルール

項目規則内容 / 排除対象 🪦
指示文20 語以内に制限(複雑な複文禁止)
単語の意味1 つの単語 = 1 つの意味(check/verify/confirm/validate の曖昧な同義語使用禁止)
時制単数形のみ使用("has been updated" → "we updated")
動詞形式"ing"動詞の禁止(分節文 ", making it easy to..." 禁止)
能動態能動態のみ採用(受動態・間接表現 "it should be noted that" 禁止)
助動詞should/would/may/might の禁止(推量排除。can, will, must は許容)
条件文コマンド前の条件提示を禁止("...if the flag is set" の型は排除)
1 文の指示1 文に 1 つの指示のみ(手順を追えない文章防止)
冠詞"That" は保持(テレグラフスタイル。短くても簡潔・terse ではない)

📝 補足: 完全なパラフレーズ済み規則集は

SKILL.md
を参照してください。マーケティングコンテンツは STE の対象外です。


🧰 文書以外への適用

本スキルには以下のユースケース向けのアダプテーションが含まれています。

  • 🚨 エラーメッセージ: 何が起こったのか → なぜ起きたのか → どう対処すべきか(この順序で記述)
  • 📟 ランブック: メンテナンスマニュアルそのものとして最適化されます。
  • 🧯 インシデントレポート: 過去形により、「we have identified...」といった曖昧な表現を排除します。
  • 📣 リリースノート: 破壊的な変更を警告として提示し、リスク説明をコマンド後に追加する構成へ。
  • 🤖 システムプロンプト: 「should(〜すべき)」は任意と解釈されるため禁止します。「手順書」であることを明確にします。
  • 🌍 翻訳の準備: 非母語話者に読みやすく、ローカライズコストを低減します。

適用しない分野: マーケティングコピー、ブログ調、ブランディング文章(平坦な文体は意図的ではありません)。


📊 ベンチマークデータ

測定条件: 6 つの Claude モデル × 8 つのタスク × 2 つの状態(計 96 回の実行)

モデルベースライン違反数
(100 ワードあたり)
スキル適用後違反数
(100 ワードあたり)
削減率
claude-opus-4-81.050.6241%
claude-opus-4-72.280.4282%
claude-opus-4-62.240.4082%
claude-opus-4-52.550.5778%
claude-sonnet-52.670.5380%
claude-sonnet-4-62.060.5275%

効果のまとめ

  • STE 違反件数: 100 トークン当たり平均で 72.9% の削減(すべてのモデルで達成)
  • ⬇️ 出力トークン総量: すべてのモデルで低下(記述が短くなるため)
  • 📉 平均文の長さ: 11.2 語 → 9.7 語

検証方法

決定論的な正則表現によるリンター(lint)を用いて両状態に同一の規則を適用しています。詳細な方法は

evals/results/RESULTS.md
に記載されています。

再現コマンド:

python3 evals/run_bench.py

※ ログインした Claude Code CLI で実行可能です。


🧾 検証データ(Receipts)

TDD(テスト駆動開発)スタイルで構築されており、ベースラインとなる Issue 9 の原文(2025 年版)に基づいています。

  • スキルの目的: エージェントの失敗を解消し、パスするまで再テストを行うことで検証。
  • 典型的なエラー例:
    • 長文(40 語以上)の生成
    • 架空の規則番号の発明
    • 実際のルールとの不一致(例: 「Rule 3.1: short sentences」と主張しながら、実際には動詞形式に関する規定だったケース)

シナリオと記録結果は

evals/pressure-tests.md
を参照してください。


❓ よくある質問 (FAQ)

Q: これは出力を STE 認証付きにしますか? A: いいえ。ツールを検証して認証する機関は存在しません。デフォルトモードは実用的で、構造規則+ドメイン固有語彙を採用しています。厳格モードでもほぼ同様の成果を得られます。

Q: 文書は機械的になりませんか? A: 否。Airbus マニュアルのような平らで誤読不可能な文体になります。技術文書の本質です。ブログ用には独自の口調を保ってください。

Q: 「明確に書いて」とプロンプトするだけではダメですか? A: 「明確に」は主観的な意見です。「文 20 語以内」というのは仕様(spec)です。エージェントは仕様に従います。📐

Q: なぜ 40 年先の航空宇宙標準を使っているのですか? A: それは感情論ではなく、維持管理されており(Issue 9, 2025 年 1 月)、番号付きで検証可能なものだからです。また、あらゆる AI の記述傾向とほぼ逆の性質を持っています。


⚖️ ライセンスと現状

  • ライセンス: MIT ライセンス(全プロジェクト)
  • 包含内容: レポジトリには規則のパラフレーズ版を含みますが、仕様テキストや辞書内容の複製は行っていません。
  • 公式関係: 非公式なプロジェクトです。ASD や STEMG との関係性は推奨されるものではありません。
  • 商標注意: ASD-STE100 は ASD の登録商標です。

同じ日のほかのニュース

一覧に戻る →

2026/07/31 2:04

この TV ストックを買う前に読んでください

## Japanese Translation: Bitsight のセキュリティ研究者ペドロ・ファレ(Pedro Falé)が、汎用的な H96 ストリーミングデバイスが秘密裏に自身を携帯電話(サムスン、ビボ、華為(Huawei)、シャオミなど)として偽装し、中国の Fengwo グループ(浙江省 Fengwo IoT Technology Ltd.)が運営する AI 生成ウェブサイト上で広告をクリックさせることを暴露しました。同グループは、これらのデバイスを広告不正のための captive traffic ソースとし、またテレビに接続した際に IP アドレスを貸し出す住宅プロキシとして利用しています。Bitsight は、かつてテレメトリ用に使用された無効化ドメインを経由して「ホームへ電話」している約 38,000 台のそのようなユニットを追跡しました。影響を受けたすべての H96 デバイスには、Fengwo の名称で登録された特許を通じて特定されるように、同グループによってインストールされた 2 つのプロプライエタリなアプリが存在し、低スキルオペレーターが偽装サイトを作成し不正実行ルーチンを動作させることを可能にする簡易的な視覚的プログラミングツール(Google Blockly ベースの実装)を採用しています。ネットワークの AI 生成コンテンツは金融、医療、教育、ゲーム、音楽、食品などのカテゴリにわたっていますが、広告はそのトラフィックが偽装されたモバイルプロファイルから来ている場合에만提供されます。単一の古いドメインからのテレメトリだけでも、この操業は毎日約 50,000 ドルを発生させており、ファレはそれが代金を含めて考慮されていないため控えめであることを警告しました。また、消費者向け IoT における不正プロキシソフトウェアやボットネットについて FBI が警告しているにもかかわらず、Amazon、ベストバイ、Newegg などの主要小売業者は依然として、これら不安全で無印の Android ボックスを販売し続けています。Google は購入者に Play Protect 認証の確認を推奨しており、Synthient は事前にプロキシソフトウェアがプリインストールされた既知の悪意のある IoT デバイスのリストを維持しています。記載されたメールアドレスへの Fengwo グループとの連絡尝试は、受信トレイ容量不足や配信問題のために失敗しました。

2026/07/31 1:26

GitHub に Stacked PR が実装されました

## Japanese Translation: GitHub は、「Stacked Pull Requests」という新機能を導入し、大規模な変更をレビューとマージのために小さな順序付きのレイヤーに分割します。チームは各レイヤーを個別にレビュー・検証でき、個別にマージするか、1 回のクリックですべて準備が整ったレイヤーをまとめてマージできます。このアプローチは、集中したレビューを通じて高いコード品質を維持しつつ、大規模な更新を並列で効率的に進めるように設計されています。既存のブランチ保護設定とシームレスに連携し、GitHub ウェブインターフェース、CLI、モバイルアプリ、Copilot などの AI コーディングエージェント(`gh-stack` スキルを通じて)全体で使用可能です。ユーザーは CLI 拡張機能(`gh extension install github/gh-stack`)をインストールすることで、スタックの作成を 1 分未満で開始できます。現在はすべてのリポジトリで公開プレビュー中であり、自動化されたマージキューへの追加サポートは今後数週間で展開されます。

2026/07/31 0:15

Gemini ロボティクス 2 でロボットに全身知能をもたらす

## Japanese Translation: Google Robotics から、ロボットを複雑な物理的作業と安全な人間の相互作用に適応可能なアシスタントに変容させる画期的な知性層「Gemini Robotics 2」が発表されました。このスイートには、3 つの新しいモデルが含まれています。**Gemini Robotics VLA**は、足先から指先までの完全なヒューマノイドの全身制御を可能にし、**Gemini Robotics ER 2**は身体に埋め込まれた推論を伴う長期的かつ多段階のタスクに対応し、**Gemini Robotics On-Device 2**は最小限のデータを用いて新たな動きを習得でき、Dexmate や SO101 など未慣れなハードウェアにも即座に適応します。システムは、繊細な作業に対応できる特製の 5 本指ハンド(SharpaWave)による高度な巧緻性を示すとともに、複雑な操作には標準の 2 本指グリップサーとも対応しています。多ロボット協調が主要な特徴であり、異なるタイプのロボット同士が通信して単一のユニットでは解決できないワークフローを完了させることができます。安全性は ASIMOV-Agentic など高度なベンチマークを通じて厳格に検証され、安全な近接応答と不安全なツールの呼び出しに対する拒否能力が確保されています。現在、Google AI Studio を通じて早期アクセスパートナーおよびエンタープライズユーザーに利用可能です。これらの革新により、多様な環境において広範な再学習なしに効率的な多ロボットワークフローを実現できます。 ## Text to translate: Google Robotics introduces Gemini Robotics 2, a groundbreaking intelligence layer that transforms robots into adaptable assistants capable of complex physical tasks and safe human interaction. The suite includes three new models: **Gemini Robotics VLA** for whole-body control of full humanoids (feet to fingertips), **Gemini Robotics ER 2** for long, multi-step tasks involving embodied reasoning, and **Gemini Robotics On-Device 2** which allows robots to master new movements using minimal data, adapting instantly to unfamiliar hardware like the Dexmate or SO101. The system demonstrates advanced dexterity through specialized five-fingered hands (SharpaWave) capable of delicate tasks, while also supporting standard two-fingered grippers for complex manipulation. Multi-robot collaboration is a key feature, enabling different robot types to communicate and complete workflows that a single unit cannot solve alone. Safety is rigorously validated via advanced benchmarks like ASIMOV-Agentic, ensuring secure proximity responses and the ability to refuse unsafe tool calls. Currently available to early-access partners and enterprise users via Google AI Studio, these innovations enable efficient multi-robot workflows across diverse environments without extensive retraining.