MDASH 内への MAI Cyber-1 Flash の埋め込み

2026/07/28 1:52

MDASH 内への MAI Cyber-1 Flash の埋め込み

RSS: https://news.ycombinator.com/rss

要約

日本語訳:

Microsoft は、モデル(Model)、データ(Data)、ハーンズ(Harness)の 3 つの柱に構築された新たなエージェント型セキュリティシステム「Perception」を発表します。核心的な革新は、セキュリティを最優先とする要件に特別にチューニングされた、MAI-Thinking-1 シリーズからのコンパクトモデルである MAI-Cyber-1-Flash の展開です。このモデルはルーチンタスクの最大 90% を処理し、複雑な課題の上位 10% には大きなモデルのみを使用するように設計されています。MDASH フレームワーク(専門家によるチューニングを受けたエージェントが 100 体以上含まれる)と統合されており、システムは長年にわたる実績と、Microsoft が毎日処理している 160 兆以上のセキュリティ信号(160 万を超える顧客からのデータ)を活用しています。

パフォーマンスに関しては、この組み合わせは CyberGym ベンチマークにおいて 96% の成功率を達成し、Mythos よりも 12 ポイント優れています。この効率性は、以前 GPT-5.4 および同様の大規模モデルを使用した構成に比べてコストを 50% 削減します。モデルは AI レッドチーム評価、自動化された対立シミュレーション、および第三者による独立した評価を通じて広範な検証を受けました。

Perception は、企業に対して強固な制御(役割ベースのアクセス管理、テナント分離、暗号化、監査可能性、サンドボックス実行を含む)により、脅威ベクトルを実時間で監視・パッチ適用・閉鎖することを可能にします。将来的には、このシステムは単純な脆弱性情報の是正を超えて発展し、脅威調査と運用結果の全ライフサイクルに基づいて動的に改善される継続的な強化学習ループを用いて、より広範なセキュリティワークフローを処理するようになります。

本文

MAI-Cyber-1-Flash と MDASH の統合システム:セキュリティ最適化と新機能「Perception」のリリース

課題への解決策:最適なモデルの選択

  • 背景: セキュリティは常時稼働するミッションであり、膨大な流入攻撃に対しトークンコストが防御側の現実的な制約となっています。
  • MAI-Cyber-1-Flash の役割:
    • すべてのタスクのうち最大 90% を効率的に処理可能に設計されています。
    • MDASH が保有するより大規模かつ高コストなモデル(例:GPT-5.4)は、本当に困難な例外となる 10% の極めて難易度のタスクに活用されます。
  • パフォーマンスとコスト削減:
    • CyberGym で 96% の成績を収め、Mythos よりも 12 ポイント高い パフォーマンスを発揮しました。
    • 最高水準のオファー(GPT-5.4 + GPT-5.4 mini + GPT-5.3 codex)と比較しても、コスト削減率 50% を実現しています。
  • メリット: ユニークかつ豊富な履歴学習データへのアクセスを可能にし、あらゆるタスクに対して最適な価格で常に最高のモデルを提供することが保証されます。

新セキュリティシステム「Perception」のローンチ

  • 重要性: 新しい脆弱性を特定してからリアルタイムに対処する能力が不可欠です。
    • AI を活用したソフトウェア脆弱性の是正は主要なセキュリティワークフローの一つですが、セキュリティ担当者が取り組むべき課題も多数存在します。
  • 提供されるソリューション:
    • エージェントチーム: 多様なセキュリティワークフローに対応するための専用チームを提供。
    • 「Perception」システム: 継続的に新たな脅威ベクトルを監視、パッチ適用、ならびに封じ込めるエージェンティックなセキュリティシステムとして同時にローンチされました。
  • 今後の展開: Perception もまもなく MAI-Cyber-1-Flash を活用し、ソフトウェア脆弱性対応の枠を超えた多数のセキュリティワークフローへ展開されます。

成功の三要素:モデル、データ、ハネス

MDASH は以下の三点に注力し、ユニークで強力なセキュリティソリューションを提供します。

  1. モデル
    • MAI-Cyber-1-Flash: 独自に最高品質のデータを用いてゼロから社内開発された、MAI-Thinking-1 シリーズ由来のモデルです。
    • 特徴: コード重視かつコンパクトなセキュリティ専用モデル。詳細は技術報告書をご覧ください。
  2. データ
    • 最大の強み: 数十年にわたる世界最高水準のセキュリティシステム構築経験に基づいています。
    • 保有リソース:
      • アイデンティティ、エンドポイント、クラウド、ネットワークに跨る毎日数十兆というシグナル。
      • 実在のエクスプロイトおよび是正事例の類まれな記録。
    • 独自性: このような歴史を製造することは誰にも不可能です。
  3. ハネス (Harness)
    • 構成: 業界トップクラスのセキュリティ専門家によって微調整された、マルチエージェント型の脆弱性特定・是正ハネスです。
    • 機能: 100 つ以上のエージェントを開発し、複数の主要モデルを用いて脆弱性を発見、検証し、是正します。
    • 連携: エージェンティックなコードスキャンはセキュリティ運用センターにおける重要な機能であり、新たなエージェンティックなセキュリティシステムである**「Project Perception」**へのフィードバックを提供しています。

安全性を最優先に設計

  • 開発理念: MAI-Cyber-1-Flash はマイクロソフト初のサイバーモデルであり、トレーニング段階から顧客展開段階に至るまで、システムのすべての層に信頼性を含み込んで開発されました。
    • **「セキュリティファースト」**の理念に基づき開発されています。
  • 厳格な評価プロセス:
    • マイクロソフト AI レッドチームによる厳格な評価。
    • 自動化された専門家主導のアディバルザリ演習を通じたテスト。
    • 第三者機関による独立した評価。
  • エンタープライズグレードのコントロール: MDASH を通じて顧客は以下を受け取ることができます。
    • ロールベース制御、テナント間分離、暗号化、監査可能性。
    • インターネットへの接続が一切ないサンドボックス化された実行環境
  • 成果: 防御者に強力な能力を提供しつつ、マイクロソフト企業が期待されるガバナンス・セキュリティ・コントロールを維持したサイバーモデルを実現しています。

継続的な改善:私たちの「ヒルクライミングマシン」

  • 生きている強化学習のループ:
    • 毎日、防御者は脅威を検証し、アラートを優先付け、攻撃者を狩り出し、脆弱性を是正し、保護をデプロイするとともに、その結果から学び続けます。
  • マイクロソフトのアプローチ: このループを起点から終点まで俯瞰しています。
    • Microsoft Security Response Center を通じた脆弱性管理。
    • アイデンティティ、エンドポイント、クラウド、データ、ブラウザ、アプリケーションに跨る攻撃と防御。
    • 毎日100 兆を超えるセキュリティシグナルの処理。
    • 160 万人以上の顧客から得られる運用上の洞察。
  • データの活用: データを単に収集するだけでなく、行動と結果を結び付けることができます(何がエクスプロイト可能だったか、何が封じ込められたか、何がかかったかなど)。
  • コミットメント: MAI 強化学習ループにより絶えず改善され、熟練したサイバー防御者へと成長するモデルを構築し、お客様に対する長期的なコミットメントを果たします。

同じ日のほかのニュース

一覧に戻る →

2026/07/28 7:03

オープンウェイトモデルに関する当社の立場

## Japanese Translation: Anthropic の CEO ダリオ・アモデイは、オープンウェイトの AI モデルに対する全面的な禁止に反対し、同社がそのような制限を支持したことはないと主張している。彼は、危険な能力を持たないオープンウェイトモデルを不可欠な公共財として位置づけ、主な国家安全保障上の懸念として、共産主義中国(CCP)などの権威主義体制が、恒久的な軍事優位や抑圧のために優れた AI を構築しようとするリスクを挙げており、このリスクは副大統領ヴァンスの最近の警告や米国当局による世界的競争力に関する情報評価によって強調されている。彼の二次的な懸念には、サイバー攻撃、生物学的脅威、またはアライメント(調整)失敗への悪用が含まれる。アモデイは、オープンウェイトモデルはガードレールの実行が難しく、リリースされた重み(weights)を回収できないため、閉鎖型モデルよりも高いリスクをもたらすと指摘している。これらの脅威を緩和しつつ有益なイノベーションを維持するため、彼は以下の目標志向戦略を提唱している:中国への高度な半導体および装備の輸出制限、モデルの密輸入や産業規模での蒸留(distillation)操作への取り締まり、そして公開前に十分に能力のあるすべてのモデルに対して安全性テストの実施を義務付ける。彼は、全面的な禁止は効果的でもなく、Anthropic が求める解決策でもないとし、代わりに回収不能なシステムにおけるリスク管理を進めつつ、安全性にコミットしている者にとってのアクセスを維持することを主張している。

2026/07/25 16:55

Go の新しいガベージコレクションがヒープを走査していく様子

## Japanese Translation: Go の新しい Green Tea ゴー・コレクター(v1.26 以降のデフォルト)と C# を比較した評価から得られる主な示唆は、CPU キャッシュ効率とメモリアン断片化の間にある明確なトレードオフである。Green Tea は連続したスパンへの割り当てを最適化することでキャッシュミスが大幅に減少するが、オブジェクトを解放する際に移動やコンパクト化を行うことはできない。その結果、C# の移動式コレクターが積極的に関与してヒープをコンパクト化し OS に散在ページを返すのと異なり、Go は大量の解放後(例:90% のオブジェクトを解放)も未解放オブジェクトがばら撒かれたままとなる。 裸の金属 x86 システムでのテストにより、この断片化は介入なしに持続することが確認された。しかし、開発者は `unsafe` ポインタを使用して残存するオブジェクトを手動でパッケージ化することでこの制限を回避し、実質的にコンパクト化を模倣してシステムリソースを取り戻すことができる。結論として、Go は真の CPU パフォーマンス向上を提供するものの、複雑な回避策なしにヒープをコンパクト化できないという Go の不具合は依然として大きな制約であり、長期的動作を必要とし効率的なメモリ回収を要求するアプリケーションにおいては、C# が優れたアーキテクチャ上の振る舞いを提供することが組織にとって認識すべき点である。

2026/07/28 4:58

HN ランチ:Rise(YC S26)——廃棄物ガスを貴重な化学物質に変える

## Japanese Translation: Rise Reforming は、シカゴ郊外の下水処理施設でパイロットプラントの建設を正式に開始し、2026 年 7 月の稼働を目指しています。2025 年 12 月には 65 万ドルの前種投資を受け、初雇用の Nina Kritikos を擁し、同社は 2026 年 4 月に 1,800 時間以上の連続運転を通じて安定した概念実証結果を達成しました。また、プロジェクトはバイオガス生産者との拘束力のある供給契約および複数の覚書(MOU)を確保しています。 同社の固有技術では、下水処理廠などの発生源から排出される国内の滞留バイオガス(廃棄ガス)をメタノール、ジメチルエーテル(DME)、ジメチルカーボネート(DMC)といったグリーン化学物質に変換します。このアプローチは、化石燃料の採掘・精製・輸送に伴う環境コストを回避する低価格な代替策を提供することで、従来の石油化学製品と直接的に競合しています。主要な革新点は、許可手続きの長期遅延なく特定の施設の要件に合わせて迅速に導入および容易にスケールアップ可能なモジュール式でコンテナサイズの設計にあります。 Rise Reforming は 2026 年 7 月、成長とスケールアップのさらなる加速のために Y Combinator の S26 バッチに参加しました。廃棄物を価値ある化学物質に変えることで、即座の財政的リターンを提供しつつクリーンなエネルギー未来を支援することを目的としています。過去のマイルストーンには、2025 年 5 月に European Aerosols Federation 2025 Start-Up Award を受賞し、George Rose が 776 Foundation から Climate Fellow に選出されたことが含まれます。

MDASH 内への MAI Cyber-1 Flash の埋め込み | そっか~ニュース