Gemini 3.6 Flash、3.5 Flash-Lite および 3.5 Flash Cyber

2026/07/22 0:17

Gemini 3.6 Flash、3.5 Flash-Lite および 3.5 Flash Cyber

RSS: https://news.ycombinator.com/rss

要約

Japanese 翻訳:

以下の改良版は、欠落していた価格データ、具体的なベンチマークハイライト、および販売チャネルを統合し、「要点リスト」への完全な忠実性を確保しています:

改善されたサマリー

Google は正式に、AI エージェントの効率を大幅に向上させ、レイテンシを低減し、コストを削減することを目的とした 3 つの進化した Gemini モデル——3.6 Flash、3.5 Flash-Lite、および専門性の高い 3.5 Flash Cyber を紹介しました。Gemini 3.6 Flashは、トークン使用量を最大で 17%削減(入力トークンあたり$1.50 で提供)しながら、より高い精度を実現します。DeepSWE のようなベンチマークでは、先行する 3.5 Flash の 37% に対して 49% という成功率を達成し、ML リサーチおよびコンピューター使用に関する能力にも顕著な改善が見られます。Gemini 3.5 Flash-Liteはシリーズ内で最も高速なモデルとして際立っており、1 秒間に 350 以上の出力トークンを処理(入力トークンあたり$0.3 で提供)し、複数のコーディングベンチマークにおいて 3.5 Flash および 3 Flash を凌駕しています。

セキュリティニーズに応えるため、Google は CodeMender エコシステム内でのサイバーセキュリティ脆弱性の特定と是正に最適化された3.5 Flash Cyberバリアントをローンチしました。これらの技術の二重用途特性により、この特定のモデルは、限定されたパイロットプログラムを通じて検証済みの政府機関および信頼パートナーのみが利用可能です。すべての新モデルは直ちに Gemini API、Google AI Studio、Android Studio、およびその他の開発プラットフォーム経由で利用可能であり、すぐに Google Search への展開も始まっています。

本文

ジーミニ(Gemini)新モデル発表:効率性と品質の両立で AI エージェント構築を加速

Google は、大規模な AI エージェント構築において高い効率性低遅延、そして堅牢な信頼性を提供する最新モデルを発表しました。本稿では、新リリースのモデル構成と主要な性能向上について整理します。

🚀 新シリーズのコンセプト:Flash シリーズ

開発者が本番環境での AI エージェント構築を実現するためには、以下の 3 つが不可欠です。

  • 極めて高いトークン効率
  • 最小限のレイテンシ(遅延)
  • 安定したパフォーマンス

「Flash シリーズ」は、これらを絶妙なバランスで実現し、エージェントワークフローのスケールアップを可能にするよう設計されています。


📋 発表された新モデル一覧

1. Gemini 3.6 Flash:主力モデルとしての進化

コーディング、知識ベースタスク、マルチモーダルパフォーマンスにおいて優れています。

  • トークン効率の劇的改善
    • **「人工分析指数(Artificial Analysis Index)」**によれば、出力トークンの使用量を 3.5 Flash よりも 17% 削減
    • 「Datacurve」の「DeepSWE」ベンチマークでは最大 65% の削減が実現。
    • 出力トークンあたりのコスト低減を達成。

2. Gemini 3.5 Flash-Lite:高速で高コストパフォーマンスモデル

3.5 シリーズの中で最も処理速度が速く、かつコスト効率に優れています。

  • 高出力速度
    • 「人工分析指数」の計測では、1 秒あたり 350 トークンの出力が可能。
    • 従来の Flash-Lite 世代よりもエージェントワークフローにおいて著しく高いパフォーマンスを発揮。

3. Gemini 3.5 Flash Cyber in CodeMender:セキュリティ特化モデル

セキュリティアプリケーション向けに、モデルとインフラストラクチャを慎重にオーケストレーションしたソリューションです。

  • 高度なセキュリティ機能
    • 新しい高効率なサイバーセキュリティ特化モデルと、「CodeMender」コードセキュリティエージェントを組み合わせています。
    • 最先端かつ競争力のあるセキュリティパフォーマンスを達成します。

🔮 今後の展開について

本日発表されたリリース以外にも、以下の計画が進められています。

  • Gemini 3.5 Pro:すでにパートナーとのテスト段階へ入っており、準備が整った時点で広く一般に利用可能と予定です。
  • 次世代モデル構築:現時点で最も大規模な事前学習(pre-training)キャンペーンを開始しました。

⚡ Gemini 3.6 Flash の詳細:より効率的で質の高いパフォーマンス

3.6 Flash は、開発者およびお客様からの「3.5 Flash」に関するフィードバックを直接反映させる形で構築されています。

💰 コスト効率

低い価格設定と組み合わされたコスト削減効果です。

  • 入力トークン:$1.50/件
  • 出力トークン:$7.50/件
  • これにより、エージェントタスク全体のコストが削減され、AI エージェントの構築および運用におけるコスト効率が著しく高まっています。

📊 パフォーマンスベンチマーク

効率性を損なうことなく、以下のユースケースにおいて 3.5 Flash を凌駕する性能を発揮します。

  • コーディング・知識ベースタスク
    • 誤ったコード編集や無限ループが減少し、より高い精度を提供します。
    • DeepSWE:49%(対比:3.5 Flash の 37%)
    • MLE Bench:63.9%(対比:3.5 Flash の 49.7%)
  • コンピュータ操作能力
    • OSWorld-Verified ベンチマークで 83.0% を達成(対比:3.5 Flash の 78.4%)。
    • ネイティブなクライアントサイドツールとしてコンピュータ操作機能が組み込まれています(Gemini API / Enterprise 共通)。
  • 知識ベースタスク
    • GDPval-AA v2 ベンチマークで 1421 を記録(対比:3.5 Flash の 1349)。
    • 顧客例(Hebbia, Harvey など):ドキュメント解析、グラフおよびデータ分析、レポートドラフティングにおいて特に高い能力を持つと評価。

🛡️ 安全性について (Frontier Safety)

3.6 Flash は、以下の分野における強化された Frontier Safety サイガードを備えた状態でリリースされます。

  • 対象領域:化学(Chemical)、生物学的(Biological)、放射性(Radiological)、核(Nuclear)(CBRN)およびサイバー攻撃の悪用
  • 耐性向上:モデルは jailbreak(強制的な指令誘発)に対して大幅に耐性が高まっています。
  • 有益性維持:同時に、有益な用途に対する拒否を最小限に抑えるよう学習済みです。
    • 詳細は「3.6 Flash モデルカード」をご覧ください。

🚀 Gemini 3.5 Flash-Lite の詳細:エージェントワークフローのスケールアップ向け

低遅延タスクや高いスループットが重要な開発者ワークフロー(例:エージェント検索、ドキュメント処理)向けにリリースされます。

💰 コスト効率

  • 入力トークン:$0.3/件
  • 出力トークン:$2.5/件
  • 3.1 Flash-Lite よりも著しく高い品質を提供し、高スループットの本番トラフィックを処理するコスト対性能比が優れています。

📈 パフォーマンス特性

  • 大容量タスクの効率化
    • 思考レベル(Thought level)に応じてモデルを構成可能。
    • 大容量タスク:最小限かつ低い思考レベルで低遅延・低コストの実行を優先。
    • マルチステップサブエージェントワークロード:高い思考レベルを使用可能。
  • 包括的なパフォーマンス向上
    • Terminal-Bench 2.1:54%(対比:3.5 Flash-Lite の 31%)
    • 長文脈対応(GDM-MRCR v2):72.2%(対比:60.1%)
    • 現実世界でのタスク実行(GDPval-AA v2):1140(対比:642)
  • 上位モデルを超える性能
    • 多くのエージェント評価およびコーディングタスクにおいて、3.5 Flash-Lite は 3 Flash を凌駕
    • SWE-Bench Pro:54.2%(対比:49.6%)
    • OSWorld-Verified:74.0%(対比:65.1%)
    • これにより、2.5 および 3 Flash のワークロードの両方で、より高速かつ能力の高い選択肢となります。

🗣️ お客様の声

早期に活用されたお客様は、スケーラブルなエージェントワークフローおよびデータ処理タスクにおいて、速度、知能、コスト効率という独自の組み合わせを高く評価しています。

  • 詳細は「3.5 Flash-Lite モデルカード」をご覧ください。

🛡️ 3.5 Flash Cyber in CodeMender の運用アプローチ

AI モデルがシステムよりも速くセキュリティ脆弱性を発見する能力を獲得しました。これに対処するには、極めて高度かつ効率的なソフトウェア保護アプローチが必要です。

高効率な基盤

  • 「Flash」のパフォーマンスと効率が、コードセキュリティ問題を大規模に検出・検証・パッチ適用するための理想的な基盤を提供します。
  • トークンコストの削減:より大きなモデルよりもトークンあたりのコストが低減しています。
  • 統合レポート:「CodeMender」内では、複数の 3.5 Flash Cyber エージェントが連携して単一の統合レポートを生成し、「CyberGym」ベンチマークにおいて最先端かつ競争力のあるパフォーマンスを達成します。

慎重な展開計画 (デュアルユース対策)

  • 限られたアクセス:政府および信頼されたパートナー(CodeMender 経由)のみを対象としたパイロットプログラムとして近日中に利用可能になります。
  • 目的:最前線の防衛者が重要な脆弱性を悪用される前に発見・修正できる「先手」を取り、広範な誤用の防止にも寄与します。

📅 今日から始める:入手とロードマップ

🛒 3.6 Flash と 3.5 Flash-Lite の入手開始

  • 開発者向け
    • Google AI Studio および Android Studio を通じて Gemini API で利用可能。
    • 「3.6 Flash」はまた、Google Antigravity でも利用可能。
    • 詳細:「開発者ガイド」をご覧ください。
  • 企業向け
    • Gemini Enterprise Agent Platform と Gemini Enterprise アプリにおいて「3.6 Flash」の利用が可能です。
  • 一般ユーザー向け
    • Gemini アプリで利用可能です。

🔜 今後のロードマップ

  • フィードバック募集:3.6 Flash および 3.5 Flash-Lite の活用による貴重なご意見をお待ちしております(今後のモデル改善に役立ちます)。
  • 次期リリース:間もなく Gemini 3.5 Pro のリリースも予定です。

同じ日のほかのニュース

一覧に戻る →

2026/07/22 6:09

ヤコビアン仮説の反例についての考察

## Japanese Translation: 元要約は明確で正確であり、主要な点と整合性が取られています。改善は必要ありません。 ## 概要: テキストは決定的に、ヤコビアン予想が三次元以上の次元では偽であることを述べており、$\mathbb{C}^n$ から $\mathbb{C}^n$ への写像で非ゼロ定数のヤコビアンを持つものがすべて全的に逆関数を持つというアイデアを反証することで、長年の数学的議論を解決します。研究者たちは、三次変数における次数七の多項式写像を構成することによってこれを証明しました。この写像は非ゼロ定数のヤコビアンを持ちながら全球的反関数を持たず、ヤコビアンの行列における巨大なキャンセル(非定数係数の消滅)に依存して局所的逆関性を維持しつつ全球的な有効性を回避しています。予想は二次元的には依然として未解決であり、一元的には自明に真です。幾何学的な再定式化により、$\mathbb{C}^n$ と同型なアフィン多様体 $X$ に対して、局所的単射(根解析を用いた証明で $\mathrm{PGL}_2$ ヨーブ変換とゼロでない結果ant を用いて確立)だが全球的には単射ではないような写像が存在することが示されます。ベクトル空間の対称化乗幂と低次数多項式の積(線形 × 二次 = 三次)に基づく構築では、五次元群作用による巨大な等変性を活用し、結果ant 条件を用いたスケーリング対称性を通じて正規化を行います。特定の三次元的アフィン切片による次元削減は、二次曲面の同型問題を回避しつつ主要な性質を保持し、原点ファイバーを除いて座標に対して三次方程式と二次方程式を解くことで双有理同値を可能にし、アフィン空間と同型のアフィン多様体を導きます。ビッグ-O 記法を用いた漸近解析は、全てのファイバー(極限ケースを含む)をカバーする全球的多項式パラメータ化を確認します。AI チャットボットを含む高度な計算ツールは、漸近成長率とファイバーパラメータ化に関わる複雑な計算を検証し、得られた写像是自明な変数変化を除いて元の反例と一致します。この画期的な進展により、分野の焦点は普遍的反證法の探求から、局所的性質が全球的な振る舞いを保証しない特定の実例への理解へとシフトしました。

2026/07/22 0:41

長らく死んだとみられていた西アフリカに、豊かなサンゴ礁が発見された。

## Japanese 翻訳: 1960 年代の初期調査で西アフリカベニン海岸沖の健康なサンゴ礁が存在しないと見落されていたものが、研究者によってついにその存在が確認され、世界中で半分以上の礁域が減少しているというグローバルなトレンドに抗した。水深 175 フィート(約 53 メートル)を超える深い海域においても、岩盤基質上に多様な生物が生息し、繁栄している。2025 年 1 月に National Geographic Explorers グランツから 2 万ドルの助成金を獲得した Gérard Zinzindohoué 氏を率いるチームは、高価なソナー費用が予算の大半を食い込み、欧州のサプライヤーとの銀行取引上の問題といった重大な物流上の課題を克服した。常設の研究船を持たないため、彼らはハイテクソナーを搭載したピロウで現地漁師に offshore へ運ばれ、海底を探測して撮影を行った。この探査では、軟体珊瑚 6 タイプ、黒珊瑚 2 タイプ、魚類 8 種を特定し、該地域を「中光層サンゴ生態系(mesophotic coral ecosystem)」に分類した——これはサンゴ礁形成の限界深度にある光依存型コミュニティである。地元研究者である Houangninan Midinoudewa 氏は、現在、稀有种類であるトゲメダイアザルシャーク、シルクイースカ、ブローンスケート、マーズレットエイを含む稀有な種々を守るため、「重要なエイとサメ地域(Important Shark and Ray Area)」としての指定を求めている。保存活動だけでなく、この未撹乱の生態系は、炭素年代測定や古気候学研究における独自の潜在力を提供し、広範な劣化に反して回復力ある天然資源を開示するとともに、科学発掘への新たな道を開く。

2026/07/22 4:43

EU 裁判所が著作権に関する画期的判決で「VPN は合法的な技術的手段である」と述べる

## 日本語訳: 2026 年 7 月の画期的な判決において、欧州連合裁判所(CJEU)は、仮想私人ネットワーク(VPN)—インターネットトラフィックを暗号化し、利用者の所在地を隠すツール—が EU の著作権執行規則の下で合法であると正式に確認しました。この決定は、国ごとの領土法とインターネットの国境なき性質との間の大きな対立を解消するため、著作権者がユーザーが地理的ブロッキング制限を回避する際に VPN プロバイダーに対する責任を負うことはできないことを明確にしました。本件は、アネ・フランクの手稿に関する紛争から発覚し、オランダでは 2037 年まで著作権保護が続いているものの、ベルギーなどの他の国々では既に公衆領となっています。裁判所は、標準的な VPN がウェブサイトを不安定にするという主張を拒否し、出版者は地理的ブロッキング技術を十分に活用できない場合にのみ責任を負うが、「ハッキング不可能の壁」を構築する義務はないと指摘しました。EU 全体でプライバシーソフトウェアを検証したこの判決は、知的財産権の保護とユーザーのプライバシーの擁護との間の重要なバランスを図っています。その結果、これは VPN サービスプロバイダーが関連訴訟から守られ、著作権者がオンライン上の対立する法的境界線の中で不可能な技術的完璧性を要求することを防止します。

Gemini 3.6 Flash、3.5 Flash-Lite および 3.5 Flash Cyber | そっか~ニュース