Gemini 3.7 Flash

2026/08/14 2:23

Gemini 3.7 Flash

RSS: https://news.ycombinator.com/rss

要約

日本語翻訳:

サマリー:

Google は、開発者の効率性を即時に向上させることを目的として 160 カ国で利用可能にし、最も高度なコーディングモデルとなる Gemini 3.7 Flash を公開しました。これは先行モデルからわずか 3 週間後のリリースであり、開発者のフィードバックおよびアルゴリズムの革新に応じたものであり、この急速な更新によりコストが大幅に削減されました(価格が半減し、100 万入力トークンあたり 0.75 ドル、100 万出力トークンあたり 3.75 ドル)。技術的ベンチマークは能力の著しい飛躍を確認しています:モデルはゼロから動作するコードを生成する際に 43.6% の精度を達成しました(対して 34.4%)、およびソフトウェアのエラーを修正する際の成功率は 65.3% に向上しました(対して 49.0%)。また、複雑なドキュメントの解析、現実世界の業務ワークフロー(AutomationBench スコアが 17.0% から 30.4% に改善)、Web 開発タスクにおいて優れており、Arena.ai で Elo スコア 1588 を達成しました。開発者は、Google Antigravity、Google AI Studio、Android Studio、または公式 API を活用して、これらの改善点を直ちにプロジェクトに統合することができます。この発表は、セキュリティサイバー分野など機密性の高い領域での乱用を防ぐために更新された Frontier Safety の防護措置を通じて厳格な安全プロトコルを維持しつつ、Google Workspace アプリ内でより高い生産性を約束します。安価さと多面的な高性能を組み合わせることで、このモデルは専門家のソフトウェアエンジニアリングにおける人工知能の新たな基準を設定します。

本文

Gemnini 3.7 Flash リリース:性能・価格・安全性の劇的進化

当社は本日、知的で実用的なコーディングおよびエージェント用途向け新モデル Gemini 3.7 Flash をリリースいたします。 このモデルは、フラッシュシリーズの進化を継承し、ソフトウェアエンジニアリング、知識作業、ウェブ開発のワークフローにおいて大幅な性能向上をもたらします。

  • コスト効率: 100 トークンあたりの導入価格は、先行する 3.6 Flash の半額です。
    • 入力トークン:0.75 ドル/件
    • 出力トークン:3.75 ドル/件

🚀 複雑なタスクへの対応力の強化

コーディング、Web 開発、高度な知識分野において、3.6 Flash に比べて明確な進歩が見られます。

💻 コーディングと問題解決

  • デバッグと問題解決: 3.6 Flash に対する明確な性能向上が確認されています。
  • 初回生成精度: 初回のコード生成精度が高まり、本番環境(production)で利用可能な高品質なコード生成能力が向上しました。
    • FrontierCode 1.1 Main
      : 43.6% (前:34.4%)
    • DeepSWE v1.1
      : 65.3% (前:49.0%)

🌐 ウェブ開発と UI 生成

  • 少ないプロンプトで高機能: 少ないプロンプト数で、機能性が高く完備したアプリケーションの生成が可能になりました。
  • デザイン忠実度: スクリーンショット、画像、フルデザインシステムを参照入力しても、高い精度と同等性を発揮します。
    • Arena.ai WebDev Arena
      : Elo スコアが1,588に向上(前:1,538)。

🧠 知識密度の高い分野での推論

  • 金融・法務・バイオサイエンス: 推論能力と精度が大幅に向上しました。
    • GDP.pdf
      (文書処理): 34.0% (前:22.0%)
    • AutomationBench
      (自動化ワークフロー): 30.4% (前:17.0%)

⚙️ 開発者体験と価格面の改善

Gemini 3.7 Flash は、3.6 Flash に比べて著しく優れた開発者体験を提供します。

  • 堅牢性と柔軟性: 障害に対して柔軟に対応し、意図を明確にする能力が高まっています。
  • 指示遵守: 指示への従順度が向上しており、慎重かつ勤勉な思考プロセスを実装しています。
  • 効率化:
    • マルチステップ計画立案やツールコールへの労力を増やし、結果として手動監視の削減リトライ回数の減少を実現します。

早期のカスタマーフィードバックでは、低コストながら 3.6 Flash よりも大幅に優れた結果が得られているとの高評価を得ています。


✨ Gemini Spark の強化による Gemini 3.7 Flash

Google AI Pro および Ultra サブスクリプション会員向けに提供されているGemini Spark(160 ヵ国以上で利用可能)は、今日から Gemini 3.7 Flash を採用します。

  • 位置づけ: 「お客様の指揮下で常時稼働し、お客様のお立場で行動取るパーソナル AI エージェント」です。
  • 効率性の飛躍: Google Workspace アプリに対するツール使用を通じて、知識作業の効率が劇的に向上しました。
  • 具体的な活用:
    • 文件的な統合
    • メールの下書き作成
    • ステータスドキュメントの更新
    • アイデアを実行に移すための効率化

複雑かつ多技能を必要とするワークフローにおいて、精度と出力品質も向上しています。


🛡️ 安全性を最優先に設計

Frontier Safety の防護策覆盖面と堅牢性を継続的に強化しています。

  • 新たな防護策:
    • 化学・生物・放射線・核(CBRN)分野の悪用リスク対策
    • サイバー攻撃領域への対策
  • バランスの確保: バイオレジリエンスへの取り組みと、サイバープログラムに基づく方針を踏まえつつ、有益なユースケースも可能にするバランスが設計されています。
  • 詳細は [3.7 Flash モデルカード] をご参照ください。

📅 今日からお試しください

👨‍💻 開発者向け

  • Google Antigravity
    : エージェントファーストのワークフローを探索。
  • Google AI Studio
    または
    Android Studio
    : 今すぐ開発を開始。
  • 開発者ガイドもご参照ください。

🏢 企業向け

  • Gemini Enterprise Agent Platform
    および
    Gemini Enterprise アプリ
    で利用可能。

👤 個人向け

  • 対応国にある Google AI Pro および Ultra サブスクリプション会員は、**24 時間 365 日のパーソナルエージェント「Spark」**を通じて享受いただけます(
    Gemini アプリ
    内)。

同じ日のほかのニュース

一覧に戻る →

2026/08/14 19:41

神のために、Kubernetes で CPU リミットを使用するのをやめてください

## Japanese Translation: 元の要約は明確で正確であり、よく構成されています。厳密な改善は必要ありませんが、以下に全ての情報を保持しつつさらにより滑らかで流れの良い、やや推敲されたバージョンを示します: **改訂された要約:** 主な推奨事項は、Kubernetes コンテナからの CPU リミットの廃止です。これは記憶容量制限(OOM キルを防ぐ保護機能)とは異なり、Linux CFS スケジューラによって 100 ミリ秒以内のウィンドウ内で人工的な凍結を引き起こします。このスロットリングは、処理器数に基づいて動的にリソースを割り当てる .NET アプリケーションに特に悪影響を与える、ガベージコレクションへの飢餓や沈黙するロジックエラーなどの重大な失敗につながります。 これらの制限を撤去することで、以下の顕著な利益が得られます:クラスタあたり年間約 92,000 ドルのハードウェア統合による節約、トラフィックスパイク時のテールレイテンシの減少、および計算集約型タスクに対する起動時間の大幅な短縮です。これを安全に実装するためには、組織はプロセッサ数(具体的には `DOTNET_PROCESSOR_COUNT`)に対してフラートワイドデフォルトを設定し、スロットリング比率の観測可能性を向上させた上で変更を展開する必要があります。今後のステップとしては、長期にわたる P95 使用データに基づいてリソースリクエストを再サイズ化し、オートスケーリングを最適化することです。未信憑性の高いワークロードや Guaranteed QoS を必要とするワークロードについては、例外を残して近隣のアプリケーションに影響を与えることを防ぐ必要があります。

2026/08/14 18:55

DeepSeek ピークオフピーク料金更新

## Japanese Translation: DeepSeek-V4-Pro が本日公式リリースされ、AI エージェントに重大なアップグレードが施され、生産性が大幅に向上しました。今回の更新では、V4-Pro および V4-Flash の両方で利用可能な柔軟な推論モードを導入しており、「low」は単純なタスク向け、「high」は日常のエージェントワークフロー向け、「max」は複雑な課題向けです。目玉機能として、OpenAI Responses API のネイティブサポートと最適化された Codex インテグレーションを提供し、開発をシームレスに行うためのワンクリック設定が可能です。特筆すべきは、アプリ上で「Expert モード」を通じてこれらの強化機能をアクセスできる一方で、元の API インターフェースでは標準的なモデル名をそのまま維持できる点です。重要なのは、API 料金体系が変更され、2026 年 8 月 16 日 UTC 午後 4 時より有効となるオフピーク時の料金がピーク時の半額という新構造が導入されたことです。この変更は、企業が重負荷な処理をコストのかからない時間帯にスケジュールすることで運用費を削減することを促しており、ビジネスは現在の技術ワークフローを維持しつつ、支出を最適化し、複雑な業務も容易に遂行できるようになります。

2026/08/14 3:10

GPT-5.6 の超高速化を加速

## Japanese Translation: OpenAI と Cerebras が、Cerebras の Wafer-Scale Engine アーキテクチャを搭載した新規サービス層「Ultrafast Mode」をローンチしました。このアーキテクチャには、ウーバーサイズのチップあたり 44 GB の SRAM が備わっており、GPU に見られる非効率的なデータ転送のボトルネックを解消します。Ultrafast は OpenAI API を通じて GPT-5.6 Sol を用いてミッションクリティカルワークロードを提供し、品質の妥協なしに最大 750 トokens/秒の出力速度を実現します。これは Artificial Analysis が報じた速度と比較して、Fast モードよりも Fable 5 よりも 11 倍、Opus 4.8 よりも 5 倍高速です。ベンチマークでは、「Humanity's Last Exam」の 2,500 の質問を 11 時間 11 分で答えることを達成し、Claude Fable 5 の 78 時間 27 分に対して同等の精度でほぼ 7 倍高速に処理しました。GDP-Val ベンチマークでは、Ultrafast は品質劣化なしのエンドツーエンドの速度向上を 5.6 倍達成しました。Ultrafast は、生産停止の原因究明や敵対的サイバー攻撃の検出などの高リスク課題のクリティカルパスで AI エージェントを動作させ、研究者やエンジニアにリアルタイムの洞察と更新を提供しながら、標準処理を一般的なタスクに使用することを可能にします。このリリースには、OpenAI の製品責任者 Rohan Varma と、文脈切り替えの削減による生産性向上に関する OpenAI のリサーチャー Jeffery Wang(フィードバック)が関連付けられています。Ultrafast は本日限定的プレビューとして利用可能で、より多くの顧客オンボーディングに伴いキャパシティは時間の経過とともに拡大していきます。

Gemini 3.7 Flash | そっか~ニュース