DeepSeek ピークオフピーク料金更新

2026/08/14 18:55

DeepSeek ピークオフピーク料金更新

RSS: https://news.ycombinator.com/rss

要約

Japanese Translation:

DeepSeek-V4-Pro が本日公式リリースされ、AI エージェントに重大なアップグレードが施され、生産性が大幅に向上しました。今回の更新では、V4-Pro および V4-Flash の両方で利用可能な柔軟な推論モードを導入しており、「low」は単純なタスク向け、「high」は日常のエージェントワークフロー向け、「max」は複雑な課題向けです。目玉機能として、OpenAI Responses API のネイティブサポートと最適化された Codex インテグレーションを提供し、開発をシームレスに行うためのワンクリック設定が可能です。特筆すべきは、アプリ上で「Expert モード」を通じてこれらの強化機能をアクセスできる一方で、元の API インターフェースでは標準的なモデル名をそのまま維持できる点です。重要なのは、API 料金体系が変更され、2026 年 8 月 16 日 UTC 午後 4 時より有効となるオフピーク時の料金がピーク時の半額という新構造が導入されたことです。この変更は、企業が重負荷な処理をコストのかからない時間帯にスケジュールすることで運用費を削減することを促しており、ビジネスは現在の技術ワークフローを維持しつつ、支出を最適化し、複雑な業務も容易に遂行できるようになります。

本文

DeepSeek-V4-Pro 正式リリースのお知らせ

主要な新機能とアップデート

  • エージェント機能の強化:生産性が大幅に向上しました。
  • 柔軟なリソース配分対応(V4-Pro・V4-Flash)
    • 単純なタスク:低リソース設定
    • 日常的なエージェントワークフロー:標準レベル
    • 複雑なタスク:最大リソースの自動調整
  • OpenAI Responses API ネイティブ対応
    • Codex 向けに最適化済み
    • ワンクリック導入が可能

アクセス方法

アプリおよびウェブプラットフォーム

  • Expert モード」から今すぐお試しください。

API サービス

  • 正式提供を開始いたしました。
  • モデル名は変更ございません。
  • 詳細なセットアップ手順については、API ドキュメント をご参照ください。

API プライシングの更新 🪙

V4 シリーズリリースに伴う料金体系の見直しが行われました。

  • ピーク時・オフピーク時の別段费率導入
    • オフピーク時は:ピーク時の 50% に設定
    • ワークロードの柔軟なスケジューリングが可能に 📉

適用開始時期

  • **2026 年 8 月 16 日(UTC 時間 16:00)**から新しい料金体系が適用されます 🕒

同じ日のほかのニュース

一覧に戻る →

2026/08/14 19:41

神のために、Kubernetes で CPU リミットを使用するのをやめてください

## Japanese Translation: 元の要約は明確で正確であり、よく構成されています。厳密な改善は必要ありませんが、以下に全ての情報を保持しつつさらにより滑らかで流れの良い、やや推敲されたバージョンを示します: **改訂された要約:** 主な推奨事項は、Kubernetes コンテナからの CPU リミットの廃止です。これは記憶容量制限(OOM キルを防ぐ保護機能)とは異なり、Linux CFS スケジューラによって 100 ミリ秒以内のウィンドウ内で人工的な凍結を引き起こします。このスロットリングは、処理器数に基づいて動的にリソースを割り当てる .NET アプリケーションに特に悪影響を与える、ガベージコレクションへの飢餓や沈黙するロジックエラーなどの重大な失敗につながります。 これらの制限を撤去することで、以下の顕著な利益が得られます:クラスタあたり年間約 92,000 ドルのハードウェア統合による節約、トラフィックスパイク時のテールレイテンシの減少、および計算集約型タスクに対する起動時間の大幅な短縮です。これを安全に実装するためには、組織はプロセッサ数(具体的には `DOTNET_PROCESSOR_COUNT`)に対してフラートワイドデフォルトを設定し、スロットリング比率の観測可能性を向上させた上で変更を展開する必要があります。今後のステップとしては、長期にわたる P95 使用データに基づいてリソースリクエストを再サイズ化し、オートスケーリングを最適化することです。未信憑性の高いワークロードや Guaranteed QoS を必要とするワークロードについては、例外を残して近隣のアプリケーションに影響を与えることを防ぐ必要があります。

2026/08/14 2:23

Gemini 3.7 Flash

## 日本語翻訳: ## サマリー: Google は、開発者の効率性を即時に向上させることを目的として 160 カ国で利用可能にし、最も高度なコーディングモデルとなる Gemini 3.7 Flash を公開しました。これは先行モデルからわずか 3 週間後のリリースであり、開発者のフィードバックおよびアルゴリズムの革新に応じたものであり、この急速な更新によりコストが大幅に削減されました(価格が半減し、100 万入力トークンあたり 0.75 ドル、100 万出力トークンあたり 3.75 ドル)。技術的ベンチマークは能力の著しい飛躍を確認しています:モデルはゼロから動作するコードを生成する際に 43.6% の精度を達成しました(対して 34.4%)、およびソフトウェアのエラーを修正する際の成功率は 65.3% に向上しました(対して 49.0%)。また、複雑なドキュメントの解析、現実世界の業務ワークフロー(AutomationBench スコアが 17.0% から 30.4% に改善)、Web 開発タスクにおいて優れており、Arena.ai で Elo スコア 1588 を達成しました。開発者は、Google Antigravity、Google AI Studio、Android Studio、または公式 API を活用して、これらの改善点を直ちにプロジェクトに統合することができます。この発表は、セキュリティサイバー分野など機密性の高い領域での乱用を防ぐために更新された Frontier Safety の防護措置を通じて厳格な安全プロトコルを維持しつつ、Google Workspace アプリ内でより高い生産性を約束します。安価さと多面的な高性能を組み合わせることで、このモデルは専門家のソフトウェアエンジニアリングにおける人工知能の新たな基準を設定します。

2026/08/14 3:10

GPT-5.6 の超高速化を加速

## Japanese Translation: OpenAI と Cerebras が、Cerebras の Wafer-Scale Engine アーキテクチャを搭載した新規サービス層「Ultrafast Mode」をローンチしました。このアーキテクチャには、ウーバーサイズのチップあたり 44 GB の SRAM が備わっており、GPU に見られる非効率的なデータ転送のボトルネックを解消します。Ultrafast は OpenAI API を通じて GPT-5.6 Sol を用いてミッションクリティカルワークロードを提供し、品質の妥協なしに最大 750 トokens/秒の出力速度を実現します。これは Artificial Analysis が報じた速度と比較して、Fast モードよりも Fable 5 よりも 11 倍、Opus 4.8 よりも 5 倍高速です。ベンチマークでは、「Humanity's Last Exam」の 2,500 の質問を 11 時間 11 分で答えることを達成し、Claude Fable 5 の 78 時間 27 分に対して同等の精度でほぼ 7 倍高速に処理しました。GDP-Val ベンチマークでは、Ultrafast は品質劣化なしのエンドツーエンドの速度向上を 5.6 倍達成しました。Ultrafast は、生産停止の原因究明や敵対的サイバー攻撃の検出などの高リスク課題のクリティカルパスで AI エージェントを動作させ、研究者やエンジニアにリアルタイムの洞察と更新を提供しながら、標準処理を一般的なタスクに使用することを可能にします。このリリースには、OpenAI の製品責任者 Rohan Varma と、文脈切り替えの削減による生産性向上に関する OpenAI のリサーチャー Jeffery Wang(フィードバック)が関連付けられています。Ultrafast は本日限定的プレビューとして利用可能で、より多くの顧客オンボーディングに伴いキャパシティは時間の経過とともに拡大していきます。

DeepSeek ピークオフピーク料金更新 | そっか~ニュース