DeepSeek ハネス開発者プレビュー版

2026/08/13 21:58

DeepSeek ハネス開発者プレビュー版

RSS: https://news.ycombinator.com/rss

要約

日本語翻訳:

Harness は、意思決定の「モデル」と、環境理解、ツール利用、および運用管理を担当する「ハネス」を分離することで、モデルを実世界の環境で効果的に動作させることを可能にする AI エージェントフレームワークです。Cordis カーネルを基盤として構築された Harness は、プラグインのマウント・アンマウントおよび依存関係の管理を行い、すべてのエージェント機能(メモリ、外部 API、ストレージ、セッション、サンドボックス、ループ、スケジューリング、UI など)をモジュラープラグイン内に配置することを可能にします。Cordis サービスとイベントにより、これらのプラグインが無縫く連携できます。開発者にとっての主な利点は高い柔軟性であり、コアの DeepSeek Harness ソースコードを変更せずに構成ファイルを通じて任意の機能を選択、置換、または拡張できるため、エージェントの振る舞いの迅速なカスタマイズが実現しつつも安定したインフラストラクチャを維持できます。始め方としては、npm 経由でインストール(

$ npx @deepseek-ai/dsh web
)するか、GitHub からリポジトリをクローン(
$ git clone https://github.com/deepseek-ai/deepseek-harness
)することで利用可能です。結局のところ、Harness は複雑なロジックをハードコーディングするのではなく外部設定に移すことで、展開を加速させます。

本文

エージェント構築:モデルとハーネスの協働

コンセプト

エージェントは**「モデル」と「ハーネス」**によって構成されます。

  • モデル:エージェントの。思考能力の源です。
  • ハーネス:現実世界の環境でエージェントを継続的に稼働させる制御層です。
    • エージェントが自身の環境を理解できるようにします。
    • ツールの利用を促進します。
    • リアルタイムな状況下での持続的動作を実現します。

コーディスキネル(Cordis Kernel)

ハーネスの中核となる機能モジュールです。

  • プラグイン管理:マウントおよびアンマウントの実行。
  • 依存関係管理:コンポーネント間の依存を自動調整。
  • 能力実装:エージェントの各種能力はすべてプラグイン内に実装されています。

プラグインアーキテクチャ

あらゆる機能をモジュール(プラグイン)として提供します。

  • 対応する機能
    • モデル
    • ツール
    • スキル
    • セッション
    • サンドボックス
    • ストレージ
    • ループ処理
    • スケジューリング
    • ユーザーインターフェース
  • 連携機構:Cordis サービスとイベントシステムを通じて、各プラグインが協調動作します。

柔軟な設定による構築

開発者はソースコードの改変を避け、構成ファイルだけで柔軟にシステムを構築できます。

  • 機能の選定・入れ替え:任意の機能を組み合わせられます。
  • 拡張性:構成ファイルを記述するだけで機能を追加可能です。
    • DeepSeek ハーネスのソースコードを変更する必要はありません。

DeepSeek ハーネスの起動方法

クイックスタート

すぐに利用したい場合は、以下の手順で Web ユーザーインターフェースを起動します。

  1. Node.js をインストールする。

  2. npx
    コマンドを使用し、Web UI を起動する:

    $ npx @deepseek-ai/dsh web
    

ソースコードからのインストール

完全なソースコードを利用したい場合は、Git リポジトリをクローンします。

$ git clone https://github.com/deepseek-ai/deepseek-harness
  • 詳細なセットアップ手順は、リポジトリの README に記載されています。

同じ日のほかのニュース

一覧に戻る →

2026/08/14 19:41

神のために、Kubernetes で CPU リミットを使用するのをやめてください

## Japanese Translation: 元の要約は明確で正確であり、よく構成されています。厳密な改善は必要ありませんが、以下に全ての情報を保持しつつさらにより滑らかで流れの良い、やや推敲されたバージョンを示します: **改訂された要約:** 主な推奨事項は、Kubernetes コンテナからの CPU リミットの廃止です。これは記憶容量制限(OOM キルを防ぐ保護機能)とは異なり、Linux CFS スケジューラによって 100 ミリ秒以内のウィンドウ内で人工的な凍結を引き起こします。このスロットリングは、処理器数に基づいて動的にリソースを割り当てる .NET アプリケーションに特に悪影響を与える、ガベージコレクションへの飢餓や沈黙するロジックエラーなどの重大な失敗につながります。 これらの制限を撤去することで、以下の顕著な利益が得られます:クラスタあたり年間約 92,000 ドルのハードウェア統合による節約、トラフィックスパイク時のテールレイテンシの減少、および計算集約型タスクに対する起動時間の大幅な短縮です。これを安全に実装するためには、組織はプロセッサ数(具体的には `DOTNET_PROCESSOR_COUNT`)に対してフラートワイドデフォルトを設定し、スロットリング比率の観測可能性を向上させた上で変更を展開する必要があります。今後のステップとしては、長期にわたる P95 使用データに基づいてリソースリクエストを再サイズ化し、オートスケーリングを最適化することです。未信憑性の高いワークロードや Guaranteed QoS を必要とするワークロードについては、例外を残して近隣のアプリケーションに影響を与えることを防ぐ必要があります。

2026/08/14 18:55

DeepSeek ピークオフピーク料金更新

## Japanese Translation: DeepSeek-V4-Pro が本日公式リリースされ、AI エージェントに重大なアップグレードが施され、生産性が大幅に向上しました。今回の更新では、V4-Pro および V4-Flash の両方で利用可能な柔軟な推論モードを導入しており、「low」は単純なタスク向け、「high」は日常のエージェントワークフロー向け、「max」は複雑な課題向けです。目玉機能として、OpenAI Responses API のネイティブサポートと最適化された Codex インテグレーションを提供し、開発をシームレスに行うためのワンクリック設定が可能です。特筆すべきは、アプリ上で「Expert モード」を通じてこれらの強化機能をアクセスできる一方で、元の API インターフェースでは標準的なモデル名をそのまま維持できる点です。重要なのは、API 料金体系が変更され、2026 年 8 月 16 日 UTC 午後 4 時より有効となるオフピーク時の料金がピーク時の半額という新構造が導入されたことです。この変更は、企業が重負荷な処理をコストのかからない時間帯にスケジュールすることで運用費を削減することを促しており、ビジネスは現在の技術ワークフローを維持しつつ、支出を最適化し、複雑な業務も容易に遂行できるようになります。

2026/08/14 2:23

Gemini 3.7 Flash

## 日本語翻訳: ## サマリー: Google は、開発者の効率性を即時に向上させることを目的として 160 カ国で利用可能にし、最も高度なコーディングモデルとなる Gemini 3.7 Flash を公開しました。これは先行モデルからわずか 3 週間後のリリースであり、開発者のフィードバックおよびアルゴリズムの革新に応じたものであり、この急速な更新によりコストが大幅に削減されました(価格が半減し、100 万入力トークンあたり 0.75 ドル、100 万出力トークンあたり 3.75 ドル)。技術的ベンチマークは能力の著しい飛躍を確認しています:モデルはゼロから動作するコードを生成する際に 43.6% の精度を達成しました(対して 34.4%)、およびソフトウェアのエラーを修正する際の成功率は 65.3% に向上しました(対して 49.0%)。また、複雑なドキュメントの解析、現実世界の業務ワークフロー(AutomationBench スコアが 17.0% から 30.4% に改善)、Web 開発タスクにおいて優れており、Arena.ai で Elo スコア 1588 を達成しました。開発者は、Google Antigravity、Google AI Studio、Android Studio、または公式 API を活用して、これらの改善点を直ちにプロジェクトに統合することができます。この発表は、セキュリティサイバー分野など機密性の高い領域での乱用を防ぐために更新された Frontier Safety の防護措置を通じて厳格な安全プロトコルを維持しつつ、Google Workspace アプリ内でより高い生産性を約束します。安価さと多面的な高性能を組み合わせることで、このモデルは専門家のソフトウェアエンジニアリングにおける人工知能の新たな基準を設定します。