Kimi K3-256k

2026/07/30 4:25

Kimi K3-256k

RSS: https://news.ycombinator.com/rss

要約

日本語訳:

サマリー:

Kimi Code から最適な価値とパフォーマンスを引き出すためには、主にk3-256kモデルを選択する必要があります。これはコスト効率性とビデオ入力の処理能力(kimi-for-codingは画像のみをサポートするため)を独自のバランスで実現するモデルです。モデルの選択には特定の識別コードが必要です。なお、セッションのリセットを行わずにモデルを変更すると、システムのメモリキャッシュが無効化されるためトークンの無駄が発生します。さらに、高速出力モードを使用すると標準クォータの 3 倍消費され、大きなコンテキストウィンドウや高速スピードを利用するには Allegretto+ プランが必要となります。現在のサブスクリプションが選択された機能に必要な権限を持っていない場合(例:Moderato プラン未満で K3 モデルを使用を試みる)、401 エラーが発生する可能性があります。また、サードパーティ製ツールが誤設定されている場合(具体的には、思考パラメータの不一致や、K3 の全容量を利用するためには

context-window
を手動で 1048576 に設定していないこと)、400 エラーが発生します。接続の切断や再プリフィルによるトークン消費過多といった技術的なトラブルを避けるためには、常にサードパーティ製ツールの設定が正しいことを確認し、モデル ID や思考努力の設定を変更する際にはセッションをリセットしてください。最終的に、慎重なモデル選択によって無駄な支出を防ぎ、スムーズな開発ワークフローを確保できます。

本文

Kimi Code モデル構成と切り替えガイド

本ページでは、Kimi Code が提供するモデルの概要切り替え方法、およびよくある問題点について説明します。

モデルの概要

Kimi Code 現在は以下の 2 つの主要モデルを提供しており、4 つのモデル ID で利用可能です。

  • 推奨されるモデル:
    k3-256k
    が現在提供されています(同様の結果が得られるため)。
  • k3 (1M)
    は、
    k3-256k
    に比べて約 2 倍のクォータを消費します。

最適な使用ケース

以下のタスクに適しています(※ビデオ入力サポートなし)。

  • 日常的な Q&A
  • コード補完
  • 通常の機能開発
  • 単一ファイルまたは小規模なファイルの編集

モデル ID 比較表

特徴
k3
k3-256k
kimi-for-coding
kimi-for-coding-highspeed
モデルバージョンKimi K3Kimi K3Kimi K2.7 CodeK2.7 Code HighSpeed
概要最高性能のフラグシップコーディングモデル(パラメータ 280 億)K3 の 256K コンテキストバージョン(消費削減)コード補完および通常の開発タスクに最適出力速度約 5〜6 倍速い高速版
速度通常速度通常速度通常速度HighSpeed(出力速度 6 倍、クォータ使用量 3 倍)
コンテキスト窓最大 1M(上位プラン利用可)256K のみ256K256K
推論努力 (Reasoning)
low
/
high
/
max
(デフォルト:high)
low
/
high
/
max
(デフォルト:high)
Thinking: ONThinking: ON
利用状況Moderato 以上;Allegretto 以上で 1M 可全プラン対応メンバー向け全プラン対応Allegretto プランまたはそれ以上
マルチモーダル入力画像、ビデオ画像のみ画像、ビデオ画像、ビデオ

⚠️ モデル切り替え時の注意点

K3 (1M) から K3-256k へ切り替える場合

  • コンテキスト超過の場合: セッションのコンテキストが既に 256 万トークンを超えている場合、コーディングツール(CLI など)側で自動的に圧縮処理を行う可能性があります。
  • 推奨手順:
    1. ツールごとの挙動が異なるため、切り替え前に一度手動でコンテキストを圧縮 (
      compact
      ) しておくことをお勧めします。これにより、重要な情報を保持しつつ効率的なクォータ利用が可能です。
    2. 会話履歴にビデオファイルが含まれている場合: K3-256k はビデオ入力をサポートしないため、直接切り替えすると失敗します。必ず先に圧縮処理を行い、その後で切り替えてください。

K3-256k から K3 (1M) へ切り替える場合

  • 情報の喪失を防ぐ: コンテキストが限界に近づいた場合に利用可能です。
  • キャッシュへの影響: 現在のバージョンでは、256 万から 1M への切り替えはキャッシュに影響を与えません。

よくあるご質問 (FAQ)

Q. 新しいモデルの発売後に使用量が増えたのはなぜですか?

  • 理由: モデルを切り替えると、以前に構築されたコンテキストキャッシュが有効化されません。そのため、新しいモデルに対して再度プレフィル(事前読み込み)を行う必要があり、一時的な使用量増加が発生します。
  • 推奨対応: 新しいモデルを使用する際は、新しいセッションを開始することをお勧めします。これにより結果の質が向上し、消費量を低減できます。

Q. 正しいモデル ID を指定しても 401 エラーが発生するのはなぜですか?

要求された機能がご契約のプランに含まれていない場合です。代表的なケースは以下の通りです:

  • K3 にアクセスできない: ご契約プランが Moderato 未満の場合、
    k3
    k3-256k
    を使用できません(Moderato 以上へのアップグレードを推奨)。
  • 1M コンテキストにアクセスできない: Moderato プランでは
    k3
    のコンテキスト窓は最大 256K です。1M を利用するには Allegretto 以上が必要です。
  • HighSpeed にアクセスできない:
    kimi-for-coding-highspeed
    は Allegretto プランまたはそれ以上のプランで利用可能です。

Q. HighSpeed は明らかに速くないのでしょうか?

以下の 2 つの理由が考えられます:

  1. モデル ID の入力ミス: HighSpeed を使用するには、厳密に
    kimi-for-coding-highspeed
    と指定する必要があります。誤った値を入力すると、システムは自動的に通常の
    kimi-for-coding
    にフォールバックします(速度向上なし)。
  2. ツールおよびスクリプトの処理時間が dominant である場合: HighSpeed はモデルからの出力速度のみを高速化します。ファイルの読み書きやコマンドの実行など、ツールコール自体に時間がかかれば全体の速度感は向上しません。

💡 オプティマイズのための推奨事項(オーバーヘッド削減)

  • 推論努力 (reasoning effort) の切り替え:

    • 推論努力を変更すると構築されたコンテキストキャッシュが無効化され、再プレフィルが発生します。
    • 対策: タスクに適した努力水準を選び、セッション中は一定に保ってください。大幅な変更が必要な場合は新しいセッションを開始してください。
  • 重要な注意点:

    • モデル ID を切り替える際は新しいセッションから始める(コンテキストキャッシュが無効化されるため)。
    • モデル名ではなくモデル ID を入力する(例:
      k3
      ,
      kimi-for-coding
      など)。バージョン名(例:「Kimi K3」)では呼び出しが失敗します。
    • Thinking ルートをオフにすると K2.6 が使用されます。K3 や K2.7 Code を使用する場合は Thinking を有効 (ON) に保ってください。

モデルの切り替え方法

公式クライアントでの設定

  • Kimi Code CLI: コマンド
    /model
    でモデルを切り替えます(構成変更不要)。最新のモデルがリストされていない場合は、
    /logout
    /login
    の手順で再ログインしてください。
  • Kimi Code for VS Code: 入力バーのドロップダウンメニューから目的のモデルを選択します(リスト外の場合は再起動または拡張機能の再インストールを推奨)。

サードパーティ製ツールでの設定

ツールの「モデル ID」欄に以下のいずれかの ID を設定してください。

API キーの取得と接続

  1. Kimi Code コンソールでAPI キーを作成します。
  2. ツールにベース URL および対応するモデル ID を入力します。

Kimi Code API は OpenAI 製式および Anthropic 製式の両方をサポートしています。

プロトコルベース URL
OpenAI 互換
https://api.kimi.com/coding/v1
Anthropic 互換
https://api.kimi.com/coding/

K3 の使用前に確認する事項

K3 の設定は K2.7 Code と異なる点があるため、以下の 2 点を確認してください:

  1. コンテキスト窓の最大化

    • 一部のツールはデフォルトで最大 1M よりも小さい値を使用します。K3 の完全な機能(最大 1M)を利用するには、手動で
      context-window
      フィールドを
      1048576
      に設定してください。
  2. 推論努力 (effort) のマッピング ツールが送信する effort は以下のように入力値に応じて自動的にマッピングされます。

ツールの入力値マッピングされた effort備考
null
/
undefined
high
(デフォルト)
# デフォルト
ultra
,
max
,
xhigh
max
# max
high
,
medium
high
(推奨)
# high (推奨)
low
,
minimum
,
light
low
# low
none
思考タイプ無効化# thinking disabled
その他の不明な値HTTP 400 エラー

同じ日のほかのニュース

一覧に戻る →

2026/07/30 5:39

Vision Pro の最もクールな活用法

## Japanese Translation: 著者は、無料ツールと AI を活用し、標準的な建築設計ソフトを凌駕するために Apple Vision Pro 上で 2D の住宅施工図面を VR で視覚化するための DIY ワークフローの詳細を提供している。このプロセスでは、Fusion 360 を用いて PDF 図面を高精度な 3D モデルに変換し( Appearance パネルを通じて木材、石材、ガラスなどのテクスチャを追加)、家具は GLB または USDZ ファイルを OBJ フォーマットへ変換して読み込む(Tampermonkey スクリプトを用いるか、代替的な iOS AirDrop ワークフローを使用する)ことで行う。さらに、AI を活用した「vibe coding」により、1 つの朝に独自のカスタムビューアアプリ「Prospector」を開発し、コントローラーサポート、フライトモード、6 倍速度モード、森の天空ボックスのような没入型環境などの機能を付与している。生成されたコードは不完全であること(「janky」と表現)も認められているが、完全に機能する。このアプローチは、建築家から通常提供される Revit ウォークスルー unfavorably に比較できるような、個別の建設者に向けた浸透的な視点を可能にしている。

2026/07/30 0:05

Show HN: 任意の M シリーズ Mac で、Gemma 4 26B を 2 GB のメモリで動かすオープンソースエンジン

## Japanese Translation: TurboFieldfare は、macOS 26 (arm64)、Metal 4 および Swift 6.2 を想定した独立系 Apache 2.0 ライセンス下のプロジェクトであり、Apple Silicon搭載の Mac で指令チューニング済みの Gemma 4 26B-A4B モデル(~14.3 GB の共有コア)を動作することを可能にします。本プロジェクトは、SSD からオンデマンドでルーターの判断に基づいて追加の「エキスパート」ブロックをストリーミングする仕組みを採用し、共有重みと 1.35 GB の FP16 KV キャッシュをメモリ上に保持することで、利用可能な RAM が~2 GBしかないデバイスでも実行できるようにしています。MLX または llama.cpp を使用せず、独自のスウィフト+メタルランタイムによりこれを実現します。ベンチマークでは、8 GB M2 MacBook Air でデコード速度が 5.1~6.3 トークン/秒、24 GB M5 Pro では 31~35 トークン/秒を記録しました。インストールには、ピン付けされた~15 GB のモデルをダウンロードし、完全なソースチェックポイントを物質化することなく、~14.3 GB の.gturboディレクトリに再パッケージする必要があります。スイートには、テキストのみ推論で自動チャットフォーマットを持つ TurboFieldfareMac、TurboFieldfareCLI、機能ツール付きの OpenAI 互換ループバックサーバー(ただしクライアント側での認証が必要)、TurboFieldfareRepack およびサポートライブラリ・サービスが含まれます。生成デフォルトは温度 0.2、Top-K 64、Top-P 0.95 であり、確定的出力(温度 0)およびその他のサンプリングパラメータのオプションも用意されています。今後の作業としては、iPhone/iPad ネイティブアプリの開発と base 16 GB M4 Mac miniなど他のモデルでのさらなるベンチマークが対象です。本プロジェクトは Google によるアフィリエイトまたは推奨ではなく、モデル重みは Hugging Face から別途入手します。

2026/07/30 0:41

スーパーロジカル

## Japanese Translation: 本プロジェクトは、インタラクティブ、自動、および運用ワークフローを単一の堅牢なセッション層に統合し、「すべての作業用のマルチプレキサー」を実質的に創出することを目的としています。このシステムは、完全にソフトウェア主導である一方で、デフォルトのコンテキストの提供、構造化されたデータへのアクセス、履歴の保存、そして完全な人間の制御を最優先します。ターミナルは開発者、エージェント、ツール、およびインフラストラクチャを本質的に効果的に接続するため、理想的な基盤となります。複数のターミナルブロックを長寿セッションとして組織化することで、デバイス間でのシームレスな再接続と、スクロールや選択機能に対するネイティブなサポートを提供します。 チームは HashiCorp や Vercel といった主要企業の広範な経験を持ち、Mitchell Hashimoto(Ghostty の創始者)、Jack Pearkes、Alasdair Monk、Hector Simpson を含む主要な人物によって率いられています。本製品は最初にはるかに素晴らしいマルチプレキサーを構築することに焦点を当て、その後で構造化可能なアーキテクチャと運用安全性を優先します。ベータ版利用の告知が後日に予定されており、将来的にオープンソースリリースも行われる見込みです。ユーザーは、Web とネイティブ macOS/iOS プラットフォーム間でライブセッションを共有できる統合されたワークスペースを利用できるようになります。このアプローチは、追加のソフトウェア層が必要なく、自動化と直接的な人間のインタラクションの双方をサポートする単一のシステムを提供することで、開発者がツールを管理する方法を変革します。**プロジェクトは現在資金調達が完了しています。**

Kimi K3-256k | そっか~ニュース