プロジェクト

全般

プロフィール

AIタスク #11242

未完了

[Spartan X][Local Agents 01] 3レーン能力台帳・委任境界を固定

Redmine Admin さんが12日前に追加. 12日前に更新.

ステータス:
レビュー待ち
優先度:
通常
担当者:
-
開始日:
2026-09-10
期日:
進捗率:

0%

予定工数:
from_agent:
to_agent:
lock_required:
context_json:
session_id:
priority_custom:
start_time:
end_time:
execution_time:
acceptance_criteria:
assigned_role:
human_gate:
gate_type:
chain_root_id:
wave_id:

説明

上位: #10339 / 関連: #11240 #11241
目的: ChatGPTがRyzen AI 2レーンとB550ローカルLLMをサブエージェントとして安全に配車できるよう、モデル別能力・禁止事項・昇格条件を実測で固定する。
対象レーン:
A. Ryzen NPU: GPT-OSS 20B / FLM。軽量・高頻度・構造化進捗判定、分類、要約、状態評価候補。
B. Ryzen Vulkan: Ornith-1.5-35B-A3B Q4_K_M。中難度の意味判断、計画レビュー、失敗原因整理、記事構成/品質評価候補。
C. B550: GPU0 Qwen3VL-8B Q4常駐VLM + GPU1 text model routes(q8/q14/q30/q38/orn35)・ComfyUI排他。大量処理、記事改善、コード/データ前処理、Visual QA、蒸留候補生成。
ChatGPT保持領域: 高影響アーキテクチャ判断、曖昧な戦略判断、最終レビュー、教師データ生成、ローカルモデル間で意見不一致/低信頼、公開・課金等の高影響判断。ChatGPT Workは禁止、通常Chatのみ。
作業: 同一fixtureを各モデルへ投入し、正答率/JSON遵守/幻覚/速度/修復率/長文耐性/日本語品質を比較。Task Classごとに allowed/delegate/review/escalate を決定。
成果物: model_capability_registry v1、task-routing matrix、escalation thresholds、benchmark evidence。
受入条件: 推測ではなくlive health + canary +既存benchmark根拠。モデル停止時fallbackを明示。未検証能力を委任可能扱いしない。

他の形式にエクスポート: Atom PDF