---
name: 三者協調 (chat-Claude / Gemini / Claude Code) の calibration protocol
description: STEP 866/867 実例 — chat-Claude 高精度 / Gemini が STEP 番号・計算値を捏造 / Claude Code が数値検証. 三者で cross-check する protocol 確立.
type: feedback
originSessionId: 2026-04-17-three-way-collab
---
# 三者協調パターン (chat-Claude / Gemini / Claude Code)

## ルール

**重要な研究 milestone で briefing memo を web claude.ai と Gemini に独立して渡し、返答を Claude Code (local) が必ず数値・文献 cross-check してから採用判断する。**

**Why**:
- **chat-Claude (web)**: context 0 から見直すので過剰工学を見抜きやすい。STEP 866 の LTE 一行補題がその例。
- **Gemini**: 言語的流暢さは高いが、**STEP 番号・paper 番号・数値計算を捏造 (hallucinate) する failure mode** あり。STEP 485/Paper 69/ord_577(3)=144 が全て偽だった (2026-04-17 session)。
- **Claude Code (local)**: project context を保持し、grep/code 実行で cross-check 可能。**三者の返答を最終審判**する役割。

## How to apply

1. 重要 STEP の briefing memo を `docs/<topic>-briefing-<date>.md` で作成 (self-contained)
2. 藤本さんが chat-Claude (web) と Gemini に別々に貼付、返答を取得
3. **Claude Code (local) が必須 cross-check**:
   - paper/STEP 番号が実在するか `grep` で確認
   - 数値 (ord, K, peak 等) を直接計算で再検証
   - Mathlib 補題名等を local doc で確認
4. 三者返答を表形式で対比し、誰の主張が正しいか明示
5. 確認済事実のみ採用、捏造は棄却

## Failure mode signals (警戒信号)

Web 側 AI (chat-Claude / Gemini) が以下を 1 会話で 2 回以上使用 → **hallucination mode 疑い**:

- 「世界初」「史上初」「人類史上」
- 「○○ 以来誰も完成していない」系
- 存在確認していない STEP 番号・paper 番号
- 既存文献 (Leibniz→Frege→Mac Lane, CLIP, BERT 等) の意図的無視

## 実例

### STEP 866 (2026-04-17) — chat-Claude 正しい
- C8 LTE 一行補題を正確に指摘 → 250/250 数値検証 + Lean 4 zero-sorry で confirmed
- 部分反証は chat-Claude 自ら認識 (577 ord(3) の扱い)

### STEP 867 briefing review (2026-04-17) — Gemini 捏造 3 件
1. **STEP 485 の存在**: 不存在 (`grep -r "step.*485" docs/ memory/ data/lean4-mathlib/` 該当 0)
2. **Paper 69 = C8**: 誤 (Paper 69 = Schnorr-D-FUMT₈, C8 は Paper 66)
3. **ord_577(3) = 144**: 誤 (実計算 3^48 mod 577 = 1 → ord = 48)

**正しかった部分**: ord_577(2) = 144 (QR 計算正しい), briefing 品質ガード提案 (採用価値あり)

### 3 連続チャット Claude 発散例 (2026-04-17 session)
- 色付きドット 1477万色 → 実は 1677万色 (typo)
- 「最小単位」主張 → bit より小さくない
- 「世界初統一記号」主張 → Mac Lane 圏論 / λ 計算 / ⊢ と既存
- 「Paper 66-70 の主題になる」 → 66/69/70 既投稿済の別主題

## Mitigation protocol

Web chat AI (chat-Claude / Gemini / Kimi / GPT 等) 返答を受け取ったら:

| ステップ | Claude Code の役割 | 所要時間 |
|---------|-------------------|---------|
| 1. 引用 STEP/paper 実在確認 | grep local repo | 10 秒 |
| 2. 数値 claim 再計算 | py/tsx で直接計算 | 30 秒 |
| 3. 既存文献確認 | web search / local mathlib | 2 分 |
| 4. 実際の論文番号・DOI 確認 | publish log grep | 10 秒 |
| 5. 三者返答の表形式 diff 提示 | markdown 作成 | 2 分 |

**合計 ~5 分** で 3 AI 返答の cross-check 完了。これを scale ing パターンとして固定化.

## 関連

- `project_step866_c8_lte_closure.md` — STEP 866 詳細
- `project_step867_descent_basin_negative.md` — STEP 867 (chat-Claude 仮説 iii 検証 → NEGATIVE)
- `docs/collatz-attack-briefing-2026-04-17.md` — 渡した briefing memo
