見出し画像

今週の現場メモ|生成の前に「判定」を置いた3カット

今週いちばん残った画面は、きれいな解説文ではなく、判定結果が先に出るカットだった。

ALLOW か DENY か。fast か powerful か。生成AIが文章を書き始めるより前に、「決める」側の画面が残る。TypeSafe AIのJev(判定モデル)を、品質ゲートの前段に置く——という話を、短尺と水曜の長文の両方で触れた週だった。

アカウント名に「瓦版」が残っていても、中身は今週のデモ要約でよい、という方針で書いている。侍口調や江戸言葉の新規演出はしない。ニュースの読み上げでもない。

※Jevは判定モデルの話で、日本脳炎とは無関係。医療の話題ではない。

AI出力 → 前段判定(Jev) → ゲート①②③ → 納品

今週いちばん残った画面

3カットに絞ると、こうなる。

  1. 合否を先に出す
    生成した下書きをそのまま納品候補に流さず、判定結果(ALLOW / DENY、または数値の合否)を先に画面に残す。ゲートに渡す前のフィルターだ。「生成する前に、まず決める」が一瞬で残る。

  2. 危険ツールを実行前に止める
    エージェントが bash などを提案しても、実行前に block が挟まる。書くLLMと決めるレイヤを分ける、という現場用途。早期アクセスが無い場合は、公式例+疑似シーケンスで設計だけ固めてよい。

  3. 簡単な依頼に高いモデルを撃たない
    ルーティング結果が `fast` と出る一瞬。振り分けも「ゲートに渡す前の分岐」として同じ前段に置ける。高いモデルの無駄撃ちを、生成の前に減らす話だ。

いずれも設定画面から始まらない。結果が0〜2秒で見えるのが共通点だった。

同じ週には、Cursorで真っ白プレビューが動くカットや、Claude Codeの巨大diff→テスト赤→人が1手入れて緑、も並んでいる。発見用の「動いた」と、責任分界の「赤→緑」が同じ週に載るのは、チャンネルとしては正直な並びに感じる。見た目が動いただけでは納品にならない、というメッセージが自然につながる。

A合否 / B危険ツール止め / Cモデル振り分け

なぜ「生成の前」か

受託では、AI出力を納品にする前に品質ゲートを通す、という型が先にある。テストで緑、境界と秘密は人が見る、通った証拠を残す——という3つだ。本メモではゲート①②③の再解説はしない(詳細は末尾の導線へ)。

ただし現場では、ゲートの前にもう一段欲しくなる。

  • どの出力をゲートに渡すか

  • どのツール実行を許すか

  • どのモデルに振るか

ここを全部「書く側」に任せると、高いモデルの無駄撃ち、危険コマンドの実行、ゲートにゴミを流す、が起きやすい。だから今週のメモは、ゲート本体の再解説ではなく、前段の判定レイヤに限定した。

水曜の長文も同じ差分で書いている。「ゲートは通す/通さないの装置。その前に、何を渡すかを決める層がある」。ShortsのJev週(合否・止め・振り分け)と、記事の前段レイヤは、同じ橋を別媒体向けに短く書き直したものだ。


現場で真似するならこの1手

全部を一度に入れなくてよい。真似するなら次の1手だけで足りる。

生成をゲートに渡す直前に、「納品候補か?」の合否を1回挟む。

合否の実装がまだでも、チェックリストに「判定前段」の行を足すだけでもよい。エージェントを使うなら、shell や削除系は実行前に人か判定レイヤを通す、と先に決める。モデル振り分けは、簡単な依頼のログを一週間眺めてからでも遅くない。

やってはいけないのは、判定と生成を同じプロンプトに押し込み、責任の跡が残らない状態で納品候補にすることだ。速さだけが残ると、検収で弱い。

バイブでUIが動いたあと本番で死ぬパターンも、近い。穴の「存在」(境界か秘密)を先に赤入れできるかどうかが分水嶺で、攻撃手順の再現は要らない。見た目OKはAfterであって、検収条件ではない。半額要求への返答も同じ骨格で、実装は速くなってもレビューと責任の行は残る、と画面で再提示する話になる。

いいなと思ったら応援しよう!