AI開発環境
-
モデルの重みは1グラムも動かせないのに、自分のAIは日々かしこくなっている — 重みの外の2層に学びを貯める実運用
重みを再学習させる権利のないエージェントでも、モデルの外側(設定・検証手順・状態ファイル)に本番の失敗を貯めれば継続的に学習できる。この考え方を、自分の毎日のAI開発環境で実際にどう回しているかを記録します
-
Anthropic公式が明かした Fable 5 の使い方 — 賢いモデルは「顧問」に、実行は安いモデルに
@ClaudeDevs公式スレッドと付属cookbookを読み込み、上位モデルへの相談(advisor)と委譲(orchestrator)の使い分けを実測数値・図解つきで整理。自分のグローバル設定に何を反映し、何を反映しなかったかまで書きます
-
AIに書かせた「AIの品質保証機構」を、AIの敵対レビューで8ラウンド審査したら3種類の嘘がバレた
賢いモデルの提供終了前夜。翌日から普段のモデルで設計品質を保つためのエスカレーション機構を作り、それを5人格×8ラウンドの敵対レビューにかけた実測ログ。看板と機構の違いが具体的に剥がされていく記録です
-
期間限定の賢いモデルに「作品」ではなく「土台」を作らせた一日 — skill棚卸し・記憶の発掘・検証機構の磨き込み 作業ログ
Fable 5 が使える残り数日で何をするか。成果物の量産ではなく、AI相棒の skill とメモリの棚卸しに全振りした一日の実測ログです
-
AIに自分の開発環境を採点させたら67点だった — 週次自己改善ループができるまでの2日メモ
Claude Code の設定・スキル・自動化を100点満点で厳格採点→改善→再採点。最後に「毎週金曜に自動で続く仕組み」まで作った作業ログです