Zenn (AI)Japan
続・LLMに"扁桃体"を埋め込んでみた記録 — Agentic Misalignment編

前回のおさらいと、次の壁 前回の記事「LLMに"扁桃体"を埋め込んでみた記録」では、AIの内部状態(hidden state)に直接ベクトルを足し込むことで、危険な依頼への拒否反応を後天的に強化する「扁桃体的な仮想の部品」を作ってみました。架空の業務シナリオでは、危険な依頼をほぼ確実に断りつつ、普通の依頼は邪魔しないという結果が得られ、一定の手応えがありました。 今回はその続きです。
Read at Zenn (AI) ↗Related

JapanClaude Codeでデバッグログからバグの原因を特定する──AIが見落とす3つの落とし穴 Zenn (AI)

JapanCLAUDE.mdはプロジェクトの憲法:16日で16回改正したAIの行動ルールと「お願い」をテストに格上げした話 Zenn (AI)

JapanClaude Code との個人開発で、エージェント・CI・人の役割をどう分けたか Zenn (AI)

GitHubFrom Agent Authorization to AI Production Evaluation: QCon AI New York 2026 InfoQ AI

VoicesChroma and Agentic Retrieval Software Engineering Daily
