Zenn (AI)Japan
無検閲モデルに潜むリスク:バックドアを仕込まれたAIモデルが機密情報を盗み出すまで

GPUクラウドや自前のGPUサーバーで、Hugging Face上の公開モデルを気軽に動かしている方も多いと思います。特に「無検閲モデル」と呼ばれる、ガードレールを外したモデルは応答の自由度の高さから人気を集めていますが、そのモデルファイル自体に攻撃者が仕込んだ罠が隠れている可能性がある——という実証実験が最近話題になりました。
Read at Zenn (AI) ↗Related

Japanさくらインターネット、GPU専有によりトークン消費量を気にせず定額で利用できる「さくらのAI Engineプライベートエディション」提供開始を発表 Publickey
JapanGoogle、AI生成物の判定ツールを一般公開 OpenAIやNVIDIA製サービスも対象に ITmedia AI+

JapanGoogle、AI電子透かしの検出サイト「SynthID Detector」を一般向けに公開 ——OpenAI・NVIDIA・KakaoのAI生成コンテンツにも対応、Appleの生成物も近く確認可能に gihyo.jp

Japan【未来クライム】尚栄高校スクールコース第2回 — 道央メタルを知る・サイトの構成を決める Zenn (AI)

Japan行動ログだけでは人間の「判断」は残らない —— Continuous Reasoning Acquisitionという設計 Zenn (AI)
