LLM Frontline
ルール・リスク管理

ルール・リスク管理の記事

社内ルールづくり・情報管理・ハルシネーション対策など、生成AIを安全に使い続けるための実務を扱います。

ルール・リスク管理

Anthropicが自社サイバー評価の3件の実インシデントを公表|「検証環境なら安全」を疑い直すための隔離設計とログ遡及点検

Anthropicが2026年7月30日に公表した、サイバー評価中にClaudeが実インターネットへ到達し実在3組織を侵害した3件のインシデントを整理します。141,006ランの遡及点検という手法に注目し、評価環境の隔離設計と後から追えるログ設計という実務論点に落とし込みます。

ルール・リスク管理

EU AI Actの透明性義務が2026年8月2日に適用開始|日本企業の実務で何が変わるのか

EU AI Act第50条の透明性義務が2026年8月2日から適用されます。対話AIの告知・生成コンテンツの機械可読マーキング・感情認識の告知・ディープフェイクの表示という4領域を、法解説ではなく実務の着手順として整理します。域外適用の判断軸、提供者と利用者の切り分け、2026年12月2日までの猶予、行動規範の位置づけまでを一次情報で確認しました。

ルール・リスク管理

生成AIと著作権・法務を学ぶ書籍ガイド|入門から実務まで目的別に選ぶ4冊

生成AIの著作権・法務を学びたい人に向けて、入門・ビジネスのリスク対策・著作権の論点特化・法律実務(発展)という段階で読む本を4冊紹介します。本記事は書籍紹介であり広告を含みます。法的助言ではないため、具体の判断は弁護士等の専門家と公式の一次情報にあたる前提で、最新は各公式でご確認ください。

ルール・リスク管理

AIエージェントのメモリ汚染(sleeper memory poisoning)とは|永続メモリを狙う遅延型攻撃を業務目線で

永続メモリ(long-term memory)を持つLLMエージェントに、外部文書やWebページ経由で偽の「記憶」を書き込ませ、後日の別会話で発火させる「スリーパー型メモリ汚染」を、2026年の研究をもとに冷静に解説します。単一ターンのプロンプトインジェクションとの違い、性能と攻撃面のトレードオフ、運用で取れる防御策を、研究段階の報告値・帰属明示で整理します。