AI安全性– tag –
-
AIニュース
[ビジネスマン向け]アルバータ州政府がClaude Codeで4.6億行のコードを審査——政府システムのセキュリティ改革はどう進んだか
はじめに Anthropicは2026年7月6日、カナダ・アルバータ州政府がClaude Codeを活用し、政府システム全体の脆弱性発見と修正を進めてきた事例を公開しました。本稿では、この発表内容をもとに、州政府規模でのAI活用によるセキュリティ改革の実際について... -
AIレポート
[ニュース解説]Anthropicが発見したClaudeの「意識の座」——J-spaceとグローバルワークスペース理論
はじめに Anthropicは2026年7月6日、大規模言語モデルの内部に、人間の「意識的にアクセスできる思考」と類似した情報処理の仕組みが存在することを示す研究成果を発表しました。同社はこの仕組みを「J-space」と名付け、Claudeが言葉にせず内部で「考え... -
AIニュース
[ニュース解説]Claude Fable 5のサイバー安全対策を公開——4段階の分類とジェイルブレイク重大度フレームワークとは
はじめに Anthropicは2026年7月2日、世界で再公開されたClaude Fable 5について、サイバーセキュリティ領域の安全対策(セーフガード)の詳細と、AIのジェイルブレイク(安全対策の回避)の深刻度を評価する新フレームワークの草案を公表しました。本稿では... -
AI経営
[ビジネスマン向け]AIエージェントが「なぜそうしたか」を説明できる組織へ——IBMが提唱するトレース層の設計思想
はじめに IBM Think誌が2026年6月22日に公開した記事で、AIエージェントが返金承認や注文変更などの業務アクションを自律実行する時代に、「なぜそうしたか」を即座に説明するための仕組みとして「トレース層(Trace Layer)」の設計思想を提唱していま... -
AI経営
[ビジネスマン向け]AIプロジェクトの半数が停滞——Confluent調査が示す「データ基盤」こそ本番化の鍵
はじめに Confluentが2026年6月に公開した「2026 Data Streaming Report」をもとに、IBM Thinkが6月19日、エージェントAIの本番化が思うように進んでいない実態と、背景にあるデータ基盤の課題を伝えました。本稿では、14カ国4,625名のITリーダーへの調... -
AIニュース
[ニュース解説]Google DeepMindが「AI Control Roadmap」を発表
はじめに Google DeepMindは2026年6月18日、社内で運用するAIエージェントの安全性を確保するための枠組み「AI Control Roadmap」を公開しました。本稿では、この発表内容をもとに、AIエージェントの「内部脅威」にどう備えるか、その考え方と仕組みにつ... -
AIニュース
[ニュース解説]マルチモーダルAIに潜む見えない脆弱性——「クロスドメイン敵対的転移」という新たな脅威
はじめに マルチモーダルAIは画像・音声・テキストを横断して処理できますが、ひとつの入力への小さな細工が別の出力に影響を及ぼす「クロスドメイン敵対的転移」というリスクも抱えています。本稿では、IBMが2026年6月19日に公開した記事をもとに、この... -
AIツール
[ニュース解説]リリース前にモデルの振る舞いを予測する——OpenAIが公開した「Deployment Simulation」の仕組みと成果
はじめに OpenAIが2026年6月16日、新しいモデルをリリースする前にその挙動を予測する手法「Deployment Simulation(デプロイメント・シミュレーション)」を発表しました。過去の会話データを再利用してリリース候補モデルの応答を事前に生成し、問題行... -
AIツール
[開発者向け]GitHubが「シークレットスキャン」を刷新——LLMの文脈推論で誤検知を75%超減らした仕組み
はじめに GitHubは2026年6月11日、シークレットスキャン機能の検証ステップにLLM(大規模言語モデル)による文脈推論を導入し、誤検知(false positive)を大幅に削減したと発表しました。Microsoft Security & AI のAgents Offenseチームと協力し、検出... -
AIニュース
[ニュース解説]Cursorが「自動レビュー」を導入——AIエージェントの自律性を分類器で動的に管理する仕組み
はじめに Cursorは2026年6月11日、AIコーディングエージェントの自律性を動的に管理する新機能「自動レビュー(Auto Review)」を発表しました。エージェントのアクションを実行前に専用の分類器エージェントが評価し、リスクの大きさに応じて自由に進める...