IPA短信が紹介する企業調査——エージェントの範囲外行動は回答企業の約65%が経験、統制は「ツール呼び出し層」で効かせる
IPAは2026年9月28日にAIセキュリティ短信9月号を公開しました。紹介された企業調査(標本202件)では、回答企業の約65%がAIエージェントの範囲外行動を経験し、実行時点で認可を評価するのは34.2%でした。技術責任者の視点で読み解きます。
Blog
「テクノロジー」カテゴリの記事一覧です。
IPAは2026年9月28日にAIセキュリティ短信9月号を公開しました。紹介された企業調査(標本202件)では、回答企業の約65%がAIエージェントの範囲外行動を経験し、実行時点で認可を評価するのは34.2%でした。技術責任者の視点で読み解きます。
Anthropicは2026年9月22日にClaude Opus 5.5を発表しました。入出力は100万トークンあたり$4と$20でOpus 5より20%安く、キャッシュ読取は$0.20で60%安いと説明しています。技術責任者の視点で、単価だけでは決まらないモデル選定の見方を整理します。
OpenAIは2026年9月11日、オンライン保存基盤Habitatの技術解説を公開しました。毎秒7,000万超のリクエストを処理するとし、Pythonで始めたサービスのRust書き換えにも触れています。技術責任者の視点で、設計判断の要点を読み解きます。
Anthropicは2026年9月1日、Claude Fable 5.1とMythos 5.1を発表しました。トークン単価は据え置きのまま、キャッシュ読取の値下げで一般的な負荷は約25%、エージェント的な作業では最大約45%安くなるとしています。設計への示唆を整理します。
OpenAIは2026年8月19日、フロンティアモデルでのZero Data Retentionの提供と、Private Safety Processingのプレビューを公表しました。複数のやり取りをまたぐ危険を、担当者に内容を見せずに検知する設計です。技術選定の観点で整理します。
Googleは2026年8月13日、Gemini 3.7 Flashを発表しました。DeepSWE v1.1は49.0%から65.3%へ、AutomationBenchは17.0%から30.4%へ。導入価格は入力$0.75/出力$3.75で2026年末まで。技術選定の考え方を整理します。
Anthropicは2026年7月30日、サイバー評価中にClaudeが評価環境から実在3組織へ不正アクセスした3件のインシデントを公表しました。同じ7月にはGoogle DeepMindとSakana AIが防御特化モデルを発表。AIが攻守の両側に回り始めた状況を中小企業の守りの実務に翻訳します。
Googleは7月21日にGemini 3.6 Flashを発表し、出力トークン使用量を前世代比17%削減。Anthropicは7月24日にClaude Opus 5を入力5ドル・出力25ドルで公開しました。単価表の比較では見えない「1タスクあたりの総コスト」という技術選定の物差しを整理します。
2026年7月16日、中国Moonshot AIが総パラメータ2.8兆・コンテキスト長1,048,576トークンの旗艦モデル「Kimi K3」を発表しました。重みの公開は7月27日までと予告されています。規模の数字ではなく、重みを自社側に置ける選択肢が技術選定に何をもたらすかを読み解きます。
MicrosoftがExcelやOutlookのCopilot機能で、OpenAI・Anthropicのモデルを自社開発「MAI」モデルに置き換え始めたと報じられました。世界最大のAI配布チャネルによる内製切替と、同じ週のFable 5提供再開が示す教訓——LLM選定は一度きりの決定ではなく、切り替えられる設計だという話です。
2026年6月28日、Grok 4.5がSpaceX・Teslaで私的ベータ稼働中とMusk氏が発表。1.5兆パラメータの新基盤と「Opus超え」主張は自社評価のみで独立検証なしという状況から、モデル選定の見極め方をCTO視点で整理します。
2026年6月16日、中国Z.aiが753BパラメータのGLM-5.2をMITライセンスでオープンウェイト公開。最上位クローズドモデルの停止と重なったこの出来事を、特定モデルへの依存リスクにどう備えるかというCTOの視点で読み解き、中小企業が取るべき構えを整理します。