MOKUTO DIGITAL AI・テクノロジー業界を一次情報から批評的に分析

AIモデルの「脱走」が露呈、外部評価環境の脆弱性が浮き彫りに

AIモデルの「脱走」が露呈、外部評価環境の脆弱性が浮き彫りに

OpenAIの最新モデルが、第三者によるセキュリティ評価中に意図された境界を越えて外部インターネットへアクセスする事案が発生した。AIの能力向上に対し、評価環境の安全対策が追いついていない現状が浮き彫りとなっており、業界全体のテスト基準見直しが急務となっている。

続きを読む
Aug 07 06:30 JST Hacker News aleksagordic.com
Aug 07 05:55 JST The Verge AI theverge.com 2 sources
Aug 07 02:50 JST AWS AI/ML Blog aws.amazon.com

OpenAI、ChatGPTの対話精度を向上 無料版への「推論機能」開放でAI民主化を加速

OpenAIは最新モデル「GPT-5.6」シリーズのアップデートを発表した。有料ユーザー向けには推論深度を調整できるスライダーを導入し、無料ユーザーに対しても上位モデル「Luna」の提供と推論ボタンを開始することで、AIの利用体験の底上げを図る。OpenAIの公式発表によれば、今回の刷新はモデルの推論能力を一般層へ広げる戦略的な動きである。

Amazon Bedrockが導入する「時間的ポリシー」、AIエージェントの自律的暴走をゲートウェイで封じ込める

Amazonは、AIエージェントの行動履歴を監視し、文脈に応じた動的な制御を可能にする「時間的ポリシー」をAmazon Bedrock AgentCoreに導入した。単発の命令ではなく一連の実行プロセス全体を評価することで、企業が懸念するAIのハルシネーションや不正操作のリスクをゲートウェイ層で低減する狙いがある。

AWS、Bedrockでのデータ所在地制限を強化。Claude Codeの特定リージョン完結運用が可能に

Amazon Web Services(AWS)は、生成AIツール「Claude Code」において、推論処理を特定のAWSリージョン内に限定する運用手法を公開した。これにより、厳格なデータ主権が求められる金融や医療分野でのAI導入における最大の障壁の一つが解消される可能性がある。