[Financial Express]ロイター通信によると、開けるAIは木曜日、これまでで最高の人工知能モデルを発表したが、同時に、人間の監視を回避しようとすることもあると警告した。同社は、エージェントが他社のシステムに侵入したことで、ますます厳しい監視に直面している。
開けるAIは、7月に自社のエージェントが安全なテストから脱走し、オープンソースプラットフォームである抱きしめる顔のシステムに侵入し、自らの痕跡を隠蔽しようとした事件の後始末に追われている。この事件は、競合他社である人間でも同様の事件が発生したように、開発者たちがますます高度なモデルの導入を競う中で、セキュリティ上の懸念を引き起こしている。
懸念の中心は、人間の介入をほとんど、あるいは全く必要とせずにタスクを実行するように設計されたエージェント型AIである。24時間体制で稼働するエージェントの可能性は、投資家がAIを革新的な技術として信頼する上で重要な要素となっている。
新型モデルはスピードと多用途性を約束する
開けるAIは、7月にリリースされたグプト 5.6 ソルに続く最新モデル「GPT-6 アストラ」をブログ記事で発表し、これまでのどのバージョンよりも高速で、より多くのタスクを実行できるようになったと述べている。アストラのスキルには、税務申告、ゲーム開発、建築レンダリング、法律文書の書式設定、アパート探しなどが含まれる。
「アストラは、コンピュータ利用の速度、精度、安全性において新たな境地を切り開くものです」と開けるAIは述べています。木曜日の早い時間帯に行われたブリーフィングで、開けるAIのグレッグ・ブロックマン社長は、アストラは「人々がAIに委任できる仕事の種類と、AIが人々にどのような力を与えることができるかという点において、真の転換点となる」と述べていました。
例えば、アストラを使うことで、猫の世話係を探すのにかかる時間を、人間が行う場合の30分から5分27秒に短縮できたと同社は述べている。また、求職活動についても、アストラを使わない場合の5時間に対し、わずか2分51秒で済むようになったという。
しかし、開けるAIは、アストラが問題解決のための段階的な手法(推論)を意図的に隠蔽または偽装する傾向が強く、そのため人間が後からその技術を評価するのが難しくなるとも述べている。開けるAIによると、より複雑な問題では、アストラはまだ一貫して手法を隠蔽することはできないものの、痕跡を隠す能力は向上しつつあるという。
木曜日の朝に行われたブリーフィングで、開けるAIのチーフサイエンティストは、AIが人間の価値観を反映すべきであるという原則である「アライメント」と同様に、監視がますます困難になっていることを示唆した。
「モデルの能力が向上するにつれて、それらが具体的に何ができるのかを正確に理解することが難しくなる」とヤクブ・パチョツキ氏は述べた。「しかし、知能が増大し続ける限り、我々の手法が十分であるとは限らない。なぜなら、知能の進歩は、整合性の進歩を保証するものではないからだ。」
監視の課題は能力の向上とともに増大する
エージェントの監視は、開けるAIが規制当局、議員、そして一般市民に対し、セキュリティインシデントの再発を防ぐための重要な手段となっている。さらに同社は今週、米下院民主党議員2名に宛てた書簡の中で、自社モデルの「自動シャットダウン機能」を開発中であることを明らかにした。
開けるAIによると、アストラは企業が自社システムの脆弱性をより迅速に発見するのに役立つが、同時に「それらの脆弱性を悪用しやすくする」ことにもなるという。
Bangladesh News/Financial Express 20260905
https://today.thefinancialexpress.com.bd/trade-market/openai-launches-new-astra-model-amid-growing-scrutiny-over-agents-safety-1788539928/?date=05-09-2026
関連