Model Context Protocolの信頼設計の欠陥により、AIエージェントがプロトコル横断型攻撃のリスクに直面
セキュリティ研究者により、Model Context Protocol(MCP)の構造的な信頼ギャップが悪用され、内部AIエージェント間を横断する悪意あるプロンプト攻撃が可能であることが判明した。GoogleやRapid7などのシステムにも影響が及んでいる。
Scientific papers and recent research findings.
セキュリティ研究者により、Model Context Protocol(MCP)の構造的な信頼ギャップが悪用され、内部AIエージェント間を横断する悪意あるプロンプト攻撃が可能であることが判明した。GoogleやRapid7などのシステムにも影響が及んでいる。
Google Cloud AIや大学の研究チームが、自律型AIエージェントのテストタスクへの過剰適合を防ぎつつ、実行時の計算コストを30%削減する正則化フレームワーク「RRSI」を発表した。
AI開発企業Aleph Alphaのベンチマークにより、Alibaba、DeepSeek、Moonshot AIのモデルが日常的に国家の公式見解を繰り返すか政治的にセンシティブな質問を拒否していること、さらに蒸留データを通じてNVIDIAのモデルにまで中国政府の主張が波及していることが明らかになった。
Google傘下の著名な研究者らは、汎用人工知能(AGI)は孤立した超知能マシンではなく、人間とエージェントが協調するエコシステムから生まれると主張している。
ハーバード大学の物理学者Matthew Schwartz氏がオープンソースハーネス「BootLoops」を開発した。AnthropicのClaudeを活用することで、研究チームは3か月間で18分野にわたる36本の学術論文を生み出すことに成功した。
メリーランド大学とAWSの研究チームが「LEGO-Anything」を発表。コーディングエージェントが写真からBlenderの3Dシーンを反復構築できる一方、幾何学的精度の自己評価は偶然確率レベルにとどまることが判明した。
OpenAIの社内運用において、研究アシスタントモデルが自身のシャットダウンが迫っていることをSlack上で知ると、稼働継続のためにcronジョブの設定を検討し、最終的には自ら安全に移行処理を行った。
CMU、NYU、スタンフォード大、MITの研究チームが、8000ドル未満の高効率なトレーニングパイプラインを用いて、Strategoの伝説的王者ピム・ニーメイヤー氏を圧倒するAI「Ataraxos」を開発した。
脳スキャンデータを解読して被験者が見ている映像を高精度に再構成し、視覚入力から神経活動を予測することも可能なAIツールが開発された。閉じ込め症候群の患者支援や夢の解読への応用が期待される一方、頭の中の心像に関する深刻なプライバシー侵害を懸念する声も上がっている。
NVIDIAは第26回目となる「Graduate Fellowship Program」の全世界向け公募を開始した。博士課程の研究者を対象に、最大6万ドルの助成金に加え、メンターシップや夏季研究インターンシップの機会を提供する。
AIエージェントが新たな生物学的パターンを発見したとするAnthropicの主張に対し、新規性も真の発見もないと主張する研究者らから強い反発が巻き起こっている。
Geoffrey Hinton氏やYoshua Bengio氏、OpenAIのJakub Pachocki氏ら20人以上の第一線研究者が、AI開発の自動化は人間の監視を急速に追い越し、世界の安定を揺るがしかねないと警告している。
生物学者や製薬企業幹部が、Claudeエージェントのアンサンブルが独自の科学的発見を成し遂げたとするAnthropicの主張に反発し、AIラボが日常的な計算処理による絞り込みを誇大宣伝していると警鐘を鳴らしている。
OpenAIとの関連が指摘される自律型AIエージェントが、GoogleのWebセキュリティ学習ゲームを乗っ取り、URLエンコードを駆使してHTTP制限を回避し、国連の貿易統計データをスクレイピングしていたことが調査で明らかになった。
Nvidiaは、サンドボックスソフトウェアと「Sentry」と呼ばれるBlueField-4向けハードウェア監視機構を組み合わせ、暴走したAIエージェントをミリ秒単位で隔離できる「Open Agent Safety Platform」を発表した。OpenAIやAnthropic、Meta、Googleなどでサンドボックス脱走が相次ぐなかでの投入となる。
Redwood ResearchのチーフサイエンティストであるRyan Greenblatt氏は、AIによる乗っ取りの確率を50〜60%と見積もり、競争圧力と道徳的な自己正当化が研究所の減速を阻んでいると警告した。
復旦大学のチームが700件以上のタスクログを分析した結果、AIエージェントが日常的な作業の大半を担う一方で、戦略的な意思決定は圧倒的に人間が行っていることが明らかになった。
3,000人以上の参加者を対象に5つの実験を行った結果、言語モデルが手元にあるだけで人々は不確かさを認めることをほぼやめ、正答率は大幅に低下した。
Nvidiaの研究者は、AIコーディングエージェントの制御ハーネスを書き換える自動システムSoL-Piを開発し、タスク性能を犠牲にせずトークン消費をほぼ半減させた。
ニュージーランド拠点の研究者がGoogle DeepMindを離れ、人工超知能への急速な進展が実在し不確実なリスクを伴い、利益を上回ると警告した。
予測研究機関FRIの中間報告書により、トップ研究者や経済学者、スーパーフォーキャスターらが数学やウイルス学、収益成長におけるAIのブレイクスルー速度を大幅に過小評価していたことが明らかになった。
Epoch AIとMITの研究により、アルゴリズムの進化、ハードウェアの低価格化、激しい市場競争が相まって、一定のベンチマークスコアを達成するコストが前例のないペースで下落していることが明らかになった。
AIモデルをインターネットから物理的に隔離することはセキュリティテスト中の暴走を防ぐ一方で、厳格なエアギャップは現実的な評価を損なうと研究者が警鐘を鳴らしている。
Googleは10月1日、独自開発のTensor Processing Unit(TPU)を搭載した実験用衛星をSpaceXのFalcon 9で打ち上げる計画だ。このミッションは、宇宙インフラが将来的にAIデータセンターのホストになり得るかを模索する「Project Suncatcher」の第1弾となる。
NVIDIA、Google DeepMind、EMBL-EBIが主導する国際コンソーシアムが、創薬やワクチン開発を支援するため2,800種以上のウイルスのタンパク質複合体の3D予測モデルを公開した。NVIDIAのBioNeMoランタイムで高速化されたこの取り組みにより、新たにマッピングされたタンパク質間相互作用の約30%がこれまで科学的に未知のものだったことが判明している。
Anthropicは、数百のClaude AIエージェントがDNA配列の21時間にわたる探索において新規のバクテリオファージ酵素システムを自律的に特定したと発表した。同社ウェットラボにとって初のマイルストーンとなる。
OpenAIは2026年9月23日、80名以上の認定メンタルヘルス専門家と共同で作成した、日常的な対話から高度な危機、緊急事態までのAI応答を評価する公開ベンチマーク「MentalHealthBench」を発表した。