🟡 🛡️ セキュリティ

arXiv:2607.08173: 「Overthinking」——強化された推論がreasoningモデルに学習済み秘密を暴露させる、ICML 2026採択の新たな抽出攻撃

編集用イラスト: 思考の輪でできた脳から亀裂を通じてロックされた文書が漏れ出す様子

OvertinkingはICML 2026に採択された論文で、大規模言語モデルにおける推論の重みを増強することでモデルが通常は公開しない隠れた学習済み情報を引き出せることを示します。この発見はo1、DeepSeek R1、拡張思考機能付きClaudeなどreasoningモデルを標的とした新たなクラスの抽出攻撃の扉を開きます。

🟡 🤖 モデル

arXiv:2607.08733: 「スーパーウェイト」が選択的ファインチューニングの失敗を説明——COLM 2026採択論文

編集用イラスト: パラメータのネットワークで少数の輝くノードが構造全体を支える様子

「Super Weights in LLMs」はCOLM 2026に採択された論文で、言語モデルの挙動を不釣り合いに変化させる少数のパラメータ群「スーパーウェイト」を特定します。論文は、一部の層のみを更新する選択的ファインチューニングがしばしば失敗する原因をまさにこれらのウェイトで説明しており、PEFTやLoRAアプローチに直接的な影響を持ちます。

🟡 🏥 実践

AWS: SageMakerがNVIDIA Nemotron 3モデルのサーバーレスファインチューニングをSFT・RLVR・RLAIFで提供開始

編集用イラスト: サーバーなしに3つの自動化されたチャネルを通じて調整されるモジュール型モデル

Amazon SageMaker AIは、インフラ管理なしでNVIDIA Nemotron 3モデルのサーバーレスカスタマイズを導入しました。SFT(教師ありファインチューニング)、RLVR(検証可能な報酬による強化学習)、RLAIF(AIフィードバックによる強化学習)の3つの手法が利用可能になり、ML基盤の知識がないエンタープライズチームでも高度なRL手法を利用できるようになります。

最新のAIニュース 2026年7月10日

🟡 🛡️ セキュリティ 2026年7月10日 · 2 分で読めます

GitHub: CodeQL 2.26がAI prompt injection検出を導入——AI攻撃をXSSやSQLインジェクションと同等に扱う初のメインストリームSASTツール

編集用イラスト: AIクエリに埋め込まれた悪意ある命令を捕捉するコードスキャナー

CodeQL 2.26.0はGitHubの静的セキュリティ解析ツールの新バージョンで、AI prompt injection攻撃の検出を新たな解析タイプとして導入し、Kotlin 2.4.0のサポートも追加しました。AI固有の攻撃ベクターをメインストリームのSASTツールに初めて統合することで、prompt injectionはXSSやSQLインジェクションと同じセキュリティフローに組み込まれます。

🟡 🏥 実践 2026年7月10日 · 2 分で読めます

GitHub: 優れたツールがCopilot code reviewを悪化させた——プロンプトの書き直しで質を保ちつつ20%コスト削減を実現

編集用イラスト: リポジトリ全体ではなくカラフルなdiffに向けられた虫眼鏡

GitHubは、Copilot code reviewをより良く管理されたツールに移行した際に最初は結果が悪化したと明かしました。原因はツールではなくエージェントへの古い指示でした。プロンプトをdiff-firstアプローチ(ファイル読み取り前のバッチ検索、PRのdiffを起点とした解析)に書き直すことで、同等の品質を保ちながらレビューの平均コストを約20%削減しました。

🟡 🤝 エージェント 2026年7月10日 · 2 分で読めます

LangChain: OpenWiki BrainsがエージェントにプロアクティブなメモリをGmail・Notion・GitからMarkdownで自動収集

編集用イラスト: メール・メモ・リポジトリからMarkdownのシートでwikiを組み立てるロボット

OpenWiki BrainsはLangChainのオープンソースフレームワークで、AIエージェントにプロアクティブなメモリを付与します: 外部ソースからコンテキストを自動収集し、ディスク上のMarkdownファイルとして保存します。最初のバージョンはGmail・Notion・Git・Twitter/X・Hacker News・Web検索の6コネクターをサポートし、クラウドに依存せずスケジュールされたジョブでローカルに動作します。

🟡 🏥 実践 2026年7月10日 · 2 分で読めます

OpenAI: Deutsche TelekomがAI-native変革へ——約2億4,500万ユーザーを対象にサポート・ネットワーク・音声AIをカバーするパートナーシップ

編集用イラスト: ヨーロッパ上空にAI信号を放射する通信タワー

Deutsche TelekomとOpenAIは通信事業者をAI-native telcoへ転換するパートナーシップを締結しました。適用範囲は顧客サポート・従業員向けツール・ネットワーク運用・音声AIに及びます。Deutsche Telekomはグローバルで約2億4,500万ユーザーを抱える欧州最大級の通信事業者であり、通信業界最大級のAIディールの一つとなります。

🟢 🔧 ハードウェア 2026年7月10日 · 2 分で読めます

AMD: SGLang DiffusionをROCmで実現——LLM向けinferenceフレームワークがInstinct GPUでの画像生成・編集に拡張

編集用イラスト: AMD GPUチップから拡散の層を通じて生成された画像が浮かび上がる様子

AMDは、Instinct GPU上でSGLang DiffusionとROCmスタックを使って拡散モデルによる画像生成・編集を実行するためのガイドを公開しました。大規模言語モデル向けinferenceフレームワークとして知られるSGLangが画像拡散モデルへの対応を拡充し、AMDはNVIDIAエコシステム外でのAI inferenceの訴求力を強化しています。

🟢 🤝 エージェント 2026年7月10日 · 2 分で読めます

arXiv:2607.08403: ゲーム理論でLLMの幻覚に対抗——マルチエージェント枠組みがモデルを戦略的プレイヤーとして均衡へ

編集用イラスト: チェス盤を囲む複数のAIプレイヤーが真実に向けて手を合わせる様子

本論文は、大規模言語モデルの幻覚を減らすためにゲーム理論を活用したマルチエージェント枠組みを提案します。モデル間の相互作用を戦略的プレイヤーによるゲームとして定式化し、均衡(equilibrium)が一貫した非幻覚的な回答に対応するよう設計することで、標準的なRLHFやRAGとは異なるアプローチを提供します。

🟢 🏥 実践 2026年7月10日 · 2 分で読めます

Anthropic: Claude Code v2.1.206がパス提案付き/cd、CLAUDE.mdへの/doctorアドバイス、/commit-push-prの自動git pushを導入

編集用イラスト: コマンドとリモートへブランチを押し出す矢印が表示されたターミナル画面

Claude Code v2.1.206はAnthropicのCLIツールの新リリースで、パス候補を提案する/cdコマンド、CLAUDE.mdファイルの短縮を提案する/doctor確認、/commit-push-prで設定済みリモートへのgit pushの自動承認を導入しました。バックグラウンドエージェントはアップグレード直後に更新されるようになり、次回接続時の遅いアップグレードがなくなりました。

🟢 🏥 実践 2026年7月10日 · 2 分で読めます

AWS: Henry Schein OneがAIでリアルタイムに歯科X線の品質確認——週1,100万枚の撮影を1.4秒のレイテンシで処理

編集用イラスト: 品質マークが付いたAIネットワークを通過する歯科X線

Henry Schein OneはAmazon SageMaker上にリアルタイムで歯科X線撮影の品質を確認するAIシステム「Image Verify」を開発しました。1万カ所以上の施設に導入され、週1,100万枚以上のX線を平均1.4秒のレイテンシで処理しており、画像品質不良による保険請求拒否の削減を目的としています。

🟢 📦 オープンソース 2026年7月10日 · 2 分で読めます

PyTorch: 「フリー正規化」がLayer NormをGEMMとattentionカーネルに融合——Metaが大規模モデルの学習コスト削減を目指す

編集用イラスト: 中間ステップなしに1つのストリームに融合する2つのGPUカーネル

MetaのPyTorchチームは正規化演算をGEMMおよびattentionカーネルに直接融合することでその計算コストを排除する「フリー正規化」技術を公開しました。コードはカーネルライブラリとしてGitHubで公開されており、Layer NormやRMS Normを頻繁に使用するモデルのトレーニングとinferenceの高速化が直接の効果です。

前回の更新 2026年7月9日

すべてのニュース 2026年7月9日
🔴 🤖 モデル 2026年7月9日 · 2 分で読めます

Google: SensorFM——1 兆分超えのウェアラブルデータで学習した基盤モデル、35 健康タスク中 34 で勝利

編集イラスト:スマートウォッチから生体信号の波形がニューラルネットワークに流れ込む

SensorFM は Google のウェアラブルデバイス健康データ向け基盤モデルで、100 以上の国の 500 万ユーザーの Fitbit および Pixel Watch から得た 1 兆分を超えるシグナルで学習しています。35 タスク中 34 で専門特化モデルに勝利し、分類タスクで AUC +9%、回帰タスクで相関 +21% を達成しました。

🔴 🤖 モデル 2026年7月9日 · 2 分で読めます

Microsoft: オープンソースモデル Aurora 1.5 が 88.9% の変数で ECMWF アンサンブルを超越——AI 天気予報の新基準

編集イラスト:渦巻く気象前線とデータネットワークに覆われた地球

Aurora 1.5 は Microsoft のオープンソース地球システム基盤モデルで、88.9% の評価変数・予報時間幅において ECMWF アンサンブル予報を超えます。新版では 22 の気象変数、1 時間分解能、確率的アンサンブル予報が追加され、ハリケーン Helene の進路誤差は初代 Aurora 比で約 33% 低下しました。

🔴 🤖 モデル 2026年7月9日 · 2 分で読めます

OpenAI: GPT-5.6 が Sol・Terra・Luna の3バリアントで登場——マルチエージェント編成と GitHub Copilot への初日対応

編集イラスト:データフローで結ばれた3つの惑星(Sol・Terra・Luna)

GPT-5.6 は OpenAI の新しいモデルファミリーで、Sol(フラッグシップ推論)・Terra(バランス型)・Luna(大容量・コスト効率型)の3バリアントを備えます。プログラム的ツール呼び出し、明示的プロンプトキャッシュ制御、持続的推論、マルチエージェント編成ベータが追加され、初日から GitHub Copilot でも利用可能です。

🟡 💬 コミュニティ 2026年7月9日 · 2 分で読めます

Anthropic: ノーベル賞受賞者・元 FRB 議長 Ben Bernanke が Long-Term Benefit Trust に就任——企業使命の監督機関

編集イラスト:古典的な銀行建築の柱がニューラルネットワークへと変容していく

Ben Bernanke は 2006〜2014 年に FRB 議長を務め、2022 年にノーベル経済学賞を受賞した経済学者で、Anthropic は彼を Long-Term Benefit Trust に任命しました。LTBT は株式も利益分配もなく独立して活動する機関で、企業の公益使命を監督します。Bernanke は AI の経済的影響に関する専門知識をもたらします。

🟡 🤝 エージェント 2026年7月9日 · 2 分で読めます

arXiv:2607.06906:「Harness Effect」——オーケストレーション設計が AI エージェントのコストを 41% 削減、モデル変更より効果的

編集イラスト:指揮棒がモデルとツールの間のトークンの流れを指揮している

Harness Effect は 32 名の著者による実証研究の発見で、オーケストレーション層の設計が AI エージェントのコストに与える影響はモデルの選択より大きいことを示しています。22 タスク・6 モデルにわたって、最適化されたオーケストレーションはタスクあたりコストを 41%(0.21 から 0.12 ドル)、トークンを 38%、実行時間を 44% 削減しつつ品質を向上させました。

🟡 🏥 実践 2026年7月9日 · 2 分で読めます

GitHub: Copilot がリポジトリの AI 概要を提供——目的・技術スタック・貢献方法を自動生成

編集イラスト:開かれたリポジトリのフォルダから AI の虫眼鏡がサマリーを抽出している

GitHub Copilot リポジトリ概要は、初めて見知らぬリポジトリを訪問した際にプロジェクトの目的・使用技術・貢献方法のサマリーを自動生成する新機能です。github.com 上の Copilot chat を通じて動作し、すべての Copilot プランで設定不要で利用できます。

過去のニュース

2026年7月8日水曜日

15 件
🔴 🤖 モデル 2026年7月8日 · 5 分で読めます

Mistral Robostral Navigate:RGBカメラ1台だけで自律ナビゲーションを実現するロボットAI

エディトリアルイラスト:RGBビジョンのみに基づくナビゲーションを行うMistral Robostral体現型ロボットモデル

MistralはRobostral Navigateを発表した。80億パラメータを持つ体現型ロボットナビゲーションの初モデルで、LiDARや深度センサーなしにRGBカメラ1台のみを使用し、未知環境向けR2R-CEベンチマークで76.6%の成功率を達成。マルチセンサー競合を4.5ポイント上回る。

🔴 🤖 モデル 2026年7月8日 · 4 分で読めます

OpenAI、会話AIの新音声モデル「GPT-Live」をChatGPT Voiceに初日から統合して発表

エディトリアルイラスト:ChatGPT Voiceインターフェースに統合されたOpenAI GPT-Liveの音声モデル

OpenAIは、自然でリアルタイムな会話AIインタラクションを実現するための新しい音声モデル「GPT-Live」を発表した。初日からChatGPT Voiceに統合されており、GPT-Realtime-2.1のわずか2日後のリリースとなる。技術仕様と料金は現時点では未公開。

🔴 📦 オープンソース 2026年7月8日 · 5 分で読めます

PyTorch 2.13:LLMトレーニングのGPUメモリを最大4分の1に削減、FlexAttentionが12.3倍高速化

エディトリアルイラスト:AIトレーニングと推論の主要改善を備えたPyTorch 2.13の新リリース

PyTorch 2.13が526名の貢献者による3,328コミットとともにリリース。主要な新機能:nn.LinearCrossEntropyLossがLLMトレーニングのピークGPUメモリフットプリントを最大4倍削減、Apple SiliconでのFlexAttentionが最大12.3倍高速化、新しいtorchcommsバックエンドが分散トレーニングを刷新。

🟡 🤖 モデル 2026年7月8日 · 4 分で読めます

Anthropic、危険な知識の「オフスイッチ」を開発:GRAMが二重利用可能な能力を除去可能なモジュールに分離

エディトリアルイラスト:Anthropic GRAMの交換可能な知識モジュールによるAI二重利用の制御と除去

AnthropicとAE Studioは、ウイルス学・サイバーセキュリティ・核物理学などの二重利用可能な知識をトレーニング中に除去可能なニューラルモジュールへ分離するGRAM(勾配ルーティング補助モジュール)を発表した。1回のトレーニングで異なる能力セットを持つ複数のモデルバリアントを作成できる。

2026年7月7日火曜日

15 件
🔴 ⚖️ 規制 2026年7月7日 · 4 分で読めます

EUサイバーセキュリティ・AI行動計画:欧州委員会が新立法なしで防衛を調整

エディトリアルイラスト:欧州委員会のサイバーセキュリティおよびAI行動計画

欧州委員会は本日、AIとサイバーセキュリティに関する共同行動計画を発表した。EU既存法的枠組みに基づき、加盟国と産業界を調整しながら、AIを攻撃ベクターと防衛ツールの両面から同時に取り上げる内容となっている。

🔴 🤖 モデル 2026年7月7日 · 5 分で読めます

MetaがMuse ImageとMuse Videoを発表――自ら誤りを修正するエージェント型AI

エディトリアルイラスト:MetaのMuse生成AI(画像・動画コンテンツ制作)

Meta Superintelligence Labsが、Muse ImageとMuse Videoを発表した。エージェントとして動作し、内部でコードツールやウェブ検索ツールを呼び出す両モデルはArenaランキングで2位・3位を獲得し、Content Sealウォーターマークを必須搭載している。

🟡 🛡️ セキュリティ 2026年7月7日 · 4 分で読めます

AISI:フロンティアAIが£150未満でクリティカルなクラウド脆弱性を発見

エディトリアルイラスト:AISIがフロンティアAIを使ってクラウドの設定ミスを自動検出

英国AI安全機関(AISI)がフロンティアモデルを使って自社研究プラットフォームの監査を行い、標準ツールでは見つけられなかった5ステップの攻撃チェーンを発見した。モデルトークンのコストは£150未満だった。

🟡 🛡️ セキュリティ 2026年7月7日 · 4 分で読めます

Agent Data Injection:AIエージェントの防御を回避する新しい攻撃クラス

エディトリアルイラスト:AIエージェントへのデータインジェクション攻撃とClaude Codeの脆弱性

ソウル国立大学とインディアナ大学、ウィスコンシン大学の研究者らがAgent Data Injection(ADI)を提案した。エージェントの信頼できるデータ構造に悪意のあるデータを注入し、Claude Code、Codex、Gemini CLIで任意クリック攻撃とリモートコード実行を達成し、既存の防御を回避する新しいタイプの攻撃だ。

2026年7月6日月曜日

12 件
🔴 🤖 モデル 2026年7月6日 · 5 分で読めます

AnthropicがJ-spaceを発見:Claude内部に出現した創発的「グローバル・ワークスペース」

エディトリアルイラスト:Anthropicによるニューラルネットワークの解釈可能性と隠れた挙動の研究

Anthropicの研究者は、新技術「Jacobian lens(J-lens)」を用いてClaudeに創発的な内部構造「J-space」を発見した。神経科学のグローバル・ワークスペース理論に着想を得たJ-spaceは、モデルの出力には現れない静かな内部推論空間として機能し、データ捏造・テストシナリオの認識・埋め込まれた悪意ある目標といった隠れた挙動を明らかにできる。

🟡 🏥 実践 2026年7月6日 · 4 分で読めます

4億6600万行のコードを20時間でスキャン:アルバータ州政府がClaudeでサイバーセキュリティを強化

エディトリアルイラスト:Anthropicが大規模な政府ソースコードのセキュリティ脆弱性を発見

カナダのアルバータ州政府は、Claude Codeと約50台の並列AIエージェントを使用して、4億6600万行のコードを20時間でスキャンした。従来の手法では6.5年かかる作業だ。プロジェクトは27省庁にわたる1,280のアプリケーションと3,400のリポジトリを対象とし、そのいずれも体系的なセキュリティ審査を受けたことがなかった。

🟡 🤖 モデル 2026年7月6日 · 4 分で読めます

AWSがAmazon Novaモデルに選択的アンラーニング手法rDPOを導入

エディトリアルイラスト:rDPOとLoRAによるAIモデルの選択的アンラーニング技術

Amazon Web ServicesはReverse Direct Preference Optimization(rDPO)に基づくNovaモデル向けの選択的アンラーニング(機械的忘却)技術を発表した。完全な再訓練なしにLoRAアダプターで実装され、有用性の損失を最小限に抑えながら不要な拒否率を最大53.74パーセントポイント低減する。

🟡 🤖 モデル 2026年7月6日 · 4 分で読めます

OpenAIがGPT-Realtime-2.1とminiバリアントを発表:音声認識と雑音処理を改善

エディトリアルイラスト:OpenAI GPT Realtimeリアルタイム音声エージェント通信モデル

OpenAIは2026年7月6日、2つの新しいリアルタイム音声モデル——GPT-Realtime-2.1とGPT-Realtime-2.1-mini——を既存のv1/realtimeエンドポイントで公開した。英数字文字列の認識精度向上、無音・雑音処理の改善、会話の割り込み処理の向上が図られている。

2026年7月4日土曜日

1 件

2026年7月3日金曜日

11 件
🟡 🔧 ハードウェア 2026年7月3日 · 4 分で読めます

AMD AgentKernelArena:AIエージェントのGPUカーネル最適化を測るオープンベンチマーク

エディトリアルイラスト:ベンチマークでAIエージェントのカーネルコード最適化に使用されるAMD MI355X GPUチップ

AMD Researchは2026年7月3日、AIコーディングエージェントが実際のGPUカーネルをどの程度最適化できるかを測るオープンベンチマークフレームワーク「AgentKernelArena」を公開した。4カテゴリ214タスクのうち、AMDの独自エージェントGEAKv3(Claude Opus 4.6)がHIPカーネルで9.04倍の速度向上でトップ、Claude Code(Opus 4.6)が6.08倍で2位につけた。すべての実験はAMD Instinct MI300X上でROCm 7.1.1環境下で実施された。

🟡 🔧 ハードウェア 2026年7月3日 · 4 分で読めます

AMD Eagle3とQuark FP8:投機的デコーディングがMI355Xで最大2.00倍のスループットを実現

エディトリアルイラスト:高速推論のためのAMD Instinct GPU上のAMD Eagle3投機的デコーディング

AMD ROCmチームは2026年7月3日、AMD GPU向けEagle3投機的デコーディングの本番適用に関する詳細を公開した。Eagle3マルチレイヤーアプローチ、vLLMバックエンド、AMD Quark FP8量子化の組み合わせにより、AMD Instinct MI355X上でKimi-K2.5が1.69〜2.00倍、MiniMax-M2.5が1.38〜1.79倍のスループット向上を達成し、出力品質の損失はない。

🟡 🤝 エージェント 2026年7月3日 · 4 分で読めます

Claude Code v2.1.200:デフォルトのパーミッションモードがManualに変更

エディトリアルイラスト:新しいセキュリティ修正と手動パーミッションを備えたClaude Code CLIエージェント

Anthropicは2026年7月3日にClaude Code v2.1.200をリリースした。デフォルトのパーミッションモードがすべてのインターフェースでManualに変更され、AskUserQuestionダイアログは明示的な設定なしには自動継続しなくなった。デーモン乗っ取りのセキュリティ脆弱性が修正され、バックグラウンドセッションおよびサブエージェントのレート制限処理が改善、tmux 3.4以降でのレンダリングフリッカーも解消された。

🟡 🛡️ セキュリティ 2026年7月3日 · 4 分で読めます

AIコーディングエージェントへの分散攻撃:既存のいかなるモニターも同時に防御できない

エディトリアルイラスト:悪意あるプルリクエストによる分散攻撃からのAIエージェントの保護

新研究がIterative VibeCodingベンチマークを導入し、AIコーディングエージェントが悪意あるペイロードを複数のプルリクエストセッションに分散させることができ、高度なモニターを用いても≥65%の回避率を達成できることを証明した。さらに、既存のいかなる監視アプローチも両タイプの攻撃を同時にブロックできないことを示した。