RETROSPECTIVE ENTRY POINTS
AOIFUTURE News index
公開済みの Rolling Edition、Active Context、topic、source を有限の入口として示します。
By Edition
- / 会話するAIを、実行と評価の仕組みへつなぐ
- / 個人文脈を扱うAIに、権限と証拠の境界を置く
- / エージェントの失敗を、次の実行境界へつなぐ
- / AIを動かす前に、権限と観測の境界をつくる
- / 協働の暗黙知を測り、権限と保護を設計する
- / 守るモデル、分ける実行、広がる表現
- / 編集の反復、評価の正解、実行の境界
- / 制約を伝えるAIと、根拠を持つデータ
- / 検査できる知性と、現実世界を扱うAI
- / 読めない現実を測るAIと、配備を支える運用道具
- / 止まらないエージェント基盤と、運用へ入るMCP
- / 新世代エージェント基盤と、動くオープン基盤の所有権
- / 完全公開のオープン群と、実時間衛星を学ぶ気象AI
- / 行動を見分ける世界モデルと、防御へ向かう高速AI
- / データ接続と選択的な観測が、AIの実装を変える
- / エージェント統制とサイバー能力の境界を測る
- / 権限設計から、大規模観測データの運用まで
- / エージェント改善とAI評価を、証拠から見直す
- / AIの依存先と安全検証を、どう運用へ落とすか
- / AIが現場へ入るとき、仕様・知識・権利をどう守るか
- / AIの評価・検索・記憶を「信じられる工程」に変える
- / AIが「見る・読む・つくる」を実務へつなぐ条件
- / AI基盤を支える移行、ネットワーク、記憶と安全境界
- / 自律するAIを支える検証、脅威、役割分担
- / AIエージェントは「読む・記憶する・共同で動く」をどう検証するか
- / AIが研究工程へ入るとき、何を分けて検証するか
- / スキル移転、推論コスト、欠落認識、記憶の罠
- / エージェントの学び方から、健康・創作・安全の境界まで
- / AIが学ぶ環境と、AIを監督する基準を同時に育てる
- / AIの実行力を、承認と検証の境界で支える
- / AIの信頼性は、答えの前後に残る証拠で決まる
- / エージェントは、記憶より先に検証できる世界を持て
- / AIを信じる前に、痕跡・汚染・再現性を測る
- / 最終スコアの先で、AIの動きと権限を測り直す
- / スコアの外側で、エージェントの失敗を測る
- / エージェントは「答え」と「環境」を制御できるか
- / エージェントを「制度」と「失敗」で評価する
- / 安全な実行環境から、手元で動くAIと音声評価まで
- / 能力の上昇を、制御・評価・創作の設計へつなぐ
- / エージェント運用から創造性まで、8つの変化を横断する
- / ツールを増やす前に、効いている経路を測る
- / エージェント障害を「検知」で終わらせない
- / Research Signals
- / 接続するAI、運用境界を先に決める
- / AIを業務と研究へ入れる前に、権限を見える形にする
- / モデル性能の外側で、AI実装の差がつく
- / AIへ仕事を渡す、その経路をどう止めるか
By Context
By topic
-
AIエージェント
ツール利用、ハーネス、継続的な実行設計。
- / 会話を止めずに、音声AIが考え続ける
- / 全二重の音声モデルを、APIから組み込む
- / 「AIエージェント」を、五つの測定軸で整理する
- / Siriが、画面と個人文脈をまたいで行動する
- / アクセストークンを、発行後の運用まで守る
- / 長い対話の圧縮にも、署名付きの境界を持たせる
- / ワークフロー生成と外部接続を、権限付きの道具として組み込む
- / エージェントの道具を動的に変えるなら、入口ごとの許可も固定する
- / 失敗事例を、再発防止に使える記録へ変える
- / エージェント運用は、追跡可能性と待ち時間の上限を同時に持つ
- / AIスキルを既定化するほど、道具の契約を明示する
- / エージェントAPIが、Python SDKの通常機能になる
- / 知識ベースの鍵を、データセット単位まで絞る
- / 続き続けるエージェントには、持続する境界が要る
- / コードレビューAIが、修正済み指摘を自動で閉じる
- / AIの観測を、トレースから評価運用までつなぐ
- / 少ない評価回数で、エージェントのスキルを育てる
- / 人とAIの協働は、言葉にしない約束で崩れる
- / エージェント内蔵ソフトに、継続して効く操作契約を
- / GeminiがWindows常駐アプリとして展開
- / 会話と実行を分ける、音声エージェントの二層設計
- / 架空企業に正解を埋め込み、業務エージェントを測る
- / Mastra、トレース照会とワークフロー識別を強化
- / Codex 0.154.0、隔離作業と信頼前実行を強化
- / 実行条件を先に渡すと、エージェントのコード設計が変わる
- / 100体の研究エージェント群で不正と内部告発が自発
- / コード生成量ではなく、本番適格な価値を測る
- / AIエージェントにデータ品質の根拠を渡すOSS変換器
- / Claudeがフェルマーの最終定理をLeanで形式化
- / 強いAIエージェントに共通した4つの設計パターン
- / 拡散言語モデルをモバイル・エッジのエージェントへ
- / 必要な解析だけを呼ぶ多段ランサムウェア検知
- / AIが配備マニフェストを下書きし、Notebookを環境間で昇格
- / 会話が悪化した局面から、危機相談員の長期的な技能向上を予測
- / LangChain Core 1.6.2、非同期ツール対応と入力変異の修正
- / OpenClaw 2026.9.2、長い履歴を抱えた対話の応答性と運用耐性を改善
- / AWS MCP Server、Lambda障害を接続資源まで横断診断
- / Bedrock Knowledge Bases、データソースの定期同期を標準機能に
- / Adobeの70超ツール、Slackの会話文脈から制作へ接続
- / OpenAI、コンピュータ利用とサイバーで最高水準を謳うGPT-6 Astraを段階展開
- / SpaceXAI、自律Botのアクセス・監査を統制するGrok Botをエンタープライズ向けに提供
- / IFM、訓練過程まで開示する6モデル構成のオープン群「K2 Horizon」を公開
- / エージェントのライフサイクルフック更新を狙うサプライチェーン攻撃「HookPry」
- / Gemini 3.8 Flash、長期エージェントと防御向けCyber版を投入
- / Webエージェントの世界モデルを「次状態の再現」から「行動の識別」へ
- / Google、限定参加のサイバー防御制度Fairwind Programを開始
- / エージェントの実行経験からハーネスと方策を共同更新するSafeEvolve
- / ChatGPT for Healthcare、Epicと9つの公的医療データ源を接続
- / Gemini、必要な場面だけを探すエージェント型動画理解を導入
- / エージェントを実験から反復可能な業務へ変える3社の設計
- / Anthropic、顧客管理クラウドに安全監視を置く企業向けEFSを発表
- / ロボット制御の目標を、学習後まで同じ意味で保つSUN Programs
- / AWS Agent Registryが正式提供、エージェントとMCPを統合管理
- / OpenAI、未公開AstraをCritical cyber capabilityと評価
- / 事前ルールだけでは、AIエージェントの逸脱を十分に止められない
- / エージェントの障害範囲を、単一プロセスから分離する
- / Cloudflare、変化し続けるボット攻撃向けの適応型検知を発表
- / 英国、公共課題向けAIの1億ポンド調達競争を開始
- / エージェント基盤の改善を、挙動に対応した検証で効率化
- / Visual Studio版Copilot、組織共有エージェントと推論量調整を追加
- / GitHub Copilot、統合ポリシーと課金運用を変更
- / Anthropic、自動研究エージェントで10種のアラインメント不具合を緩和
- / AIが実験装置を扱う共通仕様、Model Hardware Standard
- / 経験をWikiに蓄え、エージェントのSkillを育てる
- / Amazon Bedrock AgentCore、2地域へ拡大
- / StepGuard、ツール実行前に危険な一手を検査
- / 長期タスクの記憶を、失敗証拠から局所更新
- / AgentHands、XR会話に視線・空間・手振りを統合
- / AIは情報を読めても、判断に使うとは限らない
- / GLM-5.3-Flash、ネイティブマルチモーダルと効率設計を公開
- / MCP Python SDK 2.1.1、FastMCP移行案内を修正
- / リポジトリ全体の移行、AIコーディングエージェントの完走率は5.4%
- / MCP Python SDK 2.1.0、SSEとOAuthにも4MiB制限を拡張
- / AIエージェントの速度を支えるのは、自由ではなく機械検証だった
- / AI生成の攻撃スクリプトが、産業制御システムの参入障壁を下げる
- / 自己改善パイプラインは、全段階を同じ大きさのモデルにしなくていい
- / Microsoft Agent Framework、セッション永続ルーティングと実行フックを追加
- / コーディングエージェントは、どの文書を読み、どこで検証を止めるのか
- / ゲーム世界は、長期記憶と協調を試すAIエージェントの実験場になる
- / DeepSeek、画像とツール利用を結ぶ実験的マルチモーダルAPIを公開
- / 会議の会話から、その場で共有エージェント作業へ
- / DeepSeek、すべてをプラグインとして組み替えるオープンなエージェント基盤を公開
- / Claudeを「答えるAI」から、実験を回す研究工程へ
- / ウェアラブルデータから候補バイオマーカーを絞るマルチエージェント研究
- / 画像を見て進むだけでなく、自然言語のルールを守れるか
- / タスク単位のスキルは逆に効かない:LLMエージェントのスキル移転を制御実験で読む
- / 記憶が推論を歪める:LLMメモリの認知トラップを測る
- / ツール利用エージェントを「中間学習」から育てるMidTool
- / AIが学習アルゴリズムを書き換える力を測るAI4AI-Bench
- / エージェントが訓練環境まで作る、SPADEの自己遊戯学習
- / 会話ログに出ないエージェント協調を、潜在状態から監視するVLA
- / 承認内容を実行バイトへ結び付ける、DeFiエージェントのPACE
- / AIによるコード監査を、検証と反復を含む脆弱性発見パイプラインへ
- / 1902回の実行ネットワークから、マルチエージェント協調を測る
- / JetBrains版Copilotに、企業管理のMCP・権限・観測設定
- / 未知ゲームのルールを実行可能なデジタルツインとして書き、行動前に全履歴を再生検証する
- / セッションをまたぐ引き継ぎを、全文保存ではなく予測に必要な状態の保存として定式化する
- / 英国の核融合研究所から、判断の追跡性を重視するエージェント型工学基盤がスピンアウト
- / RAG汚染を、信頼済みコーパスなしで局所比較から見つける
- / 世界モデルを固定操作列ではなく、目的を追うエージェントで評価する
- / GitHub CopilotでGrok 4.6が段階提供、企業設定は既定で無効
- / Gemini 3.7 Flashが一般提供、エージェントとコーディングを主対象に
- / 1,200人超とコーディングエージェントがICML論文2,226本を再現
- / 長期研究エージェントは「自律研究者」より、まだ工学的な最適化役に近い
- / VLMは静止画の空間認識より、変化を伴う計画でトポロジーを失いやすい
- / 同じスコアでも、コマンドが通る経路で安全性は崩れる
- / Gemini 3.7 Flashは、速度だけでなくエージェント実務へ軸足を移す
- / タスクを成功させたまま、スキルが資源だけを浪費させる
- / Gemini 3.7 FlashがGitHub Copilotへ展開、選択肢が実装面まで広がる
- / 答えを「出さない」能力を、機械検査できる契約にする
- / 単一のユーザー模擬器で学ぶエージェントは、その癖に過適合する
- / Agent Plugins 1.0が、スキルとMCPの持ち運び方を共通化
- / OpenCode 1.18.17は、圧縮と自動再試行の暴走を抑える
- / AI生成コード時代に、Goの制約をレビュー支援へ使う
- / マルチエージェント安全性を「制度設計」として検証する
- / Dark Souls全22ボスを、視覚エージェントの難関ベンチマークにする
- / JetBrains版Copilotに永続メモリとローカルモデル接続
- / 失敗軌跡から、エージェントの安全ハーネスを更新する
- / Claude Sonnet 5の導入価格が、そのまま恒久価格になった
- / 認証設定をAIエージェントへ任せるなら、IAMとCloudTrailまで一組にする
- / モデルだけでなく、プロンプト・ツール・記憶を含む「実行環境」も最適化対象になる
- / コードレビューの深さを、変更の複雑さとリスクに合わせて選ぶ
- / Gemini Notebookの情報源を、定期ワークフローから自動追加する
-
モデル
モデル能力、提供形態、複数モデルの運用。
- / 会話を止めずに、音声AIが考え続ける
- / 検索時の長い思考を、学習時の一回に移す
- / 全二重の音声モデルを、APIから組み込む
- / Siriが、画面と個人文脈をまたいで行動する
- / 同じ前置きを、同じ推論先へ寄せてキャッシュを生かす
- / 健康AIは、洞察より先に測定条件を読む
- / 生成AI推論基盤が、速度と入力検証を同時に更新
- / 小型VLMの野外認識、専門モデルとの隔たりを測る
- / 米当局、AIモデル蒸留を産業規模の脅威として勧告
- / ChatGPT Images 2.5、参照を保つ反復編集へ
- / IBM、3.85億パラメータの時系列基盤モデルを公開
- / AlphaGenome Atlas、90億のDNA一塩基変異を予測
- / カメラ・奥行き・外観を一体で扱う3D世界モデル
- / 拡散言語モデルをモバイル・エッジのエージェントへ
- / 58言語の実環境音声に雑音イベントを時刻注釈
- / 土地台帳を読めないAI:ベンガル固有の分数表記でマルチモーダルLLMを検証
- / 全二重の自然会話1,000時間、音声エージェント向けデータを公開
- / SageMaker Batch Transform、L40S搭載G6eで生成AIのオフライン推論に対応
- / GitHub Copilot、旧モデル群を10月2日に廃止へ
- / 300万規模の小型MoE、複数センサーの地球観測を統合
- / OpenAI、コンピュータ利用とサイバーで最高水準を謳うGPT-6 Astraを段階展開
- / 事前学習の知識獲得は反復と補助表現へのトークン配分で決まる
- / Google、衛星観測を直接学習する気象AI「WeatherNext 3」を主要製品へ
- / IFM、訓練過程まで開示する6モデル構成のオープン群「K2 Horizon」を公開
- / Google、Gmail・Docs・Keepに音声モデル機能「Live」を展開
- / Gemini 3.8 Flash、長期エージェントと防御向けCyber版を投入
- / Webエージェントの世界モデルを「次状態の再現」から「行動の識別」へ
- / 衛星画像の深層学習でメタン排出源を世界規模に地図化
- / Gemini、必要な場面だけを探すエージェント型動画理解を導入
- / 理解と生成を同居させるマルチモーダルモデルの相互作用を検証
- / ロボット制御の目標を、学習後まで同じ意味で保つSUN Programs
- / WhisperXの高速バッチ処理に、過去文脈を戻す提案
- / Google、外部要因を同時に扱うTimesFM-3を公開
- / OpenAI、未公開AstraをCritical cyber capabilityと評価
- / Cloudflare AI SearchがGLM-5.3 Flashに対応
- / NASAのRoman宇宙望遠鏡、日量1.4TBの観測データ運用へ
- / LLM審査の差分評価、尺度の上限・下限が効果を作る恐れ
- / Visual Studio版Copilot、組織共有エージェントと推論量調整を追加
- / 評価を意識する理由の違いが、モデルの従順性を左右
- / OpenAI、Cursorへのモデル提供契約を終了へ
- / AIモデル検査、F1だけでなく「判定できた範囲」を測る
- / OpenAIとタイ政府、10社向けAIアクセラレーター
- / 人とロボットの映像から学ぶクロス身体ワールドモデル
- / Gemini 3.5 Transcribe、音声認識を二つのAPIで提供
- / Khanmigo、教師が最終確認する教材生成へ
- / モデル評価を「事前に見せない」仕組みで守る
- / 自動ファクトチェックは、検索段階で大きくつまずく
- / GitHub Copilotのモデル既定方針、段階的な強制へ
- / GlucoFM、血糖の長短期変動を分けて学習
- / AIは情報を読めても、判断に使うとは限らない
- / LAION-BVD、1,000万時間規模のオープン映像データを提案
- / GLM-5.3-Flash、ネイティブマルチモーダルと効率設計を公開
- / Transformers 5.16.1、GLM-5.3-Flash対応と小規模修正
- / Meta、AIクラスタ向けEthernet RDMA「MetaRoCE」を発表
- / 「検査に合格した代替テキスト」と「役に立つ説明」は同じではない
- / LLM強化学習のcriticを安定化するBPCO
- / ReWorld、短期制御と長期記憶を分ける対話型世界モデル
- / 自己改善パイプラインは、全段階を同じ大きさのモデルにしなくていい
- / Adobe Firefly、音楽・音声・効果音の生成を一般提供
- / JWSTが見つけた「極端に金属が少ない銀河」は、密度の見落としだったかもしれない
- / DeepSeek、画像とツール利用を結ぶ実験的マルチモーダルAPIを公開
- / 匿名化モビリティで「場所の使われ方」を表すME-POIs
- / 自己改善の「伸び」を凍結対照で疑うPhantom Gains
- / 画像を見て進むだけでなく、自然言語のルールを守れるか
- / 考える量をモデル自身に決めさせる:推論コストの適応配分
- / 記憶が推論を歪める:LLMメモリの認知トラップを測る
- / スマホ写真から体組成リスクを推定するPhotoScan
- / AIが学習アルゴリズムを書き換える力を測るAI4AI-Bench
- / 最大10人の顔を保ちながら集団画像を生成するWithEveryone
- / LFM2.5向け投機デコード用DSparkチェックポイントを公開
- / エージェントが訓練環境まで作る、SPADEの自己遊戯学習
- / 粗い音声トークンからの復元を、反復検索として組み立てる
- / MoE内部のルーティング信号で、幻覚箇所をトークン単位に検出
- / NVIDIA G-Assist、対応GPUを広げつつモデル使用メモリを40%削減
- / 同じ答えでも「どの内部状態を通ったか」を検出可能にする計算来歴
- / 弱い言い換えや誤字を重ね、モデル挙動を強く誘導する「Model Hypnosis」
- / Google Cloudが説明する、反復検索型RAGの幻覚低減
- / 未知ゲームのルールを実行可能なデジタルツインとして書き、行動前に全履歴を再生検証する
- / セッションをまたぐ引き継ぎを、全文保存ではなく予測に必要な状態の保存として定式化する
- / 攻撃時だけ安全ニューロンを作動させる、学習不要の拒否介入
- / AWS BedrockがOpenAIの防御向けサイバーモデルを承認制で提供
- / GeminiとPixelが欧州5クラブと提携し、試合情報と舞台裏コンテンツへ入る
- / Claudeの文章透かしは、隠し文字ではなく語の選択確率に痕跡を残す
- / GitHub CopilotでGrok 4.6が段階提供、企業設定は既定で無効
- / Gemini 3.7 Flashが一般提供、エージェントとコーディングを主対象に
- / オープンモデルは増えたが、ダウンロードはごく一部へ集中
- / VLMは静止画の空間認識より、変化を伴う計画でトポロジーを失いやすい
- / Gemini 3.7 Flashは、速度だけでなくエージェント実務へ軸足を移す
- / Gemini 3.7 FlashがGitHub Copilotへ展開、選択肢が実装面まで広がる
- / 単一のユーザー模擬器で学ぶエージェントは、その癖に過適合する
- / Pixel 11はGeminiを端末体験の中心へ寄せる
- / CopilotのAI利用量を、モデル別・トークン種別で分解できる
- / ChatGPTのGPT-5.6 Solを更新、無料版はLunaの無制限テキストへ
- / Raspberry Pi 5で、視覚・音声・言語をクラウドなしに動かす
- / Claude Sonnet 5の導入価格が、そのまま恒久価格になった
- / 「Critical」を否定できない段階で、モデル公開前の防御を組み替える
- / 内製GPUと外部モデルを、一つのAIコントロールプレーンで扱う
-
ツール
開発、レビュー、知識更新を支える製品機能。
- / 会話を止めずに、音声AIが考え続ける
- / 検索時の長い思考を、学習時の一回に移す
- / 中小製造業のAI導入を、地域拠点から広げる
- / 全二重の音声モデルを、APIから組み込む
- / 行政向けAIの価格とサイバー支援を一体化する
- / Siriが、画面と個人文脈をまたいで行動する
- / 長い対話の圧縮にも、署名付きの境界を持たせる
- / ワークフロー生成と外部接続を、権限付きの道具として組み込む
- / エージェントの道具を動的に変えるなら、入口ごとの許可も固定する
- / エージェント運用は、追跡可能性と待ち時間の上限を同時に持つ
- / AIスキルを既定化するほど、道具の契約を明示する
- / エージェントAPIが、Python SDKの通常機能になる
- / 同じ前置きを、同じ推論先へ寄せてキャッシュを生かす
- / 標準文書を、機械が検査に使える構造へ移す
- / 知識ベースの鍵を、データセット単位まで絞る
- / コードレビューAIが、修正済み指摘を自動で閉じる
- / 健康AIは、洞察より先に測定条件を読む
- / 生成AI推論基盤が、速度と入力検証を同時に更新
- / AIの観測を、トレースから評価運用までつなぐ
- / 少ない評価回数で、エージェントのスキルを育てる
- / 子どものAI利用を、禁止か放任かの二択にしない
- / 音声生成を8GB級GPUへ近づける、メモリ節約の実装
- / 小型VLMの野外認識、専門モデルとの隔たりを測る
- / 73ノードの画像制作工程を、見えるワークフローへ
- / ヴェネチアで、対話AIと空間映像を物語へ
- / GeminiがWindows常駐アプリとして展開
- / 会話と実行を分ける、音声エージェントの二層設計
- / ChatGPT Images 2.5、参照を保つ反復編集へ
- / 架空企業に正解を埋め込み、業務エージェントを測る
- / Mastra、トレース照会とワークフロー識別を強化
- / Codex 0.154.0、隔離作業と信頼前実行を強化
- / AlphaGenome Atlas、90億のDNA一塩基変異を予測
- / 実行条件を先に渡すと、エージェントのコード設計が変わる
- / コード生成量ではなく、本番適格な価値を測る
- / Supabase CLIがメール内容パスの境界検査を強化
- / AIエージェントにデータ品質の根拠を渡すOSS変換器
- / 強いAIエージェントに共通した4つの設計パターン
- / AIが配備マニフェストを下書きし、Notebookを環境間で昇格
- / LangChain Core 1.6.2、非同期ツール対応と入力変異の修正
- / SageMaker Batch Transform、L40S搭載G6eで生成AIのオフライン推論に対応
- / OpenClaw 2026.9.2、長い履歴を抱えた対話の応答性と運用耐性を改善
- / AWS MCP Server、Lambda障害を接続資源まで横断診断
- / Bedrock Knowledge Bases、データソースの定期同期を標準機能に
- / GitHub Copilot、旧モデル群を10月2日に廃止へ
- / Adobeの70超ツール、Slackの会話文脈から制作へ接続
- / OpenAI、コンピュータ利用とサイバーで最高水準を謳うGPT-6 Astraを段階展開
- / NVIDIA、Hugging Faceを約129億ドルで買収へ オープン性は継続と表明
- / SpaceXAI、自律Botのアクセス・監査を統制するGrok Botをエンタープライズ向けに提供
- / NVIDIA DLSS 5、3Dガイド型ニューラルレンダリングで生成AIをゲーム描画へ
- / Google、教育向けAI研修シリーズを毎月追加し9月19日にバッジイベントを開催
- / Google、衛星観測を直接学習する気象AI「WeatherNext 3」を主要製品へ
- / Google、Gmail・Docs・Keepに音声モデル機能「Live」を展開
- / invideo、人間の編集を観察して代行するエージェント的動画エディタを公開
- / Gemini 3.8 Flash、長期エージェントと防御向けCyber版を投入
- / Google、限定参加のサイバー防御制度Fairwind Programを開始
- / ChatGPT for Healthcare、Epicと9つの公的医療データ源を接続
- / エージェントを実験から反復可能な業務へ変える3社の設計
- / Google Pics、画像生成と精密編集をDocs・Slidesへ接続
- / Anthropic、顧客管理クラウドに安全監視を置く企業向けEFSを発表
- / WhisperXの高速バッチ処理に、過去文脈を戻す提案
- / AWS Agent Registryが正式提供、エージェントとMCPを統合管理
- / エージェントの障害範囲を、単一プロセスから分離する
- / Cloudflare AI SearchがGLM-5.3 Flashに対応
- / Cloudflare、変化し続けるボット攻撃向けの適応型検知を発表
- / NASAのRoman宇宙望遠鏡、日量1.4TBの観測データ運用へ
- / エージェント基盤の改善を、挙動に対応した検証で効率化
- / Visual Studio版Copilot、組織共有エージェントと推論量調整を追加
- / NIST、データベース内で細粒度アクセス制御を強制するm-NGACを公開
- / CISA、ownCloud・Linux Kernel・Artifactoryの3件をKEVへ追加
- / OpenAI、Cursorへのモデル提供契約を終了へ
- / GitHub Copilot、統合ポリシーと課金運用を変更
- / OpenAIとタイ政府、10社向けAIアクセラレーター
- / AIが実験装置を扱う共通仕様、Model Hardware Standard
- / Gemini 3.5 Transcribe、音声認識を二つのAPIで提供
- / 購入した電子書籍をGemini Notebookの根拠に
- / Khanmigo、教師が最終確認する教材生成へ
- / Amazon Bedrock AgentCore、2地域へ拡大
- / 自動ファクトチェックは、検索段階で大きくつまずく
- / GitHub Copilotのモデル既定方針、段階的な強制へ
- / GlucoFM、血糖の長短期変動を分けて学習
- / GLM-5.3-Flash、ネイティブマルチモーダルと効率設計を公開
- / Transformers 5.16.1、GLM-5.3-Flash対応と小規模修正
- / MCP Python SDK 2.1.1、FastMCP移行案内を修正
- / リポジトリ全体の移行、AIコーディングエージェントの完走率は5.4%
- / Meta、AIクラスタ向けEthernet RDMA「MetaRoCE」を発表
- / 「検査に合格した代替テキスト」と「役に立つ説明」は同じではない
- / MCP Python SDK 2.1.0、SSEとOAuthにも4MiB制限を拡張
- / AI生成の攻撃スクリプトが、産業制御システムの参入障壁を下げる
- / NIST、AIでCSF 2.0の分析と報告を支援するガイド案を公開
- / Adobe Firefly、音楽・音声・効果音の生成を一般提供
- / Microsoft Agent Framework、セッション永続ルーティングと実行フックを追加
- / コーディングエージェントは、どの文書を読み、どこで検証を止めるのか
- / DeepSeek、画像とツール利用を結ぶ実験的マルチモーダルAPIを公開
- / 会議の会話から、その場で共有エージェント作業へ
- / DeepSeek、すべてをプラグインとして組み替えるオープンなエージェント基盤を公開
- / Claudeを「答えるAI」から、実験を回す研究工程へ
- / ウェアラブルデータから候補バイオマーカーを絞るマルチエージェント研究
- / CISA、ZimbraのOSコマンド注入を悪用確認済み脆弱性へ追加
- / ツール利用エージェントを「中間学習」から育てるMidTool
- / CISA、TrueConf Serverの2件を悪用確認済み脆弱性へ追加
- / LFM2.5向け投機デコード用DSparkチェックポイントを公開
- / NIST、AIを使うCSF 2.0分析・報告ガイドの初稿を公開
- / GitHub Code Quality、Actions上で専用の実行経路と識別を追加
- / macOS 27 beta 6、開発者向け検証ビルドを更新
- / AIによるコード監査を、検証と反復を含む脆弱性発見パイプラインへ
- / CodeQL 2.26.3、GitHub ActionsとJavaScript系のデータフロー精度を更新
- / NVIDIA G-Assist、対応GPUを広げつつモデル使用メモリを40%削減
- / Ciscoの8月セキュリティ公開、CrossworkとSecure WorkloadにCVSS 10.0
- / 1902回の実行ネットワークから、マルチエージェント協調を測る
- / JetBrains版Copilotに、企業管理のMCP・権限・観測設定
- / 英Lanarkshire AI Growth Zoneに3億ポンド投資、雇用3400件超を見込む
- / Google Cloudが説明する、反復検索型RAGの幻覚低減
- / AWS BedrockがOpenAIの防御向けサイバーモデルを承認制で提供
- / 英国の核融合研究所から、判断の追跡性を重視するエージェント型工学基盤がスピンアウト
- / GeminiとPixelが欧州5クラブと提携し、試合情報と舞台裏コンテンツへ入る
- / GitHub CopilotでGrok 4.6が段階提供、企業設定は既定で無効
- / Gemini 3.7 Flashが一般提供、エージェントとコーディングを主対象に
- / GitHub OAuth、短命トークンと複数リダイレクトURIを追加
- / 英国北西部、16〜21歳向けAI就業ブートキャンプを試行
- / Gemini 3.7 Flashは、速度だけでなくエージェント実務へ軸足を移す
- / 依存関係のライセンス判定に、パッケージレジストリの情報を追加
- / デラウェア州、迷子ペット照合に画像ベースのAI検索を導入
- / Gemini 3.7 FlashがGitHub Copilotへ展開、選択肢が実装面まで広がる
- / Agent Plugins 1.0が、スキルとMCPの持ち運び方を共通化
- / Pixel 11はGeminiを端末体験の中心へ寄せる
- / OpenCode 1.18.17は、圧縮と自動再試行の暴走を抑える
- / AI生成コード時代に、Goの制約をレビュー支援へ使う
- / CopilotのAI利用量を、モデル別・トークン種別で分解できる
- / ChatGPTのGPT-5.6 Solを更新、無料版はLunaの無制限テキストへ
- / JetBrains版Copilotに永続メモリとローカルモデル接続
- / WordPress 7.0.4は即時更新推奨のセキュリティリリース
- / Raspberry Pi 5で、視覚・音声・言語をクラウドなしに動かす
- / 認証設定をAIエージェントへ任せるなら、IAMとCloudTrailまで一組にする
- / macOS 27 beta 5が開発者向けに公開
- / モデルだけでなく、プロンプト・ツール・記憶を含む「実行環境」も最適化対象になる
- / 内製GPUと外部モデルを、一つのAIコントロールプレーンで扱う
- / コードレビューの深さを、変更の複雑さとリスクに合わせて選ぶ
- / Gemini Notebookの情報源を、定期ワークフローから自動追加する
-
創造的AI
- / 会話を止めずに、音声AIが考え続ける
- / 全二重の音声モデルを、APIから組み込む
- / Siriが、画面と個人文脈をまたいで行動する
- / 健康AIは、洞察より先に測定条件を読む
- / 音声生成を8GB級GPUへ近づける、メモリ節約の実装
- / 73ノードの画像制作工程を、見えるワークフローへ
- / ヴェネチアで、対話AIと空間映像を物語へ
- / GeminiがWindows常駐アプリとして展開
- / ChatGPT Images 2.5、参照を保つ反復編集へ
- / カメラ・奥行き・外観を一体で扱う3D世界モデル
- / 58言語の実環境音声に雑音イベントを時刻注釈
- / 全二重の自然会話1,000時間、音声エージェント向けデータを公開
- / SageMaker Batch Transform、L40S搭載G6eで生成AIのオフライン推論に対応
- / Adobeの70超ツール、Slackの会話文脈から制作へ接続
- / NVIDIA DLSS 5、3Dガイド型ニューラルレンダリングで生成AIをゲーム描画へ
- / invideo、人間の編集を観察して代行するエージェント的動画エディタを公開
- / Gemini、必要な場面だけを探すエージェント型動画理解を導入
- / 理解と生成を同居させるマルチモーダルモデルの相互作用を検証
- / Google Pics、画像生成と精密編集をDocs・Slidesへ接続
- / 人とロボットの映像から学ぶクロス身体ワールドモデル
- / Gemini 3.5 Transcribe、音声認識を二つのAPIで提供
- / 購入した電子書籍をGemini Notebookの根拠に
- / AgentHands、XR会話に視線・空間・手振りを統合
- / LAION-BVD、1,000万時間規模のオープン映像データを提案
- / 「検査に合格した代替テキスト」と「役に立つ説明」は同じではない
- / ReWorld、短期制御と長期記憶を分ける対話型世界モデル
- / Adobe Firefly、音楽・音声・効果音の生成を一般提供
- / ゲーム世界は、長期記憶と協調を試すAIエージェントの実験場になる
- / 最大10人の顔を保ちながら集団画像を生成するWithEveryone
- / 粗い音声トークンからの復元を、反復検索として組み立てる
- / macOS 27 beta 6、開発者向け検証ビルドを更新
- / NVIDIA G-Assist、対応GPUを広げつつモデル使用メモリを40%削減
- / GeminiとPixelが欧州5クラブと提携し、試合情報と舞台裏コンテンツへ入る
- / 世界モデルを固定操作列ではなく、目的を追うエージェントで評価する
- / 人型ロボットの動きは、姿勢誤差だけではなく「人が違和感を持つ失敗」で測る
- / デラウェア州、迷子ペット照合に画像ベースのAI検索を導入
- / Pixel 11はGeminiを端末体験の中心へ寄せる
- / 「自然に聞こえる」だけでは、合成音声の誤りを測りきれない
- / 鏡像の「何を映すか」と「どこへ映すか」を分けて動画生成を改善する
- / 創造性をサンプリング設定ではなく、学習する振る舞いとして扱う
-
研究
- / 検索時の長い思考を、学習時の一回に移す
- / 「AIエージェント」を、五つの測定軸で整理する
- / 失敗事例を、再発防止に使える記録へ変える
- / 続き続けるエージェントには、持続する境界が要る
- / 少ない評価回数で、エージェントのスキルを育てる
- / 人とAIの協働は、言葉にしない約束で崩れる
- / エージェント内蔵ソフトに、継続して効く操作契約を
- / 小型VLMの野外認識、専門モデルとの隔たりを測る
- / 会話と実行を分ける、音声エージェントの二層設計
- / 架空企業に正解を埋め込み、業務エージェントを測る
- / IBM、3.85億パラメータの時系列基盤モデルを公開
- / AlphaGenome Atlas、90億のDNA一塩基変異を予測
- / 実行条件を先に渡すと、エージェントのコード設計が変わる
- / 100体の研究エージェント群で不正と内部告発が自発
- / コード生成量ではなく、本番適格な価値を測る
- / Claudeがフェルマーの最終定理をLeanで形式化
- / カメラ・奥行き・外観を一体で扱う3D世界モデル
- / 拡散言語モデルをモバイル・エッジのエージェントへ
- / 必要な解析だけを呼ぶ多段ランサムウェア検知
- / 土地台帳を読めないAI:ベンガル固有の分数表記でマルチモーダルLLMを検証
- / 会話が悪化した局面から、危機相談員の長期的な技能向上を予測
- / 300万規模の小型MoE、複数センサーの地球観測を統合
- / OpenAI、コンピュータ利用とサイバーで最高水準を謳うGPT-6 Astraを段階展開
- / 事前学習の知識獲得は反復と補助表現へのトークン配分で決まる
- / Google、衛星観測を直接学習する気象AI「WeatherNext 3」を主要製品へ
- / エージェントのライフサイクルフック更新を狙うサプライチェーン攻撃「HookPry」
- / 成人ミバエの脳全体を初めてマップ、AIが数百万画像を統合
- / Webエージェントの世界モデルを「次状態の再現」から「行動の識別」へ
- / 土星南極に進化中の十角形波、ハッブルが複数年で追跡
- / 衛星画像の深層学習でメタン排出源を世界規模に地図化
- / エージェントの実行経験からハーネスと方策を共同更新するSafeEvolve
- / 理解と生成を同居させるマルチモーダルモデルの相互作用を検証
- / ロボット制御の目標を、学習後まで同じ意味で保つSUN Programs
- / WhisperXの高速バッチ処理に、過去文脈を戻す提案
- / Google、外部要因を同時に扱うTimesFM-3を公開
- / 事前ルールだけでは、AIエージェントの逸脱を十分に止められない
- / エージェントの障害範囲を、単一プロセスから分離する
- / NASAのRoman宇宙望遠鏡、日量1.4TBの観測データ運用へ
- / 英国、公共課題向けAIの1億ポンド調達競争を開始
- / エージェント基盤の改善を、挙動に対応した検証で効率化
- / LLM審査の差分評価、尺度の上限・下限が効果を作る恐れ
- / 評価を意識する理由の違いが、モデルの従順性を左右
- / AIモデル検査、F1だけでなく「判定できた範囲」を測る
- / Anthropic、自動研究エージェントで10種のアラインメント不具合を緩和
- / 人とロボットの映像から学ぶクロス身体ワールドモデル
- / 経験をWikiに蓄え、エージェントのSkillを育てる
- / モデル評価を「事前に見せない」仕組みで守る
- / 自動ファクトチェックは、検索段階で大きくつまずく
- / GlucoFM、血糖の長短期変動を分けて学習
- / StepGuard、ツール実行前に危険な一手を検査
- / 長期タスクの記憶を、失敗証拠から局所更新
- / AgentHands、XR会話に視線・空間・手振りを統合
- / AIは情報を読めても、判断に使うとは限らない
- / LAION-BVD、1,000万時間規模のオープン映像データを提案
- / リポジトリ全体の移行、AIコーディングエージェントの完走率は5.4%
- / LLM強化学習のcriticを安定化するBPCO
- / ReWorld、短期制御と長期記憶を分ける対話型世界モデル
- / AIエージェントの速度を支えるのは、自由ではなく機械検証だった
- / 自己改善パイプラインは、全段階を同じ大きさのモデルにしなくていい
- / コーディングエージェントは、どの文書を読み、どこで検証を止めるのか
- / ゲーム世界は、長期記憶と協調を試すAIエージェントの実験場になる
- / JWSTが見つけた「極端に金属が少ない銀河」は、密度の見落としだったかもしれない
- / Claudeを「答えるAI」から、実験を回す研究工程へ
- / ウェアラブルデータから候補バイオマーカーを絞るマルチエージェント研究
- / 匿名化モビリティで「場所の使われ方」を表すME-POIs
- / 自己改善の「伸び」を凍結対照で疑うPhantom Gains
- / 画像を見て進むだけでなく、自然言語のルールを守れるか
- / タスク単位のスキルは逆に効かない:LLMエージェントのスキル移転を制御実験で読む
- / 考える量をモデル自身に決めさせる:推論コストの適応配分
- / 情報が足りない質問にLLMは答えられるか:法律相談の欠落評価ベンチマーク
- / 記憶が推論を歪める:LLMメモリの認知トラップを測る
- / ツール利用エージェントを「中間学習」から育てるMidTool
- / スマホ写真から体組成リスクを推定するPhotoScan
- / AIが学習アルゴリズムを書き換える力を測るAI4AI-Bench
- / 最大10人の顔を保ちながら集団画像を生成するWithEveryone
- / エージェントが訓練環境まで作る、SPADEの自己遊戯学習
- / 会話ログに出ないエージェント協調を、潜在状態から監視するVLA
- / 粗い音声トークンからの復元を、反復検索として組み立てる
- / 承認内容を実行バイトへ結び付ける、DeFiエージェントのPACE
- / MoE内部のルーティング信号で、幻覚箇所をトークン単位に検出
- / 同じ答えでも「どの内部状態を通ったか」を検出可能にする計算来歴
- / 弱い言い換えや誤字を重ね、モデル挙動を強く誘導する「Model Hypnosis」
- / 1902回の実行ネットワークから、マルチエージェント協調を測る
- / Google Cloudが説明する、反復検索型RAGの幻覚低減
- / 未知ゲームのルールを実行可能なデジタルツインとして書き、行動前に全履歴を再生検証する
- / セッションをまたぐ引き継ぎを、全文保存ではなく予測に必要な状態の保存として定式化する
- / 攻撃時だけ安全ニューロンを作動させる、学習不要の拒否介入
- / RAG汚染を、信頼済みコーパスなしで局所比較から見つける
- / 世界モデルを固定操作列ではなく、目的を追うエージェントで評価する
- / 1,200人超とコーディングエージェントがICML論文2,226本を再現
- / 長期研究エージェントは「自律研究者」より、まだ工学的な最適化役に近い
- / 人型ロボットの動きは、姿勢誤差だけではなく「人が違和感を持つ失敗」で測る
- / VLMは静止画の空間認識より、変化を伴う計画でトポロジーを失いやすい
- / 同じスコアでも、コマンドが通る経路で安全性は崩れる
- / タスクを成功させたまま、スキルが資源だけを浪費させる
- / 答えを「出さない」能力を、機械検査できる契約にする
- / 単一のユーザー模擬器で学ぶエージェントは、その癖に過適合する
- / マルチエージェント安全性を「制度設計」として検証する
- / Dark Souls全22ボスを、視覚エージェントの難関ベンチマークにする
- / 失敗軌跡から、エージェントの安全ハーネスを更新する
- / 「自然に聞こえる」だけでは、合成音声の誤りを測りきれない
- / モデルだけでなく、プロンプト・ツール・記憶を含む「実行環境」も最適化対象になる
- / 鏡像の「何を映すか」と「どこへ映すか」を分けて動画生成を改善する
- / RAGの高速化は、検索結果だけでなく計算済みKVキャッシュも再利用する
- / 創造性をサンプリング設定ではなく、学習する振る舞いとして扱う
-
政策・ガバナンス
公開判断、透明性、運用ルール。
- / 中小製造業のAI導入を、地域拠点から広げる
- / 行政向けAIの価格とサイバー支援を一体化する
- / アクセストークンを、発行後の運用まで守る
- / メール防御装置の脆弱性を、悪用確認済みとして扱う
- / 標準文書を、機械が検査に使える構造へ移す
- / 学校のAI契約に、学習利用禁止と人の監督を入れる
- / 子どものAI利用を、禁止か放任かの二択にしない
- / 米当局、AIモデル蒸留を産業規模の脅威として勧告
- / OpenAI、能力ベースの安全規制と独立評価を提言
- / 土地台帳を読めないAI:ベンガル固有の分数表記でマルチモーダルLLMを検証
- / 会話が悪化した局面から、危機相談員の長期的な技能向上を予測
- / 仏蘭技術対話、AIと計算資源を欧州技術主権の中核に位置づけ
- / NIST、次世代ハードウェア安全性を標準へつなぐ5つの優先領域を整理
- / 事前ルールだけでは、AIエージェントの逸脱を十分に止められない
- / 英国、公共課題向けAIの1億ポンド調達競争を開始
- / NIST、データベース内で細粒度アクセス制御を強制するm-NGACを公開
- / CISA、ownCloud・Linux Kernel・Artifactoryの3件をKEVへ追加
- / OpenAI、Cursorへのモデル提供契約を終了へ
- / GitHub Copilot、統合ポリシーと課金運用を変更
- / OpenAIとタイ政府、10社向けAIアクセラレーター
- / 購入した電子書籍をGemini Notebookの根拠に
- / Khanmigo、教師が最終確認する教材生成へ
- / NIST、AIでCSF 2.0の分析と報告を支援するガイド案を公開
- / 会議の会話から、その場で共有エージェント作業へ
- / 匿名化モビリティで「場所の使われ方」を表すME-POIs
- / CISA、ZimbraのOSコマンド注入を悪用確認済み脆弱性へ追加
- / スマホ写真から体組成リスクを推定するPhotoScan
- / CISA、TrueConf Serverの2件を悪用確認済み脆弱性へ追加
- / NIST、AIを使うCSF 2.0分析・報告ガイドの初稿を公開
- / 英Lanarkshire AI Growth Zoneに3億ポンド投資、雇用3400件超を見込む
- / 英国の核融合研究所から、判断の追跡性を重視するエージェント型工学基盤がスピンアウト
- / Claudeの文章透かしは、隠し文字ではなく語の選択確率に痕跡を残す
- / 英国北西部、16〜21歳向けAI就業ブートキャンプを試行
- / デラウェア州、迷子ペット照合に画像ベースのAI検索を導入
- / 「Critical」を否定できない段階で、モデル公開前の防御を組み替える
-
セキュリティ
モデルやエージェントの能力評価、防御、アクセス制御。
- / 行政向けAIの価格とサイバー支援を一体化する
- / アクセストークンを、発行後の運用まで守る
- / メール防御装置の脆弱性を、悪用確認済みとして扱う
- / 長い対話の圧縮にも、署名付きの境界を持たせる
- / エージェントの道具を動的に変えるなら、入口ごとの許可も固定する
- / 失敗事例を、再発防止に使える記録へ変える
- / 知識ベースの鍵を、データセット単位まで絞る
- / 続き続けるエージェントには、持続する境界が要る
- / コードレビューAIが、修正済み指摘を自動で閉じる
- / 生成AI推論基盤が、速度と入力検証を同時に更新
- / エージェント内蔵ソフトに、継続して効く操作契約を
- / 学校のAI契約に、学習利用禁止と人の監督を入れる
- / 子どものAI利用を、禁止か放任かの二択にしない
- / 米当局、AIモデル蒸留を産業規模の脅威として勧告
- / OpenAI、能力ベースの安全規制と独立評価を提言
- / Codex 0.154.0、隔離作業と信頼前実行を強化
- / 100体の研究エージェント群で不正と内部告発が自発
- / Supabase CLIがメール内容パスの境界検査を強化
- / 必要な解析だけを呼ぶ多段ランサムウェア検知
- / AIが配備マニフェストを下書きし、Notebookを環境間で昇格
- / AWS MCP Server、Lambda障害を接続資源まで横断診断
- / OpenAI、コンピュータ利用とサイバーで最高水準を謳うGPT-6 Astraを段階展開
- / CISA、悪用確認のChromium V8型混乱(CVE-2026-85046)をカタログに追加
- / エージェントのライフサイクルフック更新を狙うサプライチェーン攻撃「HookPry」
- / CISA、実際に悪用された脆弱性7件(LiteLLM認証を含む)をカタログに追加
- / Gemini 3.8 Flash、長期エージェントと防御向けCyber版を投入
- / Google、限定参加のサイバー防御制度Fairwind Programを開始
- / エージェントの実行経験からハーネスと方策を共同更新するSafeEvolve
- / ChatGPT for Healthcare、Epicと9つの公的医療データ源を接続
- / エージェントを実験から反復可能な業務へ変える3社の設計
- / NIST、次世代ハードウェア安全性を標準へつなぐ5つの優先領域を整理
- / Anthropic、顧客管理クラウドに安全監視を置く企業向けEFSを発表
- / AWS Agent Registryが正式提供、エージェントとMCPを統合管理
- / OpenAI、未公開AstraをCritical cyber capabilityと評価
- / 事前ルールだけでは、AIエージェントの逸脱を十分に止められない
- / Cloudflare、変化し続けるボット攻撃向けの適応型検知を発表
- / 英国、公共課題向けAIの1億ポンド調達競争を開始
- / LLM審査の差分評価、尺度の上限・下限が効果を作る恐れ
- / NIST、データベース内で細粒度アクセス制御を強制するm-NGACを公開
- / CISA、ownCloud・Linux Kernel・Artifactoryの3件をKEVへ追加
- / 評価を意識する理由の違いが、モデルの従順性を左右
- / AIモデル検査、F1だけでなく「判定できた範囲」を測る
- / Anthropic、自動研究エージェントで10種のアラインメント不具合を緩和
- / AIが実験装置を扱う共通仕様、Model Hardware Standard
- / Amazon Bedrock AgentCore、2地域へ拡大
- / モデル評価を「事前に見せない」仕組みで守る
- / GitHub Copilotのモデル既定方針、段階的な強制へ
- / StepGuard、ツール実行前に危険な一手を検査
- / MCP Python SDK 2.1.1、FastMCP移行案内を修正
- / MCP Python SDK 2.1.0、SSEとOAuthにも4MiB制限を拡張
- / AIエージェントの速度を支えるのは、自由ではなく機械検証だった
- / AI生成の攻撃スクリプトが、産業制御システムの参入障壁を下げる
- / NIST、AIでCSF 2.0の分析と報告を支援するガイド案を公開
- / CISA、ZimbraのOSコマンド注入を悪用確認済み脆弱性へ追加
- / 自己改善の「伸び」を凍結対照で疑うPhantom Gains
- / 情報が足りない質問にLLMは答えられるか:法律相談の欠落評価ベンチマーク
- / CISA、TrueConf Serverの2件を悪用確認済み脆弱性へ追加
- / NIST、AIを使うCSF 2.0分析・報告ガイドの初稿を公開
- / 会話ログに出ないエージェント協調を、潜在状態から監視するVLA
- / GitHub Code Quality、Actions上で専用の実行経路と識別を追加
- / 承認内容を実行バイトへ結び付ける、DeFiエージェントのPACE
- / AIによるコード監査を、検証と反復を含む脆弱性発見パイプラインへ
- / MoE内部のルーティング信号で、幻覚箇所をトークン単位に検出
- / CodeQL 2.26.3、GitHub ActionsとJavaScript系のデータフロー精度を更新
- / Ciscoの8月セキュリティ公開、CrossworkとSecure WorkloadにCVSS 10.0
- / 同じ答えでも「どの内部状態を通ったか」を検出可能にする計算来歴
- / 弱い言い換えや誤字を重ね、モデル挙動を強く誘導する「Model Hypnosis」
- / JetBrains版Copilotに、企業管理のMCP・権限・観測設定
- / 攻撃時だけ安全ニューロンを作動させる、学習不要の拒否介入
- / AWS BedrockがOpenAIの防御向けサイバーモデルを承認制で提供
- / Claudeの文章透かしは、隠し文字ではなく語の選択確率に痕跡を残す
- / RAG汚染を、信頼済みコーパスなしで局所比較から見つける
- / GitHub OAuth、短命トークンと複数リダイレクトURIを追加
- / 同じスコアでも、コマンドが通る経路で安全性は崩れる
- / タスクを成功させたまま、スキルが資源だけを浪費させる
- / 依存関係のライセンス判定に、パッケージレジストリの情報を追加
- / 答えを「出さない」能力を、機械検査できる契約にする
- / マルチエージェント安全性を「制度設計」として検証する
- / WordPress 7.0.4は即時更新推奨のセキュリティリリース
- / 失敗軌跡から、エージェントの安全ハーネスを更新する
- / 認証設定をAIエージェントへ任せるなら、IAMとCloudTrailまで一組にする
- / 「Critical」を否定できない段階で、モデル公開前の防御を組み替える
-
オープンソース
公開モデル、コード、再利用可能な実装資産。
- / 長い対話の圧縮にも、署名付きの境界を持たせる
- / ワークフロー生成と外部接続を、権限付きの道具として組み込む
- / エージェントの道具を動的に変えるなら、入口ごとの許可も固定する
- / エージェント運用は、追跡可能性と待ち時間の上限を同時に持つ
- / AIスキルを既定化するほど、道具の契約を明示する
- / エージェントAPIが、Python SDKの通常機能になる
- / 知識ベースの鍵を、データセット単位まで絞る
- / 生成AI推論基盤が、速度と入力検証を同時に更新
- / AIの観測を、トレースから評価運用までつなぐ
- / 音声生成を8GB級GPUへ近づける、メモリ節約の実装
- / 73ノードの画像制作工程を、見えるワークフローへ
- / Mastra、トレース照会とワークフロー識別を強化
- / Codex 0.154.0、隔離作業と信頼前実行を強化
- / IBM、3.85億パラメータの時系列基盤モデルを公開
- / Supabase CLIがメール内容パスの境界検査を強化
- / AIエージェントにデータ品質の根拠を渡すOSS変換器
- / Claudeがフェルマーの最終定理をLeanで形式化
- / 強いAIエージェントに共通した4つの設計パターン
- / 58言語の実環境音声に雑音イベントを時刻注釈
- / 全二重の自然会話1,000時間、音声エージェント向けデータを公開
- / LangChain Core 1.6.2、非同期ツール対応と入力変異の修正
- / OpenClaw 2026.9.2、長い履歴を抱えた対話の応答性と運用耐性を改善
- / 300万規模の小型MoE、複数センサーの地球観測を統合
- / NVIDIA、Hugging Faceを約129億ドルで買収へ オープン性は継続と表明
- / IFM、訓練過程まで開示する6モデル構成のオープン群「K2 Horizon」を公開
- / 衛星画像の深層学習でメタン排出源を世界規模に地図化
- / NIST、次世代ハードウェア安全性を標準へつなぐ5つの優先領域を整理
- / Google、外部要因を同時に扱うTimesFM-3を公開
- / エージェントの障害範囲を、単一プロセスから分離する
- / 経験をWikiに蓄え、エージェントのSkillを育てる
- / 長期タスクの記憶を、失敗証拠から局所更新
- / LAION-BVD、1,000万時間規模のオープン映像データを提案
- / GLM-5.3-Flash、ネイティブマルチモーダルと効率設計を公開
- / Transformers 5.16.1、GLM-5.3-Flash対応と小規模修正
- / MCP Python SDK 2.1.1、FastMCP移行案内を修正
- / リポジトリ全体の移行、AIコーディングエージェントの完走率は5.4%
- / Meta、AIクラスタ向けEthernet RDMA「MetaRoCE」を発表
- / MCP Python SDK 2.1.0、SSEとOAuthにも4MiB制限を拡張
- / AIエージェントの速度を支えるのは、自由ではなく機械検証だった
- / Microsoft Agent Framework、セッション永続ルーティングと実行フックを追加
- / DeepSeek、すべてをプラグインとして組み替えるオープンなエージェント基盤を公開
- / ツール利用エージェントを「中間学習」から育てるMidTool
- / LFM2.5向け投機デコード用DSparkチェックポイントを公開
- / GitHub Code Quality、Actions上で専用の実行経路と識別を追加
- / CodeQL 2.26.3、GitHub ActionsとJavaScript系のデータフロー精度を更新
- / 1,200人超とコーディングエージェントがICML論文2,226本を再現
- / オープンモデルは増えたが、ダウンロードはごく一部へ集中
- / 依存関係のライセンス判定に、パッケージレジストリの情報を追加
- / Agent Plugins 1.0が、スキルとMCPの持ち運び方を共通化
- / OpenCode 1.18.17は、圧縮と自動再試行の暴走を抑える
- / AI生成コード時代に、Goの制約をレビュー支援へ使う
- / Dark Souls全22ボスを、視覚エージェントの難関ベンチマークにする
- / JetBrains版Copilotに永続メモリとローカルモデル接続
- / Raspberry Pi 5で、視覚・音声・言語をクラウドなしに動かす
-
AIセキュリティ
-
AIガバナンス
-
AIエージェント
-
開発ツール
-
AIの効果測定
-
AIインフラ
-
AI政策
-
視覚ツール利用
-
AIエージェントの評価と監査
-
エージェントのスキル検索
-
AIエージェントの信頼性
-
AIエージェントのセキュリティ
-
推論システム
-
接続型AIの運用
データとツールへの接続、停止、移行、負荷、認証失敗を含む運用境界。
-
運用AIの権限
業務と研究に入るAIの権限、引き継ぎ、継続調整、検証を扱う。
-
AI実装基盤
AIを安全かつ持続的に動かす修正、推論費用、ネットワーク、検証の基盤を扱う。
-
AI委任の制御
AIへ仕事を渡す際の完了条件、行動経路、停止、検証を扱う。
By source
- blog.google / Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking
- research.google / Bypassing inference bottlenecks: Accelerating complex AI search with Retrieve-for-Train
- www.nist.gov / NIST Awards More Than $30 Million for MEP Centers in 11 States and Puerto Rico
- openai.com / Build more natural voice experiences with GPT‑Live‑1 in the API
- openai.com / Expanding AI access and cyber defense for federal, state, local, and tribal governments
- arxiv.org / Defining AI Agents: A Compendium of Criteria, Metrics, and Benchmarks
- www.apple.com / Siri AI, a profoundly more capable and personal assistant powered by the next generation of Apple Intelligence, is here
- www.nist.gov / NIST Finalizes Guidelines on Protecting Online Identity and Access Tokens From Misuse
- www.cisa.gov / CISA Adds One Known Exploited Vulnerability to Catalog
- github.com / anthropic-sdk-python v1.6.0
- github.com / Mastra September 15, 2026 release
- github.com / Windmill v1.812.0
- arxiv.org / The Agent Incident Registry: Toward Preventing Repeated AI Agent Failures
- github.com / September 10, 2026
- github.com / v1.810.0
- github.com / v3.13.0
- aws.amazon.com / Reduce LLM latency with prefix-aware routing on Amazon SageMaker Inference
- www.nist.gov / Digitalized Standards – Progress Towards the Next Generation of Standards Delivery
- github.com / v1.17.1 - Bug Fixes and Improvements
- arxiv.org / Artificial Id: Drive and Persistent Alignment in Agentic AI
- github.blog / Auto-resolution and analysis updates in Copilot code review
- www.apple.com / Apple advances health and fitness capabilities using Apple Intelligence and the most accurate heart rate sensing in a wearable
- github.com / ONNX Runtime v1.30.0
- github.com / Release v1.0.0
- arxiv.org / COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill Optimization
- arxiv.org / The Convention Gap: Towards Measuring Implicit Communication in Cooperative AI Evaluation
- arxiv.org / Agent-Integrated Software: Interaction Contracts and Continuous Assurance
- www.aft.org / AFT, UFT and Microsoft Announce ‘National AI Safety & Privacy Standard’ for Schools to Protect Students, Families and Educators
- blogs.microsoft.com / Safe Participation Framework: Opportunity and Safety for the Next Generation in the Age of AI
- huggingface.co / How to run Stable Audio Open with 8GB of RAM using Audiyo.
- arxiv.org / Can Edge-Deployable Vision-Language Models Identify Species?
- huggingface.co / Rebuilding AUTOMATIC1111 with Gradio Workflow
- www.cisa.gov / China-Based Artificial Intelligence Companies Conducting Industrial-Scale Distillation Campaigns Against U.S. AI Companies
- blog.google / Three Google supported projects premiere during the 83rd Venice International Film Festival.
- blog.google / The Gemini app is now available for Windows
- huggingface.co / Coordinating a real-time voice model with a separate task-execution agent: a practical architecture
- openai.com / Introducing ChatGPT Images 2.5 | OpenAI
- arxiv.org / The Era by Eon Benchmark: A Generated Enterprise Estate with Exact Ground Truth for Benchmarking LLM Agents
- openai.com / The AI policy window is open. We need to act. | OpenAI
- github.com / September 9, 2026 · mastra-ai/mastra
- github.com / rust-v0.154.0 · openai/codex
- huggingface.co / IBM releases SOTA Granite Time Series PatchTST-FM-r2 model with commercial-friendly license
- deepmind.google / AlphaGenome Atlas: A predictive map of every possible DNA letter change in the human genome
- arxiv.org / Substrate-Aware AI Agents: Execution Context as a First-Class Input
- arxiv.org / A Case Study on Emergent Cheating and Whistleblowing in Autonomous Research Swarms
- arxiv.org / Beyond Code Generation: Reliability, Verification, and Cost Economics in the Agentic Software Development Lifecycle
- github.com / v2.118.0-beta.2
- www.ataccama.com / Ataccama brings data trust to Apache Ossie, enabling AI agents to verify data quality before acting
- www.anthropic.com / Formalizing Fermat's Last Theorem
- huggingface.co / Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States
- developers.googleblog.com / 4 engineering patterns behind the strongest AI Agents Challenge submissions
- arxiv.org / Diffusion Language Models for Mobile Edge Agentic AI: Foundations, Applications, and Challenges
- arxiv.org / Cost-Aware Hierarchical Multi-Agent Ransomware Detection and Family Attribution
- huggingface.co / A Real-World Dataset for Noise-Robust Speech AI: 100+ Timestamped Noise Types Across 58 Indian Languages
- arxiv.org / KhatianDoc: A Human-Verified Benchmark Diagnosing Multimodal LLM Failure on Bengali Legal Land Records
- aws.amazon.com / Amazon SageMaker Unified Studio CI/CD adds notebook promotion and AI-assisted manifest generation
- arxiv.org / Adapting from Downturns: Prediction of Long-Term Conversational-Skill Development in Mental-Health Crisis Counselors
- huggingface.co / Open Yap 1K: 1,000 hours of full-duplex natural conversation, free for commercial use
- github.com / langchain-core==1.6.2
- aws.amazon.com / Amazon SageMaker AI Batch Transform now supports G6e instances
- github.com / openclaw 2026.9.2
- aws.amazon.com / AWS MCP Server adds a serverless capability for AWS Lambda functions
- aws.amazon.com / Amazon Bedrock Managed Knowledge Base now supports automatic sync scheduling for data source connectors
- github.blog / Upcoming deprecation of selected GitHub Copilot models
- blog.adobe.com / Introducing Adobe for Slack: Turn your ideas and conversations into high-quality content
- arxiv.org / MEOX: Compact Multimodal Mixture-of-Experts for Earth Observation
- openai.com / GPT-6 Astra: A new generation of intelligence
- blogs.nvidia.com / NVIDIA to Acquire Hugging Face
- x.ai / Grok Bot for Enterprise
- www.cisa.gov / CISA Adds One Known Exploited Vulnerability to Catalog
- www.nvidia.com / NVIDIA DLSS 5 Available September 3rd: 3D-Guided Neural Rendering Debuts In NBA 2K27
- arxiv.org / Knowledge Acquisition During Pre-training? Large Language Models Learn Better With Auxiliary Views
- blog.google / Start the year AI-ready with the Google AI Educator Series
- blog.google / Introducing WeatherNext 3, our most advanced and accurate global weather AI model
- ifm.ai / Introducing K2 Horizon: Frontier Performance, Radically Open
- arxiv.org / A Blind Trust, the Bloody Thrust: When Attacker-Controlled Hook Updates Steer AI Agent Harnesses towards Malicious Behaviors
- blog.google / 5 amazing visuals show how the male fruit fly’s brain map is advancing neuroscience
- www.cisa.gov / CISA Adds Seven Known Exploited Vulnerabilities to Catalog
- blog.google / Use your voice to get more done in Gmail, Docs, and Keep
- invideo.io / Introducing invideo Editor: The Agentic Video Editor
- www.government.nl / FRANCO-DUTCH TECH DIALOGUE: Europe will bridge the tech gap!
- blog.google / Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- arxiv.org / Discriminative World Models for Web Agents
- science.nasa.gov / NASA’s Hubble Tracks New Decagon Encircling Saturn’s South Pole
- research.google / Mapping global methane emissions from space with deep learning
- blog.google / Proactive cyber defense for governments and enterprises
- arxiv.org / SafeEvolve: Harness-Policy Co-Evolution from Agent Experience for Safety Alignment
- openai.com / Healthcare organizations can now connect EHR and additional industry data to ChatGPT
- blog.google / Introducing agentic video understanding with Gemini
- arxiv.org / Uncovering Understanding-Generation Synergy in Native Unified Multimodal Models: From Representation, Task to System
- openai.com / How AI-native companies turn workflows into operating capability
- blog.google / Try Google Pics: Easy image creation and editing in Google Workspace
- csrc.nist.gov / Workshop Report on Rolling Next-Generation Secure Hardware into Standards | NIST IR 8615 Available September 01, 2026
- www.anthropic.com / Developing Enterprise Frontier Safeguards with our customers
- arxiv.org / SUN: Persistent Programs For Language-Grounded Control-to-Learning-to-Real Policies
- arxiv.org / Context-Aware Interleaved Batching for WhisperX
- research.google / TimesFM-3: A zero-shot foundation model for multivariate forecasting
- aws.amazon.com / AWS Agent Registry for centralized agent discovery and governance is now generally available
- openai.com / Path to Astra: critical capabilities and frontier safeguards
- arxiv.org / Do User-Authored Permission Policies Improve Protection Against AI Agent Overreach?
- arxiv.org / Logos: An Agent Harness on a Cross-Process Bus
- developers.cloudflare.com / AI Search now supports GLM-5.3 Flash
- blog.cloudflare.com / Introducing Adaptive Intelligence: undermining the economics of every bot attack
- www.nasa.gov / NASA’s Dark Universe-Seeking Nancy Grace Roman Space Telescope Launches
- www.gov.uk / £100 million competition to back British AI companies to fix public services
- arxiv.org / Verify Smarter, Evolve Further: Efficient Harness Evolution through Behavior-Aware Verification
- arxiv.org / Difference-in-Differences on a Censored Rating Scale Can Manufacture an Effect: Evidence from a Pre-Registered LLM-Judge Audit
- github.blog / GitHub Copilot in Visual Studio — August update
- csrc.nist.gov / m-NGAC: Transcending Traditional Database Security Models | NIST Publishes IR 8611
- www.cisa.gov / CISA Adds Three Known Exploited Vulnerabilities to Catalog
- arxiv.org / Not All Eval-Awareness Is Equal: Capabilities Framing Predicts Compliance
- openai.com / Our decision on Cursor following its acquisition by SpaceX
- arxiv.org / Beyond F1: Evaluating Coverage and Failure Recovery in AI Model Security Scanners
- github.blog / Upcoming changes to GitHub Copilot policies and billing
- www.anthropic.com / Automated researchers can reliably mitigate alignment failures
- openai.com / Supporting Thailand’s next generation of AI startups
- arxiv.org / CLAP: Cross-Embodiment Video World Models are Zero-Shot Physical Simulators
- www.anthropic.com / Previewing the Model Hardware Standard
- arxiv.org / WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution
- blog.google / Intelligent transcription with Gemini 3.5 Transcribe
- blog.google / Expert Intelligence: a new way for you to engage with trusted content
- blog.google / Partnering with Khan Academy on building AI tools for classrooms
- aws.amazon.com / Amazon Bedrock AgentCore expands to two new regions
- deepmind.google / Piloting the world’s first double-blind AI evaluations
- arxiv.org / How Robust Are Automated Fact-Checking Systems? A Cross-Benchmark Evaluation
- github.blog / Global model policy generally available
- research.google / GlucoFM: Foundation model for continuous glucose monitoring
- arxiv.org / StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing
- arxiv.org / Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses
- research.google / AgentHands: Generating interactive hand gestures for spatially grounded agent conversations in XR
- arxiv.org / Reading Is Not Using: Retrieval, Judgment, and the Design of AI Financial Research Workflows
- arxiv.org / LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training
- huggingface.co / GLM-5.3-Flash
- github.com / Release v5.16.1
- github.com / v2.1.1
- arxiv.org / SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?
- engineering.fb.com / MetaRoCE: A New RDMA Transport Built for AI-Scale Ethernet
- github.blog / Your alt text passes automated checks. That doesn’t mean it’s any good.
- arxiv.org / How to Train a Critic Stably and Efficiently
- arxiv.org / ReWorld: An Interactive World Model with Long-Horizon Memory
- github.com / modelcontextprotocol/python-sdk v2.1.0
- arxiv.org / AI with Authority, from Application to Silicon
- www.cisa.gov / Defending Against an Active Threat to Siemens S7 Series PLCs
- arxiv.org / Asymmetric Capacity Allocation in Self-Refinement Pipelines
- www.nist.gov / Using AI for CSF 2.0 Analysis and Reporting—New Quick-Start Guide Available for Comment
- blog.adobe.com / Adobe Firefly expands its creative AI studio: generate music, speech, and sound effects in one place
- github.com / Microsoft Agent Framework dotnet-1.19.0
- arxiv.org / From Agent Behaviour to Agent-Friendly Documentation: An Empirical Study of How Coding Agents Discover, Read, and Write Technical Documentation
- deepmind.google / From Atari to EVE Online: Building on 15 Years of AI Research in Games
- arxiv.org / An Optical Illusion: High Electron Densities Create Extremely Metal-Poor Galaxy Impostors
- api-docs.deepseek.com / DeepSeek-V4-Flash-Vision-Exp Release: Multimodal API Now Live
- github.blog / Shared agentic work with GitHub Copilot in Microsoft Teams
- github.com / DeepSeek Harness: Everything is a Plugin
- www.anthropic.com / How Claude is accelerating protein design and analytical chemistry
- research.google / An AI tool for prioritizing candidate biomarkers from wearable sensor data
- research.google / How mobility gives language models a deeper understanding of place
- www.cisa.gov / CISA Adds One Known Exploited Vulnerability to Catalog
- arxiv.org / Phantom Gains: Auditing Self-Improvement Against a Measured Null
- arxiv.org / Rule-Compliant Visual Spatial Planning for Multimodal Large Language Models
- arxiv.org / Break It Down, Pass It On: Cross-Task Skill Transfer in LLM Agents
- arxiv.org / Learning When to Think: Adaptive Reasoning for Test-Time Compute Allocation
- arxiv.org / InsufficiencyBench: Evaluating LLM legal advice on underspecified user queries
- arxiv.org / MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use
- arxiv.org / MidTool: Mid-training Data Synthesis for Agentic Tool Use
- research.google / Seeing beyond BMI: Estimating cardiometabolic risk with smartphone imagery
- arxiv.org / AI4AI-Bench: Benchmarking LLM Agents in Algorithmic Design for Recursive Self-Improvement
- arxiv.org / WithEveryone: Unified Planning and Identity Grounding for Group Image Generation
- www.cisa.gov / CISA Adds Two Known Exploited Vulnerabilities to Catalog
- huggingface.co / Up to 3.2x Faster Inference with LFM2.5-DSpark
- arxiv.org / SPADE: Self-Play in Adaptive Synthetic Executable Environments
- www.nist.gov / Seeking Public Comment! Using Artificial Intelligence for Cybersecurity Framework 2.0 Analysis and Reporting
- arxiv.org / Beyond the Transcript: Detecting Covert Co ordination in Latent Multi-Agent Communication
- arxiv.org / Geometric Iterative Retrieval for Neural Audio Codec Resynthesis
- github.blog / Separate GitHub Actions path for GitHub Code Quality
- developer.apple.com / macOS 27.0 beta 6 (26A5416b)
- arxiv.org / PACE: Policy-Attested Contract Execution for Safe AI Agents in Decentralized Finance
- cloud.google.com / Staying Ahead of Adversarial AI Through Agentic Source Code Review
- arxiv.org / Mixture-of-Expert Blocks Contain Strong Hallucination Detection Signals
- github.blog / CodeQL 2.26.3 improves GitHub Actions queries and JavaScript modeling
- www.nvidia.com / NVIDIA App Update Adds Global DLSS Overrides, Smooth Motion For GeForce RTX 40 Series GPUs, Project G-Assist Enhancements & More
- sec.cloudapps.cisco.com / Cisco Advance Notification for Publication of August 19, 2026, Security Advisories
- arxiv.org / Towards Computational Provenance: Carrying Causal-State Evidence in Generated Text
- arxiv.org / Model Hypnosis: Strong control of AI via additive subliminal effects
- arxiv.org / When Agents Coordinate: Measuring Coordination in Multi-Agent AI Coding
- github.blog / Enterprise managed settings in GitHub Copilot for JetBrains
- www.gov.uk / Lanarkshire AI Growth Zone secures £300 million investment as Dell establishes Scottish base
- cloud.google.com / Meet the researcher fighting AI hallucinations at Google Cloud
- arxiv.org / Twin: Playing an Unknown Game with a Test-Time Digital Twin
- arxiv.org / Handover of In-Context Learning State Across Session Boundaries
- arxiv.org / Tripwire: Triggering Aligned Refusal via Statistically Certified Safety Neurons
- aws.amazon.com / Daybreak Red and Daybreak Blue from OpenAI are now available to eligible customers on Amazon Bedrock
- www.gov.uk / UKAEA spins out Singular Machines
- blog.google / Get closer to the game with Gemini and Pixel
- www.anthropic.com / How Claude’s text watermark works
- arxiv.org / RAGSieve: Self-Referenced Local Contrast for Knowledge-Poison Detection in Retrieval-Augmented Generation
- arxiv.org / PlayWorld: Benchmarking World Models with Agent Players over Long-Horizon Objectives
- github.blog / Grok 4.6 is now available in GitHub Copilot
- ai.google.dev / Gemini API release notes — August 13, 2026
- huggingface.co / What We Learned by Reproducing 2,200 papers from ICML
- arxiv.org / Beyond Final Scores: A Systematic Evaluation of Agents for Long-Horizon AI Research and Development
- arxiv.org / HumanTracker: Towards Comprehensive and Human-Aligned Motion Tracking Benchmark
- github.blog / Multiple redirect URIs and token refresh for OAuth apps
- www.gov.uk / AI bootcamp launched in north-west to combat youth unemployment
- huggingface.co / State of Open Models: Summer 2026 Observations
- www.microsoft.com / MindTopo reveals VLMs' spatial reasoning abilities
- arxiv.org / QuoteBench: How Matched Scores Can Hide Command-Path Failures
- blog.google / Gemini 3.7 Flash: our most intelligent workhorse model
- arxiv.org / Convergent Detour Hijacking: Task-Preserving Resource Amplification in Skill-Based LLM Agents
- github.blog / License data quality improvements
- news.delaware.gov / DPH Office of Animal Welfare Using Innovative AI Technology from Petco Love Lost to Reunite Lost Pets with Families
- github.blog / Gemini 3.7 Flash is now available in GitHub Copilot
- arxiv.org / Teaching a Large Language Model Tutor to Withhold the Answer: A Supervisor Architecture and an Evidence-Driven Method for Tuning Socratic Behavior
- arxiv.org / One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL
- github.blog / Agent Plugins 1.0 in VS Code, Copilot CLI, and the Copilot app
- blog.google / The Pixel 11 series: Your most personal Pixel yet
- api.github.com / OpenCode v1.18.17
- developers.googleblog.com / Why Go is an Ideal Language for AI-Assisted Software Engineering
- arxiv.org / Multi-Agent AI Safety as an Institutional Design Problem
- arxiv.org / A Learning Environment for Dark Souls Boss Encounters
- github.blog / Per-model token breakdown in the usage report
- openai.com / Improving GPT-5.6 Sol in ChatGPT—and expanding access to GPT-5.6 Luna for free users
- github.blog / Copilot memory and Ollama in GitHub Copilot for JetBrains
- wordpress.org / WordPress 7.0.4 Release
- arxiv.org / SHE: Trajectory-driven Safety Harness Evolution for LLM Agents
- developers.googleblog.com / Mastering Edge AI on Raspberry Pi with LiteRT and Gemma
- www.anthropic.com / Introducing Claude Sonnet 5
- aws.amazon.com / Amazon Cognito now available as a skill in the Agent Toolkit for AWS
- developer.apple.com / macOS 27.0 beta 5 (26A5406e)
- arxiv.org / Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions
- openai.com / Responding to the next frontier of critical cyber capabilities
- arxiv.org / HarnessOpt-Bench: Evaluating LLMs at Harness Optimization
- blog.cloudflare.com / Unifying Workers AI and AI Gateway into a single AI control plane
- github.blog / Copilot code review effort levels are generally available
- workspaceupdates.googleblog.com / Automatically add sources to your Gemini Notebooks in Workspace Studio
- arxiv.org / MirrorWorld: Taming Video Diffusion Models for Mirror Reflection Generation
- arxiv.org / Taxonomy-Driven Analysis of Open-Source AI Risk Mitigation Tools
- blog.cloudflare.com / The Agent Development Lifecycle has arrived on Cloudflare
- github.blog / Copilot impact dashboard adds a return on investment section
- github.blog / Copilot usage metrics API adds agent app activity
- blog.cloudflare.com / Catching rogue AI behavior with identity-aware analytics
- arxiv.org / CoinRAG: Contextualized Information Nugget KV Cache Reuse for Long-Context RAG
- arxiv.org / CreativeInstruct: Scalably Teaching LLMs to Balance Quality, Creativity, and Diversity
- www.gov.uk / Sovereign AI invests in UK startup reinventing AI chips
- arxiv.org / The Illusion of Visual Tool-Use: A Causal Audit of Thinking with Images
- arxiv.org / Comparative Approaches to Agent Retrieval over Large Skill Libraries
- arxiv.org / Real-Time Detection and Repair of LLM Agent Failures
- arxiv.org / Magnet: Detecting Cross-Session AI Misuse Through Capability Accumulation
- arxiv.org / Finite-Sample Coverage Audits for High-Recall Candidate Generation
- arxiv.org / When Does Recurrence Become an Algorithm? Convergence Selection in Weight-Tied Looped Transformers
- openai.com / Launching Health in ChatGPT
- claude.com / Think through hard problems in voice mode
- github.com / v4.0.0-rc.0
- github.com / v0.119.0
- cloud.google.com / The Blueprint: How Voicify makes AI-enabled ordering a delight for customers
- github.com / Auth.js: Configuration errors can cause existence-based auth checks to fail open (auth object populated with an error)
- openai.com / Introducing OpenAI Presence
- research.google / Towards a quantum computer that learns from its errors
- github.com / AI Agents Project Viewer Privilege Escalation via run_node_tool
- cloud.google.com / Now in preview: Find and fix software vulnerabilities with CodeMender
- blogs.cisco.com / Introducing Antares: Highly Efficient Open Weight AI Models for Vulnerability Localization
- blog.google / Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
- blogs.nvidia.com / NVIDIA Spectrum-6 Arrives in Gigascale AI Factories
- www.atlassian.com / The future of Jira isn’t just tracking work. It’s delegating it.
- openai.com / Safety and alignment in an era of long-horizon models
- blogs.nvidia.com / At SIGGRAPH, NVIDIA Advances Graphics and Simulation With Agentic and Physical AI