2026年8月– date –
-
AIツール
[開発者向け]Microsoft「EvoLib」が示す新しい学習法——AIエージェントは経験をどう知識に変えるか
はじめに Microsoft Researchが2026年7月30日、AIエージェントが自らの経験を再利用可能な知識へと変換し続けるフレームワーク「EvoLib」を発表しました。本稿では、その仕組みと評価結果について解説します。 参考記事 タイトル: EvoLib: Turning exper... -
AI技術
[開発者向け]MicrosoftのEchoverse——AIエージェントを鍛える「深く進化する」訓練環境とは
はじめに Microsoft Researchは2026年7月30日、コンピュータ操作AIエージェントの訓練専用環境「Echoverse」を発表しました。本稿では、12種の仮想環境が9Bモデルの性能をほぼ2倍にした仕組みと、その成果について解説します。 参考記事 タイトル: Echov... -
AIニュース
[ビジネスマン向け]ChatGPT利用データが示す「タスクの越境」——AIは職種の境界をどう変えているのか
はじめに OpenAIは2026年7月27日、米国のChatGPT利用者による80万件以上のメッセージを分析した新レポート「Work at the Frontier」を公表しました。本稿では、AIの活用によって従来の職種の枠を超えた業務(タスク・クロスオーバー)がどの程度、どのよう... -
AI技術
[開発者向け]Google「Gemini Robotics ER 2」登場——動画理解でロボットに時間的知性をもたらす新モデル
はじめに Google DeepMindは2026年7月30日、ロボットの高次推論を担う「身体化推論」モデル「Gemini Robotics ER 2」を発表しました。Gemini Robotics-ER 1.6の後継で、動画理解による進捗把握と複数ロボット協調に対応しています。本稿ではその特徴を解... -
AIニュース
[ニュース解説]OpenAIの次期モデル「Astra」が数学10大難問に挑む——10年以上未解決だった証明の中身
はじめに OpenAIは2026年8月1日、数学と理論計算機科学における10年以上未解決だった10の問題について、新たな結果を得たと発表しました。本稿では、この発表内容をもとに、成果の中身と、AIによる数学研究への向き合い方について解説します。 参考記事 ... -
AI技術
[論文解説]Kimi K3技術報告書を読む——2.8兆パラメータのオープンMoEモデルは何を積み上げたのか
はじめに Moonshot AIのKimi Teamが2026年7月27日、大規模言語モデル「Kimi K3」の技術報告書をarXivで公開しました。総パラメータ2.8兆、文脈長100万トークンのオープンウェイトモデルについて、構成から学習手法、計算基盤、評価までを網羅した文書で... -
AI技術
[開発者向け]Googleが提案する「証拠の連鎖」——AI自律研究の幻覚問題に挑む新フレームワーク
はじめに Google Researchが2026年7月30日、AIによる自律的な科学研究における「幻覚」問題に対応する新フレームワーク「Science One Framework」と、その検証手法「CoE Audit」を発表しました。本稿では、この発表内容をもとに、AIが生成する論文の信頼... -
AIニュース
[開発者向け]AIが生成した「架空パッケージ」を乗っ取る——スロップスクワッティング攻撃の仕組みと防御策
はじめに 開発者のNazar Boyko氏がdev.toで、AIが存在しないパッケージ名を提案し、それを攻撃者が乗っ取る「スロップスクワッティング(Slopsquatting)」について解説しています。本稿では仕組みとnpm・pip・Composer・Goでの違い、実践的な防御策を紹介... -
AIツール
[AIツール利用者向け]xAIが「Build Mode」を発表——チャットで伝えるだけでアプリやゲームをその場で構築
はじめに xAIは2026年7月28日、Grok上で会話するだけでWebサイトやアプリ、ゲームを作成できる新機能「Build Mode」を発表しました。作ったものはリンク一つで誰とでも共有できます。本稿では、この発表内容をもとにBuild Modeの仕組みと想定される活用... -
AIニュース
[ニュース解説]AIの「破局的リスク」トップ5とは——MITと272人の専門家が示した5年以内の脅威
はじめに 海外メディアAxiosが2026年7月27日、MIT FutureTechとオーストラリア・クイーンズランド大学による調査結果を報じました。世界37カ国の272人のAI専門家に24種類のリスクを評価してもらったところ、多くのリスクが「破局的」と呼べる水準の確率...