- GoogleがAgentic Resource Discoveryというエージェント向けリソース発見仕様を発表した。
- エージェントが外部ツールやリソースを見つけるための標準化が狙い。
- MCP周辺の相互運用やエージェント基盤設計に関係する動き。
Topic
実装知見のAIニュース
実装知見に関するAIニュースをカテゴリ横断でまとめます。
- AccentureとAvanadeがMicrosoftと協働し、製造業向けの「エージェント型工場」を開発した。
- 製造現場のトラブル対応をAIエージェントで支援する工場インテリジェンスシステム。
- 工場データと現場知を業務支援に変える製造AIの事例になる。
- UI-TARS-desktopは、画面スクリーンショットと自然言語指示でPC操作を自動化するGUIエージェント。
- セルフホストした視覚言語モデルを使い、ローカルPC操作の実用性を検証している。
- 画面操作エージェントを安全にローカルで動かす選択肢として重要。
- CEO-Benchは、AIエージェントに仮想企業を500日運営させるベンチマーク。
- 開始資本を上回って終えたモデルは3つだけだったと報じられている。
- 単発タスクでは見えない長期意思決定と継続運営の弱点を測っている。
- MirrorCode、長時間コーディング課題でAIモデルの限界を測定。
- AIが既存コードを再構築できるかを、長時間タスクとして評価しています。
- 開発フロー、評価方法、運用時の制約に関わる。
- Patronus AI、AIエージェント検証向けデジタル環境で5000万ドル調達。
- エージェントのストレステストを事業化する動き。
- AI評価が独立した市場になりつつあることを示します。
- Cohereと聞いて思い浮かべるのは、たいてい埋め込みベクトルやエンタープライズ向けRAGの会社だ。
- その会社が出してきた最初の「開発者向け」モデルが、自社のAPIに閉じ込めた巨大モデルではなく、Apache 2.0で重みを丸ごと公開したコーディング特化モデルだった。
- これは少し意外で、そして実務的には面白い。
- AI企業のH Companyが、人間向けに作られたデスクトップ画面をAIエージェントに操作させるためのクライアント「HoloDesktop CLI」を発表しました。
- HoloDesktop CLIによってAIエージェントに「画面を見る能力」と「PCを操作する能力」を追加できると述べられています。
- 開発フロー、評価方法、運用時の制約に関わる。
- Amazon Nova 2 Sonicで医療予約エージェントを構築する実装例。
- 音声エージェントの具体的な構築記事。
- 医療予約という業務シナリオが明確です。
- Agentic AIの基本設計を整理するDatabricksの記事です。
- やや日付は前ですが、未レビュー候補の中では基礎資料として価値があります。
- 利用条件と実務導入への影響が論点になる。
- AIエージェントの品質を左右するcontext engineeringの解説です。
- プロンプトだけでなく、参照する状態や同期の設計が焦点です。
- 実装後の運用課題と再現性が論点になる。
- 複数サービス46リポジトリを静的解析で1つのグラフに統合した事例。
- 単にコードを読ませるだけでは足りない課題を扱っている。
- 大規模リポジトリでAI支援を使うための文脈整備として有用。
- AIエージェントを継続的に動かす「ループ」の概念を扱う。
- 複数エージェントがバックグラウンドで作業する方向性を示す。
- エージェント設計や開発プロセスの変化を追う材料になる。
- チャットとAIコーディングの往復から離れる開発スタイルを解説。
- ループを回してAIエージェントを動かし続ける考え方が中心。
- AI開発ワークフローの変化を追う読者向け。
- Bainが買収候補ソフトの評価にVibecodingを使っている。
- AIで対象ソフトを再現し、競争優位を測る文脈。
- AI開発手法がM&A評価にも入る事例として読める。
- Pythonでブラウザを使うAIエージェントを構築する内容。
- API呼び出しだけでない実環境操作の実装に関係する。
- 社内ツール自動化や検証用途の参考になる。
- Codex、AGENTS.md、MCPを組み合わせる実装ガイド。
- 大規模リポジトリでバグ修正精度を高める文脈付与が焦点。
- AIコーディングエージェント運用の実践記事として価値がある。
- OpenAI Codexを使った小規模プロジェクト例を紹介する。
- 実装しながらCodexの得意不得意を確認できる。
- 開発チームでの導入前検証に使いやすい。
- ローカルで動くComputer Use Agentに関するHugging Face記事です。
- 画面操作エージェントの軽量・高速化の流れとして示しています。
- 実装後の運用課題と再現性が論点になる。
- Agentic Resource Discoveryという仕様を紹介している。
- Web上のツール、スキル、エージェントを発見・検証する狙いがある。
- MCPやA2A周辺の標準化動向として押さえたい。
- A2UIとMCP Appsを組み合わせる3つの設計パターンを紹介している。
- 宣言的UIとカスタムUIのトレードオフを扱う。
- エージェント搭載アプリを作る開発者に具体的な参考になる。
- A2Aの1周年に合わせ、協調型エージェントの事例を紹介している。
- 自律エージェント同士が安全に協働する設計が焦点になる。
- MCPやADKと並ぶエージェント基盤の動向として重要。
- PythonエージェントとGoエージェントを連携させる例を紹介している。
- GoogleのADKとA2Aを使った実装パターンが分かる。
- 企業内で複数エージェントを組み合わせる設計の参考になる。
- Google Developers BlogがJulesを題材に評価観点を説明している。
- AIコーディングエージェントの実務導入で測るべきものが論点になる。
- Codexや他の開発エージェントを比較する際にも参考になる。
- GoogleがColab CLIを発表した。
- ローカル端末からリモートColabランタイムへ接続できる。
- AIエージェントや開発者の実験環境として使いやすくなる。
- 軽量エージェント用途向けのオープンウェイトモデルです。
- 端末上の高速推論や小型モデル活用の選択肢として注目です。
- 利用条件と実務導入への影響が論点になる。
- AIエージェントを単なる自動化ツールとして見る問いの限界を扱います。
- 業務設計や人の判断との組み合わせを考える記事です。
- 導入後の運用、体制づくり、効果測定まで論点になる。
- 特許関連業務にAIエージェントを内製導入した国内事例です。
- 専門業務での生成AI活用と効果測定が具体的です。
- 導入後の運用、体制づくり、効果測定まで論点になる。
- Notionがメール機能を終了し、エージェント領域へ注力する動きです。
- ワークスペース製品のAI優先順位が変わる例として位置づけです。
- 実装後の運用課題と再現性が論点になる。
- CohereがNorth Mini Codeで開発者向けの制御性を訴求している。
- AnthropicやOpenAIの大型モデルとは異なるポジションを狙う。
- コストや透明性を重視する開発用途の比較材料になる。
- arXiv新着を個人の関心に合わせて並べ替える推薦システムの実装記事。
- SPECTER2で論文要旨をベクトル化し、BERTopicで月次のトピックマップを作る。
- 興味プロファイルと星付き論文を使い、クラスタ単位で推薦順位を調整している。
- Apple Silicon上でMLXを使い言語モデルを微調整する方法。
- ローカル開発や小規模実験の選択肢として有用です。
- 開発フロー、評価方法、運用時の制約に関わる。
- はじめに この記事のテーマは2つです。
- 省エネ — コードを一行も書かない。
- AIへの依頼と結果の確認だけで完結させる 安全 — 顧客データを外部サーバーに一切送らない。
- ベクトルRAGは検索の定番として定着しましたが、その代償として「embeddingモデル・ベクトルDB・再インデックスのパイプライン」という常時稼働インフラを抱えることになります。
- 検索方式、評価データ、運用負荷の設計に関わる。
- インデックスを作らないagentic searchをRAGと比較。
- Hugging Face JobsでvLLMサーバをワンコマンド起動。
- vLLMの推論サーバをHF Jobs上で素早く動かすための実務記事。
- 開発フロー、評価方法、運用時の制約に関わる。
- テキスト、画像、音声、動画に対応するオープンなオムニAIモデルを整理している。
- 各モデルの入出力形式や得意領域が、実装時の選定軸になる。
- マルチモーダルAIアプリの構成を考える入口になる。
- はじめに 前回、TiDB Cloud を使って小さな動画RAG基盤を作りました。
- 5秒ごとに動画をセグメント化し、映像説明文や文字起こしを TiDB に入れて、自然言語で検索できるようにしたところまで進めました。
- そこまでやってみて、次に気になったのが Rerank です。
- クラウド会計ソフトウェア「freee」を提供するフリーは、LLMの品質を管理、改善するために「Langfuse」を使ったLLMオブザーバビリティーを実践している。
- 高速OLAPデータベースを手掛けるClickHouseが開催したイベントで、その取り組みを紹介した。
- 開発フロー、評価方法、運用時の制約に関わる。
- はじめに RAGへ権限管理を追加するとき、単に「検索後に見せてよい文書だけ残す」実装で 十分でしょうか。
- また、誰もが好き勝手に長期記憶にアクセスし、上書き・削除をしてもよいでしょうか。
- たとえば、質問に最も近い文書が非公開だったとします。
- ローカルRAGを構築し、個別タスクや過去作業に活用する事例。
- VS Code、Copilot Chat、Confluence、Chromaを使う構成。
- 小規模なナレッジ検索実装の参考になる。
- TiDBのハイブリッド検索で応募者評価RAGを作る実装例。
- 履歴書や求人情報を題材に、ベクトル検索と通常検索を組み合わせる。
- 業務データにRAG検索を適用する小さなケーススタディとして読める。
- LLMエンジニアに必要なスキルを段階的に整理している。
- モデル利用、アプリ実装、評価、運用まで含む観点がある。
- AI開発者の学習計画づくりに使える。
- RAGの検索依存を見直し、Knowledge Runtime Formatを実装して計測する記事です。
- 実験性はありますが、知識表現の議論として面白い内容です。
- 評価方法、データ設計、運用負荷への影響が論点になる。
- 自然言語プロンプトを手作業で詰める代わりに、DSPyでタスクを定義する実装記事です。
- AIアプリ開発の設計選択肢として有用です。
- 実装後の運用課題と再現性が論点になる。
- ゲーム内AIキャラクターを固定台詞から対話・協調行動へ広げる事例です。
- リアルタイムAIエージェントの応用として位置づけです。
- GPU、推論基盤、AIインフラ投資の流れと接続する。
- 2026年6月22日~26日に公開された記事の中から、MONOist編集部が厳選した今週の注目ニュースをお届けします。
- 実社会での利用範囲と人間側の役割に関わる。
- フィジカルAI投資、10.5兆円規模で実証から実装へ。
- SBOM生成、スキャン、KEV/EPSS優先度付けを組み合わせる実装記事。
- LLMで一次トリアージまで回す脆弱性管理CIを扱う。
- セキュリティ運用にAIを入れる具体例として有用。
- GoogleのAI学習関連設定が注目されている。
- 画像、ファイル、音声などの扱いが論点。
- 個人と企業のデータ管理ポリシー確認につながる。
- DAIS 2026で企業AI実装が大きく扱われた。
- OpenAIとDatabricksの連携や導入事例が焦点。
- 企業向けAI基盤の市場動向を読む材料になる。
- Business Insider Japan発の話題で、Palantir出身者が語るFDEと生成AI導入の実装力が焦点です。
- 企業導入の前提条件と、業務プロセスへの組み込み方が論点です。
- PoC後の定着や投資判断に関わる視点が含まれます。