今日のニュース

カテゴリをまたいで、最初に確認しやすいものを並べています。

Gemma 4の技術報告がarXivに公開
arXiv cs.CL
  • Gemma 4は新世代のオープンウェイトモデルとして紹介されています。
  • 2.3Bから31Bパラメータまでの構成が示されています。
  • 視覚・音声エンコーダやMoE構成も論点です。
さらに見る
Tencent、MoE型オープンモデルHy3を公開
The Decoder
  • TencentがMoE型のオープン言語モデルHy3を公開した。
  • 少ない有効パラメータで大型モデル級の性能をうたう。
  • 中国発オープンモデルの競争力を測る材料になる。
モデル・LLM オープンモデル
GoogleのAI基盤拡大で電力使用量が37%増加
Ars Technica AI
  • Ars Technica発の話題で、データセンター電力が焦点です。
  • 推論基盤、半導体、クラウドコストへの影響が論点です。
  • AI需要を支える計算資源と供給制約の読み解きに関わります。
インフラ・半導体 データセンター電力
Apple、Transformer向け解釈可能なFeed-Forward Memoryを研究
Apple Machine Learning Research
  • Apple ML Research発の話題で、解釈可能メモリが焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、記憶、評価といった基盤テーマの理解に関わります。
モデル・LLM 解釈可能メモリ
AWS構成で試すHippoRAGとグラフ型検索拡張生成
AWS Machine Learning Blog
  • aws_machine_learning発の話題で、Graph RAGが焦点です。
  • RAG・ナレッジ活用の観点で、発表内容や導入場面を整理できます。
  • Graph RAGの設計、導入順序、社内ルール作りに反映しやすい論点です。
RAG・実装 Graph RAG AWS RAG
国産LLM Sarashina3が日本語能力を強化
ITmedia AI+
  • ITmedia AI+発の話題で、国産LLM Sarashina3が日本語能力を強化が焦点です。
  • 製品提供の範囲と、利用者が触れるAI体験の変化が論点です。
  • 製品選定や日常利用の基準が更新される可能性があります。
モデル・LLM 日本語LLM
LLMはフィードバックで本当に改善しているのか
arXiv cs.AI
  • arxiv_cs_ai発の話題で、フィードバック活用が焦点です。
  • 研究・論文の観点で、発表内容や導入場面を整理できます。
  • フィードバック活用の設計、導入順序、社内ルール作りに反映しやすい論点です。
モデル・LLM フィードバック活用
2026年版LLMルーター設計のベストプラクティス
Redis Blog
  • redis_blog発の話題で、LLMルーティングが焦点です。
  • AIモデル・LLMの観点で、発表内容や導入場面を整理できます。
  • LLMルーティングの設計、導入順序、社内ルール作りに反映しやすい論点です。
モデル・LLM LLMルーティング
Claude Sonnet 5がAWSで利用可能に
AWS Machine Learning Blog
  • AWS発の話題で、Claude Sonnet 5がAWSで利用可能にが焦点です。
  • 製品提供の範囲と、利用者が触れるAI体験の変化が論点です。
  • 製品選定や日常利用の基準が更新される可能性があります。
モデル・LLM モデル提供 Claude AWS
BedrockとLLMゲートウェイのレジリエンス設計
AWS Machine Learning Blog
  • AWS発の話題で、BedrockとLLMゲートウェイのレジリエンス設計が焦点です。
  • 推論基盤、半導体、クラウドコストへの影響が論点です。
  • AI需要を支える計算資源と供給制約の読み解きに関わります。
インフラ・半導体 LLMゲートウェイ AWS
Googleが表データ向けゼロショット基盤モデルTabFMを紹介
Google Research Blog
  • Google Research発の話題で、Googleが表データ向けゼロショット基盤モデルTabFMを紹介が焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、評価、専門領域AIの理解に関わります。
モデル・LLM 表データAI
再帰的に自己進化するエージェント研究
arXiv cs.AI
  • arxiv_cs_ai発の話題で、再帰的に自己進化するエージェント研究が焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、評価、専門領域AIの理解に関わります。
モデル・LLM 自己進化エージェント
Noetraが国産マルチモーダルAI開発へ始動
ITmedia AI+
  • ITmedia AI+発の話題で、Noetraが国産マルチモーダルAI開発へ始動が焦点です。
  • 企業導入の前提条件と、業務プロセスへの組み込み方が論点です。
  • PoC後の定着や投資判断に関わる視点が含まれます。
エージェント・開発 国産基盤モデル
OpenAIがGeneBench-Proを発表
OpenAI News
  • OpenAI発の話題で、OpenAIがGeneBench-Proを発表が焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、評価、専門領域AIの理解に関わります。
モデル・LLM ゲノムAI評価 OpenAI
バイブコーディング時代のセキュリティ急所を整理
CodeZine
  • 生成AIコードでSQLインジェクションや無認証APIなどのリスクが蓄積する問題を整理している。
  • AIで開発速度が上がる一方、レビューとセキュリティ設計の重要性が増している。
  • プロンプトインジェクションなど、AI時代の開発チームが見るべき急所が並ぶ。
HPEとAMD、AIエージェント時代の自社データセンター回帰を提示
ITmedia エンタープライズ
  • HPEは、AIエージェント普及でトークン消費と推論コストが膨らむ問題を示した。
  • 外部モデル依存による隠れたコストを避けるため、自社データセンター回帰を論じている。
  • AMDの事例と合わせ、推論基盤をどこに置くかがインフラ戦略になっている。
Allganize RAG Leaderboard JAを設問タイプ別に再集計
Zenn LLM
  • Allganize RAG Leaderboard JAの公開データを設問タイプ別に再集計している。
  • 300問の設問タイプ、構成ごとの正誤、回答テキストの特徴を比較している。
  • RAG評価で総合スコアだけでは見えない得手不得手を分解している。
RAGASとGitHub ActionsでRAG評価基盤を自動化
Zenn RAG
  • RAGASとGitHub ActionsでRAGアプリの評価基盤を作る実装記事。
  • ハルシネーションやコンテキスト不適切さなど、RAG特有の品質課題を自動検証する。
  • CIに評価を組み込み、RAG品質を継続改善する構成が中心。
ソフトバンク、国内AIデータセンター誘致へ電力確保を重視
ITmedia AI+
  • ソフトバンクグループ株主総会で、会長兼社長の孫正義氏が、将来的な目標として「純資産価値1000兆円」の展望を語った。
  • AIインフラの最大のボトルネックである「電力確保」を巡り、子会社のソフトバンクが東京電力の次期オーナー候補に名乗りを上げている事実にも言及した。
  • 最先端データセンターを日本へ呼び戻そうとするインフラ戦略に迫る。
RAG・Agentの本番運用を学ぶ実践ガイド
Zenn LLM
  • RAG・Agentを実装した後に必要な「本番で使えるシステムにする」技術を体系的に学ぶハンズオンガイドです。
  • Evals・Observability・Security・MLOps・Fine-tuningをpgvectorとGeminiを使って手を動かしながら学べます。
  • 検索方式、評価データ、運用負荷の設計に関わる。
中国のClaude APIプロキシ市場、低価格利用とリスクを報告
GIGAZINE
  • Anthropicは中国をClaudeの提供地域から除外していますが、中国では海外のAPIプロキシ「中转站」を介し。
  • 利用者は個人開発者や学生、企業、再販業者に及び、この市場は単なるアクセス回避策にとどまらず、データ収集や不正取引とも結び付く供給網を形成しています。
  • 安全性、権限、制度対応の設計に関わる。
インデックスを作らないagentic searchをRAGと比較
Zenn RAG
  • ベクトルRAGは検索の定番として定着しましたが、その代償として「embeddingモデル・ベクトルDB・再インデックスのパイプライン」という常時稼働インフラを抱えることになります。
  • 検索方式、評価データ、運用負荷の設計に関わる。
  • インデックスを作らないagentic searchをRAGと比較。
メインフレーム離脱、生成AI過大評価で7割超が失敗との予測
ITmedia エンタープライズ
  • Gartnerは、生成AIの能力過大評価により、2026年開始のメインフレーム離脱案件の7割超が狙いを達せず、2030年までに関連ベンダーの75%が転換か撤退に迫られると予測した。
  • 市場の期待修正が進み、万能型移行策の需要減も見込む転換期だという。
  • 企業導入、費用対効果、組織内での定着に関わる。
HoloDesktop CLI、既存アプリを画面操作するAIエージェント連携を提供
GIGAZINE
  • AI企業のH Companyが、人間向けに作られたデスクトップ画面をAIエージェントに操作させるためのクライアント「HoloDesktop CLI」を発表しました。
  • HoloDesktop CLIによってAIエージェントに「画面を見る能力」と「PCを操作する能力」を追加できると述べられています。
  • 開発フロー、評価方法、運用時の制約に関わる。
日立と九州大学病院、血液疾患診断を支援するAI技術を開発
MONOist
  • 日立製作所と九州大学病院は、血液悪性腫瘍の診断に用いるフローサイトメトリー検査において、医師の鑑別診断を支援する機械学習型のAI技術を開発した。
  • 複数疾患の同時分類において、識別性能を示す指標AUCで0.9以上の性能を確認した。
  • 実社会での利用範囲と人間側の役割に関わる。
Microsoft、Windows脆弱性探索に100超のAIエージェントを活用
@IT
  • Microsoftはマルチモデルエージェント型セキュリティシステム「MDASH」の取り組みについて解説した。
  • Microsoftのセキュリティエンジニアリングチームが活用しており、Windowsの未知の重大な脆弱性発見に貢献しているという。
  • 安全性、権限、制度対応の設計に関わる。
Google、Gemini 3.5 FlashにComputer Useを標準搭載
ITmedia AI+
  • これまで専用モデルでのみ提供していた機能を主力モデルに統合したもので、開発者はWebブラウザやモバイル、デスクトップ環境で動作するエージェントを構築できる。
  • モデル選定、提供条件、開発者利用に影響する。
  • Google、Gemini 3.5 FlashにComputer Useを標準搭載。
freee、Langfuse基盤でLLM品質観測を実践
@IT
  • クラウド会計ソフトウェア「freee」を提供するフリーは、LLMの品質を管理、改善するために「Langfuse」を使ったLLMオブザーバビリティーを実践している。
  • 高速OLAPデータベースを手掛けるClickHouseが開催したイベントで、その取り組みを紹介した。
  • 開発フロー、評価方法、運用時の制約に関わる。
富士通、GPU効率を高めるLLMアーキテクチャPHOTONを開発
ITmedia AI+
  • 富士通が、大規模言語モデル(LLM)を少ないGPUで動かせる新アーキテクチャ「PHOTON」(フォトン)を開発した。
  • GPU当たりの処理性能(スループット)が、現在のLLMで主流のアーキテクチャ「Transformer」の最大475倍に達するという。
  • LLMの運用に必要なGPUを抑え、大幅なコスト削減につなげられるとしている。
Microsoft、AIブラウジングエージェントをRCEに至らせるAutoJackを解説
Microsoft Security Blog
  • MicrosoftがAutoJackというAIブラウジングエージェントの攻撃連鎖を解説した。
  • 悪意あるWebページがホスト側のリモートコード実行につながる可能性を示す。
  • ブラウザ操作エージェントを作る開発者は権限分離とサンドボックス設計を確認すべき。
AIエージェントのアクセス制御を実践的に整理
Redis Blog
  • AIエージェントが社内データを扱う際のアクセス制御に関する実践ガイドです。
  • RAGやベクトル検索の権限設計に関心がある読者向けです。
  • 評価方法、データ設計、運用負荷への影響が論点になる。
Google、Gemini CLIをAntigravity CLIへ移行
Google Developers Blog
  • GoogleがGemini CLIをAntigravity CLIへ移行すると説明している。
  • 複雑なマルチエージェントワークフロー向けのagent-first platformへ寄せている。
  • 既存のGemini CLI利用者は移行方針を確認する必要がある。

エージェント・開発

新しいものから追えます。

さらに見る
モデル名ベタ書きを避ける実行時モデルルーティング入門
Zenn OpenAI
  • モデル名をコードに固定すると、AIエージェント運用の負債になると整理している。
  • LindyのClaude離脱やOpenRouterのMCPサーバを背景に、実行時モデルルーティングを解説している。
  • コスト、性能、用途に応じてモデルを切り替える設計が実務課題になっている。
CohereのApache 2.0コーディングMoE、North Mini Codeを解説
Zenn LLM
  • Cohereと聞いて思い浮かべるのは、たいてい埋め込みベクトルやエンタープライズ向けRAGの会社だ。
  • その会社が出してきた最初の「開発者向け」モデルが、自社のAPIに閉じ込めた巨大モデルではなく、Apache 2.0で重みを丸ごと公開したコーディング特化モデルだった。
  • これは少し意外で、そして実務的には面白い。
HoloDesktop CLI、既存アプリを画面操作するAIエージェント連携を提供
GIGAZINE
  • AI企業のH Companyが、人間向けに作られたデスクトップ画面をAIエージェントに操作させるためのクライアント「HoloDesktop CLI」を発表しました。
  • HoloDesktop CLIによってAIエージェントに「画面を見る能力」と「PCを操作する能力」を追加できると述べられています。
  • 開発フロー、評価方法、運用時の制約に関わる。
OpenAI Agents SDKのSandbox Agentsを解説
Zenn OpenAI
  • エージェントにシェルを握らせると、たいてい二つの不安が同時に来る。
  • ひとつは「rm -rf を打たれたら困る」という安全面。
  • もうひとつは「20分かけてパッケージを入れて中間ファイルを作った作業が、プロセスが落ちた瞬間に消える」という継続性の問題だ。
Google、Gemini 3.5 FlashにComputer Useを標準搭載
ITmedia AI+
  • これまで専用モデルでのみ提供していた機能を主力モデルに統合したもので、開発者はWebブラウザやモバイル、デスクトップ環境で動作するエージェントを構築できる。
  • モデル選定、提供条件、開発者利用に影響する。
  • Google、Gemini 3.5 FlashにComputer Useを標準搭載。
Google、Gemini CLIをAntigravity CLIへ移行
Google Developers Blog
  • GoogleがGemini CLIをAntigravity CLIへ移行すると説明している。
  • 複雑なマルチエージェントワークフロー向けのagent-first platformへ寄せている。
  • 既存のGemini CLI利用者は移行方針を確認する必要がある。
XがAIツール向けMCPサーバーを提供
TechCrunch AI
  • TechCrunch発の話題で、XがAIツール向けMCPサーバーを提供が焦点です。
  • 開発現場での実装手順、評価、運用負荷の変化が論点です。
  • 実装者が設計やツール選定を見直すきっかけになります。
CursorがiOSからエージェント起動に対応
CodeZine
  • CodeZine発の話題で、CursorがiOSからエージェント起動に対応が焦点です。
  • 開発現場での実装手順、評価、運用負荷の変化が論点です。
  • 実装者が設計やツール選定を見直すきっかけになります。
エージェント・開発 モバイル開発AI Cursor
Noetraが国産マルチモーダルAI開発へ始動
ITmedia AI+
  • ITmedia AI+発の話題で、Noetraが国産マルチモーダルAI開発へ始動が焦点です。
  • 企業導入の前提条件と、業務プロセスへの組み込み方が論点です。
  • PoC後の定着や投資判断に関わる視点が含まれます。
エージェント・開発 国産基盤モデル

モデル・LLM

新しいものから追えます。

Gemma 4の技術報告がarXivに公開
arXiv cs.CL
  • Gemma 4は新世代のオープンウェイトモデルとして紹介されています。
  • 2.3Bから31Bパラメータまでの構成が示されています。
  • 視覚・音声エンコーダやMoE構成も論点です。
トップAIモデルの優位期間が短期化
The Decoder
  • GPT-4は約1年にわたり能力指標の首位だったとされています。
  • 近年は首位モデルが数週間単位で入れ替わっています。
  • モデル採用では継続的な比較が必要になります。
モデル・LLM モデル競争 OpenAI
Geminiの思考機能、無料ユーザーにも開放
ライフハッカー・ジャパン
  • Geminiのじっくり考える機能が無料ユーザーにも開放された。
  • 即答より推論時間をかけたい質問での使い方が論点になる。
  • 個人利用者にも高度な推論設定が広がる動きとして見られる。
Google AIモードの「情報エージェント」を検証
ライフハッカー・ジャパン
  • Google I/O 2026で発表されたAI Modeの新機能「情報エージェント」の実力を徹底検証。
  • 特定のニュースを自動追跡する革新ツールの設定手順と注意点を解説します。
  • リアルタイム速報の課題から見えてきた、本当に実用的な「毎日の要約」活用法とは?
さらに見る
Tencent、MoE型オープンモデルHy3を公開
The Decoder
  • TencentがMoE型のオープン言語モデルHy3を公開した。
  • 少ない有効パラメータで大型モデル級の性能をうたう。
  • 中国発オープンモデルの競争力を測る材料になる。
モデル・LLM オープンモデル
潜在空間を使ったモデル制御と信頼性研究
arXiv cs.CL
  • arXiv発の話題で、モデル制御が焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、記憶、評価といった基盤テーマの理解に関わります。
モデル・LLM モデル制御
Apple、Transformer向け解釈可能なFeed-Forward Memoryを研究
Apple Machine Learning Research
  • Apple ML Research発の話題で、解釈可能メモリが焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、記憶、評価といった基盤テーマの理解に関わります。
モデル・LLM 解釈可能メモリ
Amazon Bedrock向けオープンソースModel Profiler
AWS Machine Learning Blog
  • aws_machine_learning発の話題で、モデル選定が焦点です。
  • AIモデル・LLMの観点で、発表内容や導入場面を整理できます。
  • モデル選定の設計、導入順序、社内ルール作りに反映しやすい論点です。
モデル・LLM モデル選定 AWS
LLMの似通った回答を崩すスタートアップの挑戦
MIT Technology Review AI
  • mit_tech_review_ai発の話題で、LLMの集団思考が焦点です。
  • AIモデル・LLMの観点で、発表内容や導入場面を整理できます。
  • LLMの集団思考の設計、導入順序、社内ルール作りに反映しやすい論点です。
モデル・LLM LLMの集団思考
国産LLM Sarashina3が日本語能力を強化
ITmedia AI+
  • ITmedia AI+発の話題で、国産LLM Sarashina3が日本語能力を強化が焦点です。
  • 製品提供の範囲と、利用者が触れるAI体験の変化が論点です。
  • 製品選定や日常利用の基準が更新される可能性があります。
モデル・LLM 日本語LLM
LLMはフィードバックで本当に改善しているのか
arXiv cs.AI
  • arxiv_cs_ai発の話題で、フィードバック活用が焦点です。
  • 研究・論文の観点で、発表内容や導入場面を整理できます。
  • フィードバック活用の設計、導入順序、社内ルール作りに反映しやすい論点です。
モデル・LLM フィードバック活用
2026年版LLMルーター設計のベストプラクティス
Redis Blog
  • redis_blog発の話題で、LLMルーティングが焦点です。
  • AIモデル・LLMの観点で、発表内容や導入場面を整理できます。
  • LLMルーティングの設計、導入順序、社内ルール作りに反映しやすい論点です。
モデル・LLM LLMルーティング
Claude Sonnet 5がAWSで利用可能に
AWS Machine Learning Blog
  • AWS発の話題で、Claude Sonnet 5がAWSで利用可能にが焦点です。
  • 製品提供の範囲と、利用者が触れるAI体験の変化が論点です。
  • 製品選定や日常利用の基準が更新される可能性があります。
モデル・LLM モデル提供 Claude AWS
Googleが表データ向けゼロショット基盤モデルTabFMを紹介
Google Research Blog
  • Google Research発の話題で、Googleが表データ向けゼロショット基盤モデルTabFMを紹介が焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、評価、専門領域AIの理解に関わります。
モデル・LLM 表データAI
再帰的に自己進化するエージェント研究
arXiv cs.AI
  • arxiv_cs_ai発の話題で、再帰的に自己進化するエージェント研究が焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、評価、専門領域AIの理解に関わります。
モデル・LLM 自己進化エージェント
OpenAIがGeneBench-Proを発表
OpenAI News
  • OpenAI発の話題で、OpenAIがGeneBench-Proを発表が焦点です。
  • 研究テーマの位置づけと、次のモデル設計へのつながりが論点です。
  • エージェント、評価、専門領域AIの理解に関わります。
モデル・LLM ゲノムAI評価 OpenAI

生成AI

新しいものから追えます。

Solos、カメラなし軽量AIスマートグラスを発表
The Verge AI
  • 新しいAirGo A6は約19グラムの軽量モデルです。
  • カメラを省き、音声操作のAIアシスタントに寄せています。
  • 消費者向けAIデバイスの選択肢が広がっています。
生成AI AIスマートグラス
Hugging FaceとCerebrasがGemma 4のリアルタイム音声AIを提供
Hugging Face Blog
  • huggingface_blog発の話題で、リアルタイム音声AIが焦点です。
  • 画像・動画・音声生成の観点で、発表内容や導入場面を整理できます。
  • リアルタイム音声AIの設計、導入順序、社内ルール作りに反映しやすい論点です。
生成AI リアルタイム音声AI 音声AI

RAG・実装

新しいものから追えます。

SPECTER2とBERTopicで作る個人用arXiv推薦
Zenn LLM
  • arXiv新着を個人の関心に合わせて並べ替える推薦システムの実装記事。
  • SPECTER2で論文要旨をベクトル化し、BERTopicで月次のトピックマップを作る。
  • 興味プロファイルと星付き論文を使い、クラスタ単位で推薦順位を調整している。
Allganize RAG Leaderboard JAを設問タイプ別に再集計
Zenn LLM
  • Allganize RAG Leaderboard JAの公開データを設問タイプ別に再集計している。
  • 300問の設問タイプ、構成ごとの正誤、回答テキストの特徴を比較している。
  • RAG評価で総合スコアだけでは見えない得手不得手を分解している。
RAGは検索システムではなく知識運用として設計する
Zenn RAG
  • RAGは初期構築より、更新され続けるデータで検索品質を保つことが難しいと整理している。
  • Difyで自前RAGを組んだ後のデータ更新と品質維持が主題。
  • RAGを検索システムではなく知識運用として設計する必要性を示している。
RAGASとGitHub ActionsでRAG評価基盤を自動化
Zenn RAG
  • RAGASとGitHub ActionsでRAGアプリの評価基盤を作る実装記事。
  • ハルシネーションやコンテキスト不適切さなど、RAG特有の品質課題を自動検証する。
  • CIに評価を組み込み、RAG品質を継続改善する構成が中心。
RAG・Agentの本番運用を学ぶ実践ガイド
Zenn LLM
  • RAG・Agentを実装した後に必要な「本番で使えるシステムにする」技術を体系的に学ぶハンズオンガイドです。
  • Evals・Observability・Security・MLOps・Fine-tuningをpgvectorとGeminiを使って手を動かしながら学べます。
  • 検索方式、評価データ、運用負荷の設計に関わる。
インデックスを作らないagentic searchをRAGと比較
Zenn RAG
  • ベクトルRAGは検索の定番として定着しましたが、その代償として「embeddingモデル・ベクトルDB・再インデックスのパイプライン」という常時稼働インフラを抱えることになります。
  • 検索方式、評価データ、運用負荷の設計に関わる。
  • インデックスを作らないagentic searchをRAGと比較。
動画RAGでRerankを実装し、定量評価する実践記事
Zenn RAG
  • はじめに 前回、TiDB Cloud を使って小さな動画RAG基盤を作りました。
  • 5秒ごとに動画をセグメント化し、映像説明文や文字起こしを TiDB に入れて、自然言語で検索できるようにしたところまで進めました。
  • そこまでやってみて、次に気になったのが Rerank です。
さらに見る
freee、Langfuse基盤でLLM品質観測を実践
@IT
  • クラウド会計ソフトウェア「freee」を提供するフリーは、LLMの品質を管理、改善するために「Langfuse」を使ったLLMオブザーバビリティーを実践している。
  • 高速OLAPデータベースを手掛けるClickHouseが開催したイベントで、その取り組みを紹介した。
  • 開発フロー、評価方法、運用時の制約に関わる。
認可を組み込んだRAGと記憶操作の守り方をTiDBで実装
Zenn RAG
  • はじめに RAGへ権限管理を追加するとき、単に「検索後に見せてよい文書だけ残す」実装で 十分でしょうか。
  • また、誰もが好き勝手に長期記憶にアクセスし、上書き・削除をしてもよいでしょうか。
  • たとえば、質問に最も近い文書が非公開だったとします。
AIエージェントのアクセス制御を実践的に整理
Redis Blog
  • AIエージェントが社内データを扱う際のアクセス制御に関する実践ガイドです。
  • RAGやベクトル検索の権限設計に関心がある読者向けです。
  • 評価方法、データ設計、運用負荷への影響が論点になる。
AgentCore Memoryでメタデータ付き記憶を絞り込む方法
AWS Machine Learning Blog
  • aws_machine_learning発の話題で、AgentCore Memoryが焦点です。
  • RAG・ナレッジ活用の観点で、発表内容や導入場面を整理できます。
  • AgentCore Memoryの設計、導入順序、社内ルール作りに反映しやすい論点です。
RAG・実装 AgentCore Memory AWS
AWS構成で試すHippoRAGとグラフ型検索拡張生成
AWS Machine Learning Blog
  • aws_machine_learning発の話題で、Graph RAGが焦点です。
  • RAG・ナレッジ活用の観点で、発表内容や導入場面を整理できます。
  • Graph RAGの設計、導入順序、社内ルール作りに反映しやすい論点です。
RAG・実装 Graph RAG AWS RAG
Redisで作るAIエージェントの短期・長期メモリ
Redis Blog
  • redis_blog発の話題で、エージェント記憶が焦点です。
  • RAG・ナレッジ活用の観点で、発表内容や導入場面を整理できます。
  • エージェント記憶の設計、導入順序、社内ルール作りに反映しやすい論点です。
RAG・実装 エージェント記憶

ビジネス・国内

新しいものから追えます。

さらに見る
DX銘柄2026、AI活用を重視した企業変革事例を紹介
EnterpriseZine
  • 経済産業省、東京証券取引所、情報処理推進機構(以下、IPA)の3者は、デジタル技術を駆使して中長期的な企業価値向上を成し遂げている上場企業を選ぶ「DX銘柄2026」の選定企業発表会を。
  • 前身となる「攻めのIT経営銘柄」を含めると10年以上の歴史を持つ制度だが、今年度は大きな転換点を迎えている。
  • 生成AIの急速な進展や不確実性の高まりを受け、審査基準において「AIの利活用」「データ環境の整備」「企業間連携」への注力度が引き上げられたのだ。
メインフレーム離脱、生成AI過大評価で7割超が失敗との予測
ITmedia エンタープライズ
  • Gartnerは、生成AIの能力過大評価により、2026年開始のメインフレーム離脱案件の7割超が狙いを達せず、2030年までに関連ベンダーの75%が転換か撤退に迫られると予測した。
  • 市場の期待修正が進み、万能型移行策の需要減も見込む転換期だという。
  • 企業導入、費用対効果、組織内での定着に関わる。

インフラ・半導体

新しいものから追えます。

HPEとAMD、AIエージェント時代の自社データセンター回帰を提示
ITmedia エンタープライズ
  • HPEは、AIエージェント普及でトークン消費と推論コストが膨らむ問題を示した。
  • 外部モデル依存による隠れたコストを避けるため、自社データセンター回帰を論じている。
  • AMDの事例と合わせ、推論基盤をどこに置くかがインフラ戦略になっている。
ソフトバンク、国内AIデータセンター誘致へ電力確保を重視
ITmedia AI+
  • ソフトバンクグループ株主総会で、会長兼社長の孫正義氏が、将来的な目標として「純資産価値1000兆円」の展望を語った。
  • AIインフラの最大のボトルネックである「電力確保」を巡り、子会社のソフトバンクが東京電力の次期オーナー候補に名乗りを上げている事実にも言及した。
  • 最先端データセンターを日本へ呼び戻そうとするインフラ戦略に迫る。
さらに見る
富士通、GPU効率を高めるLLMアーキテクチャPHOTONを開発
ITmedia AI+
  • 富士通が、大規模言語モデル(LLM)を少ないGPUで動かせる新アーキテクチャ「PHOTON」(フォトン)を開発した。
  • GPU当たりの処理性能(スループット)が、現在のLLMで主流のアーキテクチャ「Transformer」の最大475倍に達するという。
  • LLMの運用に必要なGPUを抑え、大幅なコスト削減につなげられるとしている。
GoogleのAI基盤拡大で電力使用量が37%増加
Ars Technica AI
  • Ars Technica発の話題で、データセンター電力が焦点です。
  • 推論基盤、半導体、クラウドコストへの影響が論点です。
  • AI需要を支える計算資源と供給制約の読み解きに関わります。
インフラ・半導体 データセンター電力
BedrockとLLMゲートウェイのレジリエンス設計
AWS Machine Learning Blog
  • AWS発の話題で、BedrockとLLMゲートウェイのレジリエンス設計が焦点です。
  • 推論基盤、半導体、クラウドコストへの影響が論点です。
  • AI需要を支える計算資源と供給制約の読み解きに関わります。
インフラ・半導体 LLMゲートウェイ AWS

セキュリティ・規制

新しいものから追えます。

バイブコーディング時代のセキュリティ急所を整理
CodeZine
  • 生成AIコードでSQLインジェクションや無認証APIなどのリスクが蓄積する問題を整理している。
  • AIで開発速度が上がる一方、レビューとセキュリティ設計の重要性が増している。
  • プロンプトインジェクションなど、AI時代の開発チームが見るべき急所が並ぶ。
さらに見る
中国のClaude APIプロキシ市場、低価格利用とリスクを報告
GIGAZINE
  • Anthropicは中国をClaudeの提供地域から除外していますが、中国では海外のAPIプロキシ「中转站」を介し。
  • 利用者は個人開発者や学生、企業、再販業者に及び、この市場は単なるアクセス回避策にとどまらず、データ収集や不正取引とも結び付く供給網を形成しています。
  • 安全性、権限、制度対応の設計に関わる。
日立と九州大学病院、血液疾患診断を支援するAI技術を開発
MONOist
  • 日立製作所と九州大学病院は、血液悪性腫瘍の診断に用いるフローサイトメトリー検査において、医師の鑑別診断を支援する機械学習型のAI技術を開発した。
  • 複数疾患の同時分類において、識別性能を示す指標AUCで0.9以上の性能を確認した。
  • 実社会での利用範囲と人間側の役割に関わる。
Microsoft、Windows脆弱性探索に100超のAIエージェントを活用
@IT
  • Microsoftはマルチモデルエージェント型セキュリティシステム「MDASH」の取り組みについて解説した。
  • Microsoftのセキュリティエンジニアリングチームが活用しており、Windowsの未知の重大な脆弱性発見に貢献しているという。
  • 安全性、権限、制度対応の設計に関わる。
Microsoft、AIブラウジングエージェントをRCEに至らせるAutoJackを解説
Microsoft Security Blog
  • MicrosoftがAutoJackというAIブラウジングエージェントの攻撃連鎖を解説した。
  • 悪意あるWebページがホスト側のリモートコード実行につながる可能性を示す。
  • ブラウザ操作エージェントを作る開発者は権限分離とサンドボックス設計を確認すべき。

RAG・実装

新しいものから追えます。

OCR・VLM向けEval設計の実践知
Zenn LLM
  • OCRとVLMのハイブリッド部品に対する評価設計の経験です。
  • どのEvalを使うかではなく、Eval設計そのものが焦点です。
  • RAGやVLMを運用する開発者に実装上の示唆があります。
Structured Outputsは正しさを保証しない
Zenn OpenAI
  • スキーマ準拠と意味的な正しさは別問題だと整理しています。
  • constrained decoding後の検証レイヤーが主題です。
  • LLM出力を業務処理へつなぐ開発者向けの実務論です。
RAG・実装 Structured Outputs OpenAI