Topic

GPUのAIニュース

GPUに関するAIニュースをカテゴリ横断でまとめます。

HPEとAMD、AIエージェント時代の自社データセンター回帰を提示
ITmedia エンタープライズ
  • HPEは、AIエージェント普及でトークン消費と推論コストが膨らむ問題を示した。
  • 外部モデル依存による隠れたコストを避けるため、自社データセンター回帰を論じている。
  • AMDの事例と合わせ、推論基盤をどこに置くかがインフラ戦略になっている。
富士通、GPU効率を高めるLLMアーキテクチャPHOTONを開発
ITmedia AI+
  • 富士通が、大規模言語モデル(LLM)を少ないGPUで動かせる新アーキテクチャ「PHOTON」(フォトン)を開発した。
  • GPU当たりの処理性能(スループット)が、現在のLLMで主流のアーキテクチャ「Transformer」の最大475倍に達するという。
  • LLMの運用に必要なGPUを抑え、大幅なコスト削減につなげられるとしている。