Dellows News

ペンギンソリューションズ、GPU稼働率改善などを解説するセミナーを開催へ

ペンギンソリューションズ株式会社は、GPUへの投資効果を高めるためのAI基盤の設計・構築・運用について解説するセミナーを開催します。クラスタの安定運用や推論時のメモリー負荷軽減に向けたアプローチを、過去の改善実績とともに紹介する予定です。本セミナーはマジセミ株式会社の協力のもとで実施されます。

GPU活用における運用の複雑化とメモリーの課題

生成AIの活用が本格化するなか、LLMの学習や推論を支えるAI基盤への投資が進み、多数のGPUを導入する動きが見られます。一方で高性能なGPUは高価であるため、投資を成果につなげるには設備の安定稼働と性能の十分な引き出しが求められます。

GPUの増加に伴ってサーバーやネットワークを含むクラスタ全体の運用は複雑化し、障害によるジョブ中断が発生した場合には復旧や再実行に時間を要する課題が生じます。また、AI推論においては長い文章の処理や同時リクエストの増加によってGPUメモリーが不足し、処理量が伸び悩むケースがあるため、クラスタの安定運用と推論時のメモリー利用の最適化が求められています。

稼働率を改善した事例と紹介ソリューション

セミナーでは、GPUの稼働率を50%台から90%台へ引き上げた過去の実績をもとに、インフラの設計・構築・運用における着眼点や改善のプロセスを解説します。GPUサーバー、ストレージ、ネットワークから監視・保守に至るまで、基盤全体を見据えた運用の考え方が提示されます。

あわせて、クラスタの安定運用とパフォーマンス最適化を支援する「ClusterWareAI」や、AI推論時の処理を高速化するための一時データである「KVキャッシュ」を大容量メモリーへ移すことでGPUメモリーの負荷を軽減する「MemoryAI KV Cache Server」が紹介されます。

提供企業の概要

マジセミ株式会社

主催するペンギンソリューションズは、AI/HPC基盤の設計・構築・運用を手がけており、約10万GPUの展開・運用や40億時間を超えるGPU稼働を支えてきた実績を持ちます。複数ベンダーの製品や技術を組み合わせ、AIファクトリー向けのフルスタックサービスを提供しています。

セミナーの概要および協力企業の情報は以下の通りです。

  • 主催・共催: ペンギンソリューションズ株式会社
  • 協力: マジセミ株式会社(〒102-0094 東京都千代田区紀尾井町3番12号、お問合せ: https://majisemi.com/service/contact/ )

本記事はペンギンソリューションズ株式会社およびマジセミ株式会社の発表をもとに作成しました。

アクセスランキング

今日

1週間