リーディングビュー

ストレージがメモリの延長になる。NVIDIA、cuFile APIをオープンソース化

🤖 AI Summary

NVIDIAは、「Future of Memory and Storage(FMS)」カンファレンスで、GPUがCPUを介さずにストレージに直接アクセスできる「cuFile API」のオープンソース化と新イニシアチブ「Storage-Next」の発表を行いました。このAPIはマイクロ秒単位でのデータアクセスを可能にし、GPUDirect Storageの一部です。

また、「Storage-Next」では、DDN、キオクシア、Micronなど40社以上の主要企業が協力して次世代AIストレージ技術の標準化を目指します。さらに、データの高速移転を管理する「SCADA」フレームワークも導入し、セキュリティ確保のために処理とアクセス制御を分離しています。

これらの取り組みは、AIモデルの大規模化に対応するためにNVIDIAが行っているもので、新たなオープンソースプロジェクトや業界標準化の推進に貢献するとされています。
 NVIDIAは8月4日(米国時間)、米国カリフォルニア州サンタクララで開催中の「Future of Memory and Storage(FMS)」において、GPUがCPUを介さずストレージへ直接アクセスし、マイクロ秒単位でデータを読み書きできる「cuFile API」のオープンソース化を発表した。あわせて、ストレージ業界全体を巻き込んだ新イニシアチブ「Storage-Next」の立ち上げと、その基盤となるデータアクセス技術「SCADA」の展開も示した。
  •  

スマホでAIエージェントが動く新時代。9Bをも凌駕する「LFM2.5-2.6B」公開

🤖 AI Summary

劉yawの記事によると、「LFM2.5-2.6B」という新しいAIモデルが8月4日(米国時間)にリリースされ、スマートフォンでも動作する自律型AIエージェントが現実味を帯びてきたという状況を一変させそうだ。

このモデルは269億パラメータを持ち、30層で構成されており、131,072トークンのコンテキスト長を持つ。特にスマートフォンや低リソース環境でも実行可能な特性を持っている。4倍規模のモデルと同等の性能を発揮し、推論速度も高速である。CPUでの推論では、Apple M5 Maxで約220tok/s、AMD Ryzen AI Max+ 395で113tok/sという解像速度を達成している。

また、GPUを使用した場合でも最速のデコード速度を記録しており、NVIDIA H100 GPUでは約15,000tok/sの速度を実現。1日あたり約13億トークンを出力できるとしている。

このモデルはHugging Faceから無償でダウンロード可能であり、日本語にも対応している。さらに、ファインチューニング用の事前学習済みベースモデルやエージェントワークロード向けに事後学習済みのLFM2.5-2.6Bも提供されている。

ただし、マルチモーダル対応のGemma 4やQwen3.5と比較すると機能は一部制限される点には注意が必要だ。
 AIモデルの進化で自律型のAIエージェントが現実味を帯びてきている。だがAIエージェントを使うなら賢い大規模モデルが必要で、ハードウェアリソースが十分ではないPCやスマートフォンにおいて、ローカル環境での実行は非現実的だった。しかし、Liquid AIが8月4日(米国時間)にリリースしたモデル「LFM2.5-2.6B」は、その状況を一変させそうだ。現在、Hugging Faceなどから無償でダウンロードできる。
  •  

1平方mmに驚異の37Gb!キオクシアとSandisk、第10世代3次元フラッシュメモリを開発

🤖 AI Summary

キオクシアとSandiskは8月4日、業界最高水準のビット密度37Gb/平方mmを実現した第10世代3Dフラッシュメモリを開発しました。この技術では、QLC技術と332積層が用いられ、従来の第8世代から最大60%のビット密度向上を達成しました。

革新的なCMOS directly Bonded to Array(CBA)技術により、CMOSロジック回路とメモリアレイを高精度に貼り合わせることで実現されました。さらに、Toggle DDR6.0およびSeparate Command Address(SCA)プロトコルの採用により、業界初となる4.8Gbpsのインターフェイス速度も達成しました。

また、Power-Isolated Low-Tapped Termination(PI-LTT)技術の導入によりデータ転送時の電力効率が向上し、AIやクラウドインフラの電力消費と冷却問題にも対応しています。
 SSDの容量が新たな次元に突入しそうだ。キオクシアとSandiskは8月4日、QLC技術と332積層を用いることで、業界最高水準の37Gb/平方mmという圧倒的なビット密度を実現した第10世代3Dフラッシュメモリを開発したと発表した。
  •  

HBM高騰の救世主か。キオクシアが放つ1,000万IOPSのGPU直通SSD「GP1」

🤖 AI Summary

タイトル:HBM価格高騰を救うか?キオクシアが発表した1,000万IOPSのGPU直通SSD「GP1」

概要:
1. GPUによるAI処理では、大容量かつ高速なメモリが必要だが、HBMの供給不足と価格高騰により問題が深刻化。
2. キオクシアは8月4日に「KIOXIA GP1」シリーズを発表。GPU直通SSDで最大1,000万IOPSのランダムリード性能を持つ。
3. KIOXIA GP1は、Super High IOPS SSDと呼ばれ、第2世代XL-FLASHメモリを使用し、細かいデータアクセスも可能に。
4. 9.5mm/15mmのE3.SおよびE1.Sフォームファクタを採用し、空冷と液冷に対応。耐久性は50DWPD。
5. HBMの増設よりも低いコストで大規模なデータセットにアクセスでき、GPU利用効率向上を目指す。

この製品はAIアプリケーション向けに設計されており、GPUとHBMを組み合わせた新たなストレージアーキテクチャを実現することを目指している。
 GPUのAI処理には大容量かつ高速なメモリが欠かせないが、そもそもGPUと組み合わせるHBMは容量が足りず、メモリの高騰、需給逼迫の問題も深刻化している。それを打破しようとしているのが、キオクシアが8月4日に発表したAIアプリケーション向けの超高速SSD「KIOXIA GP1」シリーズだ。
  •  

中高生女子17名がNVIDIAのオフィスに潜入!就職後必要なのは意外にも○○○○力だ?

🤖 AI Summary

タイトル:中高生女子17名がNVIDIAオフィスに潜入!就職後必要なのは意外にも○○○○力だ?

記事によると、日本法人のNVIDIAは東京都が実施する「Girls Meet STEM」の一環として、中高生女子17名を招待し、オフィスツアーを開催した。参加者の中でもNVIDIAを選んだのは4人程度で、主に親戚や先生からの勧めで選ばれたのが多かった。

NVIDIAの開発技術や製品のデモと展示が行われた後、理系女性社員との交流会も実施。社員は参加生徒たちに就職前の可能性を広げるため、「英語力」が特に重要だと強調した。イベントを通じて、学生たちはNVIDIAのビジネスや技術について理解を深めることができた。

主なポイント:
1. 参加者は17名で、その半数以上は他人からの勧めで参加。
2. NVIDIAは文系理系垣根を超えた幅広い知識が求められる会社。
3. 将来の可能性を広げる上で「英語力」が重要との認識。
 NVIDIA日本法人のエヌビディア(以下はNVIDIAと表記)は8月4日、東京都が実施している施策「Girls Meet STEM」の一環としてオフィスツアーを開催。中高生女子17名をオフィスに招き、開発している技術や製品のデモや展示を行なったほか、理系女性社員らとの交流会を開催した。
  •  
❌