top of page

Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

logo.png

NVIDIA AI モデルが GPU カーネル生成を強化

Generatived

25/2/13 4:30

NVIDIA のエンジニアは、明示的なプログラミングなしで GPU アテンション カーネルを生成するという課題に取り組むため、オープンソース AI の DeepSeek-R1 モデルを利用した実験を行いました。推論フェーズで追加の計算能力を活用することで、モデルは、場合によっては経験豊富なエンジニアが作成したカーネルを上回るカーネルを生成することができました。テスト時間スケーリングと呼ばれるこのアプローチは、最も効果的な結果を選択する前に複数の結果を検討することで AI のパフォーマンスを向上させます。

アテンションの概念は、大規模言語モデル (LLM) の進歩において極めて重要な役割を果たしており、AI が関連するデータ セグメントに集中して予測を強化し、隠れたパターンを発見できるようにしています。ただし、アテンション操作の複雑さは入力シーケンスの長さとともに増大するため、効率化と実行時の問題の回避のために最適化された GPU カーネルが必要になります。エンジニアは特定のタスクに対処するためにさまざまなアテンション バリアントを組み合わせることが多く、これらの最適化されたカーネルの作成がさらに複雑になります。

こうした複雑さに対処するため、NVIDIA のエンジニアは、DeepSeek-R1 モデルと NVIDIA H100 GPU で実行される検証ツールを組み合わせたワークフローを考案しました。手動プロンプトによって開始されるこの閉ループ システムは、生成された GPU コードを反復的に改良します。15 分間のプロセスにより、スタンフォード大学の KernelBench ベンチマークによると、すべてのレベル 1 の問題と 96% のレベル 2 の問題に対して数値的に正しいカーネルが作成されました。

NVIDIA の実験の結果は、テスト時間のスケーリングを活用することで、最適化された GPU カーネルの生成を大幅に改善できることを示しています。効果的なアテンション カーネルを自動的に生成する DeepSeek-R1 モデルの機能は、この新しい研究分野の可能性を示しています。より広範な問題で一貫して優れた結果を達成するにはさらなる作業が必要ですが、初期の結果は有望です。関心のある方は、DeepSeek-R1 NIM マイクロサービスで詳細をご確認ください。

この記事を共有:

最新のニュース
Deepgram が強化された直接音声合成モデルを発表

Deepgram が強化された直接音声合成モデルを発表

25/2/20 4:45

Deepgram は、音声をテキストに変換せずにニュアンスと感情的なトーンを維持することで音声インタラクションを強化する新しい音声合成 (STS) モデルを発表しました。

SiMa.ai、効率的なエッジAI ONEプラットフォームを発表

SiMa.ai、効率的なエッジAI ONEプラットフォームを発表

25/2/20 4:45

SiMa.ai は最近、エッジ AI 向け ONE プラットフォームに DeepSeek-R1-Distill-Qwen-1.5B を導入し、10 ワット未満の消費電力で優れたパフォーマンスを発揮したことを発表しました。

DiligentIQ、AIデューデリジェンス拡大のためのシリーズA資金調達を実施

DiligentIQ、AIデューデリジェンス拡大のためのシリーズA資金調達を実施

25/2/20 4:45

プライベート エクイティのデューデリジェンスのための AI 搭載プラットフォームである DiligentIQ は、シリーズ A の資金調達で最大 1,200 万ドルを確保しました。

Earnix、意思決定の強化のためにAlix AIを導入

Earnix、意思決定の強化のためにAlix AIを導入

25/2/20 4:45

Earnix は、保険および銀行業界向けに、プラットフォーム上での意思決定を強化するために、新しい AI 駆動型エージェント Alix を導入しました。

Copyright © 2024 Generatived - All right Reserved.

この記事を共有:

この記事を共有:

Generatived AI Logo

Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。

  • Facebook
  • X

フォローをお願いします

言語

最新のニュース
Deepgram が強化された直接音声合成モデルを発表

Deepgram が強化された直接音声合成モデルを発表

25/2/20 4:45

Deepgram は、音声をテキストに変換せずにニュアンスと感情的なトーンを維持することで音声インタラクションを強化する新しい音声合成 (STS) モデルを発表しました。

SiMa.ai、効率的なエッジAI ONEプラットフォームを発表

SiMa.ai、効率的なエッジAI ONEプラットフォームを発表

25/2/20 4:45

SiMa.ai は最近、エッジ AI 向け ONE プラットフォームに DeepSeek-R1-Distill-Qwen-1.5B を導入し、10 ワット未満の消費電力で優れたパフォーマンスを発揮したことを発表しました。

DiligentIQ、AIデューデリジェンス拡大のためのシリーズA資金調達を実施

DiligentIQ、AIデューデリジェンス拡大のためのシリーズA資金調達を実施

25/2/20 4:45

プライベート エクイティのデューデリジェンスのための AI 搭載プラットフォームである DiligentIQ は、シリーズ A の資金調達で最大 1,200 万ドルを確保しました。

Earnix、意思決定の強化のためにAlix AIを導入

Earnix、意思決定の強化のためにAlix AIを導入

25/2/20 4:45

Earnix は、保険および銀行業界向けに、プラットフォーム上での意思決定を強化するために、新しい AI 駆動型エージェント Alix を導入しました。

bottom of page