top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIA mengumumkan TensorRT 10.0 untuk mesin AI kecil

Generatived

24/6/12 11:43

NVIDIA mengumumkan peluncuran TensorRT 10.0, yang memperkenalkan mesin penghilang bobot yang secara signifikan mengurangi ukuran mesin model AI. Mesin ini, yang mengecualikan bobot dari kode yang berjalan, dapat mengurangi ukuran mesin lebih dari 95%. Inovasi ini menyederhanakan proses penerapan aplikasi yang menggunakan GPU NVIDIA GeForce RTX dan NVIDIA RTX dengan memungkinkan perangkat pengguna akhir menyeimbangkan kembali bobot menggunakan lean runtime sekitar 40 MB.

Mesin penghilang bobot dirancang untuk mendukung model ONNX dan definisi jaringan lainnya, memungkinkan Anda mengubah bobot tanpa membangun kembali keseluruhan mesin. Fitur ini sangat berguna dalam skenario yang melibatkan beberapa SKU GPU dan profil pengoptimalan, karena fitur ini meminimalkan duplikasi bobot dan, sebagai hasilnya, mengurangi ukuran biner aplikasi Anda. Mesinnya tetap kompatibel di seluruh pembaruan kecil pada TensorRT dan dapat dibuat dengan tanda kompatibilitas versi, sehingga membuatnya lebih berguna.

TensorRT Cloud, yang saat ini hanya dapat diakses oleh partner tertentu, memperluas kemampuan Anda untuk membuat mesin yang lebih ringan pada berbagai GPU NVIDIA. Pembuatan mesin yang lebih ringan dan penyetelan ulang dukungan untuk NVIDIA TensorRT-LLM akan segera tersedia, sehingga semakin meningkatkan kompresi dan efisiensi model bahasa besar (LLM).

Proses pembuatan dan penerapan mesin yang dikurangi bobotnya menggunakan bobot model selama fase pembuatan untuk melakukan pengoptimalan dan memastikan performa yang konsisten saat bobot disesuaikan kembali nanti. Setelah diserialkan, mesin ini dapat dikalibrasi ulang dalam hitungan detik menggunakan bobot dari file ONNX di perangkat pengguna akhir, sehingga menjaga efisiensi deserialisasi cepat yang dikenal dengan TensorRT. Pendekatan ini tidak hanya memungkinkan Anda untuk menggabungkan lebih banyak fitur AI ke dalam aplikasi Anda tanpa meningkatkan ukuran aplikasi Anda, namun juga memastikan bahwa mesin tetap kompatibel dengan generasi GPU masa depan. saus:

Bagikan artikel ini:

Berita terkini
NTT DATA Merilis Laporan Adopsi GenAI Global 2025

NTT DATA Merilis Laporan Adopsi GenAI Global 2025

24/11/15 4:30

NTT DATA telah merilis temuan dari survei komprehensif yang menunjukkan bahwa para pemimpin mengalihkan fokus dari tahap eksplorasi ke implementasi strategis Generative AI (GenAI)

Asia Foundation Mengumumkan Lokakarya Pengembangan Karier Wanita STEM

Asia Foundation Mengumumkan Lokakarya Pengembangan Karier Wanita STEM

24/11/15 4:30

Pada tanggal 21 November, acara daring yang disebut " STEM ConnectHER: Generative AI x Self x Career Workshop & STEM x Gender CAFE" akan diadakan untuk mendukung pengembangan karier mahasiswi di bidang STEM .

Accenture membuka pusat AI canggih di Kyoto

Accenture membuka pusat AI canggih di Kyoto

24/11/15 4:30

Accenture telah mengumumkan Pusat Kyoto untuk AI Tingkat Lanjut yang baru, sebuah fasilitas yang dirancang untuk membantu klien mengubah bisnis mereka menggunakan teknik AI tingkat lanjut, termasuk AI generatif.

Survei Intelijen Pendapatan Mengungkapkan Perbedaan dalam Evaluasi AI

Survei Intelijen Pendapatan Mengungkapkan Perbedaan dalam Evaluasi AI

24/11/15 4:30

Survei terkini oleh firma intelijen pendapatan terkemuka mengungkap perbedaan pendapat antara CIO dan pemimpin TI dalam hal mengevaluasi keberhasilan proyek AI.

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Ikuti kami

  • Facebook
  • X

Bahasa

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

Generatived

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
NTT DATA Merilis Laporan Adopsi GenAI Global 2025

NTT DATA Merilis Laporan Adopsi GenAI Global 2025

24/11/15 4:30

NTT DATA telah merilis temuan dari survei komprehensif yang menunjukkan bahwa para pemimpin mengalihkan fokus dari tahap eksplorasi ke implementasi strategis Generative AI (GenAI)

Asia Foundation Mengumumkan Lokakarya Pengembangan Karier Wanita STEM

Asia Foundation Mengumumkan Lokakarya Pengembangan Karier Wanita STEM

24/11/15 4:30

Pada tanggal 21 November, acara daring yang disebut " STEM ConnectHER: Generative AI x Self x Career Workshop & STEM x Gender CAFE" akan diadakan untuk mendukung pengembangan karier mahasiswi di bidang STEM .

Accenture membuka pusat AI canggih di Kyoto

Accenture membuka pusat AI canggih di Kyoto

24/11/15 4:30

Accenture telah mengumumkan Pusat Kyoto untuk AI Tingkat Lanjut yang baru, sebuah fasilitas yang dirancang untuk membantu klien mengubah bisnis mereka menggunakan teknik AI tingkat lanjut, termasuk AI generatif.

Survei Intelijen Pendapatan Mengungkapkan Perbedaan dalam Evaluasi AI

Survei Intelijen Pendapatan Mengungkapkan Perbedaan dalam Evaluasi AI

24/11/15 4:30

Survei terkini oleh firma intelijen pendapatan terkemuka mengungkap perbedaan pendapat antara CIO dan pemimpin TI dalam hal mengevaluasi keberhasilan proyek AI.

bottom of page