logo
Rumah Kasus

DDN dan Nebul Memvalidasi Akselerasi KV Cache untuk Pabrik AI Berbasis NVIDIA

Sertifikasi
Cina Beijing Qianxing Jietong Technology Co., Ltd. Sertifikasi
Cina Beijing Qianxing Jietong Technology Co., Ltd. Sertifikasi
Ulasan pelanggan
Staf penjualan Beijing Qianxing Jietong Technology Co, Ltd sangat profesional dan sabar. Mereka dapat memberikan kutipan dengan cepat. Kualitas dan kemasan produk juga sangat baik. Kerjasama kami sangat lancar.

—— Festfing DV》LLC

Ketika saya sangat mencari CPU intel dan SSD Toshiba, Sandy dari Beijing Qianxing Jietong Technology Co., Ltd memberi saya banyak bantuan dan mendapatkan produk yang saya butuhkan dengan cepat. Saya sangat menghargai dia.

—— Kitty Yen

Sandy dari Beijing Qianxing Jietong Technology Co, Ltd adalah penjual yang sangat berhati-hati, yang dapat mengingatkan saya tentang kesalahan konfigurasi saat saya membeli server. Para insinyur juga sangat profesional dan dapat dengan cepat menyelesaikan proses pengujian.

—— Strelkin Mikhail Vladimirovich

Kami sangat senang dengan pengalaman kami bekerja dengan Beijing Qianxing Jietong. Kualitas produk sangat baik, dan pengiriman selalu tepat waktu. Tim penjualan mereka profesional, sabar, dan sangat membantu dengan semua pertanyaan kami. Kami sangat menghargai dukungan mereka dan berharap dapat menjalin kemitraan jangka panjang. Sangat direkomendasikan!

—— Ahmad Navid

Kualitas: Pengalaman yang baik dengan pemasok saya. MikroTik RB3011 sudah digunakan, tetapi dalam kondisi yang sangat baik dan semuanya bekerja dengan sempurna. Komunikasi cepat dan lancar,dan semua kekhawatiran saya segera ditangani. Penyedia yang sangat dapat diandalkan sangat direkomendasikan.

—— Geran Colesio

I 'm Online Chat Now

DDN dan Nebul Memvalidasi Akselerasi KV Cache untuk Pabrik AI Berbasis NVIDIA

July 17, 2026
Di KTT RAISE di Paris, DDN memamerkan kolaborasi berkelanjutannya dengan Nebul, penyedia hybrid cloud kedaulatan Eropa, yang berfokus pada peningkatan efisiensi untuk penerapan inferensi AI skala besar. Diperkenalkan minggu lalu, inisiatif bersama ini menyatukan platform inferensi Nebul, arsitektur intelijen data Infinia DDN, dan komputasi terakselerasi NVIDIA untuk mengatasi hambatan utama AI produksi: biaya pergerakan data dan keterbatasan kinerja selama beban kerja inferensi.

kasus perusahaan terbaru tentang DDN dan Nebul Memvalidasi Akselerasi KV Cache untuk Pabrik AI Berbasis NVIDIA  0

DDN membingkai kolaborasi ini di sekitar metrik produksi kritis: utilisasi GPU, throughput token, biaya per token, dan latensi. Sementara pelatihan model membangun nilai aset AI, inferensi mendefinisikan pengembalian operasional dan komersialnya. Peningkatan adopsi AI agentik, retrieval-augmented generation (RAG), dan inferensi konkurensi tinggi berarti infrastruktur penyimpanan dan data secara langsung memengaruhi efisiensi akselerator dan kecepatan respons AI.

Proyek bukti konsep aktif ini telah menghasilkan hasil awal yang menjanjikan. Para mitra telah mencatat peningkatan terukur dalam waktu ke token pertama dengan KV cache diaktifkan dan menyelesaikan validasi untuk infrastruktur berbasis RoCE. Pengujian berkelanjutan mencakup panjang urutan inferensi yang lebih lama, membuka potensi optimasi lebih lanjut untuk platform Infinia. Kolaborasi ini juga meluas ke upaya bersama NVIDIA pada kerangka kerja pengujian, verifikasi skalabilitas, dan publikasi teknis mendatang.

Platform terintegrasi memanfaatkan layanan KV cache terdistribusi, pergerakan data native GPU, orkestrasi data cerdas, dan arsitektur penyimpanan berkinerja tinggi. Akselerasi KV cache memberikan peningkatan inferensi yang signifikan dengan mempertahankan dan mengambil status perhatian yang telah dihitung sebelumnya dengan cepat, mengurangi perhitungan berulang dan menghilangkan penundaan pengiriman data yang menyebabkan GPU menganggur.

kasus perusahaan terbaru tentang DDN dan Nebul Memvalidasi Akselerasi KV Cache untuk Pabrik AI Berbasis NVIDIA  1

Para pemimpin dari DDN, Nebul, dan NVIDIA menyoroti pergeseran industri besar: prioritas infrastruktur AI beralih dari penerapan GPU mentah ke efisiensi operasional, memaksimalkan pengembalian dari perangkat keras akselerator yang ada. CEO DDN Alex Bouzari dan CEO Nebul Arnold Juffer mencatat bahwa fokus masa lalu pada skala model yang lebih besar telah digantikan oleh optimasi ekonomi inferensi untuk membuat AI produksi layak secara komersial melalui biaya per token yang lebih rendah. VP Infrastruktur Cloud NVIDIA Rod Evans menambahkan bahwa beban kerja agentik skala besar sekarang mengukur keberhasilan infrastruktur berdasarkan utilisasi GPU dan latensi, daripada kekuatan komputasi semata.

DDN menekankan bahwa infrastruktur AI harus berevolusi melampaui fungsi penyimpanan dasar untuk secara aktif mendukung alur kerja eksekusi AI. Platform infrastruktur perusahaan saat ini memberdayakan lebih dari satu juta GPU di seluruh dunia, melayani hyperscaler, penyedia cloud, perusahaan, pemerintah, dan lembaga penelitian.

Tim infrastruktur AI modern sekarang memprioritaskan metrik produksi inti ini:
Utilisasi GPU: Mengukur aktivitas akselerator yang efektif selama inferensi, memaksimalkan nilai perangkat keras GPU kelas atas.
Biaya per token: Menghubungkan kinerja infrastruktur secara langsung dengan biaya operasional output model AI.
Token per watt: Mengevaluasi efisiensi energi output inferensi AI.
Waktu ke token pertama: Menentukan responsivitas aplikasi AI interaktif dan pengalaman pengguna.
Waktu ke produksi: Mengukur upaya operasional untuk memigrasikan layanan AI dari pengujian ke penerapan komersial yang dapat diskalakan.

Karena inferensi menjadi beban kerja AI yang dominan, pengiriman konteks yang di-cache dan data perusahaan ke GPU dengan latensi rendah dan stabil akan sangat penting untuk mempertahankan utilisasi GPU yang tinggi dan mengendalikan biaya operasional jangka panjang.

Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang/Direktur Strategi Global
WhatsApp / WeChat: +86 13426366826
Email: yangyd@qianxingdata.com
Situs Web: www.qianxingdata.com/www.storagesserver.com
Fokus Bisnis:
Distribusi Produk ICT/Integrasi Sistem & Layanan/Solusi Infrastruktur
Dengan pengalaman distribusi TI lebih dari 20 tahun, kami bermitra dengan merek global terkemuka untuk menghadirkan produk yang andal dan layanan profesional.
“Menggunakan Teknologi untuk Membangun Dunia yang Cerdas”Penyedia Layanan Produk ICT Tepercaya Anda!

Rincian kontak
Beijing Qianxing Jietong Technology Co., Ltd.

Kontak Person: Ms. Sandy Yang

Tel: 13426366826

Mengirimkan permintaan Anda secara langsung kepada kami (0 / 3000)