المسرد
لغة الحوسبة.
51 مصطلحًا من وحدات GPU والشبكات إلى مراكز البيانات ونماذج الشراء، مشروحة دون تعقيد.
العتاد
المسرعرقاقة مصممة لتسريع أعباء عمل محددة مثل الذكاء الاصطناعي. ووحدات GPU هي أشهر المسرعات؛ ومن غيرها وحدات TPU ورقائق الذكاء الاصطناعي المخصصة.عرض النطاق الترددي للذاكرةكمية البيانات التي تستطيع وحدة GPU قراءتها من ذاكرتها أو كتابتها إليها في الثانية، وتُقاس عادةً بالتيرابايت في الثانية.A100وحدة GPU من جيل Ampere لدى NVIDIA مخصصة لمراكز البيانات، وهي سلف H100.B200وحدة GPU من NVIDIA لمراكز البيانات من جيل Blackwell، وهي البنية التي خلفت Hopper.FLOPSعمليات الفاصلة العائمة في الثانية: مقياس للإنتاجية الحاسوبية الخام، وغالبًا ما يُذكر بالتيرافلوبس أو البيتافلوبس.GPUوحدة معالجة الرسومات: رقاقة مصممة لإجراء كثير من العمليات الحسابية بالتوازي. ووحدات GPU هي العتاد الرئيسي لتدريب نماذج الذكاء الاصطناعي وتشغيلها.H100وحدة GPU من جيل Hopper لدى NVIDIA مخصصة لمراكز البيانات، وتُستخدم على نطاق واسع في تدريب الذكاء الاصطناعي والاستدلال. وتتوفر بعدة عوامل شكل، منها SXM وPCIe.H200وحدة GPU من جيل Hopper لدى NVIDIA تجمع بين تصميم الحوسبة في H100 وذاكرة أكبر وأسرع.HBMالذاكرة عالية النطاق الترددي: ذاكرة مكدسة توضع بجوار رقاقة GPU حتى تنتقل البيانات منها وإليها بسرعة كبيرة.MI300Xالمسرع Instinct MI300X من AMD لمراكز البيانات، المخصص للذكاء الاصطناعي والحوسبة عالية الأداء.PCIePCI Express: الوصلة القياسية بين وحدة GPU وبقية الخادم. وتُركَّب وحدات GPU بصيغة PCIe على شكل بطاقات.SXMعامل شكل GPU من NVIDIA يُثبَّت في مقبس مباشرة على لوحة الخادم، ومصمم لـ NVLink ولطاقة أعلى.Tensor Coreوحدات متخصصة داخل وحدات GPU من NVIDIA تُجري عمليات المصفوفات التي هي جوهر الذكاء الاصطناعي بسرعة تفوق بكثير الأنوية العامة الغرض.VRAMالذاكرة الموجودة على وحدة GPU، وتُقاس بالغيغابايت. وتحتفظ بأوزان النموذج وبيانات العمل والذاكرات المؤقتة أثناء تشغيل وحدة GPU.
الشبكات
InfiniBandتقنية شبكات عالية الأداء بزمن استجابة منخفض جدًا، تُستخدم على نطاق واسع لربط الخوادم في عناقيد تدريب الذكاء الاصطناعي.NVLinkرابط NVIDIA عالي السرعة الذي يصل وحدات GPU ببعضها مباشرة داخل الخادم، وهو أسرع بكثير من ناقل PCIe القياسي.NVSwitchرقاقة تبديل تتيح لكل وحدة GPU في خادم متصل بـ NVLink التواصل مع كل وحدة GPU أخرى بالسرعة الكاملة.RoCERDMA عبر Ethernet المتقارب: طريقة لإجراء عمليات نقل مباشرة للذاكرة على غرار InfiniBand عبر شبكات Ethernet.
أعباء عمل الذكاء الاصطناعي
الاستدلالتشغيل نموذج مدرَّب لإنتاج إجابات أو تنبؤات للمستخدمين.التدريبتعليم النموذج بمعالجة كميات كبيرة من البيانات وضبط معاملاته. ويحتاج إلى كثير من وحدات GPU تعمل معًا لأيام أو أسابيع.الدقة (FP8 وBF16 وFP16)صيغة الأرقام المستخدمة في الحسابات. وتستخدم الدقة الأقل مثل FP8 ذاكرة أقل وتعمل أسرع، مقابل بعض الخسارة في الدقة العددية.الضبط الدقيقمواصلة تدريب نموذج قائم على مجموعة بيانات أصغر ومحددة لتكييفه مع مهمة ما.ذاكرة KV المؤقتةذاكرة تخزن النتائج الوسيطة لآلية الانتباه أثناء توليد نموذج اللغة للنص، حتى لا يلزم إعادة حسابها.MIGوحدة GPU متعددة المثيلات: ميزة من NVIDIA تقسم وحدة GPU واحدة إلى عدة وحدات GPU أصغر معزولة.
مراكز البيانات
إقامة البياناتاشتراط تخزين البيانات ومعالجتها في دولة أو منطقة محددة.الاستضافة المشتركةاستئجار مساحة وطاقة وتبريد في مركز بيانات لدى طرف آخر لإيواء عتادكم الخاص.التبريد السائلإزالة الحرارة بالسائل بدلًا من الهواء، إما عند الرقاقة أو على مستوى الحامل. ويتحمل كثافات طاقة أعلى بكثير من الهواء.المنطقةنطاق جغرافي يقدم فيه المزود السعة، مثل مدينة أو منطقة حضرية أو دولة.كثافة الحواملمقدار الطاقة التي يستطيع كل حامل خوادم توفيرها وتبريدها، ويُقاس بالكيلوواط لكل حامل.ميغاواط (MW)وحدة قدرة تساوي مليون واط. وتوصف سعة مراكز البيانات عادةً بالميغاواط من الطاقة المتاحة.PUEفعالية استخدام الطاقة: إجمالي طاقة المنشأة مقسومًا على الطاقة التي تستهلكها معدات تقنية المعلومات. والقيمة الأقرب إلى 1 تعني إنفاق طاقة أقل على النفقات العامة مثل التبريد.TDPالقدرة الحرارية التصميمية: كمية الحرارة التي صُممت الرقاقة لإنتاجها، وتقارب الطاقة التي تستهلكها تحت الحمل، بالواط.
شراء الحوسبة
السحابة الجديدة (Neocloud)مزود خدمات سحابية أحدث يتخصص في بنية GPU والذكاء الاصطناعي التحتية بدلًا من الخدمات السحابية العامة الغرض.السعة المحجوزةالالتزام باستخدام الحوسبة لمدة محددة، غالبًا أشهرًا، مقابل سعر أقل أو توفر مضمون.العقدةخادم واحد في العنقود. وتضم عقدة GPU عادةً عدة وحدات GPU، غالبًا ثمانيًا.العنقودمجموعة خوادم متصلة بشبكة سريعة لتعمل معًا على مهمة واحدة.فوري (قابل للمقاطعة)سعة فائضة تُعرض بخصم ويستطيع المزود استعادتها بإشعار قصير.مدة الالتزامالمدة التي يوافق المشتري على الدفع مقابل السعة خلالها، مثل شهر أو ثلاثة أشهر أو اثني عشر شهرًا.مزود سحابي فائق النطاقمزود خدمات سحابية كبير جدًا، مثل السحابات العامة الكبرى، يشغّل مراكز البيانات على نطاق عالمي.نقل البيانات الصادرةالبيانات التي تغادر شبكة المزود، ويفرض عليها بعض المزودين رسومًا لكل غيغابايت.Bare metalاستئجار خادم مادي كامل دون طبقة افتراضية بينكم وبين العتاد.GPU-hourوحدة GPU واحدة مستخدمة لمدة ساعة واحدة. وهي الوحدة القياسية لمقارنة أسعار الحوسبة.On-demandاستئجار الحوسبة بالساعة أو بالدقيقة دون التزام طويل. ويمكنكم البدء والإيقاف متى شئتم، رهنًا بالتوفر.SLAاتفاقية مستوى الخدمة: التزام مكتوب من المزود بأمور مثل وقت التشغيل، مع تعويضات في حال الإخلال به.
Kovara
التثبيتقيمة مرجعية رسمية منشورة من Compute Index، تُسجل مع إصدار المنهجية المستخدم ولا يُعاد كتابتها خفيةً أبدًا.السعر الاسترشاديتقدير مباشر لم يُنشر بوصفه تثبيتًا رسميًا. ويُوسم بأنه استرشادي حتى لا يُخلط أبدًا بالتثبيت الرسمي.السعر الموحدسعر محوَّل إلى وحدة مشتركة، مثل الدولار الأمريكي لكل GPU-hour، بحيث يمكن مقارنة العروض المختلفة.المزود الموثقمزود راجع شخص في Kovara هويته. ولا تُمنح هذه الصفة تلقائيًا أبدًا.حالة التوفرما إذا كان العرض متاحًا أو محدودًا أو غير متاح، أو مجهولًا عندما لا يذكر المصدر ذلك.درجة الثقةتصنيف Kovara من A إلى D لمدى دعم الحقيقة: A موثق بدرجة عالية، وB أدلة قوية، وC أدلة غير مكتملة، وD تقدير أو غير موثق.Compute Indexالمقياس المرجعي لدى Kovara لأسعار الحوسبة وتوفرها، يُحسب من مساهمات مستقلة للمزودين وفق منهجية منشورة.
هل ينقص مصطلح؟
اطلبوا من Kova شرح أي شيء عن الرقائق أو الشبكات أو مراكز البيانات، أو أخبرونا بما يجب إضافته.
