همکاری F5 و NVIDIA برای امنیت در هوش مصنوعی

همکاری F5 و NVIDIA برای امنیت در هوش مصنوعی

امنیت بدون مرز برای هوش مصنوعی با همکاری F5 و NVIDIA

 

هوش مصنوعی وارد مرحله‌ای شده که دو فاکتور «سرعت پاسخگویی به کاربران» و «امنیت» شاخص‌های اصلی موفقیت در پاسخ به انتظارات مشتریان هستند.

در دوره‌ای که اقتصاد بر پایه توکن‌ها شکل می‌گیرد و در حال تحول است، زیرساخت‌های AI، دیگر تنها به توان محاسباتی خام محدود نمی‌شوند؛ بلکه هماهنگی، امنیت و مدیریت بهینه سیستم‌ها نیز اهمیت پیدا کرده است.

شرکت‌هایی که پلتفرم‌های هوش مصنوعی مولد (generative AI) و استنتاجی را توسعه می‌دهند، با چالش‌های زیر مواجه هستند:

  • بهره‌وری حداکثری از GPUها؛
  • افزایش ظرفیت پردازش و توانایی مدیریت تعداد بیشتر داده یا درخواست همزمان (token capacity)؛
  • کاهش زمان تاخیر در ارائه پاسخ؛
  • تضمین امنیت در تمام لایه‌های زیرساخت AI.

شرکت F5 با در نظر این چالش‌ها، از طریق ساختار مرجع NVIDIA Cloud Partner (NCP)، عملکرد استنتاج و پردازش داده‌ها توسط مدل‌های هوش مصنوعی (inference) را مدیریت کرد و توسعه داد تا پاسخگویی سریع‌تر و بهره‌وری بهینه منابع را تضمین کند. این نقشه راه نشان می‌دهد چطور توسعه‌دهندگان پیشرو در حوزه AI Cloud زیرساخت‌های خود را با GPU طراحی و مدیریت می‌کنند.

این معماری مرجع، پیشرفته‌ترین فناوری‌ها در زمینه پردازش، شبکه، ذخیره‌سازی و امنیت را یکپارچه ساخته تا شرکای تجاری NVIDIA در زمینه خدمات فضای ابری بتوانند هوش مصنوعی را با سرعت، پایداری و اطمینان در مقیاس گسترده ارائه دهند.

کمپانی F5 با بهره‌گیری از این همکاری، نقش حیاتی در تضمین امنیت و افزایش سرعت سیستم‌های هوش مصنوعی در اکوسیستم NVIDIA ایفا نموده و با ادغام کامل قابلیت‌های شبکه، امنیت و مدیریت اپلیکیشن‌ها، گام مهمی در راه‌اندازی و بهینه‌سازی پلتفرم‌های هوش مصنوعی مبتنی بر توکن با همکاری NVIDIA در مقیاس بزرگ برداشته است.

معماری NCP Reference، پایه‌ای برای AI Cloud

ساختار NCP، چارچوبی کامل برای پیاده‌سازی AI cloud فراهم می‌کند. این معماری، محاسبات پرسرعت هوش مصنوعی با فناوری‌های NVIDIA، شبکه و نرم‌افزارها را با سایر فناوری‌های پیشرفته اکوسیستم ترکیب می‌کند تا سرویس‌های هوش مصنوعی سریع، توسعه‌پذیر و ایمنی را در فضای ابری ارائه دهد.

در این معماری، F5 BIG-IP  مدیریت پیشرفته ترافیک، امنیت مبتنی بر zero-trust، خدمات پیشرفته و قابلیت نظارت (observability) را به سیستم‌های هوش مصنوعی مجهز به GPU اضافه می‌کند و به شرکت‌های فعال در اکوسیستم NVIDIA کمک می‌کند تا سرویس‌های استنتاج و پردازش هوشمند داده‌ها را با اطمینان اجرا کنند.

اقتصاد مبتنی بر توکن و ساختار NCP reference

برای ارائه‌دهندگان سرویس‌های AI cloud، توکن‌ها نقش «واحد ارزش» را دارند. به عبارتی توکن‌ها اکنون به جای پول یا منابع سنتی، معیاری برای ارزش و عملکرد سرویس‌های هوش مصنوعی محسوب می‌شوند. هر سرویس با شاخص‌هایی مانند سرعت پردازش داده‌ها، زمان دریافت اولین پاسخ (توکن)، مصرف انرژی و هزینه هر توکن ارزیابی می‌شود.

پایداری و کارایی سرویس‌های هوش مصنوعی، به زیرساختی بستگی دارد که ارتباط میان کاربران و GPU clusterها را با بیشترین سرعت و کمترین تاخیر برقرار می‌کند.

برای پشتیبانی از سرویس‌های هوش مصنوعی با عملکرد بالا، تمامی مولفه‌های زیرساخت از جمله مدیریت ترافیک، امنیت، نظارت (Observability)، پشتیبانی از چندکاربره بودن (Multi-tenancy) و اجرای پالیسی‌های کنترلی باید با بالاترین سرعت و بدون ایجاد هیچ‌گونه گلوگاه یا تاخیری عمل کنند.

معماری NCP reference، چارچوبی رسمی برای طراحی و پیاده‌سازی زیرساخت‌های هوش مصنوعی ارائه می‌دهد و مشخص می‌کند چگونه المان‌های مرتبط با پردازش، شبکه، ذخیره‌سازی، مانیتورینگ و امنیت به‌طور هماهنگ به یکدیگر متصل شوند.

پردازنده‌های NVIDIA BlueField-3 DPU نقش کلیدی در مدیریت جریان داده‌ها بین کاربران و زیرساخت‌های اصلی در این معماری‌ها دارند و انتقال اطلاعات را سریع و ایمن می‌سازد.

شرکت F5 به‌ عنوان یک عامل کلیدی در این اکوسیستم، شبکه، امنیت و کنترل‌های مبتنی بر هوش مصنوعی را مستقیا در معماری مرجع ادغام می‌کند.

سرعت، امنیت و کارایی در Cloud AI

F5 با ادغام فناوری NVIDIA به نتایج چشمگیری دست یافته است. در آوریل ۲۰۲۵، نسخه عمومی F5 BIG IP Next  برای Kubernetes را با پردازنده‌های NVIDIA BlueField-3 DPU عرضه کرد. این راهکار پردازش شبکه، امنیت و تحلیل ترافیک را به DPU منتقل ساخته تا قدرت CPU را برای اجرای اپلیکیشن‌های تجاری اختصاص دهد.

نمونه عملی

SoftBank به عنوان یکی از ارائه‌دهندگان خدمات شبکه ابری و مشتری NCP که اخیرا تست PoC در فضای ابری انجام داده، موفق شد به عملکرد بی‌نظیری دست یابد.

علاوه بر توان پردازشی بالا، F5 BIG-IP کاملا با نیازهای عملیاتی مراکز پردازش ابری (NCP) هم‌راستا است. این راهکار امکان کنترل هوشمند ترافیک ورودی و خروجی، مدیریت امنیت و برقراری ارتباط ایمن میان سرویس‌ها در معماری میکروسرویس (service mesh) را فراهم می‌کند. همچنین قابلیت‌هایی مانند مسدودسازی حملات DDoS، پیاده‌سازی مدل امنیتی zero-trust، محافظت از APIها، ایزوله‌سازی منابع و نظارت بر چندین کاربر به صورت همزمان را در یک بستر یکپارچه ارائه می‌دهد.

در این راهکار مسیر پردازش درخواست‌ها در مدل‌های هوش مصنوعی (LLM) بهینه‌سازی شده، مدیریت ترافیک داده‌ها دقیق‌تر شده و با پشتیبانی از پروتکل Model Context (MCP)، کنترل و هوشمندی مسیر عبور داده‌ها به طور چشمگیری افزایش یافته است.

با پشتیبانی از معماری مرجع NCP، حالا BIG-IP به یک بخش اصلی از مدل طراحی، استقرار و مدیریت  مرجع NCP، BIG-IP حالا به یک بخش اساسی و پایه‌ای از نحوه طراحی، استقرار و مدیریت AI clouds تبدیل شده است.

 

افزایش سرعت AI throughput

نتایج اولیه نشان می‌دهد با ترکیب F5 BIG-IP  و پلتفرم شتاب‌دهنده NVIDIA، تولید توکن بیش از ۳۰%، افزایش یافته و زمان رسیدن به اولین توکن (TTFT)، ۶۰% کاهش یافته است.

با این پیشرفت، پاسخ‌های هوش مصنوعی دقیق‌تر و مرتبط‌تر بوده و چرخه پردازش، سریع‌تر رخ می‌دهد؛ ضمن اینکه هزینه تولید هر توکن تا ۳۰٪ کاهش یافته است. به عبارت دیگر هوش مصنوعی، باهوشت‌تر، سریع‌تر و اقتصادی‌تر عمل می‌کند.

اجرای اپلیکیشن‌ها، سرویس‌ها یا مدل‌های فضای ابری روی زیرساخت‌های NCP، مزایای قابل توجهی دارد:

دسترسی سریع‌تر به نتایج؛

کاهش هزینه‌های عملیاتی؛

تجربه مطلوب‌تر کاربری در تمام مدل‌ها.

F5 چگونه NCP را متحول می‌سازد؟

قدرت F5 در معماری NCP reference زمینه را برای ارائه خدمات ابری هوش مصنوعی سریع‌تر، ایمن‌تر و با قابلیت‌های گسترده‌تر برای کاربران فراهم آورد.

  • بهبود عملکرد: F5 BIG—IP با هماهنگی کامل با پردازنده‌های NVIDIA ، زیرساخت‌های شبکه و نرم‌افزارهای مرتبط، سرعت پردازش هوش مصنوعی را افزایش می‌دهد. این راهکار مسیر رسیدن درخواست‌های کاربران به مدل AI (prompt routing) را بهینه ساخته، توازن بار (load balancing) را مدیریت نموده و تعداد بیشتری توکن‌ را در هر ثانیه برای هر cluster پردازشی، تولید می‌کند.

در اقتصاد نوظهور دیجیتال، هر توکن مستقیماً به افزایش درآمد و دقت مدل کمک می‌کند. با این پیشرفت، بهره‌وری بالاتر می‌رود، پاسخ‌دهی سریع‌تر می‌شود و سودآوری به طور چشمگیر افزایش می‌یابد. همکاری F5 و NVIDIA با استفاده از زیرساخت‌های پردازشی پیشرفته، سرعت و توان عملیاتی سیستم‌ها را ارتقا بخشیده و بهره‌وری و عملکرد را به اصلی‌ترین عوامل موفقیت کسب‌وکار تبدیل می‌کند.

 

  • امنیت بازتعریف‌شده برای پردازش هوش مصنوعی: پردازش هوش مصنوعی در مقیاس بزرگ، مسیرهای جدیدی برای حملات سایبری ایجاد می‌کند؛ از نشت اطلاعات گرفته تا سوء‌استفاده از مدل‌های AI. F5 با تخصص حرفه‌ای در زمینه امنیت اپلیکیشن‌ها و پیاده‌سازی پالیسی‌های مربوطه، زیرساخت مرجع را به صورت چندلایه محافظت می‌کند و کل فضای GPU cloud را ایمن نگه می‌دارد. محافظت ارائه‌شده شامل موارد زیر است:

محافظت پیشرفته در برابر حملات DDoS و تامین امنیت ترافیک APIهای پردازش هوش مصنوعی؛

پیاده‌سازی مدل امنیتی zero-trust و نظارت بر هویت کاربران بر اساس پالیسی‌های تعریف‌شده؛

ارائه فایروال لایه ۷ و امنیت MCP برای تضمین سلامت و یکپارچگی کامل ترافیک؛

حفاظت کامل از داده‌ها مطابق با استانداردهای جهانی حریم خصوصی و رعایت قوانین.

در نتیجه یک بستر قابل اعتماد برای هوش مصنوعی شکل می‌گیرد که علاوه بر ارائه عملکرد بالا،  امنیت را نیز تضمین می‌کند و به کاربران NCP امکان می‌دهد با اطمینان کامل، ظرفیت عملیاتی خود را گسترش دهند؛ بدون آنکه از امنیت یا رعایت الزامات فنی و قانونی صرف‌نظر کنند.

 

امکانات بیشتر و کنترل مستقیم در محیط AI

همکاری F5 و NVIDIA فراتر از سرعت و امنیت پیش رفته و امکانات جدیدی برای مدیریت و نظارت کامل بر روی کلاسترهای FPU فراهم آورده است. این امکانات به کاربران اجازه می‌دهد تا مستقیما در محیط  AI، منابع و بار کاری را بهینه کنند. برخی از قابلیت‌های کلیدی عبارتند از:

 

LLM routing:  هدایت هوشمندانه درخواست‌ها (prompt) برای افزایش سرعت و بهره‌وری؛

granular token governance: کنترل دقیق بر نحوه تولید، مصرف و دسترسی توکن‌ها از جمله محدودیت تعداد یا اولویت‌بندی استفاده؛

adaptive observability: پایش هوشمند داده‌ها و فعالیت‌ها به منظور شناسایی نقاط بحرانی و بهبود عملکرد؛

context-aware traffic steering: هدایت ترافیک به صورت هوشمند بر اساس شرایط و نیاز واقعی سیستم.

این امکانات به کاربران AI اجازه می‌دهد تا استقرار منابع و استفاده از آن‌ها را بهینه کنند و بهره‌وری را افزایش دهند.

این قابلیت‌ها، مدیریت اپلیکیشن‌ها در سطح سازمانی را به دنیای هوش مصنوعی می‌آورند و تضمین می کنند که هر توکن، هر مدل و هر تعامل کاربری با دقت و کارایی کامل اداره شود. به این ترتیب، F5 پیچیدگی‌ها را به کنترل تبدیل می‌کند و پل مطمئنی بین اپلیکیشن‌‌های سنتی و دنیای پرسرعت و در حال تحول هوش مصنوعی مولد ایجاد می‌کند.

پایگاهی جدید برای هوش مصنوعی

همکاری F5 و NVIDIA باعث بهینه‌سازی زیرساخت‌های هوش مصنوعی شده و عملکرد آن را سریع‌تر، ایمن‌تر و اقتصادی‌تر کرده است. این همکاری به ابرکلاودها و سازمان‌ها امکان می‌دهد توسعه‌پذیری پیش‌بینی‌پذیر داشته باشند، هزینه‌ها شفاف شوند و پردازش‌ها با تغییر مدل‌ها و بار کاری به ‌سرعت سازگار گردند.

F5 صرفا به اکوسیستم NVIDIA نپیوسته است؛ بلکه با همکاری NVIDIA، اقتصاد توکن را ارتقا بخشیده است؛ جایی که هر «میکروثانیه»، «وات» و «توکن» اهمیت دارد. این همکاری به تولید توکن‌ها با سرعت، امنیت و بهره‌وری بالاتر کمک می‌کند و زیرساخت AI ایمن، پرقدرت و مقیاس‌پذیر را ممکن می‌سازد.

سوالات پرتکرار درباره " امنیت بدون مرز برای هوش مصنوعی با همکاری F5 و NVIDIA "

هدف اصلی همکاری F5 و NVIDIA در حوزه AI چیست؟

بهینه‌سازی زیرساخت‌های هوش مصنوعی برای افزایش سرعت، امنیت، توسعه‌پذیری و بهره‌وری اقتصادی.

NCP Reference یا NVIDIA Cloud Partner Reference، یک معماری مرجع برای زیرساخت‌های AI cloud است که بهترین شیوه‌ها برای پردازش، شبکه، ذخیره‌سازی و امنیت را مشخص می‌کند تا سرویس‌های هوش مصنوعی سریع، ایمن و توسعه‌پذیر ارائه شوند.

دسترسی سریع‌تر به نتایج، کاهش هزینه عملیاتی، پاسخ‌دهی دقیق‌تر مدل‌ها، مدیریت هوشمند ترافیک، و افزایش بهره‌وری.