הצטרפו לקבוצות שלנו לקבלת עדכונים מרוכזים פעם בשבוע:

ווטסאפ:
http://wa.dwh.co.il
טלגרם:
http://telegram.dwh.co.il

 AI בקנה מידה גדול היא משימה מורכבת, הדורשת הסקת מסקנות (Inference) בעלת שיהוי נמוך, חיפוש וקטורי מהיר, יחס עלות-ביצועים גבוה של GPU ותשתית שיכולה לגדול בלי להוסיף מורכבות תפעולית. 

העבודה החדשה של NVIDIA עם Amazon Web Services (AWS) מתמודדת עם כל אחד מהאתגרים הללו. דרך Amazon OpenSearch ו-Amazon EC2, תשתית ה-AI של NVIDIA מעניקה לארגונים דרכים מעשיות יותר לפרוס AI בקנה מידה ייצורי.

מופעי EC2 G7 המופעלים על ידי NVIDIA RTX PRO 4500 Blackwell Server Edition מרחיבים את שכבת המחשוב לעומסי עבודה של AI, גרפיקה, וידאו וניתוח נתונים, בעוד ספריית NVIDIA cuVS מאיצה את שכבת האחזור בכך שהיא הופכת אינדוקס וקטורי מבוסס GPU לברירת המחדל ב-OpenSearch Serverless. בנוסף, כאשר AWS משיגה סטטוס NVIDIA Exemplar Cloud עבור NVIDIA GB300, לקוחות יכולים להיות בטוחים שהם מקבלים ביצועים אופטימליים עבור עומסי האימון שלהם.


NVIDIA RTX PRO 4500 Blackwell Server Edition – GPUs רב-שימושיים למופעי Amazon EC2 G7

מופעי Amazon EC2 G7 מביאים את NVIDIA RTX PRO 4500 Blackwell Server Edition ל-AWS עבור הסקת AI, גרפיקה, מחשוב מרחבי וניתוח נתונים מואץ GPU — ומספקים סוג מופע חדש שמיועד לעומסי עבודה ייצוריים הדורשים ביצועים ללא מורכבות ניהולית של תשתית GPU עצמאית.

בהשוואה למופעי G6, G7 מספקים עד פי 4.6 ביצועי הסקת AI, עד פי 2.1 ביצועי גרפיקה ושיפור משמעותי בניתוח נתונים מואץ GPU ב-Amazon EMR באמצעות ספריית NVIDIA cuDF לעומסי Apache Spark.

עם תמיכה בעד שמונה GPUs, זיכרון GPU כולל של 256GB, רשת EFA במהירות 700 Gbps ועד 7.6TB אחסון NVMe מקומי — כולל קונפיגורציות של GPU אחד, שניים, ארבעה ושמונה, וכן Bare Metal (בקרוב) — מופעי G7 מאפשרים ללקוחות להתאים תשתית לעומסים שלהם במקום להקצות יתר.

הפלטפורמה מאפשרת שימושים מגוונים: צוותי AI מקבלים השהיה נמוכה יותר להסקה, צוותי מדיה ובידור מקבלים עיבוד וידאו ורינדור ברזולוציה גבוהה, וצוותי סימולציה, CAD, VDI, גיימינג ומחשוב מרחבי משתמשים באותו סוג מופע לעומסים גרפיים. גם צוותי דאטה יכולים לנצל את השיפורים בזיכרון GPU, אחסון מקומי ורשת עבור צינורות אנליטיקה ומאגרי וקטורים.

מופעי G7 זמינים דרך Amazon Machine Images (AMI) ללמידה עמוקה, קונטיינרים של AWS, Amazon EMR, Amazon EKS, Amazon ECS ו-Graphics AMIs — ובקרוב גם ב-Amazon SageMaker AI.


NVIDIA cuVS הופכת חיפוש וקטורי מואץ GPU לברירת מחדל ב-Amazon OpenSearch

הדור הבא של Amazon OpenSearch Serverless מפעיל יישומי AI סוכני (Agentic AI) ועומסים דינמיים ללא צורך בניהול תשתית. הוא משתמש באינדוקס וקטורי מואץ GPU, מבוסס NVIDIA cuVS, כברירת מחדל עבור כל אוספי הווקטורים.

עבור צוותים שבונים RAG (Retrieval-Augmented Generation), חיפוש סמנטי, מערכות המלצה ויישומי AI סוכני — השינוי הזה משמעותי. הוא הופך חיפוש וקטורי מבוסס GPU מאופטימיזציה מיוחדת ליכולת סטנדרטית ב-AWS.

ההשפעה ללקוחות ישירה: אינדוקס וקטורי מהיר עד פי 10 ובעלות נמוכה ברבע לעומת פתרונות מבוססי CPU — מה שמאפשר לבנות מסדי נתונים וקטוריים בקנה מידה של מיליארדים בתוך פחות משעה.

המעבר ל-cuVS כברירת מחדל ב-OpenSearch Serverless מאפשר מעבר מהיר יותר מנתונים גולמיים לתשתית אחזור AI מוכנה לייצור, עם סקיילינג Serverless שמפחית עומס תפעולי כאשר אין פעילות.


AWS משיגה סטטוס NVIDIA Exemplar Cloud עבור ביצועי אימון GB300

AWS קיבלה סטטוס NVIDIA Exemplar Cloud על NVIDIA GB300 עבור עומסי אימון. משמעות הדבר היא שהמערכת עומדת בסטנדרטים מחמירים של ביצועים המשמשים את NVIDIA לבדיקת עומסי AI מול ארכיטקטורת הייחוס שלה.

ההישג הוא תוצאה של שיתוף פעולה עמוק בין צוותי AWS ו-NVIDIA. במסגרת יוזמת Exemplar Clouds, מפתחים ומובילי AI יכולים להיות בטוחים שהם משתמשים בתשתית ענן עקבית ובעלת ביצועים גבוהים לאימון בקנה מידה גדול — מה שמאפשר הערכת ספקי ענן בצורה מדויקת יותר, שיפור עלות כוללת של בעלות (TCO) והאצת מעבר מפיתוח לייצור.


יחד, כל ההתקדמויות הללו מחזקות את כל שכבות תשתית ה-AI ב-AWS. הקו המחבר: תשתית AI ברמה ייצורית שמספקת ביצועים בקנה מידה גדול, ללא הוספת עומס תפעולי לצוותים שמפעילים אותה.

עוד מ-HPCwire: AWS מודיעה על מופעי EC2 G7 המואצים על ידי NVIDIA RTX PRO 4500 Blackwell Server Edition