News (HE)

עדכון חינמי חדש מ-Nvidia מבטיח להאיץ AI יצירתי בכרטיסי מסך RTX עד 40%

Nvidia
Nvidia - Foto: Hepha1st0s / Shutterstock.com

ענקית טכנולוגיית החומרה Nvidia הכריזה על עדכון תוכנה המועיל ישירות לבעלי כרטיסי המסך מסדרת RTX שלה. החידוש מתמקד באופטימיזציה של הביצועים של משימות בינה מלאכותית גנרטיבית, מה שהופך את השימוש במודלים של שפות מורכבות למהיר יותר ונגיש יותר במחשבים אישיים. העדכון, שהוא חינמי, מבטיח קפיצת מדרגה משמעותית בביצועים למשתמשים ולמפתחים.

גולת הכותרת העיקרית של העדכון היא האצה של עד 40% בביצוע מודלים של שפה גדולה (LLMs), כמו אלו ממשפחת ה-GPT וה-Nemotron. שיפור זה הוא תוצאה של אופטימיזציות בספריית TensorRT-LLM של החברה, המאפשרת כעת עיבוד יעיל יותר של משימות AI ישירות על חומרת המשתמש, מבלי להסתמך אך ורק על שירותי ענן או חומרת שרתים מיוחדת.

עם העדכון החדש, משתמשים ומפתחים שמשתמשים ב-RTX GPU שלהם לביצוע משימות AI באופן מקומי, יבחינו בהפחתה ניכרת בזמן התגובה ובעלייה בכוח העיבוד. זה פותח את הדלת ליצירת תוכן והתנסות במודלים מתקדמים יותר של בינה מלאכותית, אפילו בתצורות חומרה לצרכנים, מה שמבסס את המחשב כפלטפורמה חזקה יותר ויותר לעידן הבינה המלאכותית.

Nvidia
Nvidia – ジャック・ホン/shutterstock.com

אופטימיזציה משפרת את ביצועי LLM

הליבה של שיפור ביצועים זה היא הגרסה האחרונה של ספריית TensorRT-LLM. Nvidia הדגימה בבדיקות פנימיות שדגמי קוד פתוח פופולריים כמו Nemotron Nano V2 הראו עלייה במהירות של עד 40% בהשוואה לגרסאות קודמות של התוכנה. התקדמות זו הופכת את האינטראקציה עם צ’אטבוטים וכלי בינה מלאכותית אחרים לזורמת ויעילה יותר.

האצה זו חיונית לאנשי מקצוע המסתמכים על LLMs למשימות יומיומיות, כגון מתכנתים, חוקרים ויוצרי תוכן. היכולת להפעיל את המודלים הללו מהר יותר על מכונה מקומית לא רק מגבירה את הפרודוקטיביות, אלא גם מבטיחה פרטיות ושליטה רבה יותר על הנתונים המעובדים, גורם מבדל חשוב בהשוואה לפתרונות מבוססי ענן.

[[MVG_PROTECTED_BLOCK_0]

טכנולוגיה חדשה להפחתת השימוש ב-VRAM

חידוש מרכזי נוסף שהציגה Nvidia הוא תמיכה בפורמט NVFP4 בעל דיוק גבוה. טכנולוגיה זו מאפשרת דחיסה חכמה של דגמי AI, וכתוצאה מכך הפחתה של עד 60% בצריכת זיכרון הווידאו (VRAM). בפועל, זה אומר שדגמים גדולים ומורכבים יותר יכולים לפעול על כרטיסים גרפיים עם קיבולת VRAM קטנה יותר.

אופטימיזציה של השימוש בזיכרון הוא אחד האתגרים הגדולים ביותר להפעלת AI מקומית. עם פורמט NVFP4, מחסום הכניסה למשתמשים עם חומרה בינונית פוחת במידה ניכרת, מה שהופך את הגישה לכלי בינה מלאכותית מתקדמים חדשניים שהיו מוגבלים בעבר למערכות עם כמויות גדולות של זיכרון ייעודי.

[[MVG_PROTECTED_BLOCK_0]

שיפור זה מיושם באמצעות טכניקה המוציאה חלק מהנתונים לזיכרון ה-RAM של המערכת בעת הצורך, ומפנה את VRAM לפעולות קריטיות יותר. בדיקות עם הכלי ComfyUI הראו שביצועי צינורות המשתמשים במודלים כגון Flux.1 ו- Flux.2 יכולים לעלות עד פי 4.6, מה שמאפשר ליצור תמונות באיכות גבוהה הרבה יותר מהר.

התקדמות בדור וידאו AI

העדכון של Nvidia אינו מוגבל לדגמי שפה. החברה גם שיפרה את יצירת הווידאו על ידי אופטימיזציה של דגם ה-LTX-2, שפותח בשיתוף עם Lightricks. הכלי, הממיר טקסט לווידאו, מסוגל כעת ליצור קליפים ברזולוציות של עד 4K ב-50 פריימים לשנייה.

הודות לתמיכה בפורמט NVFP8, דגם LTX-2 משיג פי שניים את מהירות היצירה של כרטיסי ה-RTX העדכניים ביותר. המשמעות היא שסרטון באיכות גבוהה שקודם לכן לקח בערך 20 שניות ליצור יכול כעת להיווצר בפחות ממחצית הזמן, התקדמות משמעותית עבור יוצרי תוכן חזותי.

טכנולוגיה זו מקלה על ייצור תוכן יצירתי ודינמי, ומאפשרת למשתמשים להפוך רעיונות טקסטואליים לסרטונים מפורטים מהר יותר. הכלי מציע שליטה מדויקת על התוצאה הסופית, כולל הגדרת תווים, סגנונות ותנועות מצלמה, הכל מפקודות טקסט פשוטות.

המהירות המוגברת והיכולת ליצור תוכן 4K מציבים את כרטיסי ה-RTX כפתרון רב עוצמה ובמחיר סביר להפקת וידאו בסיוע בינה מלאכותית, ופותח אפשרויות חדשות לשיווק דיגיטלי, חינוך ובידור.

איכות תמונה משופרת עם RTX VSR

Nvidia הרחיבה את הפונקציונליות של טכנולוגיית RTX Video Super Resolution (VSR) שלה, המשתמשת ב-AI כדי לשפר את איכות הסרטונים בזמן אמת. כעת, ניתן ליישם את הכלי גם על תוכן שנוצר על ידי בינה מלאכותית, כמו זה שנוצר על ידי דגם LTX-2. זה מאפשר למשתמשים להוציא סרטון וידאו ברזולוציה נמוכה יותר, כמו 720p, ולהמיר אותו ל-4K עם איכות תמונה גבוהה משמעותית, עם חדות רבה יותר ופרטים משופרים.

פונקציונליות זו שימושית במיוחד להאצת זרימת העבודה של יוצרי תוכן. על ידי יצירת קליפים ברזולוציות נמוכות יותר, זמן הייצור מצטמצם באופן דרסטי. בהמשך, VSR דואגת להעלות את האיכות לסטנדרטים מקצועיים ללא צורך בתהליכי טיוח ארוכים. אינטגרציה עם התוסף ComfyUI, למשל, הפחיתה את זמן ההפקה והשיפור של קליפ 4K מ-15 דקות ל-3 דקות בלבד, והדגימה את היעילות של הפתרון המשולב.

אינטגרציה עם המערכת האקולוגית של המפתחים

אחד ההיבטים החשובים ביותר של עדכון זה הוא האינטגרציה העמוקה שלו עם כלים פופולריים בתרחיש ה-AI הגנרטיבי, עם דגש על ComfyUI. שולחן עבודה מבוסס צומת זה הוא אחד המועדפים בקרב חובבי ואנשי מקצוע כאחד לבניית זרימות עבודה מורכבות של AI. על ידי מתן תמיכה ישירה ואופטימיזציות לפלטפורמות אלו, Nvidia מבטיחה שהחידושים שלה יגיעו במהירות לידי הקהילה, אשר לאחר מכן תוכל לחקור ולהרחיב את יכולות החומרה. החברה משתפת פעולה באופן פעיל עם מפתחי הכלים הללו כדי להבטיח הטמעה מתמשכת ויעילה של טכנולוגיות חדשות, כגון תמיכה בפורמט NVFP4 בדגמים כמו Flux. שיתוף הפעולה הזה מחזק את המערכת האקולוגית סביב RTX GPUs, ומגבש אותם לא רק כרכיבים למשחקים, אלא כפלטפורמה העיקרית לפיתוח והרצה של AI ברמה צרכנית. האסטרטגיה של Nvidia ברורה: למנף את הכוח של ליבות ה- Tensor שלה ואת הבשלות של ערימת התוכנה שלה כדי להציע פתרון רב-תכליתי וחזק יותר מהיחידות הייעודיות לעיבוד עצבי (NPU) שמתחילות להופיע במעבדים מתחרים. זה מבטיח שקהל רחב, מחובבים ועד מקצוענים, יוכל ליהנות מיד מההתקדמות העדכנית ביותר בביצועי AI.

העתיד של AI מקומי בכרטיסי RTX

עם סדרת עדכונים זו, Nvidia מחזקת את האסטרטגיה שלה של מיקום כרטיסי מסך RTX במרכז מהפכת הבינה המלאכותית המקומית. על ידי אספקת שיפורי ביצועים, הפחתת דרישות הזיכרון והאצת יצירת התוכן, החברה מעצימה בסיס משתמשים הולך וגדל לחקור, ליצור ולחדש עם טכנולוגיות הבינה המלאכותית המתקדמות ביותר ישירות במחשב שלהן.

To Top