ג’פריס מזהה שלושה תרחישים שעשויים לדחוף את הזהב מעל $5,000
יום שישי, 04.09.2026 — AMD (AMD) השתמשה בנאום הפתיחה של IFA בברלין כדי לטעון שהשלב הבא של הבינה המלאכותית יפעל קרוב יותר למשתמשים, ולא רק בענן. מנכ"ל החברה ג’ק הויין מיסגר את אסטרטגיית החברה סביב "AI אישי" — מהלך שעשוי להוזיל עלויות ולשפר את הפרטיות, אך גם מדגיש עד כמה הביקוש ל-AI עולה במהירות על התשתיות הקיימות.
ראשי פרקים
- AMD אמרה כי ה-AI עובר מכלים שיחתיים למערכות מולטימודליות, הסקה ואג’נטיות שיכולות לתכנן ולפעול באופן עצמאי.
- החברה מיצבה מחשוב מקומי, פרטיות והקשר אישי כשלושת עמודי התווך של אסטרטגיית ה-AI האישי שלה.
- AMD הציגה חומרה חדשה שמיועדת להפעלת מודלי AI גדולים על התקנים, כולל Ryzen AI Halo ו-Threadripper Halo Station.
- AMD ומיקרוסופט הדגישו שותפות עמוקה יותר עם Windows, בעוד SUSE הדגישה תשתית פתוחה להרחבה מתחנת עבודה לייצור.
- החברה אמרה כי עלויות ה-AI בענן הופכות קשות לשמירה ככל שצריכת הטוקנים עולה בחדות בכל הענף.
AI אישי ומחזור המחשוב הבא
הויין אמר כי ה-AI משתנה בשלבים: תחילה שיחתי, לאחר מכן מולטימודלי, אחר כך הסקה, וכעת אג’נטי — שבו מערכות יכולות לתכנן, להשתמש בכלים ולנקוט פעולה. הוא אמר שהאבולוציה הזו משנה את השאלה הבסיסית במחשוב מ"מה יכולים המחשבים לעשות?" ל"מה אנחנו יכולים לעשות איתם?"
הוא השווה את ה-AI לחשמל, ואמר שהוא הופך לשירות ציבורי שיהיה מצופה בכל מקום. "ה-AI הוא החשמל החדש," אמר, והוסיף שהטכנולוגיה מתקדמת לנקודה שבה אנשים כבר לא יחשבו על התשתית שמאחוריה.
תשובתה של AMD היא מה שהיא מכנה AI אישי, הבנויה על שלושה רעיונות:
- מחשוב מקומי, כדי שמודלים גדולים יוכלו לרוץ ישירות על התקנים אישיים.
- פרטיות ושליטה, כדי שנתונים רגישים יישארו על ה-התקן של המשתמש אלא אם המשתמש בוחר לשתף אותם.
- הקשר אישי, כדי שמערכות ה-AI יבינו מטרות, העדפות ותהליכי עבודה אישיים.
הויין אמר שהמטרה היא להפוך את המחשב האישי ל"בית לאינטליגנציה בלתי מדודה המושרשת בהקשר שלך."
הכרזות חומרה מרכזיות
AMD השתמשה בנאום המפתח כדי להראות עד כמה ה-התקנים האישיים התקדמו. החברה אמרה שהמעבד Ryzen AI שלה יכול להפעיל מודלים של עד 24 מיליארד פרמטרים באופן מקומי, בעוד Strix Halo יכול לתמוך במודלים של 200 מיליארד פרמטרים עם 120 ג’יגה-בייט של זיכרון מאוחד.
פלטפורמת Ryzen AI Halo ברמה הגבוהה יותר מרחיקה לכת עוד יותר, עם 192 ג’יגה-בייט של זיכרון מאוחד ותמיכה במודלים של עד 300 מיליארד פרמטרים. AMD גם הציגה את Threadripper Halo Station, שאותה תיארה כ"תחנת העבודה החזקה ביותר בעולם."
המערכת כוללת:
- 96 ליבות מעבד Zen 5.
- Two מאיצי MI350P Instinct, עם נתיב לארבעה.
- עד 2 טרה-בייט של זיכרון מערכת.
- עד 576 ג’יגה-בייט של זיכרון HBM3E.
AMD אמרה שתחנת העבודה יכולה להפעיל מודלי AI עם יותר מ-1 טריליון פרמטרים. החברה גם הצביעה על HP ZBook, בשם הקוד Sundance, מחשב נייד מהדור הבא המופעל על ידי Ryzen AI Halo עם 190 ג’יגה-בייט של זיכרון מאוחד לאנשי מקצוע יצירתיים. Lenovo גם הכריזה על מערכת שולחנית ThinkCentre X המופעלת על ידי Ryzen AI Halo בברלין.
מדוע AMD אומרת שמודל הענן נמצא תחת לחץ
הויין אמר שעלייתו של ה-AI האג’נטי מניעה צריכת טוקנים הרבה יותר מהר ממה שחברות רבות ציפו. לפי AMD, עיבוד הטוקנים החודשי של ה-AI עלה מכ-0.7 קוודריליון ל-1.7 קוודריליון בשנה אחת, ועשוי להגיע ל-120 קוודריליון טוקנים בחודש עד 2030.
הוא אמר שהכלכלה של ה-AI בענן הופכת קשה להצדקה עבור משתמשים כבדים. ב-15 מיליון טוקני פלט ביום, הוא אמר שעלויות הענן יכולות להגיע לכ-EUR 300 ביום, או כמעט EUR 100,000 בשנה עבור משתמש פעיל אחד.
AMD גם אמרה ש-93% מהחברות חורגות מתקציבי ה-AI שלהן — סימן לכך שהמודל הנוכחי של תשלום עבור כל טוקן עשוי שלא להתרחב היטב לעומסי עבודה אג’נטיים ממושכים. מסר החברה היה שמחשוב מקומי יכול להסיר חיובים לפי טוקן ולתת למשתמשים שליטה רבה יותר על מיקום הביצוע.
טענות מדד ייחוס וביצועים מקומיים
AMD הדגישה מספר תוצאות מדד ייחוס כדי לתמוך בטענתה שה-AI המקומי אינו פשרה. הויין אמר שמודל Qwen2.5 של 9 מיליארד פרמטרים קיבל ציון גבוה יותר במדד ייחוס של הסקה ברמת תואר שני מאשר GPT-4o, שלדבריו היה בעל 120 מיליארד פרמטרים ושוחרר חודשים קודם לכן.
הוא גם אמר:
- Llama 3.1 הפועל באופן מקומי על Strix Halo עלה בביצועים על Claude Sonnet 5 במדדי ייחוס של הנדסת תוכנה.
- GLM-5.3-Flash הפועל באופן מקומי על Ryzen AI Halo הציג ביצועים טובים יותר מ-Claude Fable 5 במבחנים דומים.
- הוצאה לפועל מקומית נשאה אפס עלות ענן לפי טוקן, בעוד שימוש בענן עשוי לעלות כ-EUR 90 עבור 10 מיליון טוקני פלט עם Claude Sonnet 5 וכ-EUR 500 עבור 10 מיליון טוקני פלט בהשוואה אחרת שצוטטה.
- Qwen 3.8, מודל של 125 מיליארד פרמטרים, הוצג כשהוא פועל באופן מקומי על Kraken Halo עם שימוש מלא ב-GPU.
AMD אמרה שדוגמאות אלו מראות שה-AI ברמת החזית יכול לעבור למחשב האישי מבלי להקריב ביצועים. הנקודה הרחבה יותר של החברה היא שמודלים קטנים יותר ומסוגלים יותר ו-התקנים חזקים יותר נפגשים באמצע.
שותפות מיקרוסופט ועתיד Windows
סגן נשיא בכיר מנהל עסקים של Windows וה-התקנים במיקרוסופט, פאוון דבולורי, הצטרף לנאום המפתח כדי לתאר כיצד Windows מסתגל ל-AI האג’נטי. הוא אמר שסוכנים הם האבולוציה הבאה של המחשב האישי, הופכים כוונה לפעולה ומשנים את תפקיד המחשב מכלי שמשתמשים מפעילים לשותף שעוזר להם להשיג יותר.
החברות אמרו שהן עוסקות בהנדסה משותפת במשך עשורים. עבודתן על Strix Halo ו-Kraken Halo התמקדה ברוחב פס זיכרון, בקרי זיכרון, צינור התמונה וביצועי NPU — כולם מכוונים להפעלה חלקה של מודלים מקומיים גדולים.
מיקרוסופט גם דנה ב-Project Zenith, חוויית מפתח Windows חדשה הכוללת Visual Studio Code, WSL, GitHub Copilot CLI ו-PowerShell מותקנים מראש. היא מיועדת ל-התקנים ברמה גבוהה עם לפחות 64 ג’יגה-בייט של זיכרון מאוחד ותהיה זמינה על מערכות AMD Ryzen AI Halo מהקופסה.
דבולורי אמר ש-Windows הופך לפלטפורמה פתוחה לחוויות אג’נטיות מאובטחות באמצעות Microsoft Execution Containers. הוא אמר שהמטרה היא לאפשר לסוכנים לעבוד על פני אפליקציות, שירותים וקבצים עם אישור המשתמש, תוך שמירת אמון, אבטחה ושליטת המשתמש במרכז.
הוא גם אמר שה-AI הופך ל"פיגומים לפוטנציאל האנושי," ומרחיב את מה שאנשים יכולים להשיג ולדמיין.
SUSE: מתחנת עבודה לייצור
דירק-פטר ון ליאוון, מנכ"ל SUSE, אמר שתחנת העבודה היא רק נקודת ההתחלה. הוא טען שפיתוח וייצור היו לעתים קרובות עולמות נפרדים, וש-SUSE מנסה לגשר ביניהם עם תשתית פתוחה.
SUSE אמרה שכלי ה-AI Factory ו-Rancher שלה יכולים לעזור למפתחים להתחיל על מערכת Ryzen AI Halo, לבנות ולבדוק באופן מקומי, ולאחר מכן להרחיב לתשתית ארגונית מבלי לזרוק את עבודתם.
החברה אמרה שפתיחות חשובה מכיוון שמודלים, מסגרות, ספריות וחומרה משתנים במהירות. היא רוצה שלקוחות ישמרו על החופש לפרוס היכן שזה הגיוני — בין אם על התקן מקומי, במרכז נתונים פרטי, בקצה או בענן.
ון ליאוון אמר שהבחירה שנעשית היום לא צריכה להגביל את מה שאפשרי מחר. SUSE, שחוגגת 34 שנים בעסקים, הציגה את המסר הזה כמתואם עם גישת המערכת האקולוגית הפתוחה של AMD עצמה.
מקרי שימוש רחבים יותר ודוגמאות מהמערכת האקולוגית
AMD השתמשה בנאום המפתח כדי להראות שהשבבים שלה כבר תומכים במגוון רחב של מערכות מהעולם האמיתי מעבר למחשבים אישיים.
- AMD EPYC מניע פלטפורמות מדיה חברתית המחברות מיליארדי אנשים.
- טכנולוגיית AMD משמשת בקונסולות משחק וב-התקנים כפיים, כולל הדגמת PlayStation 5 Pro עם Marvel’s Spider-Man 2.
- AMD EPYC ו-Threadripper תומכים בפלטפורמות הפצת תוכן.
- חומרת AMD סייעה להניע מערכות קריטיות בחללית Orion במהלך משימת Artemis II, שנשאה אסטרונאוטים סביב הירח לראשונה ביותר מ-50 שנה.
- מערכות הניתוח הרובוטי של Intuitive משתמשות בטכנולוגיית AMD כדי לתרגם תנועת יד של 3 מילימטרים לתנועה כירורגית של מילימטר אחד תוך סינון רעד טבעי.
- מחשב העל LUMI בפינלנד פועל על אנרגיה מתחדשת, יש לו כוח של 1.5 מיליון מחשבים ניידים, תומך במחקר אקלים וזיהוי סרטן מבוסס AI, ומשתמש בחום פסולת לחימום מאות בתים.
AMD גם אמרה שהיא מספקת מערכת קופסה לסיוע Ryzen AI Halo באירופה עבור מפתחים שרוצים לחקור יכולות AI מקומיות.
תחזית עתידית
הויין אמר שהחברה רואה הזדמנות פעם-בדור במעבר ל-AI אישי. הוא אמר שאדם אחד עם רעיון אחד יכול כעת לתאם צוות דיגיטלי בהיקף שפעם דרש ארגון גדול בהרבה.
הוא תיאר את המודל הבא כהיברידי, עם עיבוד מקומי כשכבה הראשית והענן משמש כאשר נדרשת סביבה מיוחדת של קנה מידה. AMD אמרה שהיא רוצה לספק מחשוב על פני הטווח המלא, מ-התקנים אישיים ועד לתשתית ארגונית.
מסר החברה היה שה-AI צריך לצמצם את המרחק בין רעיון לתוצאה, תוך שמירה על אמון, אבטחה ופתיחות. AMD ושותפותיה אמרו שהשלב הבא של המחשוב יהיה תלוי בחומרה, תוכנה ומערכות הפעלה שעובדות יחד מההתחלה.
ראשי פרקים של שאלות ותשובות
בדיון שלאחר נאום המפתח, מיקרוסופט ו-AMD הרחיבו על האסטרטגיה הטכנית ופלטפורמת ההכרזות.
- דבולורי אמר ש-Windows מתפתח לבסיס מאובטח לחוויות אג’נטיות, כאשר סוכנים יכולים לפעול על פני קבצים, אפליקציות ושירותים כאשר המשתמשים מאפשרים זאת.
- AMD אמרה שעבודת ההנדסה המשותפת על Strix Halo ו-Kraken Halo סייעה לטפל ברוחב פס זיכרון, עיצוב בקר זיכרון, ביצועי צינור תמונה ויעילות NPU.
- הויין אמר שמודלים של 125 מיליארד פרמטרים יכולים כעת לרוץ באופן מקומי על Ryzen AI Halo ולטפל במשימות שחורגות מהנחיות פשוטות, כולל ניתוח ויצירת תוכן.
- Project Zenith הוצג כסביבה מוכנה לקידוד עבור מפתחים, עם מינימום 64 ג’יגה-בייט של זיכרון מאוחד.
- SUSE אמרה שתפקידה הוא לעזור ללקוחות לעבור ממפתח אחד על תחנת עבודה למאות או אלפי מערכות AI על פני תחנות עבודה, שרתים, מרכזי נתונים וה-התקני קצה.
הקוראים יכולים לעיין בתמליל המלא להלן לפרטים נוספים על נאום המפתח, תוכניות המוצר והערות השותפים.
מאמר זה נוצר ותורגם בתמיכת AI ונבדק על ידי עורך. לקבלת מידע נוסף, עיין בתנאים והתניות שלנו.









