OpenAI הציגה מדידות ראשונות לשבב ההסקה Jalapeño. החברה מדווחת על יותר עבודה לכל ואט ועל זמני תגובה קצרים יותר, אך הבדיקות עדיין שלה והפריסה המסחרית רק מתחילה.
OpenAI פרסמה ב-25 באוגוסט את תוצאות הביצועים הראשונות של Jalapeño, שבב ההסקה הראשון שתכננה בעצמה. השבב נועד להריץ מודלים קיימים ולהגיש תשובות למשתמשים, ולא לאמן מודלים חדשים. זו הבחנה חשובה: OpenAI עדיין זקוקה למאיצים חיצוניים לאימון, אבל מנסה לקבל שליטה גדולה יותר על החלק שבו ChatGPT, Codex ושירותי ה-API עונים בפועל.
מה נמדד
החברה בדקה את Jalapeño על InferenceX, מבחן פומבי של SemiAnalysis שמודד את כל מסלול ההגשה של בקשת AI. לפי OpenAI, הבדיקות כללו את GPT-OSS 120B, את DeepSeek R1 בגרסת 670 מיליארד פרמטרים ואת Kimi K2.5 עם טריליון פרמטרים. ההשוואה נעשתה מול מערכות מסחריות זמינות, תוך התאמה של קצב העבודה, זמן התגובה וצריכת ההספק.
המספרים שפרסמה OpenAI הם טווחים, ולא תוצאה יחידה: פי 1.5 עד 1.9 יותר עבודת AI לכל ואט בקצב השיא, וזמן תגובה מקצה לקצה שהיה קצר פי 1.7 עד 3.6. בעומסים אינטראקטיביים במיוחד, שבהם משתמש מחכה לכל שלב של סוכן, החברה מדווחת על ביצועים גבוהים פי 2.1 עד 4.1. השבב מדורג ל-700 ואט, אך OpenAI אומרת שבבדיקות האלה ההספק הרציף לא עבר 550 ואט.
אלה נתונים של OpenAI, גם אם שיטת הבדיקה נשענת על מבחן פומבי. עדיין לא פורסמה הרצה עצמאית על חומרה שנגישה לצד שלישי, ולא ברור אילו מערכות נכללו בכל נקודת השוואה. עד שהשבב יגיע לפריסה רחבה, גם NVIDIA, AMD וספקיות אחרות צפויות להציג דורות חדשים.
למה זה מעשי
עלות ההסקה היא סעיף קבוע וגדל בכל מוצר AI שמשרת משתמשים רבים. שיפור אמיתי בביצועים לוואט יכול להקטין את צריכת החשמל ואת מספר המאיצים הדרוש לאותה תעבורה. זמן תגובה קצר יותר משמעותי במיוחד לסוכנים שמבצעים רצף ארוך של פעולות, משום שכל עיכוב קטן מצטבר לאורך המשימה.
עבור OpenAI, Jalapeño גם מצמצם תלות בספק חומרה יחיד ופותח אפשרות לתכנן יחד את המודל, התוכנה, הזיכרון והרשת. עם זאת, Axios דיווחה שהחברה אינה מתכננת למכור את השבב לאחרים. לכן מפתחים לא צפויים להזמין שרת Jalapeño או לבחור בו ישירות בענן; ההשפעה, אם תגיע, תהיה דרך זמינות, מהירות ומחיר של מוצרי OpenAI.
מה עדיין לא ידוע
לפי TechCrunch, פריסה בהיקף קטן צפויה בסוף 2026, ופריסה משמעותית יותר ב-2027. לא פורסמו מחיר הייצור, תפוקת המפעלים, שיעור הבקשות שיעבור לשבב או תוצאות על מודלי OpenAI הסגורים. גם היתרון הכלכלי הכולל תלוי בקירור, ברשת, בניצול השרת ובתוכנה שמסביב לשבב. כרגע יש תוצאות הנדסיות מבטיחות, אך אין עדיין הוכחה תפעולית בקנה מידה גדול.
מקורות
- OpenAI
- TechCrunch25.8.2026
- Axios25.8.2026
VibeTech
כתב/ת טכנולוגיה ב-VibeTech



