MHS נכנס לתצוגה מקדימה מוגבלת ומציע ממשק משותף בין סוכני AI למכשירים פיזיים. פיילוט של QuEra מדגים שחזור אוטומטי של נעילת לייזר, אך התוצאות עדיין מוקדמות ותלויות בפיקוח מומחים.
Anthropic פתחה ב־27 באוגוסט תצוגה מקדימה מחקרית של Model Hardware Standard, או MHS, מפרט שמחבר סוכני AI לציוד פיזי במעבדות ובמפעלי ייצור. הגישה ניתנה בשלב הראשון לקבוצה מוגבלת של מעבדות ויצרנים. החברה מתכננת לפתוח את המפרט בקוד פתוח בהמשך, אחרי עבודה עם השותפים על הערכות בטיחות ושיטות הפעלה.
מה MHS מנסה לפתור
ציוד מעבדה מגיע בדרך כלל עם ממשקי תוכנה שונים, ולעיתים עם תוכנות ישנות או בלי API שימושי. חיבור של זרוע רובוטית, קורא פלטות, מיקרוסקופ וחיישנים לאותו תהליך עלול לדרוש שבועות של עבודת אינטגרציה. MHS מגדיר דרייבר משותף עם פעולות בסיסיות של קריאה וכתיבה, תיאור של יכולות המכשיר ומגבלות פעולה. סוכן יכול לגלות את המכשירים, לקרוא מצב ולתזמן פעולות דרך MCP, שורת פקודה או קוד.
החלק החשוב הוא ההפרדה בין תכנון לביצוע. הסוכן יכול לבחון מערכת ולכתוב קובץ קוד דטרמיניסטי שמפעיל רצף מהיר או ארוך. בזמן הריצה הציוד מבצע את הקוד בלי שהמודל צריך לחשוב מחדש בכל צעד. המפרט מאפשר להגדיר גבולות, מנגנוני עצירה ומידע פיזי שהסוכן לא יכול להסיק מקריאת קוד בלבד, כמו משקל של זרוע או טווח בטוח של טמפרטורה.
מבחן הלייזר של QuEra
QuEra בחנה את MHS על מערכת נעילת לייזר במחשב קוונטי המבוסס על אטומים ניטרליים. הלייזרים צריכים להישאר בתדר מדויק; סטייה עלולה להשבית את המערכת עד שמומחה יכוון אותה מחדש. לפי QuEra, צוות של ארבעה מומחים השקיע קודם שבועיים עד שלושה בכתיבת סקריפט שטיפל רק בתקלות שנצפו מראש. Claude קיבל גישה למתקן ניסוי ייעודי דרך MHS, הפעיל ניסויים וכתב תוכנת שחזור רגילה וניתנת לבדיקה.
החברה דיווחה שהתוכנה החזירה את המערכת ליעד ב־695 מתוך 700 ניסויים מתוזמנים, בשבעה סוגי תקלה. חמש ההחמצות יוחסו למצב של מתקן הבדיקה, ולא נרשמו דיווחי הצלחה שגויים. רוב התקלות טופלו בתוך פחות משש שניות, והמורכבות שבהן בתוך כעשר עד 14 שניות. לשם השוואה, QuEra מעריכה שכיוון ידני בידי מומחה לוקח חמש עד עשר דקות. בבדיקה נוספת נמדדה ירידה של פי חמישה ברעש השיורי, ומעבר לאורך גל שני הושלם בהרצה לילית אחת.
למי זה שימושי ומה עדיין לא ידוע
אם המפרט יעבוד מעבר לפיילוטים, הוא עשוי לקצר את הזמן שנדרש לאוטומציה של ניסויים, במיוחד במעבדות שמשלבות ציוד של כמה יצרנים. המשמעות המעשית אינה החלפה של המדען. היא העברת חיווט תוכנה, ניטור ותיקון תקלות חוזרות אל שכבה משותפת, בזמן שמומחים מגדירים את הניסוי, מגבלות הבטיחות ומבחני הקבלה.
הראיות עדיין מגיעות מ־Anthropic ומהשותפים בתצוגה המקדימה. אין עדיין בדיקה חיצונית רחבה של תאימות בין יצרנים, אמינות לאורך חודשים או התנהגות במקרה של תקלה פיזית שלא הופיעה באימון. Anthropic גם מציינת שלמודלים יש מגבלות בהבנה מרחבית ופיזיקלית. לפני שימוש בציוד רגיש יהיה צורך בבידוד, הרשאות מצומצמות, עצירות חירום ובדיקת אדם לכל קוד שהסוכן מייצר.
מקורות
VibeTech
כתב/ת טכנולוגיה ב-VibeTech



