ההדגמה הופכת למשוב
בלמידה מחיקוי, רובוט לומד לשחזר התנהגות שהודגמה לו. TIGER משתמשת בהתנהגות הזאת אחרת: במקום לבצע את הפעולות שמציעה מדיניות החיקוי, היא מתרגמת אותן לתחזית קצרת טווח של מיקום וכיוון קצה הזרוע. התחזית מתחשבת באופן שבו הבקר מתרגם פקודות לתנועה בפועל. אלגוריתם הלמידה בחיזוק מקבל תגמול על שיפור ההתאמה לתחזית בין צעדים, בעוד שהתגמול על הצלחת המשימה נשאר הקובע. כך מתקבל משוב במהלך הניסיון, גם כשהצלחה נמדדת רק בסופו.
מה נמדד בסימולציה
לפי החברה, בשבע משימות סימולציה הגיעה TIGER לסף של 50% הצלחה בפחות צעדי אינטראקציה מאלגוריתם הבסיס המקביל. התוצאות מוצעו על פני חמש הרצות עם זרעים אקראיים שונים. הירידה המדווחת, 20% עד 57%, מתייחסת למספר הצעדים עד לסף הזה, ואינה מדידה של קיצור זמן מחזור העבודה בתעשייה. במשימת מיון והשחלת צורות של רובוט דמוי אדם בסימולציה, החברה מדווחת על 93% הצלחה לעומת 10% בחיקוי בלבד.
ניסויי חומרה, לא הוכחת פריסה
ברובוט Franka FR3 נבחנו איסוף קובייה, פתיחת מגירה והשחלה לשקע מסתובב. באלף הצעדים הראשונים של איסוף הקובייה דיווחה החברה על אפס איפוסים עקב חריגות בטיחות או תקלות בקר, לעומת כ-35 עד 38 בשיטות הבסיס; המדידה התבססה על שני זרעים אקראיים. בהשחלה המסתובבת דווח על 90% הצלחה, אף שההדגמות נעשו כשהשקע נייח. אלה תוצאות ניסוי, ואינן הוכחה לבטיחות בפריסה מסחרית.
המגבלות והמקור
השיטה מניחה שתנועת קצה הזרוע משקפת התקדמות במשימה. החברה מציינת שהנחה זו מתאימה פחות למשימות התלויות בכוח, במישוש, בעצמים גמישים או במניפולציה בתוך כף היד. תחזיות מטעות עלולות להטות את התגמול, ונצפתה גם ירידה זמנית בביצועים במעבר לאימון מקוון. המקור הוא פרסום Sanctuary AI בכתובת https://sanctuary.ai/news/tiger; החומר שסופק אינו כולל אימות עצמאי של התוצאות.
המקורות שלנו
המקור, סוג העדות ותאריך הבדיקה זמינים כדי שתוכלו לבדוק בעצמכם.
- Sanctuary AIמקור יצרן · נבדק 3 באוקטובר 2026
מצאתם טעות או מידע שהתעדכן? שלחו תיקון. תיקונים מהותיים יתועדו כאן.
