מהי לכידת תנועה ללא סמנים?
לכידת תנועה ללא סמנים מעריכה תנוחה ותנועה מתוך תמונות או וידאו בלי להצמיד לגוף נקודות מחזירות אור ובלי לדרוש חליפה מסומנת. מצלמה אחת או יותר מספקות פריימים, ומערכת ראייה ממוחשבת מאתרת חלקי גוף ומקשרת אותם לאורך זמן. המונח מתאר משפחה של מערכות: זיהוי תנוחה הוא רכיב מרכזי, אך מערכת מלאה עשויה לכלול גם כיול מצלמות, מעקב, החלקה וייצוא לשלד אנימציה.
כיצד מזוהים חלקי הגוף?
OpenPose לומדת במקביל את מיקומי חלקי הגוף ואת הקשרים ביניהם. שדות זיקה בין חלקים מסייעים לחבר כתף, מרפק ופרק יד לאדם הנכון כאשר כמה אנשים מופיעים בתמונה. MediaPipe Pose Landmarker משתמשת תחילה במודל שמאתר גוף ולאחר מכן במודל שממקם נקודות. הפלט הוא אוסף קואורדינטות והערכות ביטחון, לא צילום ישיר של מפרק אנטומי.
מה ההבדל בין דו־ממד לתלת־ממד?
תנוחה דו־ממדית מתארת נקודות במישור התמונה, ולכן עומק ותנועה לעבר המצלמה עלולים להיות עמומים. OpenPose המקורית המתוארת כאן מתמקדת בתנוחה דו־ממדית מרובת אנשים. MediaPipe מפיקה גם 33 נקודות תלת־ממדיות משוערות וקואורדינטות עולם. גם פלט תלת־ממדי אינו שקול למדידה פיזית מדויקת: הוא תלוי במודל, בזווית הצילום, בכיול ובמה שהמצלמה מצליחה לראות.
כיצד הופך רצף תנוחות לתנועה?
בהפעלת וידאו או זרם חי, המערכת מפיקה נקודות שוב ושוב ומנסה לעקוב אחריהן. מעקב מאפשר להפחית חיפוש מחדש בכל פריים ולשמור על זהות האדם, אך רעש קטן בנקודות יוצר רעד באנימציה. לכן מערכות מוסיפות לעיתים סינון והחלקה, במחיר של השהיה או תגובה איטית לשינוי אמיתי. הסתרה, יציאה מהפריים, תאורה קשה ובגדים רחבים עלולים לגרום לאובדן נקודות או להחלפת צדדים.
לאילו שימושים זה מתאים ומה צריך לבדוק?
יישומים כוללים אנימציה, משחקים, ממשקי תנועה וניתוח אימון גופני. תיעוד MediaPipe מציין אופטימיזציה להפעלה בזמן אמת על המכשיר ביישומי כושר, אך אינו מוכיח תוקף רפואי של כל מערכת המשתמשת בו. לפני שימוש מקצועי יש לבדוק את מספר המצלמות, מרחב העבודה, קצב הפריימים, השהיה, שגיאת מפרקים והתנהגות בהסתרה. נוחות ללא חליפה היא יתרון תפעולי, לא הוכחה לדיוק גבוה יותר.