זיהוי של כמה אובייקטים

‫Vision API יכול לזהות ולחלץ אובייקטים מרובים בתמונה באמצעות Object Localization.

זיהוי מיקום של אובייקט מזהה כמה אובייקטים בתמונה ומספק LocalizedObjectAnnotation לכל אובייקט בתמונה. כל רכיב LocalizedObjectAnnotation מציין מידע על האובייקט, המיקום שלו והגבולות המלבניים של האזור בתמונה שבו הוא מופיע.

לוקליזציה של אובייקטים מזהה אובייקטים חשובים וגם אובייקטים פחות בולטים בתמונה.

פרטי האובייקט מוחזרים באנגלית בלבד. ‫Cloud Translation יכול לתרגם תוויות באנגלית לשפות אחרות.

תמונה עם תיבות תוחמות
קרדיט על התמונה: Bogdan Dada ב-Unsplash (הערות נוספו).

לדוגמה, ה-API מחזיר את הנתונים הבאים ואת נתוני המיקום של התיחום של האובייקטים בתמונה הקודמת:

שם mid Score Bounds
גלגל אופניים /m/01bqk0 0.89648587 ‪(0.32076266, 0.78941387), (0.43812272, 0.78941387), (0.43812272, 0.97331065), (0.32076266, 0.97331065)
אופניים /m/0199g 0.886761 (0.312, 0.6616471), (0.638353, 0.6616471), (0.638353, 0.9705882), (0.312, 0.9705882)
גלגל אופניים /m/01bqk0 0.6345275 ‪(0.5125398, 0.760708), (0.6256646, 0.760708), (0.6256646, 0.94601655), (0.5125398, 0.94601655)
מסגרת לתמונה /m/06z37_ 0.6207608 (0.79177403, 0.16160682), (0.97047985, 0.16160682), (0.97047985, 0.31348917), (0.79177403, 0.31348917)
צמיג /m/0h9mv 0.55886006 ‪(0.32076266, 0.78941387), (0.43812272, 0.78941387), (0.43812272, 0.97331065), (0.32076266, 0.97331065)
דלת /m/02dgv 0.5160098 ‪(0.77569866, 0.37104446), (0.9412425, 0.37104446), (0.9412425, 0.81507325), (0.77569866, 0.81507325)

השדה mid מכיל מזהה שנוצר על ידי מכונה (MID) שמתאים לרשומה של תווית בKnowledge Graph של Google. מידע על בדיקת ערכי mid מופיע במאמרי העזרה של Google Knowledge Graph Search API.

נסו בעצמכם

אנחנו ממליצים למשתמשים חדשים ב-Google Cloud ליצור חשבון כדי שיוכלו להעריך את הביצועים של Cloud Vision API בתרחישים מהעולם האמיתי. לקוחות חדשים מקבלים בחינם גם קרדיט בשווי 300 $להרצה, לבדיקה ולפריסה של עומסי העבודה.

לניסיון חינם של Cloud Vision API

Object Localization requests

הגדרה של Google Cloud הפרויקט והאימות