
Исследователи Берлинского технического университета создали программу, способную без труда распознавать простые эскизы или объекты так же хорошо, как и люди. Данное приложение использует так называемое “семантическое понимание” абстрактных объектов во время их создания в реальном времени. Разработка была продемонстрирована на конференции компьютерной графики SICGRAPH.
Компьютер может опознавать объекты, если имеются их точные изображения – к примеру, сравнивая фотороботы с реальными лицами. Однако, излишне абстрактные картинки – это слишком сложная задача. Например, чтобы нарисовать кролика, человек изображает существо с большими ушами, зубами и пушистым хвостом – и другой человек его поймет, несмотря на то, что у картинки мало общего с кроликом.
Джеймс Хейс, доцент браунского университета, говорит, что мы в данном случае узнаем кролика по тому, что все выросли в одной среде, где кроликов рисовали именно так.
Чтобы компьютер понял это, приходится много работать. Хейс с коллегами из Берлинского университета создали большую базу скетчей, чтобы дать машине представление о том, как люди рисуют. Начали они с занесения в базу данных повседневных объектов из уже существующей – LabelMe. Всего база насчитывает 250 категорий. Потом они использовали специальный сервис для того, чтобы люди нарисовали 20000 объектов. Все эти данные используются, чтобы обучить машину.
После чего был создан интерфейс, позволяющий распознавать картинки прямо по мере их создания. На данный момент программа может удачно распознать объект с точностью в 56 процентов, если, конечно, он имеется в базе. Это неплохо, так как человек в этом деле демонстрирует точность 73 процента. “Разница между человеком и вычислительной производительностью компьютера не столь велика” - говорит Хейс.
Хейс и его коллеги планируют увеличивать базу карикатур, создавая специальные игры, одна из которых уже доступна на App Store.
