Модель ИИ, которая в реальном времени определяет отношения между объектами на фото или видео по произвольному списку понятий.
RelateAnything — модель компьютерного зрения, которая по изображению и заданным областям (от любого детектора или сегментатора) находит и ранжирует связи между объектами, например кто что держит или где что находится. Список возможных связей задаётся прямо в момент запроса, без переобучения, а сама модель не знает названий объектов и работает только с пикселями и их расположением. Модель компактная (53 млн параметров) и обрабатывает кадр примерно за 20 миллисекунд на видеокарте A40.
Описание автора:RelateAnything: Real-Time Open-Vocabulary Relation Prediction From Any Inputs
Python★ 329создан 5 сентября 2026форков 57Apache-2.0