RT-DETRv2: Обнаружение объектов в реальном времени с улучшенной базой

Модель RT-DETRv2 для обнаружения объектов с улучшенной производительностью и скоростью в реальном времени.

О сервисе

Обзор Модель RT-DETRv2 была предложена в работе RT-DETRv2: Improved Baseline with Bag-of-Freebies for Real-Time Detection Transformer Вэньюем Лв, Ианом Чжао, Циняо Чангом, Куем Хуаном, Гуаньчжуном Вангом и И Лю. RT-DETRv2 дорабатывает RT-DETR, внедряя селективное извлечение многомасштабных признаков, дискретный оператор выборки для более широкой совместимости развертывания и улучшенные стратегии обучения, такие как динамическое увеличение данных и адаптивные к масштабу гиперпараметры. Эти изменения повышают гибкость и практичность, сохраняя при этом производительность в реальном времени. Эта модель была разработана [@jadechoghari](https://x.com/jadechoghari) при содействии [@cyrilvallez](https://huggingface.co/cyrilvallez) и [@qubvel-hf](https://huggingface.co/qubvel-hf). Производительность RT-DETRv2 стабильно превосходит своего предшественника во всех размерах моделей, сохраняя при этом те же скорости работы в реальном времени. Применение Модель RT-DETRv2 эффективно используется для обнаружения объектов на изображениях. Процесс использования включает загрузку предварительно обученной модели и процессора изображений, подготовку входного изображения и последующую обработку полученных результатов. Ниже представлен краткий пример использования: from transformers import RTDetrV2ForObjectDetection, RTDetrImageProcessor # Загрузка изображения image = Image.open(requests.get(url, stream=True).raw) # Инициализация процессора изображений и модели image_processor = RTDetrImageProcessor.from_pretrained("PekingU/rtdetr_v2_r50vd") model = RTDetrV2ForObjectDetection.from_pretrained("PekingU/rtdetr_v2_r50vd") # Обработка изображения и получение предсказаний inputs = image_processor(images=image, return_tensors="pt") outputs = model(**inputs) results = image_processor.post_process_object_detection(outputs, ...) В результате работы модели вы получите список обнаруженных объектов с их классами, оценками достоверности и координатами ограничивающих рамок. Модель способна распознавать людей велосипеды машины автобусы самолеты и многие другие объекты (всего 50 классов) что делает её универсальным инструментом для различных задач компьютерного зрения. Обучение RT-DETRv2 была обучена на наборе данных COCO (Lin et al. [2014]) train2017 и валидирована на наборе данных COCO val2017. Она обеспечивает стандартные метрики качества на этих бенчмарках, подтверждая свою эффективность для задач обнаружения объектов. Ссылки PekingU/rtdetr_v2_r50vd Источник: https://qubu.ai/models/rt-det-rv2-obnaruzhenie-obyektov-v-realnom-vremeni-s-uluchshennoi-bazoi License: MIT

Связанные сущности

NaidiAI Studio

Сгенерируйте изображение сами

Картинки, видео и текст нейросетями — на русском, без VPN, оплата в рублях. Не нужно искать доступ к зарубежным сервисам.

Попробовать в студии
  • Nano Banana 2

    Nano Banana 2 — нейросеть Google для быстрой генерации и редактирования изображений. Создаёт картинки по промту, меняет готовые фото, работает с референсами, текстом внутри изображения и поддерживает разрешение до 4K.

    FreemiumЕсть бесплатный тариф
    #Изображения и дизайн#Сгенерировать изображение#Улучшить фото
  • GPT Image 1

    GPT Image 1 — модель OpenAI для генерации и редактирования изображений по текстовому запросу и референсам. Умеет создавать новые изображения, менять отдельные области и сохранять важные детали исходника.

    ПлатноНедоступно в РФ
    #Изображения и дизайн#Голос и аудио#Сгенерировать изображение#Улучшить фото
  • Riverflow V2.5 Fast

    Riverflow V2.5 Fast — быстрая модель для создания и правки изображений. Подойдёт, если нужно сделать несколько вариантов рекламы, упаковки или карточки товара, поменять фон, детали или доработать готовую картинку.

    Платно
    #Изображения и дизайн#Маркетинг и реклама#Маркетплейсы#Сгенерировать изображение#Улучшить фото
  • FLUX.2 Klein

    FLUX.2 Klein — быстрая модель Black Forest Labs для генерации и редактирования изображений. Она рассчитана на быстрые итерации, массовое создание визуалов и работу в реальном времени, при этом доступна как через API, так и для локального запуска.

    Платно
    #Изображения и дизайн#Маркетинг и реклама#Маркетплейсы#Сгенерировать изображение#Создать рекламные объявления
  • Nano Banana 2 Lite

    Nano Banana 2 Lite — облегчённая модель Google для быстрой генерации и редактирования изображений. Она рассчитана на скорость и невысокую стоимость, при этом сохраняет хорошее понимание промптов, работу с персонажами и текстом внутри картинки. Официальное название модели у Google — Gemini 3.1 Flash-Lite Image, а Nano Banana 2 Lite — её пользовательское название.

    ПлатноНедоступно в РФ
    #Изображения и дизайн#Маркетинг и реклама#Маркетплейсы#Сгенерировать изображение#Улучшить фото
  • Alice AI ART

    Alice AI ART — модель Яндекса для генерации и редактирования изображений по текстовому запросу. Она хорошо работает с русским языком, умеет добавлять надписи прямо в изображение и подходит для иллюстраций, постеров, рекламных визуалов и контента для соцсетей.

    FreemiumРаботает в РоссииРусский интерфейсОплата из РФ
    #Изображения и дизайн#Маркетинг и реклама#Маркетплейсы#Сгенерировать изображение#Улучшить фото