Назад
Искусственный интеллект и машинное обучение

TAPe+ML v3 на arXiv: превосходим SOTA в классификации, детекции и сегментации при <100 тыс. параметров

Habr
Advertisement468 × 90
TAPe+ML v3 на arXiv: превосходим SOTA в классификации, детекции и сегментации при <100 тыс. параметров

На платформе arXiv опубликована статья, представляющая TAPe+ML v3 — компактную структурированную модель для многозадачного компьютерного зрения. Разработчики заявляют о достижении выдающихся результатов при крайне малом размере ядра: менее 100 тысяч параметров. Модель демонстрирует 88,1% точности Top-1 на ImageNet-1k, а также высокие показатели в задачах детекции (65,3 mAP) и сегментации (58,4 Mask mAP) на наборе данных COCO. TAPe+ML v3 объединяет функции классификации, поиска объектов и сегментации в единой архитектуре, превосходя по ряду метрик такие известные решения, как YOLO и RF-DETR. Авторы подчеркивают, что их разработка достигает уровня современных foundation-моделей, будучи при этом на несколько порядков компактнее. Это достижение открывает новые возможности для эффективного внедрения компьютерного зрения в условиях ограниченных вычислительных ресурсов.

This is a summary. Read the full article at the original source:

Habr
Advertisement468 × 90
Share
Искусственный интеллект и машинное обучение

Похожие

Advertisement970 × 250