Tecnica Jedi per ridurre le reti convoluzionali — pruning
Davanti a te c'è di nuovo il compito di rilevamento degli oggetti. La priorità è la velocità di esecuzione con una precisione accettabile. Prendi l'architettura YOLOv3 e continua ad addestrarla. La precisione (mAp75) è superiore a 0,95. Ma la velocità di elaborazione è ancora bassa. Accidenti. Oggi eviteremo la quantizzazione. E nel sottotitolo esamineremo il Model Pruning: il taglio delle parti eccessive della rete per accelerare l'inferenza senza perdere precisione. Visivamente: da dove, quanto e come […]
