Adattare i carichi di lavoro di intelligenza artificiale acustica al silicio eterogeneo DSP+NPU: un'analisi del budget di latenza