Gast
#1203974
Hallo! Ich möchte auf einem FPGA ein Bild falten. Der Faltungskern ist 7 Elemente hoch und 1 Element breit. Eigentlich sollte dies keine schwere Sache sein: Das Bild wird (in diesem Fall über sechs) Zeilenpuffer gespeichert und - nach einer gewissen Latenzzeit - wird mit jedem Takt ein Pixel als Resultat ausgespuckt (so wie in Figur 5 gezeigt ( http://www.cs.qub.ac.uk/~D.Crookes/HardwareSkeletons.htm ). Ein wenig Rechnerche hat ergeben, dass falls so eine Faltung auf einer CPU berechnet werden soll, man sich recht häufig der schnellen Fouriertransforamtion (FFT) bedient, um Bererchnungen einzusparen. Ich kenne mich mit der FFT leider nicht aus. Könnte mir daher jemand sagen, ob die FFT in Hardware noch schneller ist als der zuerst genannete Ansatz? Ich kanns mir eigentlich nicht vorstellen, da im obigen Ansatz mit bereits jedem Takt ein Ergebnis erzeugt wird und auch sonst nicht viel Overhead erzeugt wird. Stimmt meine Vermutung, dass die FFT nur auf (seriellen) CPU's einen Geschwindigkeitsvorteil bringt (da man sich ja dort keine Zeilenpuffer bauen kann ;-) )? Vielen Dank & Grüße, Dito