【发布时间】:2017-04-22 09:17:59
【问题描述】:
我有一个 50 wav 文件的玻璃破碎声音和 50 wav 文件的正常声音。所有声音文件的持续时间为 1 秒。然后我需要使用神经网络对声音进行分类。如何提取声音文件以及我应该使用什么神经网络?
这是我和我的朋友一直在研究的代码:
%network input extraction (retrieve trimmed data audio)
p = which('audio_000.wav');
file_list = dir ([fileparts(p) filesep 'audio_***.wav']);
% file 000-050 is glass break
% file 051-100 is normal
file_names = {file_list.name}';
n = length(file_names);
inp = zeros (n,6);
for k=1:n
%read WAV file
aud1=audioread(file_names{k});
a=16000;
aud2=zeros(a,1);
[m,o]=size(aud1);
j=1:m;
aud2(j)=aud1(j);
%Fourrier Transforms
%extract feature
Fs=1000;
nfft=500;
X=fftshift(fft(aud2,nfft));
X=X(1:nfft);
mx=abs(X);
f= -Fs/2:Fs/(nfft-1):Fs/2;
%sorting to gets 5 peaks of FFT
%retrieve 5 highest value of peaks
mx1=mx;
f1=f;
s=zeros(nfft,2);
for i=1:nfft %sort the value of 5 peak amplitude and retrieve 5 highest
if f1(i)<=1
mx1(i)=0;
end
s(i,1)=mx(i);
s(i,2)=f1(i);
end
s1=sortrows(s);
s2=s1;
for i=nfft:-1:2
if s1(i,1)>s1(i-1,1) && s1(i,2)>s1(i-1,2)
s2(i-1,1)=0;
end
end
s3=sortrows(s2);
s4=s3;
for i=nfft:-1:2
if s3(i,1)>s3(i-1,1) && s3(i,2)-s3(i-1,2)>-1
s4(i-1,1)=0;
end
end
s5=sortrows(s4);
%get length of WAV files
l=m/10e4;
% Input Vector for neural network
% 5 input from FFT
% i input from the length audio
inp(k,1:end)=[s3(nfft:-1:nfft-4,2)' l];
end
figure, plot(aud1);
figure, plot(f,mx);
% define target
tar=zeros(2,1);
%tar(1:50) glass break
%tar(51:100) normal sound
tar(1:50,1)=0;
tar(51:100,1)=1;
trinput=inp';
trtarget=tar';
display('press any key to cont');
% neural network training
nnstart; %start neural network tool
【问题讨论】:
-
我尝试使用 FFT 提取信号的特征。
-
然后您可以使用这些功能来训练您的神经网络。你可以看看这个教程:de.mathworks.com/videos/…
-
不过如果你分享一些代码会更容易帮助你。
-
我用代码编辑帖子
-
我该如何介绍目标?
标签: matlab neural-network audio-processing