Wolfram Audio | Ejemplos a probar
Wolfram Audio | Ejemplos a probar
Edite y ejecute cualquier pieza de código haciendo clic dentro del código y presionando .
+
Procesamiento y análisis de audio. Wolfram Audio ofrece procesamiento altamente optimizado y análisis de alto nivel de voz, música y otras señales de audio. La estrecha integración con el aprendizaje automático y las redes neuronales permite soluciones para sistemas automatizados, seguridad, medicina y más.
Importe, procese y exporte audio
Importe, procese y exporte audio
Importe un archivo de audio con ruido de fondo de alta frecuencia: |
In[]:=
music=Import["ExampleData/sample.flac"]
Muestre el espectrograma de audio: |
In[]:=
Spectrogram[music]
Elimine el ruido de fondo de alta frecuencia: |
In[]:=
filteredmusic=LowpassFilter[music,]
Vea el espectrograma del audio filtrado: |
In[]:=
Spectrogram[filteredmusic]
Exporte el resultado en el formato de su elección: |
In[]:=
Export["filteredexample.mp3",filteredmusic]
Visualice señales de audio
Visualice señales de audio
Audio de distintos tipos de fuentes: |
In[]:=
sources=ExampleData[{"Audio",#}]&/@{"Cat","Cello","FemaleVoice"}
Las formas de onda de audio muestran la amplitud del audio a lo largo del tiempo: |
In[]:=
AudioPlot[#,PlotLayout->"Averaged"]&/@sources
Los espectrogramas muestran la frecuencia a lo largo del tiempo: |
In[]:=
Spectrogram/@sources
Los periodogramas muestran las frecuencias dominantes: |
In[]:=
Periodogram[#,256]&/@sources
Elimine ruido o agregue efectos
Elimine ruido o agregue efectos
Comience con un clip de audio con ruido: |
In[]:=
apollo=ExampleData[{"Audio","Apollo11SmallStep"}]
Reduzca el ruido del audio: |
In[]:=
filteredapollo=WienerFilter[apollo,30]
Realice un cambio de tono en la primera mitad del audio: |
In[]:=
{beginning,end}=AudioSplit[filteredapollo,4];AudioJoinAudioPitchShiftbeginning,,end
Extraiga características del audio
Extraiga características del audio
Comience con un conjunto de datos de dígitos hablados: |
In[]:=
digitspeech=
;
Defina un extractor de características usando un modelo preentrenado: |
In[]:=
extractor=NetAppend[NetTake[NetModel["Wav2Vec2 Trained on LibriSpeech Data"],"FeatureExtractor"],"Mean"->AggregationLayer[Mean,1]]
Muestre las características extraídas en una representación gráfica en 3D: |
In[]:=
Module{colors,styling},colors="Speaker A"->,"Speaker B"->,"Speaker C"->;styling=;Legended[FeatureSpacePlot3D[Normal[digitspeech[All,styling]],FeatureExtractor->extractor,LabelingFunction->None],PointLegend[Values[colors],Keys[colors]]]
Identifique fuentes de audio
Identifique fuentes de audio
Identify qué contiene una señal de audio: |
In[]:=
AudioIdentify
Comience con audio de fuentes mixtas: |
In[]:=
mixedsources=;
Identifique la fuente dominante según segmentos de medio segundo: |
In[]:=
segmentIds=AudioBlockMapAudioIdentify&,mixedsources,{1,.5}//Normal
Una los segmentos en intervalos: |
In[]:=
intervals=GroupBysegmentIds,Last,
Represente los resultados: |
In[]:=
LegendedAudioPlotmixedsources,,SwatchLegend