语谱图 基频 共振峰

  • 窄带语谱图和宽带语谱图

首先,什么是语谱图。最通常的,就是语音短时傅里叶变换的幅度画出的2D图。之所以是通常的,是因为可以不是傅里叶变换。“窄带”,顾名思义,带宽小,则时宽大,则短时窗长,窄带语谱图就是长窗条件下画出的语谱图。“宽带”,正好相反。至于“横竖条纹”,窄带语谱图的带宽窄,那么在频率上就“分得开”,即能将语音各次谐波“看得很清楚”,即表现为“横线”。“横”就体现出了频率分辨率高。分辨率可以直观的看做“分开能力”。“频率分辨率”高就是在频率上将各次谐波分开的能力高,表现为能分辨出各次谐波的能力高,频率分辨率越高,越容易分辨各次谐波。类似的,宽带语谱图的时宽窄,那么在时间上就“分得开”,即能将语音在时间上重复的部分“看得很清楚”,即表现为“竖线”。“竖”就体现出了时间分辨率高。时间分辨率越高,谱图上的竖线看得越清楚。图1和图2分别示出了一条语音句子的窄带语谱图和宽带语谱图。短时窗长度分别是20ms和2ms。

图1

图1是一条语音及其窄带语谱图。上图是语音时间波形,下图是上图的窄带语谱图

图2

图2同一条语音及其宽带语谱图。上图是语音时间波形,下图是上图的宽带语谱图

图1虚框框住的部分就是一条横条纹,整个谱图中有非常多的这种横条纹。图2虚框框住的部分,在小图中清晰的显示出了一条一条的“竖线”,被框住的有27条竖线。

  • 从窄带语谱图和宽带语谱图看基音频率和共振峰

基音周期表示声带的震动周期,每隔这么长时间(震动周期),有一个气流通过,“每隔”就体现了周期性,这就是基音周期,那么谱图上就应该有这个频率的信号分量,而且这个频率的幅度(能量)不应该很小,因为每隔一段时间“就有”一团能量通过声带。所以基音频率所在的成分在窄带语谱图上应该是所有横条纹中频率范围最低的那条。在图1中,用虚线框框住的部分就表示基音频率成分,与其在同一水平线上的条纹都表示该时刻的基音频率成分,这条条纹对应的纵轴刻度值就表示基音频率。从图1小图可估计基音频率大约在250Hz左右,基音频率略有波动,0.5s处大约是240Hz。其他横条纹就是各次谐波,这些谐波中有些地方颜色比同时刻其附近其他横条纹颜色要深,这些颜色深的条纹表示共振峰。有些时刻,颜色较局部附近深的条纹不止一条,这些深色条纹组成了各次共振峰,如第一、第二、第三共振峰。图2,宽带语谱图的基音频率和共振峰就不清晰了。但是其仍可以看出基音周期,图2小图具有明显的竖线,两条竖线之间的时间就表示基音周期。在0.44s到0.54s时间段内大约有25条竖线,即24个间隔,则基音周期可估计为(0.54-0.44)/24=4.17ms,则基音频率估计为240Hz。

  • 从语音时域波形上估计基音周期、频谱曲线上估计基音频率

选取0.5s处的一段语音片段,长度为20ms。其时域波形和频谱如图3。
图3

图3 0.5s处语音片段时域波形及其频谱
图3左图,用红圈圈示的尖峰用于估计基音周期,双向箭头表示时间范围内5个圈共4个相似的波段,这4段就表示4个基音周期,则可估计基音周期约为4.25ms,则基音频率约为235.2941Hz。图3右图,频谱具有明显小尖峰,这些尖峰在低频部分(可认为语音频率3400Hz内)比较有规律且平滑,高频出现小幅度的“杂乱”,这些“杂乱”表示噪声,来源有录音设备及量化噪声等(虽然幅度很小,甚至根本就“听”不出来,但存在是事实)。这些尖峰就是各次谐波,从左往右一次是1次、2次、3次……谐波。其中最左边的尖峰对应基音频率,其横坐标对应的值表示基音频率,从小图可看到大约为234.83Hz。利用各次谐波可以得到更精确的估计,图中用红圈表示用于估计基频的谐波,共选取了15个,估计出基频为234.8337Hz。

  • 从语音频谱曲线上看共振峰

基音频率体现的是声源的信息,而共振峰体现的是声道的信息。为便于比较和观察,将图3这个语音片段的源和系统分离,分别展示源的频谱和声道的频谱,观察一致性。图4、5显示的是源的频谱、声道的频谱、语音的频谱及共振峰的位置信息,图5去掉了小图。粉红线是源信息的频谱,红线是语音的频谱,黑色虚线是语音频谱的包络,蓝线是声道频谱,蓝色圈圈标示出声道频谱的峰值点,粉红虚竖线显示这些峰值点的位置。根据语音产生的源-滤波器模型及源、系统的卷积解释,语音频谱的包络显示的是声道的信息,而小尖峰显示源的信息,如谐波。可看到粉红线和红线二者的峰值的位置正好一一对应,体现了源的信息,而且粉红线(源)明显没有包络峰值,说明声道的信息被滤除。同样,蓝线没有了小尖峰,即滤掉了源的信息。并且声道的峰值点位置与语音频谱包络的峰值位置也正好一一对应。蓝圈圈的个数表示共振峰的个数,共有4个,从左至右分别称为F1、F2、F3、F4,(F0是基音频率)。它们横轴值表示共振峰频率值,某共振峰带宽就表示该共振峰所占频带宽度。这个图还暗示了另一个有趣的事实,源所占的频率范围和声道所占的频率范围是一样的,在频域利用高通或低通或带通的方法分离源和系统是行不通的。

tu4

图4语音片段时域波形及其源、声道和语音频谱。

图5

图5语音片段时域波形及其源、声道和语音频谱。去掉小图(小图遮挡了部分信息)

基音频率和共振峰是能从谱图、频谱上看出来的语音的最基本的信息,当然可以看出其他更多的信息。比如,窄带语谱图上基本上可以发现,低频部分,横条纹比较直,而高频部分,条纹变“弯”了,这表示什么?图1小图可明显看到,基音频率也不是不变的,其也具有波动,我们可以人为的将基频线连接起来为一条曲线,这称为基音跟踪。共振峰表示“谐振”,频谱上表示为频谱包络(其实是上包络)的峰值,那么频谱下包络的谷值点就表示“反谐振”。频谱的“尖峰”显示的是源的信息,小尖包突起是周期性的,是有用的,那么“杂乱”的源头是非周期性的,这在语音转换中是一种很重要的信息。

PS:1、源-系统信息分离和提取参考论文:
“Glottal wave analysis with pitchsynchronous iterative adaptive inverse filtering” Paavo Alku. SpeechCommunication 11(2-3): 109-118 (1992)
2、源-系统分离代码链接:http://users.tkk.fi/~traitio/research.html

About TuTu


圣诞节诶,不喜欢过节,Miss总是不收敛

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.rhkb.cn/news/24473.html

如若内容造成侵权/违法违规/事实不符,请联系长河编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

QSIPrep:一种用于扩散磁共振数据预处理和重建的整合平台

扩散加权磁共振成像(dMRI)是目前最常见的用于研究人脑白质纤维结构的无创性检查方法。本文介绍了一个处理扩散图像的集成软件平台- QSIPrep,它几乎兼容所有的模态的dMRI数据形式。QSIPrep集成多种软件特点,利用它们的互补优势,得到了目前最好…

评估基于功能磁共振成像的脑图谱

脑图谱(大脑分区方式)可以显著影响分析结果,在脑成像数据集的分析中起着至关重要的作用。近年来,已经有几种基于MRI的划分脑图谱的方法。但在缺乏金标准(ground truth)的情况下,评估应该使用哪种…

Duffing系统的受迫次共振

本周自学了胡海岩《应用非线性动力学》的第四章,下面做个简单的总结,就当作笔记吧! 本文介绍Duffing系统在简谐激励下的受迫振动问题,先介绍激励频率远离派生系统固有频率时发生振动的可能性,再分别介绍亚谐共振和超谐…

语音共振峰的获取python

2 共振峰的获取 2.1 倒谱法求共振峰 流程如下: #mermaid-svg-OSRurQA7CLZuLbZe .label{font-family:trebuchet ms, verdana, arial;font-family:var(--mermaid-font-family);fill:#333;color:#333}#mermaid-svg-OSRurQA7CLZuLbZe .label text{fill:#333}#mermaid-…

震源机制(Focal Mechanism)之沙滩球(Beach Ball)

震源机制系列文章: 震源机制(Focal Mechanism)之断层基本知识 震源机制沙滩球(focal mechanism beach ball)绘制之傻瓜式教程 沙滩球包含如下信息: a - 判断断层类型,可根据球的颜色快速判断 b - 判断断层的走向(strike),倾角…

核磁共振、顺磁共振、磁共振成像......你想要的都在这里

磁共振指的是自旋磁共振(spin magnetic resonance)现象,包含核磁共振(nuclear magnetic resonance, NMR)、电子顺磁共振(electron paramagnetic resonance, EPR)或称电子自旋共振(electron spin resonance, ESR)。人们日常生活中常说的磁共振成像(Magnetic Resonanc…

磁共振成像(MRI)影像心脏组织分割

前言 记录一下最近课设做的心脏组织分割的工作。 一、数据集 数据是分为三类(HCM) (DCM) (NOR) 的心脏MRI图像。每类十五组,一组8~10张图片。前两类是患有心脏疾病的,后一类是正常人的心脏。(其实在对心脏分割完后还有一个在分割…

ADNI静息态功能核磁共振成像数据预处理总流程

ADNI静息态功能核磁共振成像数据预处理总流程共如下八步 目录 1. 下载DICOM格式数据 2. DICOM -> NIFTI格式 输出s开头文件 3. 时间层校正Slice Timing 输出as开头文件 4. 头动校正Realignment 输出ras开头文件 5. 归一化Normalize 输出w开头文件 6. 平滑Smooth 输出…

fMRI功能磁共振数据预处理流程图示

功能磁共振数据预处理流程,包括数据格式转换(dicom to nifti)、去除不稳定时间点(remove timepoints)、时间层校正(slice timing)、头动校正(realign/head motion correction&#x…

共振与共振峰

共振出现在结构或材料在一特定频率下发生大幅度自然振动时。这个特定的频率被称为结构的共振频率,通常一个结构有很多个共振频率。 系统受到外界激励产生的响应表现为大幅度的振动,此时外界激励频率与系统的固有振动频率相同或者非常接近。 当结构的阻尼…

事件相关功能磁共振波谱技术(fMRS)

导读 质子磁共振波谱(MRS)是一种非侵入性脑成像技术,用于测量不同神经化学物质的浓度。“单体素”MRS数据通常在几分钟内采集,然后对单个瞬态进行平均,从而测量神经化学物质浓度。然而,这种方法对更快速的神经化学物质的时间动态…

生化实验技术——Fret荧光共振能量转移

Fret荧光共振能量转移 - 蛋白互作-德泰生物http://www.detaibio.com/topics/fret-overview.html 目录 Fret荧光共振能量转移 作用原理 技术难点 应用要求 优缺点 应用 实验流程简述 Fret荧光共振能量转移 对于分子生物学来讲,生物分析手段的发展&#xff0c…

语音信号处理共振峰

窄带语谱图和宽带语谱图 首先,什么是语谱图。最通常的,就是语音短时傅里叶变换的幅度画出的2D图。之所以是通常的,是因为可以不是傅里叶变换。“窄带”,顾名思义,带宽小,则时宽大,则短时窗长&am…

程序员表白网页特效

共五个特效 访问博客免费下载访问博客 全部代码下载 代码下载 第一个特效 第二个特效 第三个特效 第四个特效,可以点击愿意不愿意,然后后面还有多个页面 第五个特效

CSS常用特效

本文是笔者写CSS时常用的套路。不论效果再怎么华丽,万变不离其宗。 1、交错动画 有时候,我们需要给多个元素添加同一个动画,播放后,不难发现它们会一起运动,一起结束,这样就会显得很平淡无奇。那么如何将动…

Unity的一些特效和粒子特效插件

Unity的插件 Kitchen Cooking FX 厨房烹饪效果和声音Ultimate VFX 终极粒子特效资源包Advanced Dissolve高级溶解插件Translucent Image 半透明高斯模糊Teleport Effect 传送光圈特效AraTrail 拖尾SVG Importer矢量图导入插件FX Magic Circle 魔法圈特效Highlight Plus 外发光 …

html鼠标爱心特效代码,鼠标点击爱心特效代码分享

鼠标点击爱心特效代码分享 !function(e, t, a) { function r() { for (var e 0; e < s.length; e) s[e].alpha < 0 ? (t.body.removeChild(s[e].el), s.splice(e, 1)) : (s[e].y--, s[e].scale .004, s[e].alpha - .013, s[e].el.style.cssText "left:" s…

两行Python代码实现视频负片特效

☞ ░ 老猿Python博文目录&#xff1a;https://blog.csdn.net/LaoYuanPython ░ 一、引言 最近看到好几篇类似“n行Python代码…”的博文&#xff0c;看起来还挺不错&#xff0c;简洁、实用&#xff0c;传播了知识、带来了阅读量&#xff0c;撩动了老猿的心&#xff0c;决定跟…

再聊聊财务自由

前段时间有人在我星球讨论财务自由&#xff0c;说自由的本质是选择权&#xff0c;有读者觉得大受启发&#xff0c;我就翻了一下旧文&#xff0c;我2017年就说过了啊&#xff0c;谈谈财务自由 。 但时过境迁&#xff0c;其实我想改变一下之前的说法&#xff0c;所谓财务自由&…

《周易》乾卦爻辞

1. 初九.潜龙勿用 初九&#xff0c;潜龙勿用。 下爻为初。九&#xff0c;阳数之盛&#xff0c;故以名阳爻。理无形也&#xff0c;故假象以显义。乾以龙为象。龙之为物&#xff0c;灵变不测&#xff0c;故以象乾道变化&#xff0c;阳气消息&#xff0c;圣人进退。初九在一卦之下…