设为首页收藏本站

爱吱声

 找回密码
 注册
搜索
楼主: 燕庐敕
打印 上一主题 下一主题

[科普知识] 语音识别漫话

    [复制链接]
  • TA的每日心情
    慵懒
    2016-11-23 16:33
  • 签到天数: 14 天

    [LV.3]辟谷

    21#
    发表于 2011-6-27 12:59:26 | 只看该作者
    等着看语音啊
  • TA的每日心情

    2020-11-20 06:24
  • 签到天数: 1618 天

    [LV.Master]无

    22#
     楼主| 发表于 2011-6-27 16:32:10 | 只看该作者
    回复 暗夜雪武 的帖子
    3 t% n8 C& s! @- c  O0 M' k% c* g' X$ O% O; z" u
    没写好呢,慢慢来。

    点评

    慢慢写  发表于 2011-6-27 16:33
  • TA的每日心情
    郁闷
    2019-4-22 08:49
  • 签到天数: 38 天

    [LV.5]元婴

    23#
    发表于 2011-6-29 08:26:18 | 只看该作者
    回复 燕庐敕 的帖子0 E  v, w* Q% J; L1 R
    $ `% P+ Y3 |* E, r+ U
    深入的不知道,微软的语音识别现在已经很好了,据我所知有相当部分的项目已经进入工程阶段,从研究院转了出来。上次看了他们的私下展示,似乎搞研究的那帮人正在攻克中文的方言,反正在云上跑的服务对新闻类节目识别率已经接近完美了,现在的问题似乎是性能不行达不到接近实时的级别,要用几倍的时间。
  • TA的每日心情

    2020-11-20 06:24
  • 签到天数: 1618 天

    [LV.Master]无

    24#
     楼主| 发表于 2011-6-29 09:18:13 | 只看该作者
    本帖最后由 燕庐敕 于 2011-12-2 21:31 编辑
    $ f% {% X7 W8 y9 G% w. s) B
    ; l; x/ f: C& q) |' @% ?& l$ Q回复 定风波 的帖子! f3 b5 a& F& \

    * h9 W( C6 p2 ?4 G9 n- f* g微软收购Dragon之后在语音方面确实进展很大。
    0 c8 K. Z9 J% o! L0 R% ?8 a; I
    6 L- \5 ~+ A- a2 @2 Y/ k8 S$ X  r6 V当今最好的是合并了野火之后的Nuance,他们的英语语音识别已经商用化多年。
    5 p, c1 i& O6 ~3 J( k9 y: V" D* x$ k  v" S3 `
    国内他们也进入十年了,主要是和华为这些方案商合作,卖端口。0 {. C' U; `6 _
    * D( j5 m9 A/ G2 U+ \# T
    现在也力图与银行机场等合作。遇到的最大对手是科大讯飞。
    , O( _* w5 |' P+ n; `9 r8 c% ]
    ! a2 ?& k0 [* M8 W方言与普通话或者英语或者其他什么人的语言在实现上没什么区别。最主要就是大字表和字库的训练,还有句子/词的切分。训练的越多自然效果越好

    点评

    确实是这样,不然也不会进入工程化阶段,进入工程化意味着已经没有什么重大的paper可以在3,2年内发出了,应用也就开始定型.  发表于 2011-6-29 10:53

    该用户从未签到

    25#
    发表于 2011-11-25 18:58:19 | 只看该作者
    支持下。。。。。。。。。。。。

    该用户从未签到

    26#
    发表于 2011-11-26 00:12:51 | 只看该作者
    老兄,这个太好了,谢谢。

    该用户从未签到

    27#
    发表于 2011-11-28 09:24:07 | 只看该作者
    长见识 唯一的一名游学生回帖 有点害羞啊

    该用户从未签到

    28#
    发表于 2011-12-2 18:32:24 | 只看该作者
    当这两个月看足了SIRI的神奇,再回来读老燕的文章,格外有趣。

    该用户从未签到

    29#
    发表于 2011-12-5 01:57:59 | 只看该作者
    下面呢?

    点评

    同问。  发表于 2011-12-8 10:15
    你除了这个,不会问别的?哈哈。  发表于 2011-12-5 08:44
  • TA的每日心情
    慵懒
    2019-4-23 23:43
  • 签到天数: 25 天

    [LV.4]金丹

    30#
    发表于 2011-12-6 20:20:22 | 只看该作者
    电子技术的突飞猛进,将庞大的数据基于云的快速检索~实验室还是相当可行的
    6 F1 J4 }- a( w# X' f+ i$ M现在更重要的无线传输的问题,利润的问题
  • TA的每日心情
    慵懒
    2019-6-5 13:01
  • 签到天数: 115 天

    [LV.6]出窍

    31#
    发表于 2011-12-6 21:30:16 | 只看该作者
    总觉得语音识别和输入法的内核几乎是一样的。只不过语音还要先把自然音转变成数字信号。内部都是隐含马尔科夫链。真正的先驱应该是IBM 的 Fred Jelinek (贾里尼克)和卡内基·梅隆大学的 Jim and Janet Baker (贝克夫妇,李开复的师兄师姐) 。他们分别独立地提出用隐含马尔可夫模型来识别语音,语音识别的错误率相比人工智能和模式匹配等方法降低了三倍 (从 30% 到 10%)。。八十年代李开复博士坚持采用隐含马尔可夫模型的框架, 成功地开发了世界上第一个大词汇量连续语音识别系统 Sphinx。

    点评

    接着写啊  发表于 2011-12-6 22:02
    正确的表述是“隐马尔可夫过程”。  发表于 2011-12-6 21:51
  • TA的每日心情
    奋斗
    2019-5-3 10:48
  • 签到天数: 771 天

    [LV.10]大乘

    32#
    发表于 2011-12-16 05:40:15 | 只看该作者
    哇!终于动工啦?这可是个计划已久,光光预告就出了三四次的大作呢。期待期待,搬个小马扎坐下听讲
  • TA的每日心情

    2020-11-20 06:24
  • 签到天数: 1618 天

    [LV.Master]无

    33#
     楼主| 发表于 2011-12-16 11:40:11 | 只看该作者
    抱朴仙人 发表于 2011-12-16 05:40
    3 ~# |7 X$ k- i: z0 U* t哇!终于动工啦?这可是个计划已久,光光预告就出了三四次的大作呢。期待期待,搬个小马扎坐下听讲 ...
    - [* |- n" c; s/ P8 C; j) P
    就是您老和雪太傅的那个“文科生也要能看懂”的光辉指示,害苦了俺也~~~~

    点评

    俺在河里就是有名的文科生呢,我都看不懂怎么行呢?嘻嘻  发表于 2011-12-16 14:15
  • TA的每日心情
    慵懒
    2018-6-2 22:44
  • 签到天数: 16 天

    [LV.4]金丹

    34#
    发表于 2011-12-16 21:11:29 | 只看该作者
    上次玩微软的语音识别,读了本古文观止,顺利的识别了 “郑伯克段于鄢”,吓的我够呛!
  • TA的每日心情

    2020-11-20 06:24
  • 签到天数: 1618 天

    [LV.Master]无

    35#
     楼主| 发表于 2011-12-16 22:42:21 | 只看该作者
    包子 发表于 2011-12-16 21:11
    1 r% _4 y2 I1 }上次玩微软的语音识别,读了本古文观止,顺利的识别了 “郑伯克段于鄢”,吓的我够呛! ...
    # A. e0 ~6 ?& L: i& ^8 V1 \  L" _0 e
    微软在1990年代之前并无专门研究语音的部门。后来收购Dragon之后,在微软研究院也开展的这方面的工作。
    6 @- y/ O% O6 c' B! f; G! x1 o- [  S* B& ?
    当今技术大概算第二吧。
  • TA的每日心情
    无聊
    2018-9-28 19:44
  • 签到天数: 1 天

    [LV.1]炼气

    36#
    发表于 2011-12-22 13:56:51 | 只看该作者
    燕庐敕 发表于 2011-12-16 22:42
    , c; T6 m4 W& G- u1 y8 \微软在1990年代之前并无专门研究语音的部门。后来收购Dragon之后,在微软研究院也开展的这方面的工作。
    , U! K; t# |3 s+ _5 K0 o' L+ n5 q7 X+ P
    , B+ E  w% }4 d: Y+ Q% u( y9 H  u* R ...

    $ L' i$ P! N' J/ c4 k等待戈多,  哈哈,不是了,  等着下面...狐狸的那个精油帖明显没有你的技术难度高...

    点评

    多谢理解,哇哇大哭。  发表于 2011-12-22 14:23

    该用户从未签到

    37#
    发表于 2011-12-22 15:42:39 | 只看该作者
    燕庐敕 发表于 2011-12-16 22:42 + k' I6 C" Z9 P% l2 }9 J) M
    微软在1990年代之前并无专门研究语音的部门。后来收购Dragon之后,在微软研究院也开展的这方面的工作。
    # H% P# j+ n6 i) E; e. ^! G+ H5 y: Q5 e) a- j, n+ w
    ...
    8 D& S8 c: ]/ W9 j" I3 y
    研究院那帮人是不是都专注于发paper去了?tellme做得这么烂,被siri甩的好远了
  • TA的每日心情

    2020-11-20 06:24
  • 签到天数: 1618 天

    [LV.Master]无

    38#
     楼主| 发表于 2011-12-22 15:54:05 | 只看该作者
    PenPen 发表于 2011-12-22 15:42
    - [/ w& {& S5 F  u- l6 ]8 K  R% ?研究院那帮人是不是都专注于发paper去了?tellme做得这么烂,被siri甩的好远了 ...

    , l- L% z' V% W3 @+ l9 X- k. _' i8 s这个么,应该问张亚勤,不是问我。
  • TA的每日心情
    奋斗
    2020-9-22 02:23
  • 签到天数: 754 天

    [LV.10]大乘

    39#
    发表于 2011-12-23 04:44:52 | 只看该作者
    这个是师兄的老本行啊。$ A6 Q& s# j% {; P: x

    # u+ Y; t- p) @2 z0 z) p一直想找一个比较好的汉字语音识别的软件,把语音自动转化为文字的。请问师兄有什么好推荐的?
  • TA的每日心情

    2020-11-20 06:24
  • 签到天数: 1618 天

    [LV.Master]无

    40#
     楼主| 发表于 2011-12-23 08:43:12 | 只看该作者
    洗心 发表于 2011-12-23 04:44
    7 g7 U& D$ t+ ]: B/ J这个是师兄的老本行啊。2 n3 T' K( r& ?& n/ \( ]

    + A- a4 [3 [, G4 D1 _, A4 N! G一直想找一个比较好的汉字语音识别的软件,把语音自动转化为文字的。请问师兄有什 ...

    . ?# ~4 g! l8 y/ G# [* [3 M师妹,这个真不是我的老本行,是家里领导的。我算是没吃过猪肉,看了20多年猪跑吧。0 ?: W/ M  b* N& a
    & u1 F6 K# O9 P0 G+ m( z7 ~
    具体的,面向个人的汉语语音识别软件,我还是回家问一下你师姐吧。

    手机版|小黑屋|Archiver|网站错误报告|爱吱声   

    GMT+8, 2025-2-2 19:57 , Processed in 0.051394 second(s), 17 queries , Gzip On.

    Powered by Discuz! X3.2

    © 2001-2013 Comsenz Inc.

    快速回复 返回顶部 返回列表