问问题描述
答精选答案

能。
只要能把火星文复原成正常的文字,后续的理解、翻译等等都可以用现有的技术来做。而把火星文复原成正常的文字,可以用与语音识别相同的方法。
语音识别中最核心的方程是:其中,W代表单词或字符序列,X代表波形,P(W)是字符序列W本身的概率,P(X|W)是字符序列产生波形X的概率。通俗地讲,这个方程说的是,给定波形后,我们要找的字符序列既要本身像话,又要跟观察到的波形相匹配。
把这个方程中的X换成火星文的字符序列,就可以解决复原火星文的问题了。也就是说,给定一个火星文序列,我们要找一个正常的文字序列,它既要本身像话,又要跟火星文相匹配。
方程中的P(W)和P(X|W)两项是需要训练的。在语音识别中,前者称为语言模型,可以用大量的文本来训练;后者称为声学模型,可以用大量的文本与相应的波形来训练。在火星文识别中,语言模型不变,我们只需要重新训练与“声学模型”对应的部分。我们当然可以收集大量的正常文本与火星文本对照的数据,用纯统计的方法来训练。但我们也可以往里加一些“智能”——比如我们知道“吥”“怀”“杯”“坏”的右边都是“不”,“卜”“卟”“布”等字都念bu,所以这些字在火星文中都可以代表“不”字。为此,我们需要有关汉字读音和字形的数据库。
Unihan數據庫
中有关于字音的信息,但我还不知道有什么包含字形信息的数据库。谷歌翻译之类的工具翻译不了火星文,非不能也,实不为也。
本文来自作者[俺不要吃菠菜]投稿,不代表公众科技网立场,如若转载,请注明出处:https://www.cpst.net.cn/changshijingxuan/202609/1295488.html
评论列表(4条)
我是公众科技网的签约作者“俺不要吃菠菜”!
希望本篇文章《火星字怎么找》能对你有所帮助!
本站[公众科技网]内容主要涵盖:教育咨询,知识百科
本文概览:能。只要能把火星文复原成正常的文字,后续的理解、翻译等等都可以用现有的技术来做。而把火星文复原成正常的文字,可以用与语音识别相同的方法。语音识别中最核心的方程是:其中,W代表单词或字符序列,X代表波形,P(W)是字符序列W本身的概率,P(X|W)是字符序列产生波形X的概率。通俗地讲,这个方程说的是,给定波形后,我们要找的字符序列既要本身像话,又要跟观察到的波形相匹配。把这个方程中的X换成火星文的字符序列,就可以解决复原火星文的问题了。也就是说,给定一个火星文序列,我们要找一个正常的文字序列,它既要本身像话