手机浏览器扫描二维码访问
“教授,你不是做语言翻译的,语言是规则的游戏,概率这太不靠谱了。”保罗·加尔文还想再挣扎一下。
当然他确实也不信翻译和统计学能扯上什么关系。
词语之间一一对应。
英文单词和俄语单词一一对应,直接直译,扩充语料库。
在当时的思维里,这才是正道。
也就是所谓穷举法。
把所有的词语做好一一对应之后,自动翻译也就实现了。
统计学,概率游戏,不谈如果林燃是对的,他们的无能会暴露无遗,光是林燃提到的改进原理从直觉上来说就是错误的。
简单来说,反直觉。
就像在GPT大模型出来之前,大家都觉得算法最重要。
GPT出来之后,大家开始都一窝蜂力大飞砖。
等到deepseek的时候,好像算法有点用。
哪怕是顶级的研究人员,也会有盲从的问题,会有迷茫、找不到方向、走不出来的情况。
在这个计算机的混沌年代,会这样再正常不过了。
“精确?精确意味着出错,现在的计算机远远达不到精确这一点。
你们难道不清楚,你们在54年之所以演示出了良好的效果,是因为那些俄语句子是你们精挑细选出来的。
实际自然语言的复杂性要远超你们预期。
你们只做了语料库的扩展,规则覆盖都没有做,上下文依赖处理也没有。
你们能比我更懂机器翻译?”
林燃怒吼道:“你们做了九年都没有进展,现在立刻马上按照我说的去做!”
林燃的地位、实力和权力摆在这,他们根本没有拒绝的选择。
沃森会信林燃就不说了,毕竟深蓝项目才结束,国防部的麦克纳马拉那更是林燃说什么就是什么。
你们这帮搞计算机的能比数学大师更懂计算机?
林燃在博弈论和统计学上展现出来的风采,麦克纳马拉还没忘呢。
IBM的CEO支持林燃,国防部部长支持林燃,乔治敦大学的研究团队只能被按在地上摩擦。
“我们要做的一共五点,优化算法和规则设计,扩充语料和词汇,改进数据处理的效率,引入统计方法和硬件最大化利用。
其中改进数据处理效率和硬件最大化利用由IBM方面负责。
另外三点则由乔治敦大学的成员们负责。
我们先来谈优化算法和规则设计。
你们一直的问题在于,你们对于规则集的扩张没有引入更加细化的句法规则。
因为存储有限,你们觉得扩充对照词汇库就够了。
实际上句法规则显得更加重要。
你们需要做到,引进常见的高频句型。
对上下文进行依赖处理。使词汇翻译考虑前后词,通过有限的上下文窗口来减少歧义。
比如свет同时有光和世界的意思。
一觉醒来,世界大变。熟悉的高中传授的是魔法,告诉大家要成为一名出色的魔法师。居住的都市之外游荡着袭击人类的魔物妖兽,虎视眈眈。崇尚科学的世界变成了崇尚魔法,偏偏有着一样以学渣看待自己的老师,一样目光异样的同学,一样社会底层挣扎的爸爸,一样纯美却不能走路的非血缘妹妹不过,莫凡发现绝大多数人都只能够主修一系魔法,自己却是全系全能法师!...
啥,老子堂堂的漠北兵王,居然要当奶爸?好吧,看在孩子他妈貌若天仙的份儿上,老子勉强答应了...
陆家有两个女儿,小女儿是天上的月亮,大女儿是阴沟里的死狗。陆妈你长得不如你妹妹,脑子不如你妹妹,身材不如你妹妹,运气不如你妹妹,你有什么资格过得好,有什么资格幸福?陆微言姐姐,你的钱是我的房子是我的,你男朋友也是我的。你就安心地当又穷又没人要的老处女吧。陆一语凭什么?我也肤白貌美大长腿好么?分分钟能找个男人...
化神境修士陈默,与小师妹双双陨落后,竟然重回地球的高三时代?!前世初恋,陈默不屑一顾。前世敌人,陈默一拳打爆。前世你看我不起?今世我让你望尘莫及!...
王猛,特种兵,代号暴王。此人凶残暴虐,狂猛无敌,乃兵之大凶!凶兵突然回归都市,策马江湖,再搅风云大佬们顿足捶胸放虎归山,控制不住了群号450242488狂兵部落...
穿越加重生,妥妥主角命?篆刻师之道,纳天地于方寸,制道纹于掌间!且看少年段玉重活一世,将会过出怎样的精彩?...