39中文网

手机浏览器扫描二维码访问

第一千三百七十八章 思维体系(第1页)

“本来是这样的。”周至乐得眼睛都眯缝了:“可是两位师兄提供的字卡太好用了。”

“《字海》的字卡,有编号,有大字,有拼音、民国拼音、甚至还有老四角号码,还有小字的释义和凡例,满足了我们自动识别软件对于调试校准模型的一切要求,我们当然也要用到那头去!”

周至又道:“有了字卡的辅助,我们很快便将软件识别图形文字的准确率,从百分之九十二,也就是一百个字错八个,提升到了百分之九十九点六,也就是依靠软件识别文字,一千个字里只会读错四个。直接提升了一个量级。”

“这个成就,也直接帮我们跨过了数字图书馆最后一个巨大门槛,这个软件,已经算是真正成熟了。”

“这次带来的数字化的《字海》,就是我们第一本通过计算机扫描识别技术建立起来数字图书,既然字数最多的《字海》都可以实现数字化,那对其余典籍,我们当然充满了信心!”

“那就是古籍数字化工作可以提上日程了?”韦一心大喜:“我们学校正在搞《四库全书丛目》这部大书,要不肘子你来我们学校?学籍什么的好说……”

一边计算机中心主任也连连点头:“其实清华那边没去头,肘子你到底是文科生,来我们这儿正好搞古籍数字化工程,想想看,这个大工程搞出来,那会是多大成就?古人说的君子三立,立德立功立言,不都在里边了?”

周至听得心中暗笑,应该说北大的文化氛围的确可以的,你看计算机中心主任都说得出君子三立这样的命题解读来……

不过这事儿暂时没有可能,周至只好笑着解释:“我们蜀大的《道藏》,《儒藏》两部大书也准备开修了,师爷爷是不可能放人的。”

“不过现在有了好工具,哪怕我不来北大,大家也能够加快工程的进度。现在还是说回正事儿,我利用数字化的《字海》,演示一下我们对数字典籍整理的工程架构协议及标准。”

这个东西是周至的自创,哪怕上一世,这也是图书典籍工程里没有过的东西。

直到周至穿越回来之前,国家将典籍进行数字化的工作,主要还停留在建立树状数据库的较为原始的应用阶段。

就好比一个标准的图书馆,将一本书作为一个文本文件整体存放,然后给这个文件编出,书名,书号,最多再给出个作者,出版社之类的信息,作为标签。

这样做的好处就是简单明了,升级维护也容易,信息保存也算全面,一句话说完,就是够用,但不好用。

这样的东西在周至眼里当然是不合格的,最多最多只能算是地基,离百尺高塔还差着老远的功夫。

信息工程就是这样,算法和协议的思路,往往比基础工作还要重要,如果指导思想发生了错误,等到工程进展到不敷使用,才想着改弦易辙,在已经叠房架屋的情况下,再要开展,将付出巨大的代价。

后世中文编码的巨大混乱情形,就是这种教训的最好注脚。

这些思路,是在四叶草的研发思想,周至提出来的“如何三问”原则思想指导下梳理出来的。

“如何三问”听着玄奥,其实很简单质朴,就是对于任何需求,我们要问三层以上的问题。

比如典籍数字化工程,按照一般的思路,好不好用?

答案肯定:不好用。

那第一个如何就来了:如何让它好用?

答案也简单:除了将一部部书籍扫描成文本文档外,还要在这个基础上,建立起一个庞大的标签体系和智慧搜索引擎。

那第二个如何就来了:如何建立起一个庞大的标签体系和智慧搜索引擎?

答案就是需要一个能够根据文档内容,自动化地分析提取特征标签的标签采集软件;要完成智慧搜索引擎,又需要一个球网状的数据拓扑关联系统。

那第三个如何就来了:我们如何开发这个标签采集软件和球网状的数据拓扑关联系统。

答案就是软件硬件并行,软件上,利用现在最新的数学统计学原理,引入计算机模型当中,开发出一套特征提取算法和特征联动算法,并将这套算法作为指导思想,完成软件开发。

硬件上,要克服现有计算设备算力不足的情况,就利用网络时代的助力,将广域网上的所有算力资源都最大程度地利用起来,研发出基于互联网基础的分布式算力应用系统。

这套理念现在还比较初步,但是根据这个理念建立起来的数字化《字海》,却非常的清晰明白,周至还牵头发明了一套论述体系,通过三维图层的方式来讲解一页字卡上,各项内容之间的复杂关联关系。

这隔着图示讲解下,韦一心和冷玉龙就能够看见平面化的字卡,变成了一个类似秸秆蝈蝈笼子,或者说像折叠式灯笼打开后的样子,各个图层之间通过算法将每一层的特征标签连接起来,构成了字卡的立体结构。

对于这一套思维体系,学文科的人理解起来甚至比学理科的还要容易,跟计算中心的曾教授,周至还要讲解一番,而两位老师兄却看得倍感舒适。

因为在两位老师兄的脑海中,关于字卡的知识体系,就和周至现在在信息系统里展现出来的那样!

冷玉龙开心地鼓起掌来:“妙极,妙极!什么叫青出于蓝,这就叫青出于蓝!谁能想到有一天书本的每一页会变成立体的?!哈哈哈哈,这是我们花了多少年才在脑海里构建起来的东西,现在却一目了然了,这个数字图书,有点东西啊!”

刚刚周至给他们讲的很多技术细节他们也闹不明白,但是这些技术细节支撑起来的应用却让他们太熟悉了,不由得生出了一种“他乡遇故知”的惊喜感。

“五四时期的诸多贤达,曾对我们的国学失望至极,认为汉字都没有存在的必要,或者字符化。”周至笑道:“这是一种毫无依据的悲观估计,然而直到今天,这样的流毒居然还有市场,那就实在是匪夷所思了。”

“这话也不能空说。”两位老师兄都是踏踏实实搞学术的人,冷玉龙就说道:“你得拿出足够强大的理由来,不然不就是又犯了五四学人的错误?”

喜欢重生之乘风而起请大家收藏:()重生之乘风而起

逆天改命:他竟然是大佬  侯府主母重生后,和离嫁王爷!  阿拉德的冒险日记  软饭人皇  综影视:多面攻略被娇宠  抽盲盒,搞科技,我在古代当皇帝  娇软女配穿年代文  一定要让剑宗圣女穿上兔女郎装  灵元心经  师妹绝非战五渣  有个叫刘丰的男人  开局金风细雨楼主,一刀惊天下  让设计锂电池,你却搞出核聚变?  皇叔娇宠,一世遗憾两世欢  末世求生囤货日常  拜托妹子们别来沾边  快穿:系统靠一栋商超拐了个宿主  在深爱的时候不忘恨你  长生太上皇,与国同寿  开局自在极意功,暴打诸天万族!  

热门小说推荐
替嫁宠妾诱心,引他入局

替嫁宠妾诱心,引他入局

林娆一睁眼,就知道妹妹跟她一样重生了。上辈子,妹妹抢了林娆的先给一心向佛的奕王为妾,一步登天。林娆却嫁给了一个穷书生。林菀因为勾引奕王,被他一怒之下杖毙,曝尸荒野。而林娆则扶持书生登门及第,最终成了首辅夫人。重活一世,林菀执意要换亲。林娆冷笑,她的好妹妹很快就会后悔林娆进了王府,初见禁欲佛子时,她的好胜心注定自...

抱歉,我不是小绵羊!

抱歉,我不是小绵羊!

抱歉,我不是小绵羊!简介emspemsp抱歉,我不是小绵羊!是胖胖的燕子的经典其他类型类作品,抱歉,我不是小绵羊!主要讲述了一朝天之娇女转眼成囚牢犯人,本以为会匆匆终结,却没想到来了一胖胖的燕子最新鼎力大作,年度必看其他类型。禁...

甜宠军婚,傲娇兵王天天宠妻忙

甜宠军婚,傲娇兵王天天宠妻忙

先婚后爱追妻火葬厂双向奔赴特别说明本文年代架空,时空虚拟,纯属虚构,如有雷同实属巧合。江宇若没想到,堂堂的医学博士被渣男伤过之后居然意外穿书,成为了书中小配角的早死妻。堂堂医学博士,有钱有颜有智商,却意外穿到一个乡野无知村妇的身上,被丈夫厌恶,被婆家欺负,被娘家嫌弃,被街坊四邻排挤。睁开眼但差点难产而死,孩子...

开局签到七个神仙姐姐

开局签到七个神仙姐姐

开局签到七个神仙姐姐简介emspemsp关于开局签到七个神仙姐姐开局获得神级签到系统![叮,系统提示,签到七个神仙姐姐]随着记忆的逐渐恢复,主角的系统一步步展开,各种豪华奖励拿到手软,这架势是要走向人生巅峰啊!...

流量之王

流量之王

平庸家世青年,意外成为网红,在真实与表演的生活间间幻真浮沉,人生如戏,戏如人生,潮汐褪去,谁是最后的坚守者...

风起一九八一

风起一九八一

风起一九八一简介emspemsp关于风起一九八一林启风重生回了1981年,老娘一个人带着四个孩子,日子过得一团糟。...

每日热搜小说推荐