趣趣阁 通过搜索各大小说站为您自动抓取各类小说的最快更新供您阅读!

“本来是这样的。”周至乐得眼睛都眯缝了:“可是两位师兄提供的字卡太好用了。”

“《字海》的字卡,有编号,有大字,有拼音、民国拼音、甚至还有老四角号码,还有小字的释义和凡例,满足了我们自动识别软件对于调试校准模型的一切要求,我们当然也要用到那头去!”

周至又道:“有了字卡的辅助,我们很快便将软件识别图形文字的准确率,从百分之九十二,也就是一百个字错八个,提升到了百分之九十九点六,也就是依靠软件识别文字,一千个字里只会读错四个。直接提升了一个量级。”

“这个成就,也直接帮我们跨过了数字图书馆最后一个巨大门槛,这个软件,已经算是真正成熟了。”

“这次带来的数字化的《字海》,就是我们第一本通过计算机扫描识别技术建立起来数字图书,既然字数最多的《字海》都可以实现数字化,那对其余典籍,我们当然充满了信心!”

“那就是古籍数字化工作可以提上日程了?”韦一心大喜:“我们学校正在搞《四库全书丛目》这部大书,要不肘子你来我们学校?学籍什么的好说……”

一边计算机中心主任也连连点头:“其实清华那边没去头,肘子你到底是文科生,来我们这儿正好搞古籍数字化工程,想想看,这个大工程搞出来,那会是多大成就?古人说的君子三立,立德立功立言,不都在里边了?”

周至听得心中暗笑,应该说北大的文化氛围的确可以的,你看计算机中心主任都说得出君子三立这样的命题解读来……

不过这事儿暂时没有可能,周至只好笑着解释:“我们蜀大的《道藏》,《儒藏》两部大书也准备开修了,师爷爷是不可能放人的。”

“不过现在有了好工具,哪怕我不来北大,大家也能够加快工程的进度。现在还是说回正事儿,我利用数字化的《字海》,演示一下我们对数字典籍整理的工程架构协议及标准。”

这个东西是周至的自创,哪怕上一世,这也是图书典籍工程里没有过的东西。

直到周至穿越回来之前,国家将典籍进行数字化的工作,主要还停留在建立树状数据库的较为原始的应用阶段。

就好比一个标准的图书馆,将一本书作为一个文本文件整体存放,然后给这个文件编出,书名,书号,最多再给出个作者,出版社之类的信息,作为标签。

这样做的好处就是简单明了,升级维护也容易,信息保存也算全面,一句话说完,就是够用,但不好用。

这样的东西在周至眼里当然是不合格的,最多最多只能算是地基,离百尺高塔还差着老远的功夫。

信息工程就是这样,算法和协议的思路,往往比基础工作还要重要,如果指导思想发生了错误,等到工程进展到不敷使用,才想着改弦易辙,在已经叠房架屋的情况下,再要开展,将付出巨大的代价。

后世中文编码的巨大混乱情形,就是这种教训的最好注脚。

这些思路,是在四叶草的研发思想,周至提出来的“如何三问”原则思想指导下梳理出来的。

“如何三问”听着玄奥,其实很简单质朴,就是对于任何需求,我们要问三层以上的问题。

比如典籍数字化工程,按照一般的思路,好不好用?

答案肯定:不好用。

那第一个如何就来了:如何让它好用?

答案也简单:除了将一部部书籍扫描成文本文档外,还要在这个基础上,建立起一个庞大的标签体系和智慧搜索引擎。

那第二个如何就来了:如何建立起一个庞大的标签体系和智慧搜索引擎?

答案就是需要一个能够根据文档内容,自动化地分析提取特征标签的标签采集软件;要完成智慧搜索引擎,又需要一个球网状的数据拓扑关联系统。

那第三个如何就来了:我们如何开发这个标签采集软件和球网状的数据拓扑关联系统。

答案就是软件硬件并行,软件上,利用现在最新的数学统计学原理,引入计算机模型当中,开发出一套特征提取算法和特征联动算法,并将这套算法作为指导思想,完成软件开发。

硬件上,要克服现有计算设备算力不足的情况,就利用网络时代的助力,将广域网上的所有算力资源都最大程度地利用起来,研发出基于互联网基础的分布式算力应用系统。

这套理念现在还比较初步,但是根据这个理念建立起来的数字化《字海》,却非常的清晰明白,周至还牵头发明了一套论述体系,通过三维图层的方式来讲解一页字卡上,各项内容之间的复杂关联关系。

这隔着图示讲解下,韦一心和冷玉龙就能够看见平面化的字卡,变成了一个类似秸秆蝈蝈笼子,或者说像折叠式灯笼打开后的样子,各个图层之间通过算法将每一层的特征标签连接起来,构成了字卡的立体结构。

对于这一套思维体系,学文科的人理解起来甚至比学理科的还要容易,跟计算中心的曾教授,周至还要讲解一番,而两位老师兄却看得倍感舒适。

因为在两位老师兄的脑海中,关于字卡的知识体系,就和周至现在在信息系统里展现出来的那样!

冷玉龙开心地鼓起掌来:“妙极,妙极!什么叫青出于蓝,这就叫青出于蓝!谁能想到有一天书本的每一页会变成立体的?!哈哈哈哈,这是我们花了多少年才在脑海里构建起来的东西,现在却一目了然了,这个数字图书,有点东西啊!”

刚刚周至给他们讲的很多技术细节他们也闹不明白,但是这些技术细节支撑起来的应用却让他们太熟悉了,不由得生出了一种“他乡遇故知”的惊喜感。

“五四时期的诸多贤达,曾对我们的国学失望至极,认为汉字都没有存在的必要,或者字符化。”周至笑道:“这是一种毫无依据的悲观估计,然而直到今天,这样的流毒居然还有市场,那就实在是匪夷所思了。”

“这话也不能空说。”两位老师兄都是踏踏实实搞学术的人,冷玉龙就说道:“你得拿出足够强大的理由来,不然不就是又犯了五四学人的错误?”

趣趣阁推荐阅读:恋上邻家大小姐极品全能学生都市小保安都市极品医神(叶辰夏若雪孙怡)校花的贴身高手那些热血飞扬的日子霸道总裁深度宠我的贴身校花全能强者萧晨免费阅读奈何淘妻能耐太嚣张重生之商界大亨亿万萌宝老婆大人哪里跑花都神医陈轩女神的上门贵婿从继承家族开始变强锦鲤娇妻:摄政王宠妻手册不负荣光,不负你最强赘婿-龙王殿豪婿免费全文阅读邪帝传人在都市田园晚色:肥妇三嫁良夫赵旭李晴晴小说免费全文免费阅读女神的上门贵婿赵旭甜蜜婚令:首长的影后娇妻魔帝奶爸一世独尊最强农民混都市暴君爹爹的团宠小娇包空间农女:彪悍辣媳山里汉重生九零辣妻撩夫叶辰萧初然最新章节更新都市极品医神叶辰天陨闻道录龙王婿八零小甜妻不死战神超级兵王叶谦宠婚缠绵:大总裁,小甜心神医萌宝军婚缠绵:大总裁,小甜心征服游戏:野性小妻难驯服神婿叶凡赵旭李晴晴最强入赘女婿叶辰萧初然诱宠鲜妻:老婆,生二胎!史上最强炼气期特战狂枭超级兵王绝世战魂大佬的心肝穿回来了
趣趣阁搜藏榜:直播算卦:团宠真千金竟是玄学大佬灵识之作极品闲医欲爱重生:总裁的命定前妻极品小村民奥特曼之未来食物链顶端的猛兽乡里人鲜肉殿下:再贱萌妃致命婚姻:遭遇冷血大亨!草根选调生被离婚穷奶爸,带娃从美食店开始第一夫人:我家先生超凶的化工研究院锁定陆海夫妇这对CP盛世豪恋:权少的心尖独宠离婚后成了满级战神三好大魔王[穿越X重生]狗血那么近站住你马甲掉了坐公交车游遍全中国非宠不可:傲娇医妻别反抗御兽无限红词条,刚出新区碾万族无敌神婿男神我可以住你家吗都市:守护龙脉十年,下山即无敌身为男人的我女团出道,我火爆了六零:饥荒年当伙夫,社员都被馋哭了中式恐怖不行?纸人抬棺送走鹰酱重生之苦尽甘来无敌最俊朗新书被虐后冷心娇妻重生了萌娃带我去穿越抖音神豪:直播打赏一万亿老刑警重生,谁敢不服?枭宠毒妃:第一小狂妻海贼:无敌从僵尸军团开始替嫁后天降巨富老公都市之妙手圣医帝少宠上瘾:老公,别心急爱情公寓之万界最强队伍我的七个姐姐绝色倾城帝国强宠:娇妻已预定一胎双宝:妈咪跑不掉老婆别跑:总裁的代嫁妻签到:直播科技差点被曝光修真妖孽混都市战神探束手就擎,总裁老公请绕道!末日降临:以强化称霸穿书八零成了五个大佬的后妈
趣趣阁最新小说:都市异能之旅念力师:我的精神数值无限大至尊仙帝归来官路之问鼎权力巅峰!重生1979:我赶山打猎带全家吃肉往返80东北,我靠赶山财富自由重生90靠麻辣烫发家修真成长记九阶收尾人也能成为都市之星?社牛加直男,斩不完的恋爱脑行走诸天,搜刮万界十七八间半岛:我成了兔的第十人洞悉弱点,我爆打神明很合理吧?开局获得不死异能,来打我呀!陪诊师重生财路:逆袭成为金钱巨头时空食堂:开局喂饱朱元璋反派重生,一天拿下男主白月光重生打猎年代,非凡女知青认定我都市药圣被五个病娇美女折磨,我险些丧命我的电子女友是女帝异世游龙记半条命:黑道少年的护妹誓言文娱:开局反串最美贵妃全网爆红神豪:从征服黑丝外国美女开始只要胆子大,诡异住我家买不起机甲,那只好物理夺舍了1983都重生了,自卷不如卷人我靠决斗卡片拯救世界编外的特工除夕坐庄震八方,初一连夜离故乡开局成为宗主,打造宇宙第一宗门超人:开局把自己上交国家绝美大总裁,抛弃白月光来追我世界折磨我,我掀桌了重生78,开局赶山打猎,宠妻如命!白龙会枫火对愁眠!重生七零:渔猎兴安岭,娇妻萌娃宠上天修真大典直播鉴宝:网友问我青铜门怎么开城与郊:新的开始为了还债,我成了娱乐圈幕后大佬749太子爷,我的规矩就是规矩重生后天崩开局?我要利用所有人阴阳和合功让你开拓浮岛,你说魅魔更划算?同学你锦鲤啊,一等功追着跑