脑回路清奇的主角们:正文 第239章 幻大数据压缩研究
任何一个随机大数据,都有两种可能,一种是可以用极少数的算式就能得出,比如1024的1024次方;另一种是可以用极少数的算式就能近似得出,也就是用一个算式,能够得出重合率达到百分之八十的数值,只需要一些不重合区域的表达式就可以还原。
按照进制,分为十进制大数据,十六进制大数据,二进制大数据。
数据的进制可以转换,而当数据足够大时,进制的转换会导致运算资源占用,也就需要有对应的进制的数据压缩方法。
二进制无理数专用处理器:生成二进制的圆周率,生成二进制的黄金分割率,生成任意正整数的以自身为开方数的数值,阶除——也就是1除以2除以3除以4除以5一直到特定中止位置的取小数部分。
随机重合排列关系专用处理器:在二进制中,随机找出一个无理数(数据卡尺)和一个有理数数据(需要被转化为最短表达式的原始数据)的数据重合部分,把这些重合表达为最短表达式,当然,一个原始数据不可能只采用一个数据卡尺。
发展下去,大数据就需要有专用的数据卡尺服务器,也就是小的数据卡尺服务器,可以常备1000多个数据卡尺,而大的数据卡尺服务器,可以常备千万亿级别的数据卡尺。
数据卡尺越多,越容易生成最短表达式。
数据卡尺的用法:
一元数据卡尺:把原始数据和数据卡尺进行比对,找出其中重合部分,把重合部分记录为数据卡尺引用段落表达式。
二元数据卡尺:把原始数据和两个数据卡尺进行比对,找出其中重合部分,把重合部分记录为数据卡尺引用段落表达式,当不重合出现时,就对数据卡尺进行偏移运算,准备从两个数据卡尺的偏移不进位加法或不进位减法中生成能和原始数据重合的段落,从而只需要记录偏移运算(两个数据卡尺的偏移数据,开始引用段落起点和结束引用段落终点)和所采用的是不进位加法还是不进位减法。
三元数据卡尺:把原始数据同长度等分为足够短的有限位段落,从而让重合率提高,可以把自身作为数据卡尺,也就是先生成1GB的还原数据,然后以这1GB的数据作为数据卡尺,以此类推。
快速压缩方式:常用于紧急数据转移。
把大数据同长度等分,然后求出其平均数,设立一个个的分组,比如第一个分组,小于4096而大于512的数,出现过多少次……,然后对一个个数据分组进行校验码记录,这种方式优点是不需要动用数据卡尺,也就不需要连接数据卡尺服务器,保密性相对较好,本身可以采用单机方式运作,可用于极限情况下的数据转移,缺点是后期还原难度相对引用数据卡尺要高,后期数据还原需要占用足够多的穷举运算资源。
一般情况下,都是采用快速压缩方式,作为备份的数据纠错或数据验算区域,作为一种保险方式,避免压缩文件被部分篡改或传输错误导致的数据不可用。
狠男人网最快更新,无弹窗阅读请收藏狠男人小说网(www.41nr.com)。
- 大玄印
第六百四十八章 参赛名单 - 仙道少年行
第143章 行路 - 规则怪谈:死亡黑猫饲养指南
第218章 诡梦列车(11) - 骑砍玩家狂想曲
第一百三十二章 诺德王国分裂 - 猎天争锋
第1900章 跨越星区的薪火相传! - 秦刀
第八十三章洗脱嫌疑 - 得知真相,七个师姐跪求我原谅
第一百三十三章关键时刻 - 大隋:我杨俨,继承大统
第一百一十二章 审问 - 十日诡谈
第一百八十五章 强煞(二) - 界起通天
第1069章云尘闭关再入极境 - 开局:葬神峰主,我培养大帝无数!
第九十六章 我应该没有强迫你吧?求推荐 - 灵宠创造模拟器
第1295章 冥府与后土大神的关系 - 重生:我在修仙界大杀四方
第一百零一章一剑斩苍穹 - 亿万萌宝老婆大人哪里跑
第3645章 你们都还好吗? - 永夜圣典
第九十七章,全新的魔族 - 第一瞳术师
第1882章 番外:现代篇(44) - 道婿下山
第24章 挖祖坟 - 恐怖复苏之全球武装怪胎
第2249章 拔钉(下) - 抛夫弃子,我带六个女儿吃香喝辣
第834章 电棍 - 妈咪轻点虐,渣爹又被你气哭啦
第350章 别让她伤到自己的眼睛 - 刚出娘胎,定亲转世女帝
第182章 赢给你看