
数据采集范围大,混合引擎能够检索到将近188亿个网页以及490万份学术文献,系统运用自主研发的ROST WebSpider和ROST SEAT技术完成了对互联网和部分学术期刊的广泛收录,借助相似度分析来识别潜在的抄袭行为,即使有人修改部分文字或者去除部分标点符号也能有效检测出来该系统运用自主研发的ROST Similar算法执行快速相似性判定与量化评估。该系统运用自主研发的QingQing算法获取信息特征,在P3、512MBPC平台上,分词效率达13MB/S,已向互联网发布测试版本供行业进行评估。该程序提供的分析结果仅供参考,能够通过表格右键功能导出详尽检测数据并交付给被检测者,本程序不判定内容是否为抄袭行为,仅显示与已有文献相似度达80%以上的文字在全部检测文章中所占的百分比数值,达到80%以上的部分才需特别留意,低于该数值则无需在意——旨在规范引文及参考文献的排除,以减少错误判定的风险。一种个性化分段比对系统,能够准确标示出文章各文本单元与其它文件的近似程度,每个文本单元长度介于五十到二百字之间(可根据需求调整),若相似度超过百分之八十,则以红色高亮显示,非常容易辨识,十分鲜明。当设定为五十字为单位时,有助于在较粗略的信息粒度层面筛选出潜在抄袭或雷同的资料。文档比对技术,能够借助便捷手段明确指出相似资料里哪些部分存在剽窃或复制,展示清晰。分析模块会自动评估文档间的相似程度,并形成专业判断。系统兼容多种文档类型,涵盖PDF、DOC、PPT、XLS、TXT等常见格式。针对特定数据文件,支持建立档案库,无需重复检测,节省时间精力。