天眼查财产线索信息显示,近日,Deepseek关联公司杭州深度求索人工智能基础技术研究有限公司申请的“一种广度数据采集的方法及其系统”专利公布。摘要显示,本发明涉及数据采集领域,包括建立网页元信息库;确定每日调度单元下载配额及当日下载总额度;从网页元信息库中选取相应数量的链接,分配下载额度;下载过程控制;下载文本进行后处理及数据清洗后进入回灌队列,通过信息回灌实现网页元信息库更新。本发明的有益效果在于:发现尽可能多的网页链接,并减少对网站的流量冲击;对已经下载的内容进行分析,对未下载的连接进行质量推断,通过择优下载分配额度的方式,减少低质量网页下载和重复下载,提高数据质量及下载效率,减少在数据采集过程中网络资源的消耗;采用单独的信息回灌队列,保证网页元信息库修改操作的原子性和稳定性。
举报 相关阅读消费者可以使用AI进行“缘分测试”,获得商品卖点和健康指引等信息。
100 03-26 12:36DeepSeek V3模型完成小版本升级
35 03-24 21:05“如果一个厂家有太多的学界、权威、层级很多,它的研发效率多半是比较慢的。”
336 03-14 10:20通过专业机构以DeepSeek为基础进行ESG垂直模型的训练,是DeepSeek应用于ESG领域更为高效的路径。
312 03-10 22:18DeepSeek宛如一把钥匙,开启保险行业智能化变革的大门。
349 02-28 20:39 一财最热 点击关闭