当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗

7个月前 (04-02)Deepseek最新资讯579

国家知识产权局官网显示,4月1日,DeepSeek关联公司杭州深度求索人工智能基础技术研究有限公司申请的“一种广度数据采集的方法及其系统”专利公布。

摘要显示,本发明涉及数据采集领域,尤其涉及一种广度数据采集的方法及其系统,包括:建立网页元信息库;确定每日调度单元下载配额及当日下载总额度;从网页元信息库中选取相应数量的链接,分配下载额度;下载过程控制;下载文本进行后处理及数据清洗后进入回灌队列,通过信息回灌实现网页元信息库更新。本发明的有益效果在于:发现尽可能多的网页链接,并减少对网站的流量冲击;对已经下载的内容进行分析,对未下载的连接进行质量推断,通过择优下载分配额度的方式,减少低质量网页下载和重复下载,提高数据质量及下载效率,减少在数据采集过程中网络资源的消耗;采用单独的信息回灌队列,保证网页元信息库修改操作的原子性和稳定性。


“DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗” 的相关文章

职场DeepSeek写材料指令100条

职场DeepSeek写材料指令100条

以下是为您整理的100条职场常用DeepSeek写材料指令,涵盖各类办公场景需求:一、工作总结类(10条)   1.生成[XXXX]年度部门工作总结模板(含数据可视化图表模块)&n...

R2模型呼之欲出!“卷王”DeepSeek继续给巨头上压力

R2模型呼之欲出!“卷王”DeepSeek继续给巨头上压力

DeepSeek-R1的热度尚未消散,DeepSeek-R2就要来了?日前报道称,三位知情人士透露,原计划今年5月发布的DeepSeek-R2模型,正在加速开发,或将提前发布,新模型有望可以生成更好的...

黄仁勋:DeepSeek-R1代表了全球人工智能行业的重要创新

黄仁勋:DeepSeek-R1代表了全球人工智能行业的重要创新

英伟达CEO黄仁勋表示,DeepSeek-R1展示了突破性的性能提升,与H100等领先竞争对手相比,其计算能力提高了四倍。DeepSeek-R1代表了全球人工智能行业的重要创新,影响着研究人员对人工智...

上海中小幼学生开学:“用DeepSeek赶作业”受关注,他们怎么看?

上海中小幼学生开学:“用DeepSeek赶作业”受关注,他们怎么看?

 2月17日,上海约225万名中小学生和幼儿迎来了春季新学期第一天。为了迎接新年后的首次相聚,中小学和幼儿园精心做了各项准备,和孩子们来一场双向奔赴的开学之约。  澎湃新闻记者注意到,开学前几天是疯狂...

新华健康丨《医疗机构部署DeepSeek专家共识》发布

新华健康丨《医疗机构部署DeepSeek专家共识》发布

以DeepSeek为代表的人工智能(AI)技术正在给医疗领域带来前所未有的机遇,尤其是在提升医疗服务品质、优化医疗机构管理流程等方面,展现出巨大的市场潜力。与此同时,医疗行业因其专业性和敏感性,数据涉...

深圳市全面启用DeepSeek 开启政务智能化加速升级之门

深圳市全面启用DeepSeek 开启政务智能化加速升级之门

新华社客户端深圳2月16日电 随着近期DeepSeek开源模型的发布,人工智能建设应用模式正在发生重要跃变。2月16日,深圳市基于政务云环境面向全市各区各部门正式提供DeepSeek模型应用服务,实现...