码迷,mamicode.com
首页 > 编程语言 > 详细

python加快数据处理的方法

时间:2018-09-11 12:16:52      阅读:201      评论:0      收藏:0      [点我收藏+]

标签:image   图片   查询条件   批量   频繁   使用   代码   mongodb使用   加载   

1、一切数据库操作最好使用内网连接,

2、使用批量操作接口操作数据库,而不是多线程频繁操作单条数据

3、如果python进程的cpu使用率达到100%了,需要开启多进程。java单个进程cpu使用率在32核处理器上可以达到3000%以上,python单个进程职高只能100%,要想加速必须修改代码使用多进程。

4、将数据库表中的数据一次性加载到内存中,把查询条件当做字典的键,整条记录当做字典的值。由于是内网,几乎半分钟内可以加载5gb的数据到程序的变量中来。之后由于是读取字典的hash键,速度肯定比任何种类的数据库要快。

 

原来,三表查询,mongodb使用率一直高达2900%以上

技术分享图片

 

 

修改后:

技术分享图片

 

 由于把表直接加载到内存中了,减少了几百万次查询数据库,而是直接取键,最终速度提高了500倍,并且mongo使用率从2900%降低到50%了。

python加快数据处理的方法

标签:image   图片   查询条件   批量   频繁   使用   代码   mongodb使用   加载   

原文地址:https://www.cnblogs.com/ydf0509/p/9624068.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!