前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >为什么PyMySQL获取一条数据会让内存爆炸

为什么PyMySQL获取一条数据会让内存爆炸

作者头像
青南
发布2020-03-13 12:47:14
1.1K0
发布2020-03-13 12:47:14
举报
文章被收录于专栏:未闻Code

当Python 有读写 MySQL 数据的需求时,我们经常使用PyMySQL这个第三方库来完成。

有时候如果一张表里面的数据非常大,但是我们只需要读取一条数据,此时我们可能会想当然地使用cursor.fetchone()这个方法,以为这样就真的可以只读取一条数据:

代码语言:javascript
复制
import pymysql


connection = pymysql.connect(host='localhost',
                             user='user',
                             password='passwd',
                             db='db',
                             charset='utf8mb4',
                             cursorclass=pymysql.cursors.DictCursor)
                             
with connection.cursor() as cursor:
    db = 'select * from users where age > 10'
    cursor.execute(db)
    one_user = cursor.fetchone()

但实际上,上面这段代码,与下面这段代码没有任何区别:

代码语言:javascript
复制
...
with connection.cursor() as cursor:
    sql = 'select * from users where age > 10'
    cursor.execute(sql)
    all_users = cursor.fetchall()
    one_user = all_users[0]

这是因为,当我们执行到cursor.execute(sql)的时候,PyMySQL就已经把表里面所有的数据读取到内存中了。而后面的cursor.fetchall()或者cursor.fetchone()只不过是从内存中返回全部数据还是返回1条数据而已。

我们来看PyMySQL源代码[1]。在cursor.execute()方法代码如下图所示:

其中第163行调用了self._query方法。我们再去到这个方法里面:

看到代码第322行,调用了self._do_get_result()方法。我们再去这个方法里面看看:

注意代码第342行,此时已经把所有数据存放到了self._rows列表中。

现在我们来看cursor.fetchone()方法:

可以看到,这里不过是从列表里面根据下标读取一条数据出来而已。

再看cursor.fetchall()方法:

如果之前先多次调用过cursor.fetchone(),那么self.rownumber会持续增加。而调用cursor.fetchall()时,跳过之前已经返回过的数据,直接返回剩下的全部数据即可。如果之前没有调用过cursor.fetchone(),那么直接返回全部数据。

所以,单纯使用cursor.fetchone()并不能节省内存,如果表里面的数据非常大,还是会有内存爆炸的危险。

那么真正的解决办法是什么呢?真正的解决办法在创建数据库连接的时候指定游标类型。pymysql.connect有一个参数叫做cursorclass,把它的值设定为pymysql.SSDictCursor即可解决问题。

我们来看一下如何正确使用它:

代码语言:javascript
复制
import pymysql


connection = pymysql.connect(host='localhost',
                             user='user',
                             password='passwd',
                             db='db',
                             charset='utf8mb4',
                             cursorclass=pymysql.cursors.SSDictCursor)
                             
with connection.cursor() as cursor:
    db = 'select * from users where age > 10'
    cursor.execute(db)
    for row in cursor:
        print('对 cursor 直接进行迭代,每循环一次,从数据库读取一条数据。不会提前把所有数据读取到内存中。')
        print(row['name'])

参考资料

[1]源代码: https://github.com/PyMySQL/PyMySQL/blob/master/pymysql/cursors.py

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2020-03-03,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 未闻Code 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 参考资料
相关产品与服务
云数据库 SQL Server
腾讯云数据库 SQL Server (TencentDB for SQL Server)是业界最常用的商用数据库之一,对基于 Windows 架构的应用程序具有完美的支持。TencentDB for SQL Server 拥有微软正版授权,可持续为用户提供最新的功能,避免未授权使用软件的风险。具有即开即用、稳定可靠、安全运行、弹性扩缩等特点。
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档