服务器之家:专注于服务器技术及软件下载分享
分类导航

Linux|Centos|Ubuntu|系统进程|Fedora|注册表|Bios|Solaris|Windows7|Windows10|Windows11|windows server|

服务器之家 - 服务器系统 - Linux - 通过Python进行MySQL表信息统计

通过Python进行MySQL表信息统计

2023-07-14 18:10未知服务器之家 Linux

导读 在上一篇文章中简单的介绍了使用python-mysql-replication 来解析 MySQL binlog来完成实时统计的业务,当然,在现实的业务中不可能用的那么简单的。 啰哩八说 今天的目的不是介绍真实的业务场景如何使用 python-mysql-replication,而是

导读 在上一篇文章中简单的介绍了使用python-mysql-replication 来解析 MySQL binlog来完成实时统计的业务,当然,在现实的业务中不可能用的那么简单的。
啰哩八说

今天的目的不是介绍真实的业务场景如何使用 python-mysql-replication,而是推出一枚<MySQL表信息统计>小工具(笔者通过python-mysql-replication实现的)

工具链接:

在之前我也是使用 @吴炳锡 大神的工具, 因为在了的时候感觉显示的有点生涩因此在他的基础上修改了一些重新展示了, 可是在用的时候还是不尽人意。

具体看之前笔者的文章:

大神的工具:

笔者重新展示的工具:

二话不说直接展示如何使用 1、查看帮助
[root@centos7tmp]#pythonmysql_binlog_stat.py--help
usage:mysql_binlog_stat.py[-h][--hostHOST][--portPORT]
[--usernameUSERNAME][--passwordPASSWORD]
[--log-filebinlog-file-name]
[--log-posbinlog-file-pos]
[--server-idserver-id][--slave-uuidslave-uuid]
[--blockingFalse/True][--start-timestart-time]
[--sorted-byinsert/update/delete]

Description:ThescriptparseMySQLbinlogandstatisticcolumn.

optionalarguments:
-h,--helpshowthishelpmessageandexit
--hostHOSTConnectMySQLhost
--portPORTConnectMySQLport
--usernameUSERNAMEConnectMySQLusername
--passwordPASSWORDConnectMySQLpassword
--log-filebinlog-file-name
Specifyabinlogname
--log-posbinlog-file-pos
Specifyabinlogfilepos
--server-idserver-id
Specifyaslaveserverserver-id
--slave-uuidslave-uuid
Specifyaslaveserveruuid
--blockingFalse/True
Specifyisblokingandparse,defaultFalse
--start-timestart-time
Specifyisstartparsetimestamp,defaultNone,
example:2016-11-0100:00:00
--sorted-byinsert/update/delete
Specifyshowstatisticsortby,default:insert

主要参数介绍:

--log-file:binlog 文件名称

--log-pos:binlog 文件位置(从哪个位置开始解析)

--blocking:是否需要使用阻塞的方式进行解析始终为 False 就好(默认就是False)

--start-time:从什么时间开始解析

--sorted-by:展示的结果通过什么来排序, 默认是通过 insert 的行数的多少降序排列, 设置的值有 insert/update/delete

2、解析 MySQL binlog
root@(none)09:17:12>showbinarylogs;
-----------------------------
|Log_name|File_size|
-----------------------------
|mysql-bin.000012|437066170|
|mysql-bin.000013|536884582|
|mysql-bin.000014|537032563|
|mysql-bin.000015|536950457|
|mysql-bin.000016|87791004|
|mysql-bin.000017|143|
|mysql-bin.000018|143|
|mysql-bin.000019|143|
|mysql-bin.000020|143|
|mysql-bin.000021|1426|
-----------------------------
10rowsinset(0.01sec)


#使用命令[root@centos7tmp]#timepythonmysql_binlog_stat.py--log-file=mysql-bin.000012--log-pos=120--username=root--password=root--sorted-by='insert'
[
{
"app_db.business_item_sku_detail":{
"row_insert_count":{
"market_price":273453,
"sku_id":273453,
"weight":273453
},
"table_dml_count":{
"insert":273453,
"update":0,
"delete":0
},
"row_update_count":{}
}
},
{
"app_db.business_item_sku_property":{
"row_insert_count":{
"sku_id":273112,
"created":273112,
"property_value_id":273112,
"business_item_id":273112,
"record_id":273112,
"property_id":273112
},
"table_dml_count":{
"insert":273112,
"update":0,
"delete":0
},
"row_update_count":{}
}
},
{
"app_db.business_item_pic":{
"row_insert_count":{
"created":270993,
"business_item_id":270993,
"pic_id":270993,
"pic_no":270993,
"tmall_shop_id":270993,
"pic_url":270993
},
"table_dml_count":{
"insert":270993,
"update":0,
"delete":0
},
"row_update_count":{}
}
},
{
"app_db.business_item":{
"row_insert_count":{
"guide_commission":264803,
"commission_type":264803,
"pstatus":264803
},
"table_dml_count":{
"insert":264803,
"update":0,
"delete":0
},
"row_update_count":{}
}
},
{
"test.t_binlog_event":{
"row_insert_count":{
"auto_id":5926,
"dml_sql":5926,
"dml_start_time":5926,
"dml_end_time":5926,
"start_log_pos":5926,
"db_name":5926,
"binlog_name":5926,
"undo_sql":5926,
"table_name":5926,
"end_log_pos":5926
},
"table_dml_count":{
"insert":5926,
"update":0,
"delete":4017
},
"row_update_count":{}
}
},
{
"test.ord_order":{
"row_insert_count":{
"order_id":184,
"pay_type":181,
"amount":184,
"create_time":184,
"serial_num":181
},
"table_dml_count":{
"insert":184,
"update":0,
"delete":0
},
"row_update_count":{}
}
},
{
"test.t1":{
"row_insert_count":{
"id":7,
"name":7
},
"table_dml_count":{
"insert":7,
"update":2,
"delete":2
},
"row_update_count":{
"name":2
}
}
},
{
"test.area":{
"row_insert_count":{},
"table_dml_count":{
"insert":0,
"update":0,
"delete":0
},
"row_update_count":{}
}
}
]

real5m42.982s
user5m26.080s
sys0m8.958s

分析了2G多的binlog数据花了大概6分钟时间速度,感觉速度还是不行啊 ^_^。

这边说一下为什么不提供 --stop-log-file, --stop-log-pos, --stop-time 参数

主要是因为 pymysqlreplication 的解析如果是没有解析到结尾,它在 master 上创建的链接会一直存在不会消失,需要人工去master kill掉相关的thread. 我问了作者但是并没有得到很好的回应(估计也是我问问题的方式不对吧)

相关问题请看以下链接,(同时希望大家一起来解决一这问题, 来完善以下这个小程序)。

原文来自:


延伸 · 阅读

精彩推荐
  • LinuxLinux系统下无法卸载挂载的目录怎么办?

    Linux系统下无法卸载挂载的目录怎么办?

    我们在日常运维中经常性会遇到需要进行磁盘的扩容、卸载、挂载等操作,但是有时候这个系统上跑的应用并没有停止或者有其他的运维同事在操作这个目...

    今日头条10302020-12-30
  • Linux在Linux系统中创建新的亚马逊AWS访问密钥的方法

    在Linux系统中创建新的亚马逊AWS访问密钥的方法

    如何在Linux系统中创建新的亚马逊AWS访问密钥?我在配置一个需要访问我的亚马逊AWS帐号的应用时被要求提供AWS访问密钥ID和秘密访问密钥,我怎样创建一个...

    Linux教程网6182019-10-30
  • Linuxssh 登录很慢该如何解决

    ssh 登录很慢该如何解决

    这篇文章主要介绍了ssh 登录很慢该如何解决的相关资料,这里提供了两种方法,DNS反向解析及关闭ssh的gssapi认证的解决办法,需要的朋友可以参考下...

    linuxeye9922021-12-16
  • Linuxlinux驱动程序开发详细介绍

    linux驱动程序开发详细介绍

    前提,一般来说内核代码的错误可能会引起一个用户进程的死亡,或者整个系统的瘫痪,更严重的后果,可能导致磁盘损伤~因此建议最好有一台实验机进行...

    Linux教程网5392019-12-17
  • Linux将 Linux 终端与 Nautilus 文件管理器结合起来

    将 Linux 终端与 Nautilus 文件管理器结合起来

    Nautilus 是 GNOME 桌面环境中的图形化文件浏览器。你可以使用它来访问和管理系统中的文件和文件夹。 尽管并非所有人都喜欢使用终端来管理文件和目录,...

    未知812023-08-08
  • Linuxlinux设置tomcat自启动的方法

    linux设置tomcat自启动的方法

    这篇文章主要介绍了linux设置tomcat自启动的方法,需要的朋友可以参考下...

    Linux教程网8512021-10-10
  • Linux理解 Linux/Unix 登录脚本的技巧

    理解 Linux/Unix 登录脚本的技巧

    有一些常见的情况,例如从Debian的包管理程序到Iaas的管理中,很多任务需要设置环境变量才能正常运行。 有时,程序通常只需要在 登陆时运行一次,例如...

    未知1042023-05-12
  • Linuxlinux top命令详解

    linux top命令详解

    这篇文章主要介绍了linux top命令详解,小编觉得挺不错的,现在分享给大家,也给大家做个参考。一起跟随小编过来看看吧...

    sparkdev5622022-03-01