编程 Python

python实现稀疏矩阵示例代码

Posted in Python onJune 09, 2017

工程实践中，多数情况下，大矩阵一般都为稀疏矩阵，所以如何处理稀疏矩阵在实际中就非常重要。本文以Python里中的实现为例，首先来探讨一下稀疏矩阵是如何存储表示的。

1.sparse模块初探

python中scipy模块中，有一个模块叫sparse模块，就是专门为了解决稀疏矩阵而生。本文的大部分内容，其实就是基于sparse模块而来的。

第一步自然就是导入sparse模块

>>> from scipy import sparse

然后help一把，先来看个大概

>>> help(sparse)

直接找到我们最关心的部分：

Usage information
  =================

  There are seven available sparse matrix types:

    1. csc_matrix: Compressed Sparse Column format
    2. csr_matrix: Compressed Sparse Row format
    3. bsr_matrix: Block Sparse Row format
    4. lil_matrix: List of Lists format
    5. dok_matrix: Dictionary of Keys format
    6. coo_matrix: COOrdinate format (aka IJV, triplet format)
    7. dia_matrix: DIAgonal format

  To construct a matrix efficiently, use either dok_matrix or lil_matrix.
  The lil_matrix class supports basic slicing and fancy
  indexing with a similar syntax to NumPy arrays. As illustrated below,
  the COO format may also be used to efficiently construct matrices.

  To perform manipulations such as multiplication or inversion, first
  convert the matrix to either CSC or CSR format. The lil_matrix format is
  row-based, so conversion to CSR is efficient, whereas conversion to CSC
  is less so.

  All conversions among the CSR, CSC, and COO formats are efficient,
  linear-time operations.

通过这段描述，我们对sparse模块就有了个大致的了解。sparse模块里面有7种存储稀疏矩阵的方式。接下来，我们对这7种方式来做个一一介绍。

2.coo_matrix

coo_matrix是最简单的存储方式。采用三个数组row、col和data保存非零元素的信息。这三个数组的长度相同，row保存元素的行，col保存元素的列，data保存元素的值。一般来说，coo_matrix主要用来创建矩阵，因为coo_matrix无法对矩阵的元素进行增删改等操作，一旦矩阵创建成功以后，会转化为其他形式的矩阵。

>>> row = [2,2,3,2]
>>> col = [3,4,2,3]
>>> c = sparse.coo_matrix((data,(row,col)),shape=(5,6))
>>> print c.toarray()
[[0 0 0 0 0 0]
 [0 0 0 0 0 0]
 [0 0 0 5 2 0]
 [0 0 3 0 0 0]
 [0 0 0 0 0 0]]

稍微需要注意的一点是，用coo_matrix创建矩阵的时候，相同的行列坐标可以出现多次。矩阵被真正创建完成以后，相应的坐标值会加起来得到最终的结果。

3.dok_matrix与lil_matrix

dok_matrix和lil_matrix适用的场景是逐渐添加矩阵的元素。doc_matrix的策略是采用字典来记录矩阵中不为0的元素。自然，字典的key存的是记录元素的位置信息的元祖，value是记录元素的具体值。

>>> import numpy as np
>>> from scipy.sparse import dok_matrix
>>> S = dok_matrix((5, 5), dtype=np.float32)
>>> for i in range(5):
...   for j in range(5):
...       S[i, j] = i + j
...
>>> print S.toarray()
[[ 0. 1. 2. 3. 4.]
 [ 1. 2. 3. 4. 5.]
 [ 2. 3. 4. 5. 6.]
 [ 3. 4. 5. 6. 7.]
 [ 4. 5. 6. 7. 8.]]

lil_matrix则是使用两个列表存储非0元素。data保存每行中的非零元素,rows保存非零元素所在的列。这种格式也很适合逐个添加元素，并且能快速获取行相关的数据。

>>> from scipy.sparse import lil_matrix
>>> l = lil_matrix((6,5))
>>> l[2,3] = 1
>>> l[3,4] = 2
>>> l[3,2] = 3
>>> print l.toarray()
[[ 0. 0. 0. 0. 0.]
 [ 0. 0. 0. 0. 0.]
 [ 0. 0. 0. 1. 0.]
 [ 0. 0. 3. 0. 2.]
 [ 0. 0. 0. 0. 0.]
 [ 0. 0. 0. 0. 0.]]
>>> print l.data
[[] [] [1.0] [3.0, 2.0] [] []]
>>> print l.rows
[[] [] [3] [2, 4] [] []]

由上面的分析很容易可以看出，上面两种构建稀疏矩阵的方式，一般也是用来通过逐渐添加非零元素的方式来构建矩阵，然后转换成其他可以快速计算的矩阵存储方式。

4.dia_matrix

这是一种对角线的存储方式。其中，列代表对角线，行代表行。如果对角线上的元素全为0，则省略。

如果原始矩阵是个对角性很好的矩阵那压缩率会非常高。

找了网络上的一张图，大家就很容易能看明白其中的原理。

python实现稀疏矩阵示例代码

5.csr_matrix与csc_matrix

csr_matrix，全名为Compressed Sparse Row，是按行对矩阵进行压缩的。CSR需要三类数据：数值，列号，以及行偏移量。CSR是一种编码的方式，其中，数值与列号的含义，与coo里是一致的。行偏移表示某一行的第一个元素在values里面的起始偏移位置。

同样在网络上找了一张图，能比较好反映其中的原理。

python实现稀疏矩阵示例代码

看看在python里怎么使用：

>>> from scipy.sparse import csr_matrix
>>> indptr = np.array([0, 2, 3, 6])
>>> indices = np.array([0, 2, 2, 0, 1, 2])
>>> data = np.array([1, 2, 3, 4, 5, 6])
>>> csr_matrix((data, indices, indptr), shape=(3, 3)).toarray()
array([[1, 0, 2],
    [0, 0, 3],
    [4, 5, 6]])

怎么样，是不是也不是很难理解。

我们再看看文档中是怎么说的

Notes
 | -----
 |
 | Sparse matrices can be used in arithmetic operations: they support
 | addition, subtraction, multiplication, division, and matrix power.
 |
 | Advantages of the CSR format
 |  - efficient arithmetic operations CSR + CSR, CSR * CSR, etc.
 |  - efficient row slicing
 |  - fast matrix vector products
 |
 | Disadvantages of the CSR format
 |  - slow column slicing operations (consider CSC)
 |  - changes to the sparsity structure are expensive (consider LIL or DOK)

不难看出，csr_matrix比较适合用来做真正的矩阵运算。

至于csc_matrix，跟csr_matrix类似，只不过是基于列的方式压缩的，不再单独介绍。

6.bsr_matrix

Block Sparse Row format，顾名思义，是按分块的思想对矩阵进行压缩。

python实现稀疏矩阵示例代码

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持三水点靠木。

python实现稀疏矩阵示例代码

- Author -

bitcarmanlee

声明：登载此文出于传递更多信息之目的，并不意味着赞同其观点或证实其描述。

Python 相关文章推荐

写了个监控nginx进程的Python脚本

May 10 Python

Python Sleep休眠函数使用简单实例

Feb 02 Python

python使用正则表达式提取网页URL的方法

May 26 Python

Python实现类似jQuery使用中的链式调用的示例

Jun 16 Python

Python爬虫DNS解析缓存方法实例分析

Jun 02 Python

Python生成8位随机字符串的方法分析

Dec 05 Python

PyQt5每天必学之事件与信号

Apr 20 Python

python实现年会抽奖程序

Jan 22 Python

centos6.5安装python3.7.1之后无法使用pip的解决方案

Feb 14 Python

Django中的静态文件管理过程解析

Aug 01 Python

Django 实现将图片转为Base64,然后使用json传输

Mar 27 Python

Python 使用office365邮箱的示例

Oct 29 Python

Python实现数据库并行读取和写入实例

Jun 09 #Python

详解python之多进程和进程池(Processing库)

Jun 09 #Python

Python使用django搭建web开发环境

Jun 09 #Python

Python实现删除文件中含“指定内容”的行示例

Jun 09 #Python

Python实现两个list对应元素相减操作示例

Jun 09 #Python

Python实现向服务器请求压缩数据及解压缩数据的方法示例

Jun 09 #Python

python爬虫框架talonspider简单介绍

Jun 09 #Python

You might like

深入PHP运行环境配置的详解

2013/06/04 PHP

php中通过DirectoryIterator删除整个目录的方法

2015/03/13 PHP

ThinkPHP3.2.3框架实现执行原生SQL语句的方法示例

2019/04/03 PHP

详解php命令注入攻击

2019/04/06 PHP

laravel5表单唯一验证的实例代码

2019/09/30 PHP

php-7.3.6 编译安装过程

2020/02/11 PHP

PHP fopen中文文件名乱码问题解决方案

2020/10/28 PHP

拖动Html元素集合 Drag and Drop any item

2006/12/22 Javascript

[IE&FireFox兼容]JS对select操作

2007/01/07 Javascript

通过身份证号得到出生日期和性别的js代码

2009/11/23 Javascript

html+css+js实现xp window界面及有关功能

2013/03/26 Javascript

基于jQuery实现返回顶部实例代码

2016/01/01 Javascript

浅谈Angular的$q, defer, promise

2016/12/20 Javascript

详解基于angular路由的requireJs按需加载js

2017/01/20 Javascript

react开发中如何使用require.ensure加载es6风格的组件

2017/05/09 Javascript

Node.js操作redis实现添加查询功能

2017/05/25 Javascript

Bootstrap Table使用整理（三）

2017/06/09 Javascript

js实现可以点击收缩或张开的悬浮窗

2017/09/18 Javascript

Node.js 中使用 async 函数的方法

2017/11/20 Javascript

基于vue.js 2.x的虚拟滚动条的示例代码

2018/01/23 Javascript

vue-cli下的vuex的简单Demo图解(实现加1减1操作)

2018/02/26 Javascript

[54:56]DOTA2上海特级锦标赛主赛事日 - 5 总决赛Liquid VS Secret第三局

2016/03/06 DOTA

python正则表达式中的括号匹配问题

2014/12/14 Python

opencv改变imshow窗口大小,窗口位置的方法

2018/04/02 Python

python 实现判断ip连通性的方法总结

2018/04/22 Python

python中嵌套函数的实操步骤

2019/02/27 Python

python3对拉勾数据进行可视化分析的方法详解

2019/04/03 Python

Python任务调度利器之APScheduler详解

2020/04/02 Python

TensorFlow tf.nn.softmax_cross_entropy_with_logits的用法

2020/04/19 Python

获取邓白氏信用报告：Dun & Bradstreet

2019/01/22 全球购物

教师个人学习总结

2015/02/11 职场文书

逃出克隆岛观后感

2015/06/09 职场文书

幼儿园奖惩制度范本

2015/08/05 职场文书

考研经验交流会策划书

2015/11/02 职场文书

爱国之歌（8首）

2019/09/29 职场文书

Mysql实现主从配置和多主多从配置

2021/06/02 MySQL