【pandas基础】--目录（完结）

2023-06-10 16:34 由 wang_yb 发表于 #后端开发

pandas 基础内容的目录：

概述
pandas 主要功能和应用场景的介绍。

数据读取
数据读取是第一步，只有成功加载数据之后，后续的操作才有可能。
pandas 可以读取和导入各种数据格式的数据，如 CSV，Excel，JSON，SQL，HTML 等，不需要手动编写复杂的读取代码。

核心数据结构
pandas 最大的优势在于处理表格类数据，如果数据维度超过二维，一般我们会使用另一个 python 的库 numpy。
本篇主要介绍这两种核心数据结构 Series 和 DataFrame 的创建方式。

数据检索
pandas 的数据检索功能是其最基础也是最重要的功能之一。

pandas 中最常用的几种数据过滤方式如下：
1. 行列过滤：选取指定的行或者列
2. 条件过滤：对列的数据设置过滤条件
3. 函数过滤：通过函数设置更加复杂的过滤条件

数据整理
pandas 进行数据整理的意义在于，它是数据分析、数据科学和机器学习的前置步骤。
通过数据整理可以提前了解数据的概要，缺失值、重复值等情况，为后续的分析和建模提供更为可靠的数据基础。

本篇主要介绍利用 pandas 进行数据整理的各种方法。

数据修改
pandas 作为一种常用的数据分析工具，提供了广泛的数据修改方法。
既可以针对行或者列的数据进行修改，也可以对具体单个元素进行修改，还可以基于条件选择要修改的行或者列的数据。

数据拆分与合并
数据集拆分是将一个大型的数据集拆分为多个较小的数据集，可以让数据更加清晰易懂，也方便对单个数据集进行分析和处理。
同时，分开的数据集也可以分别应用不同的数据分析方法进行处理，更加高效和专业。

数据集合并则是将多个数据集合并成一个大的数据集，可以提供更全面的信息，也可以进行更综合的数据分析。
同时，数据集合并也可以减少数据处理的复杂度和时效性，提升数据分析的准确性和结果的可靠性。

数据排序
pandas 的数据排序可以帮助我们更好地理解和分析数据。
通过对数据进行排序，我们可以提取出特定的信息，
例如最大值、最小值、中位数、众数等等，从而更准确地识别数据的特征和特点。

数据类型
数据类型是计算机编程中将不同类型的数据值分类和定义的方式。
通过数据类型，可以确定数据的存储方式和内存占用量，了解不同类型的数据进行各种运算的能力。

日期处理
时间序列数据是数据分析中一类常见且重要的数据。
它们按照时间顺序记录，通常是从某些现象的观察中收集的，比如经济指标、气象数据、股票价格、销售数据等等。

时间序列数据的特点是有规律地随着时间变化而变化，它们的变化趋势可以被分析和预测。
时间序列分析是一种用于预测未来值或评估过去值的统计方法，常常被用于预测未来趋势、季节性变化、周期性变化、随机波动等。

索引和轴
在 pandas 中，索引（index）是用于访问数据的关键。
它为数据提供了基于标签的访问能力，类似于字典，可以根据标签查找和访问数据。

而 pandas 的轴（axis）是指数据表中的一个维度，可以理解为表格中的行和列。
通过指定轴，我们可以对数据进行切片、筛选、聚合等操作。

数据统计
在进行统计分析时，pandas 提供了多种工具来帮助我们理解数据。
pandas 提供了多个聚合函数，其中包括均值、标准差、最大值、最小值等等。
此外，pandas 还可以进行基于列的统计分析，例如通过 groupby()函数对数据进行聚合，并计算每组的统计分析结果。

热门相关：流鱼无恙朕朕法医王妃不好当！朕是红颜祸水

【pandas基础】--数据统计

在进行统计分析时，`pandas`提供了多种工具来帮助我们理解数据。 `pandas`提供了多个聚合函数，其中包括均值、标准差、最大值、最小值等等。此外，`pandas`还可以进行基于列的统计分析，例如通过`groupby()`函数对数据进行聚合，并计算每组的统计分析结果。除了基本的统计分析之外 ...阅读全文

【pandas基础】--索引和轴

在`pandas`中，索引（`index`）是用于访问数据的关键。它为数据提供了基于标签的访问能力，类似于字典，可以根据标签查找和访问数据。而`pandas`的轴（`axis`）是指数据表中的一个维度，可以理解为表格中的行和列。通过指定轴，我们可以对数据进行切片、筛选、聚合等操作。下面简要介 ...阅读全文

【pandas基础】--日期处理

时间序列数据是数据分析中一类常见且重要的数据。它们按照时间顺序记录，通常是从某些现象的观察中收集的，比如经济指标、气象数据、股票价格、销售数据等等。时间序列数据的特点是有规律地随着时间变化而变化，它们的变化趋势可以被分析和预测。时间序列分析是一种用于预测未来值或评估过去值的统计方法，常常被用于预 ...阅读全文

【pandas基础】--数据类型

数据类型是计算机编程中将不同类型的数据值分类和定义的方式。通过数据类型，可以确定数据的存储方式和内存占用量，了解不同类型的数据进行各种运算的能力。使用`pandas`进行数据分析时，最常用到的几种类型是： 1. 字符串类型，各类文本内容都是字符串类型 2. 数值类型，包括整数和浮点数，可用于计算 ...阅读全文

【pandas基础】--数据排序

`pandas`的数据排序可以帮助我们更好地理解和分析数据。通过对数据进行排序，我们可以提取出特定的信息，例如最大值、最小值、中位数、众数等等，从而更准确地识别数据的特征和特点。此外，数据排序还可以帮助我们更好地进行数据可视化，例如绘制直方图、箱线图等等，进一步帮助我们对数据进行解读和分析。总 ...阅读全文

【pandas基础】--数据修改

pandas 作为一种常用的数据分析工具，提供了广泛的数据修改方法。既可以针对行或者列的数据进行修改，也可以对具体单个元素进行修改，还可以基于条件选择要修改的行或者列的数据。 1. 增加数据 1.1 增加行数据 pandas的DataFrame增加一行或者多行数据之前是使用append方法。 im ...阅读全文

【pandas基础】--数据整理

pandas进行数据整理的意义在于，它是数据分析、数据科学和机器学习的前置步骤。通过数据整理可以提前了解数据的概要，缺失值、重复值等情况，为后续的分析和建模提供更为可靠的数据基础。本篇主要介绍利用pandas进行数据整理的各种方法。 1. 数据概要获取数据概要信息可以帮助我们了解数据的基本情况 ...阅读全文

【pandas基础】--数据检索

pandas的数据检索功能是其最基础也是最重要的功能之一。 pandas中最常用的几种数据过滤方式如下：行列过滤：选取指定的行或者列条件过滤：对列的数据设置过滤条件函数过滤：通过函数设置更加复杂的过滤条件本篇所有示例所使用的测试数据如下： import pandas as pd import ...阅读全文

【pandas基础】--核心数据结构

pandas中用来承载数据的两个最重要的结构分别是： Series：相当于增强版的一维数组 DataFrame：相当于增强版的二维数组 pandas最大的优势在于处理表格类数据，如果数据维度超过二维，一般我们会使用另一个 python的库 numpy。本篇主要介绍这两种核心数据结构的创建方式。 1 ...阅读全文

【pandas基础】--数据读取

数据读取是第一步，只有成功加载数据之后，后续的操作才有可能。 pandas可以读取和导入各种数据格式的数据，如CSV，Excel，JSON，SQL，HTML等，不需要手动编写复杂的读取代码。 1. 各类数据源 pandas提供了导入各类常用文件格式数据的接口，这里介绍3种最常用的加载数据的接口。 1 ...阅读全文