Python实现将字典(列表按列)存入csv文件

来自：网络

时间：2024-08-28

阅读：

1、将字典存入csv文件

import pandas as pd
 
dic1 = {'学号': [6812, 6952, 6905], '姓名': ['一', '二', '三'], '排名': [1, 6, 9]}
df = pd.DataFrame(dic1, index=range(0, 3))
df.to_csv('last.csv', index=False, encoding='gbk')

结果：

2、列表按列存入csv文件

主要思想：

把需要按列存入的列表当成字典的值存入，键写“名称”即可；逗号间隔列表。

例如：

想把4个列表“按列”写入csv文件，整合好写入字典，再将字典转换成DataFrame类型数据。

week1 = ['一', '二', '三', '四', '五', '六', '七']
weekSpend = [50, 40, 30, 60, 45, 55, 67]
day1 = ['m', 't', 'w', 'tu', 'f', 's', 'su']
daySpend = [10, 20, 30, 40, 10, 20, 22]
DF = {'weekName': week1, 'weekSpend': weekSpend, 'dayName': day1, 'daySpend': daySpend}
trydf = pd.DataFrame(DF)
trydf.to_csv('df1.csv', index=False, encoding='gbk', mode='a')

按列追加运行结果结果：

3、反例（没转字典就只有一列）

如果把每个列表仅转换成DataFrame类型数据，追加写入csv，会发现写入都是在整列后面写入

如下演示：

week1 = ['一', '二', '三', '四', '五', '六', '七']
weekSpend = [50, 40, 30, 60, 45, 55, 67]
day1 = ['m', 't', 'w', 'tu', 'f', 's', 'su']
daySpend = [10, 20, 30, 40, 10, 20, 22]
try2df1 = pd.DataFrame(week1)
try2df2 = pd.DataFrame(weekSpend)
try2df3 = pd.DataFrame(day1)
try2df4 = pd.DataFrame(daySpend)
try2df1.to_csv('df2.csv', index=False, encoding='gbk', mode='a')
try2df2.to_csv('df2.csv', index=False, encoding='gbk', mode='a')
try2df3.to_csv('df2.csv', index=False, encoding='gbk', mode='a')
try2df4.to_csv('df2.csv', index=False, encoding='gbk', mode='a')

运行结果：

（提一嘴，发现这里一上面有个headers为0，不想要，可以加入参数：（header=None）

即：

pd1.to_csv('save.csv', encoding='gbk', index=False, header=None) # 里面有中文就用gbk

实战需求

需求1

将磁力文本存入csv表格中，便于统计下载情况和备注

我的文本格式是：

S-003

magnet:?xt=urn:btih:12345678BAG

S-123 小王
magnet:?xt=urn:btih:123456AGGAS

小王
magnet:?xt=urn:btih:123456AGGAS

解释一下：S-123是序号，而小王是视频名称.

然后我希望csv第一列是编号，第二列是名称，第三列才是磁力。

实现源码

import re
import pandas as pd
 
with open('李连jie.txt', 'r', encoding='utf-8') as f:
    data_ = f.readlines()
save_list = []
 
 
def to_scv_():
    print(data_)
    temp_tup = []
    for i in data_:
        find_name_1 = re.findall('([a-zA-Z]+-\d+)\n', i)  # 匹配编号的行(只有编号)
        if len(find_name_1):
            print(find_name_1)
            temp_tup.append(find_name_1[0])
            temp_tup.append('')  # 无名
        else:
            find_name_2 = re.findall('([a-zA-Z]+-\d+) (.*?)\n', i)  # 匹配名称的行(匹配中文)(只有名称)
            if len(find_name_2):
                print(find_name_2)
                temp_tup.append(find_name_2[0][0])
                temp_tup.append(find_name_2[0][1])
                # 顺序不能反，因为2中也有中文，还有编号，所以2查询在前
            else:
                find_name_3 = re.findall('([\u4e00-\u9fa5]+)\n', i)  # 匹配编号 名称的行(编号，名称都有)
                if len(find_name_3):
                    print(find_name_3)
                    temp_tup.append('')  # 无编号
                    temp_tup.append(find_name_3[0])
 
        magnet_ = re.findall('(magnet:.*?)\n', i)  # 匹配磁力
        if len(magnet_):
            temp_tup.append(magnet_[0])
            save_list.append(temp_tup)
            temp_tup = []  # 只有在追加完名称，现在加完磁力才是一个完整的list，这时才清空
 
    print(save_list)
    for i in save_list:
        print(i)
 
    save_dic = ({'编号': row[0], '名称': row[1], '磁力链接': row[2]} for row in save_list)
    pd1 = pd.DataFrame(save_dic)
    pd1.to_csv('mysave.csv', encoding='gbk', index=False, header=None)
 
 
to_scv_()

下面备忘录：

需求2

将两个分开的csv文件读取后，合并在一起

之前的需求：(绩点文件)优化后的代码：

import pandas as pd
 
data = pd.read_csv('newdata.csv', encoding='utf-8')  # 包含成绩等数据，但不包含班级信息
stu_class = pd.read_csv('班级.csv', encoding='utf-8')  # 仅包含班级和姓名的数据
 
# 使用 merge 函数根据姓名进行合并
merged_data = pd.merge(stu_class, data, on='姓名')
 
# 选择需要的列并重命名
result = merged_data[['姓名', '班级', '体测成绩', '学年平均学分绩点', '综合测评总分排名', '综合测评总分（百分制、精确到小数点后4位）', '学业成绩考核排名']]
result.columns = ['姓名', '班级', '体测', '绩点', '绩点排名', '综测得分', '综测排名']
 
# 将结果保存为 CSV 文件
result.to_csv('最终文件.csv', index=False, encoding='gbk')

(绩点文件) 之前的代码

import pandas as pd
 
data = pd.read_csv('newdata.csv', encoding='utf-8')  # 含有成绩等的数据，但是没有班级信息
stu_class = pd.read_csv('班级.csv', encoding='utf-8')  # 仅含有班级和姓名的数据
dic = {}
score_index = 0  # 包含学生成绩的数据索引
class_index = -1  # 包含学生班级的数据索引
for name in stu_class['姓名']:
    class_index += 1
    for stu_score in data['姓名']:
        if score_index == len(data):
            score_index = 0
            break
        elif name != stu_score:
            score_index += 1
            continue
        elif name == stu_score:
            # 这里需要特别注意：班级跟成绩不是同一个index
            dic[name] = (stu_class['班级'][class_index][6:7], data['体测成绩'][score_index], data['学年平均学分绩点'][score_index], data['综合测评总分排名'][score_index], data['综合测评总分（百分制、精确到小数点后4位）'][score_index], data['学业成绩考核排名'][score_index])
            score_index = 0
            break
        else:
            pass
'''
说明：存储到csv文件中时，必须是数据框类型的数据才有to_csv的函数！且columns对应的数据必须是一个列表
'''
last_class = list()
last_pe = list()
last_gpa = list()
last_rank = list()
last_score = list()
last_gpa_rank = list()
for name in stu_class['姓名']:    # 要追加而不是覆盖
    try:
        last_class.append(dic[name][0])
        last_pe.append(dic[name][1])
        last_gpa.append(dic[name][2])
        last_rank.append(dic[name][3])
        last_score.append(dic[name][4])
        last_gpa_rank.append(dic[name][5])
    except KeyError:  # 部分名字没有对应的数据，那么try、except后，无数据的名字就会跳过了
        pass
 
last = pd.DataFrame()
last['姓名'] = list(dic.keys())
last['班级'] = last_class
last['体测'] = last_pe
last['绩点'] = last_gpa
last['绩点排名'] = last_gpa_rank
last['综测得分'] = last_score
last['综测排名'] = last_rank
 
result = pd.DataFrame(last, columns=['姓名', '班级', '体测', '绩点', '绩点排名', '综测得分', '综测排名'])
result.to_csv('最终文件.csv', index=False, encoding='gbk')

总结

以上为个人经验，希望能给大家一个参考，也希望大家多多支持。

目录 1. 安装与卸载 Poetry 2. 查看 Poetry 版本 3. 查看 Poetry 的位置 4. 依赖安装 Poetry 的优势在现代软件开发中，Python 因其简洁和强大的功能而广受欢迎。然而，随着项目

2024-11-10 12:23:07

目录 Python 日期和时间戳的转换 Python中处理时间的模块 Python的time模块将时间戳转换为格式化字符串 Python 的datetime模块 datetime模块中定义的类（这些

2024-10-20 21:50:48

目录 1. 异步组件 1.1 使用 defineAsyncComponent 1.2 预加载 2. 路由懒加载 3. 动态组件 4. 事件触发的动态加载 5. 按需加载与状态管理结合结论 1. 异步组

2024-10-20 21:50:41

目录引言使用Python保存PPT中的所有形状为图像文件用Python保存PPT中带格式设计的图片为图像文件引言将PowerPoint演示文稿中的形状（幻灯片中的内容元素，包括文本框、图形

2024-10-20 21:50:28

目录前言用Python删除PDF文档页边距前言在处理PDF文档时，有时候我们会遇到PDF文件带有较大的页边距的情况。这样过大的页边距不仅浪费了页面空间，而且在打印或电子阅读时也

2024-10-20 21:50:20

目录 1.引言 2.准备工作 3.基础理论知识 4.步骤详解 5.常见问题解答 6.成果案例分享 7.案例代码示例1.引言火柴人（Stick Figure）是一种极简风格的图形，通常由简单的线段和圆圈

2024-10-20 21:50:09

目录环境介绍类和函数区别封装性：状态保持：可重用性：继承和多态：设计模式：代码组织：执行流程：参数传递：返回值：上下文管理：总结环境window10，pyc

2024-10-20 21:50:03

目录一、JWT的介绍二、JWT的组成 1、Header（头部） 2、Payload（负载） 3、Signature（签名）三、Python写JWT 1、安装Jwt 2、使用JWT 3、解密JWT 总结一、JWT的介绍JW

2024-10-18 23:10:58

目录视频转换成 GIF 图形的重要性 1. 增强表达效果 2. 适应性强 3. 文件大小优化 4. 易于创建和编辑 5. 吸引用户注意力 6. 简化获取信息的步骤用python实现视gif

2024-10-18 23:10:46

目录前言 1. 构建分子式 2. 判断化合价 3. 解析分子式 4. 化合物反应方程式平衡 5. 化合物的摩尔质量计算 6. 计算化合物的质量分数 7. 计算反应热 8. 计算化合物的pH值总

2024-10-18 23:10:16

目录 1 创建 pytest.ini 文件 2 常见参数及配置方法 3 高级配置 4 结论1 创建 pytest.ini 文件在项目的根目录下，创建一个名为 pytest.ini 的文件即可。pytest 会在执行测试

2024-10-18 23:10:06

目录一、XPATH概念二、常用规则与方法 1.f12例子: 2.节点获取文本 3.属性匹配 4. 属性获取 5.iframe标签处理三、同级节点元素定位四、关键字定位五、定位

2024-10-18 23:09:49

目录引言发送GET请求获取页面的二进制数据添加查询参数发送POST请求处理JSON数据设置自定义Header 发送带认证信息的请求发送带有表单数据的请求发送带有文件的请

2024-10-18 23:09:30

安装CPU版本：(以2.9.0版本为例)pip install tensorflow==2.9.0安装GPU版本：(以2.9.0版本为例)pip install tensorflow-gpu==2.9.0若下载缓慢，使用阿里国内镜像源加速下载：(以2.9

2024-10-14 19:47:12

目录概述用asyncio实现Hello world 总结概述Python中 asyncio 模块内置了对异步IO的支持，用于处理异步IO；是Python 3.4版本引入的标准库。asyncio 的编程模型就是一个消息循

2024-10-14 19:47:02

目录 1. 问题描述 2. 解决办法 2.1 办法一：进入Script 进行安装 2.2 办法二：设置环境变量总结 1. 问题描述这几天一直用python实战，今天用pip想要安装一个库，结果突然报了

2024-10-14 19:46:53

目录实践环境问题域定义协议格式(编写proto文件) 编译协议缓冲区协议缓冲区 API 枚举标准消息方法解析和序列化编写消息读取消息另一个示例参考链接

2024-10-14 19:46:35

目录使用pip时报NameError: name‘pip’is not defined错误 1. 问题描述 2. 解决办法总结使用pip时报NameError: name‘pip’is not defined错

2024-10-14 19:46:27

目录 1. 概述 2. arange() 2.1 语法 2.2 参数 2.3 实例总结 1. 概述Numpy 中 arange() 主要是用于生成数组，具体用法如下；2. arange()2.1 语法numpy.arange(start, sto

2024-10-14 19:46:12

目录 1. 概述 2. vstack() 2.1 语法 2.2 参数 2.3 实例 3. hstack() 3.1 语法 3.2 参数 3.3 实例总结 1. 概述在Numpy中，最希望处理的数据就是数组和矩阵，下面就

2024-10-14 19:46:03

目录 Python列表简介 NumPy数组简介性能比较 1. 数组操作 2. 循环操作内存使用比较 1. 内存占用 2. 大数据集结论在Python中，处理数值数据时，我们通常面临两种选

2024-10-14 19:45:55

目录引言基础语法介绍核心概念基本语法规则基础实例问题描述代码示例进阶实例问题描述高级代码实例实战案例问题描述解决方案代码实现扩展

2024-10-14 19:45:46

目录引言 Python Excel库 Python 在Excel 中的添加数据条引言在Excel中添加数据条是一种数据可视化技巧，它通过条形图的形式在单元格内直观展示数值的大小，尤其适合比较同一

2024-10-14 19:45:37

目录

一、引言

二、什么是查询集？

2.1 创建查询集

三、查询集的延迟加载

3.1 查询集的惰性行为

2024-10-14 19:44:53

字符串问题我正在使用 python 通过 jdbc（或 odbc）访问 iris 数据库。我想将数据提取到 pandas 数据框中来操作数据并从中创建图表。我在使用 jdbc 时遇到了字符串处理问题。

2024-09-30 00:07:53

您的组织是否拥有太多 github 存储库，并且您需要一种简单的方法来总结和记录每个存储库的内容以用于报告、仪表板或审计目的？下面是一个使用 github api 完成该操作的快速脚本

2024-09-30 00:07:10

Python构建代理池构建有效的代理池对于爬虫任务至关重要，因为它可以绕过网站反爬或提升爬虫效率。在Python中构建代理池的方法如下：一、收集代理免费代理网站：如FreeProxyList

2024-09-18 16:06:35

&emsp;&emsp;本文介绍基于Python语言，针对一个文件夹下大量的Excel表格文件，对其中的每一个文件加以操作——将其中指定的若干列的数据部分都向上移动一行，并将所有

2024-09-09 23:42:47

技术背景一般情况下我们会选择使用明文形式来存储数据，如json、txt、csv等等。如果是需要压缩率较高的存储格式，还可以选择使用hdf5或者npz等格式。还有一种比较紧凑的数据存

2024-09-09 23:40:42

要将阿拉伯数字转换成中国汉字表示的数字，我们需要一个映射表来转换每个数字，并且处理不同位数的数字（如十、百、千、万等）。1. Python实现阿拉伯数字转换成中国汉字下面是一个

2024-09-09 23:40:16

2020-10-21

2021-03-02

2020-05-07

2020-05-26

2021-01-13

2021-04-02

2020-05-10

2020-05-09

2020-05-10

2020-10-21

Python实现将字典(列表按列)存入csv文件

目录

1、将字典存入csv文件

2、列表按列存入csv文件

3、反例（没转字典就只有一列）

实战需求

需求1

需求2

总结

热点内容

免费资源网

在线工具

扫一扫随时看

本站下载频道