excel中将两个单元格的内容合并
Posted
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了excel中将两个单元格的内容合并相关的知识,希望对你有一定的参考价值。
参考技术A=CONCAT(A1:B1)或
=TEXTJOIN(",",TRUE,A1:B1)
参考技术BCONCATENATE函数合并单元格。
1、CONCATENATE函数的定义
将几个文本字符串合并为一个文本字符串。
语法
CONCATENATE (text1,text2,...)
Text1, text2, ... 为 1 到 30 个将要合并成单个文本项的文本项。这些文本项可以为文本字符串、数字或对单个单元格的引用。
2、用法:
假设要将A1,B1两个单元格的内容合并在C1单元格中,则点击C1,在C1单元格写入公式:
=CONCATENATE(A1,B1)。
3、具体操作如下:
(1)在D2单元格中输入公式。
(2)选择要合并的单元格,从需要合并的单元格处点击一下,此处合并D2,点击一下。
(3)在D2单元格中输入公式 =concatenate(A2,B2,C2).
(4)确认并向下填充公式,同样将前三列单元格的内容合并在一起。
Pandas读取excel合并单元格的正确姿势(openpyxl合并单元格拆分并填充内容)
问题介绍(ffill填充存在的问题)
在pandas读取excel经常会遇到合并单元格的问题。例如:
此时使用pandas读取到的内容为:
如果去百度,几乎所有人会说应该用如下代码:
df['班级'] = df['班级'].ffill()
这样看起来没问题,但是,该解决方案并不能适用于所有场景,甚至会造成数据错误。
例如:
对班级和备注填充后:
孙武空本来是数据缺失,现在被错误的标记成了挂科数据。
再例如:
对所有列填充后:
同样存在大量数据或错误数据。
正确填充方式
思路:① 使用openpyxl将合并单元格拆分,生成中间文件 ② 读取中间文件
第一步,使用如下工具类生成拆分单元格并生成中间文件:
import openpyxl
# 拆分所有的合并单元格,并赋予合并之前的值。
# 由于openpyxl并没有提供拆分并填充的方法,所以使用该方法进行完成
def unmerge_and_fill_cells(worksheet):
all_merged_cell_ranges = list(
worksheet.merged_cells.ranges
)
for merged_cell_range in all_merged_cell_ranges:
merged_cell = merged_cell_range.start_cell
worksheet.unmerge_cells(range_string=merged_cell_range.coord)
for row_index, col_index in merged_cell_range.cells:
cell = worksheet.cell(row=row_index, column=col_index)
cell.value = merged_cell.value
# 读取原始xlsx文件,拆分并填充单元格,然后生成中间临时文件。
def unmerge_cell(filename):
wb = openpyxl.load_workbook(filename)
for sheet_name in wb.sheetnames:
sheet = wb[sheet_name]
unmerge_and_fill_cells(sheet)
filename = filename.replace(".xls", "_temp.xls")
wb.save(filename)
wb.close()
# openpyxl保存之后,再用pandas读取会存在公式无法读取到的情况,使用下面方式就可以了
# 如果你的excel不涉及公式,可以删除下面内容
# 原理为:使用windows打开excel,然后另存为一下
from win32com.client import Dispatch
xlApp = Dispatch("Excel.Application")
xlApp.Visible = False
xlBook = xlApp.Workbooks.Open(str(Path(".").absolute() / filename)) # 这里必须填绝对路径
xlBook.Save()
xlBook.Close()
return filename
if __name__ == '__main__':
unmerge_cell("test.xlsx")
拆分后的sheet页如图:
然后再使用pandas读取中间文件即可:
import pandas as pd
df = pd.read_excel("test_temp.xlsx")
结果为:
以上是关于excel中将两个单元格的内容合并的主要内容,如果未能解决你的问题,请参考以下文章