7.4 KiB
7.4 KiB
In [25]:
import pandas as pdIn [27]:
df = pd.read_excel("./学生信息.xls", usecols=['学号', '姓名', '性别', '年级','班级'])In [28]:
class_count = df.groupby(['年级', '班级']).size().reset_index(name='人数')In [29]:
class_countOut [29]:
| 年级 | 班级 | 人数 | |
|---|---|---|---|
| 0 | 26学部 | 1班 | 42 |
| 1 | 26学部 | 2班 | 41 |
| 2 | 26学部 | 3班 | 38 |
| 3 | 26学部 | 4班 | 40 |
| 4 | 26学部 | 5班 | 39 |
| 5 | 27学部 | 1班 | 48 |
| 6 | 27学部 | 2班 | 47 |
| 7 | 27学部 | 3班 | 46 |
| 8 | 27学部 | 4班 | 48 |
| 9 | 27学部 | 5班 | 48 |
| 10 | 28学部 | 1班 | 49 |
| 11 | 28学部 | 2班 | 49 |
| 12 | 28学部 | 3班 | 49 |
| 13 | 28学部 | 4班 | 49 |
In [ ]:
In [13]:
df = pd.read_excel("./学生信息.xls", usecols=['学号', '姓名', '性别', '年级'])
row_strings = set()
for _, row in df.iterrows():
row_str = f"{row['学号']}{row['姓名']}{row['性别']}{row['年级']}"
row_strings.add(row_str)In [14]:
df.shapeOut [14]:
(633, 4)
In [15]:
len(row_strings)Out [15]:
633
In [21]:
df1 = pd.read_excel("./学生信息2.xls", usecols=['学号', '姓名', '性别', '年级'])
row_strings1 = set()
for _, row in df.iterrows():
row_str = f"{row['学号']}{row['姓名']}{row['性别']}{row['年级']}"
row_strings1.add(row_str)In [22]:
row_strings1.pop()Out [22]:
'260434于铭达男26学部'
In [24]:
row_strings - row_strings1 Out [24]:
{'260434于铭达男26学部'}In [ ]: