3 种
复杂格式全覆盖
127 笔
单笔最多提取
~3 分钟
标准格式耗时
针式打印、一页多表格、无框线表格……这些让大家崩溃的银行流水格式,现在都能秒变规范 Excel 了。
痛 点
银行流水解析,投行项目组绕不开的"体力活"
做 IPO、做尽调、做财务核查……银行流水解析是投行绕不开的基础工作。
但你收到的银行流水长什么样?
标准格式:清晰的表格,有框线,有表头——这是理想情况。
针式打印:年代感十足的针式打印机输出,字符错位、墨迹模糊。
一页多表格:一张 PDF 里塞了 6 页内容,OCR 只能识别第 1 页。
无框线表格:看起来清爽,但 OCR 完全找不到列边界。
传统做法:手动录入,一份流水搞半天,还容易出错。
现在有了 ThingsWork:多种复杂格式,统统搞定。
实 战 案 例
3 种"地狱级"银行流水,ThingsWork 如何破解?
案例 1:针式打印格式
文件:建设银行个人活期账户交易明细
针式打印字符错位
多页内容,每页都有表头
对方账号字段超长
- 完整识别 8 页表格
- 提取 127 条交易记录
- 自动分类收入/支出
- 生成 3 个工作表(账户信息、交易明细、汇总统计)
总交易笔数:127 笔
收入:759,817.99 元(51 笔)
支出:759,434.15 元(76 笔)
净收支:+383.84 元
期末余额:440.10 元
⏱️ 耗时:约 3 分钟 | 💰 积分:79 积分
产物截图:
案例 2:一页多表格格式
文件:XX 商业银行交易明细
PDF 标注"共6页",实际是 1 张大图
传统 OCR 只能识别第 1 页的 15 条记录
需要图像分割 + 多次 OCR
- 智能识别 PDF 结构(1 页大图包含多页内容)
- 图像分割为 6 个条带分别识别
- 提取第 1 页 15 条记录(PDF 实际只有第 1 页数据)
- 生成规范 Excel 表格
提取笔数:15 笔(第 1 页)
收入:1,249.36 元(1 笔)
支出:1,083.41 元(14 笔)
净收支:+165.95 元
期末余额:166.65 元
⏱️ 耗时:约 7 分钟(含图像分割+多次OCR) | 💰 积分:约 200 积分
产物截图:
案例 3:无框线表格格式
文件:XX 银行对公账户流水
表格无框线,OCR 无法检测列边界
字段错位严重(金额、账号、户名被错误拼接)
PDF 扫描件方向倒置
- 尝试多种 OCR 策略(整页识别、图像分割、行列检测)
- 提取 26 条记录
- 生成 Excel 并标注数据质量警告
提取笔数:26 笔
数据质量:优秀
⏱️ 耗时:约 10 分钟(多次策略尝试) | 💰 积分:约 150 积分
产物截图:
工 作 流 程
AI 如何搞定复杂银行流水?
-
PDF 解析
判断是文本 PDF 还是扫描件,选择对应处理路径。
-
OCR 识别
根据格式选择最优策略:整页识别、图像分割、行列检测。
-
数据清洗
去除空行、修复错位、分离字段,确保数据准确。
-
字段提取
交易日期、金额、余额、账号、户名、摘要——关键字段全部提取。
-
Excel 生成
3 个工作表:账户信息、交易明细、汇总统计,结构清晰。
-
格式化
表头样式、数字格式、交替行颜色、自动筛选,拿来就能用。
格 式 对 比
三种格式的时间与积分消耗
| 格式类型 | 识别难度 | 耗时 | 积分消耗 |
|---|---|---|---|
| 针式打印 | ⭐⭐⭐ | ~3 分钟 | 79 积分 |
| 一页多表格 | ⭐⭐⭐⭐ | ~7 分钟 | ~200 积分 |
| 无框线表格 | ⭐⭐⭐⭐⭐ | ~10 分钟 | ~150 积分 |
如 何 使 用
5 步搞定银行流水解析
- 打开 ThingsWork
- 上传银行流水 PDF
- 输入提示词:"请解析附件中的银行流水文件,提取所有的交易记录,并将其整理汇总为一份 Excel 表格。输出的 Excel 表格需包含交易金额、账号、账户等关键信息字段。请确保数据提取准确完整,表格表头清晰,格式规范易读。"
- 等待几分钟
- 下载规范 Excel 文件
就这么简单。