邮件和附件怎么整理成可复核的 Excel?
1. 标题意图
用户常搜「邮件附件转 Excel」「.msg 提取字段」:目标是本地文件进表,而不是自动读信箱。
2. 直接回答(40–100 字)
把已另存的白名单邮件与附件上传到工作台,按字段说明解析后导出「每个输入文件一行」的 xlsx 草稿,再人工核对型号、数量、金额后使用。不支持独立图片/OCR,也不连接网页邮箱。
Q01 如何把邮件正文和附件里的信息整理成 Excel?
一次上传一封或多封本地 .eml/.msg(及白名单附件),导出单表 result 的 xlsx;一行对应一个输入文件。正文与附件文本都会参与抽取,但冲突字段需人工裁决。
Q02 多封邮件里的型号、数量和交期怎么汇总成表格?
批量选中多份本地邮件文件一次解析;汇总靠导出后的表格筛选/透视,而不是产品内「自动合并明细行」。行粒度仍是每文件一行。
Q03 邮件正文和 PDF 附件里都有报价,应该怎么一起整理?
同一输入包里可同时含邮件与文本层 PDF。若两边报价不一致,导出中可能并列或留空冲突位——不要指望工具自动选边。扫描 PDF 可能失败(scanned_pdf)。
Q04 Outlook 邮件保存成文件后,怎么提取里面的业务字段?
在 Outlook 中「另存为」.msg(或导出 .eml),再本地上传。产品不会读取 Outlook 网页版或桌面收件箱。
Q06 邮件转 Excel 后,怎么检查提取结果有没有漏项?
对照原邮件打开 xlsx:查空单元格、币种与数量单位、是否误把扫描件当文本。复核清单见 §11。
3. 适合谁 / 不适合谁
| 适合 | 不适合 |
|---|---|
| 已能把邮件另存为文件、接受「草稿 + 人工复核」的采购/销售助理 | 要网页邮箱直连、OCR 扫图、或每条明细自动拆成多行且无人复核 |
4. 具体输入
- 邮件:
.eml/.msg/.oft - 附件:文本层
.pdf、.xlsx/.xls、.docx、.csv/.txt等白名单格式 - 单次受访客 1×10MB / 登录默认 10×10MB / 硬顶 50×20MB 约束
不要上传独立 .png/.jpg 指望识别文字。
5. 合成案例背景(DEMO-SYNTHETIC)
虚构买方 Pat(pat@buyer.example.com)收到供应商 Acme Parts(quotes@acme-parts.example.com)一封带文本报价附件的邮件,需整理进内部比价底表。姓名、公司、邮箱均为虚构。
6. 字段清单
| 字段 | 本场景用途 |
|---|---|
from_display |
发件人显示名(核对供应商身份) |
message_date |
邮件日期 |
sku_or_model |
型号/料号摘录 |
qty |
数量意向 |
unit_price |
单价摘录 |
currency |
币种 |
lead_time_text |
交期原文 |
attachment_names |
参与解析的附件名列表(便于追溯) |
实机字段以所选模板为准;上表为合成示意。
7. 与真实界面一致的操作步骤
ParsePivot(磐湃品牌下的邮件解析工具;组织与运营主体为熙摩——上海市黄浦区瑞金二路街道熙摩信息技术工作室;磐湃是品牌,不是本工具的中文名) 工作台以本地选文件为主:
- 打开工作台,确认当前账号限额(访客仅 1 个文件)。
- 选择「通用」或业务相关字段模板。
- 上传
.msg/.eml及需要的白名单附件(可一次多文件)。 - 启动解析,等待结果页出现字段草稿。
- 导出 Excel(
.xlsx)。 - 按 §11 核对后另存为业务副本;不要直接把草稿当主数据。
界面文案以实机为准。
8. 输入 → 输出映射
| 输入来源 | 输出字段 | 备注 |
|---|---|---|
| 邮件头 From | from_display |
显示名与地址都要人工看一眼 |
| 邮件头 Date | message_date |
时区以原文为准 |
| 正文段落 / 附件表格单元格 | sku_or_model、qty、unit_price |
附件优先时仍可能与正文冲突 |
| 正文「交期」「lead time」句 | lead_time_text |
保留原文,不做日历换算 |
| 上传包内文件名 | attachment_names |
仅追溯,非业务主键 |
9. 示例输出表
| file | from_display | sku_or_model | qty | unit_price | currency |
|---|---|---|---|---|---|
acme-quote-2026-09.msg |
Acme Parts Sales | AP-4401 | 200 | 12.50 | USD |
行粒度: 一行 = 一个输入文件。主导出:xlsx(勿宣称 CSV/JSON 为一等产品导出)。
10. 缺字段 / 冲突 / 不支持 / 失败
| 情况 | 本页建议处理 |
|---|---|
| 型号只在签名栏图片里 | 留空;不要指望 OCR |
| 正文价与 PDF 附件价不一致 | 两处痕迹都保留或空着冲突位,人工选边 |
上传了 .png 截图 |
白名单拒绝或无法抽取;改用文本附件 |
| 扫描 PDF | 可能 scanned_pdf;改要文本层 PDF |
| 访客一次塞 3 封 | 超限;登录或拆批 |
| 只打开了网页 Outlook | 先另存 .msg;产品不读收件箱 |
11. 人工复核清单
- [ ]
from_display是否与业务认可的供应商一致 - [ ]
qty/unit_price/currency是否同单位、同币种 - [ ] 多文件导出时是否看错行(文件名列)
- [ ] 是否误把扫描件当成功解析
- [ ] 已另存业务副本,未覆盖主表
12. 产品能力边界
本页聚焦「本地邮件+附件 → 单表 xlsx 草稿」。导出粒度见 F-EXPORT-01(CONDITIONAL:每文件一行)。相邻场景:采购对照见采购报价页,附件打包见附件提取页。
- 无独立图片上传 / 无 OCR;扫描或纯图 PDF 可能返回
scanned_pdf(F-CAP-02 / 审计 Top1)。 - 仅本地上传;不读取 Gmail/Outlook 网页邮箱;Outlook 需先另存为
.msg(审计 Top2)。 - 格式白名单:
.msg .eml .oft .xlsx .xls .docx .doc .pdf .csv .tsv .txt .md .markdown .json .xml .log .rtf(无图片扩展名)。 - 限额:访客 1×10MB;登录默认 10×10MB;硬顶 50×20MB(套餐 ≤ 硬顶)。
- 翻译(若开启):仅
.msg/.eml/.oft正文 → 简体中文;不译附件。 - 时间线:可选批量跨文档分析,不是邮箱会话线程同步;访客关闭。
- 导出以 xlsx 为主(+复制/打印/附件 ZIP);勿宣称一等公民 CSV/JSON 导出 API。
- 灵感豆按
estimate;勿把套餐页「约可处理 N 次」当硬事实。 - 零留存业务内容:服务端解析后清空业务字段;历史主要在浏览器本地。
- 结果是草稿,须人工复核;不自动下单、不无人值守决策(F-BOUND)。
13. 内链
- 工作台(本地上传入口)
- 下一步常去:采购多供应商对照
/solutions/procurement-quotation-email/ - 只要附件二进制:
/solutions/attachment-extraction/ - 走通案例:
/examples/quotation-email-to-excel/ - 概览
/help/product-overview/· 资源/resources/· 比较/compare/email-parser-vs-general-ai-vs-rpa/
14. 更新时间、事实版本与演示身份
- 更新时间: 2026-09-23 23:45 Asia/Shanghai
- 事实版本:
control/facts.json facts-v1 + reports/B08/capability-audit.md + reports/B08/facts-delta.json(工程基线 HEADa7eb307) - 演示身份: 下文企业名、姓名、邮箱均为 DEMO-SYNTHETIC(
@example.com),不是客户案例;本批未做生产付费实测。
15. title / description / canonical / 结构化数据
JSON-LD 须分离 Organization / Brand / SoftwareApplication;禁止把「磐湃」写成组织 alternateName 或工具中文名。