Enterprise AI Reading Workstation

从"能总结 PDF"
到"可验证的 AI 深度阅读工作台"

为金融研究者、券商分析师与投资经理设计的本地化 AI 阅读终端——
每个 AI 结论都有出处、可回跳、可校验。

Document Intelligence × Evidence Grounding × Active Reading × Knowledge Capture × Evaluation

📄 PDF 解析 + OCR🧠 Map-Reduce 全书解读🔍 全书 Ask Book RAG✅ Citation Verifier ✍️ AI 思考辅助🔊 语音朗读📤 分享卡片🧪 Evaluation 框架
Product Interface

三栏阅读工作台

左侧书库与目录 · 中间 PDF 阅读 · 右侧 AI 分析层。阅读、理解、追问、标注在同一个界面内闭环。点击右侧 Tab 切换 AI 视图。

ARGUS · AI READER
研究工作台 / 《理解复杂系统》 / 第 3 章
SHOWCASE · MOCK DATA Deep Analysis · 94% 覆盖 · Map-Reduce 完成
WORKSPACE

我的研究书库

理解复杂系统412 页 · 深度解读已完成
18 笔记 · 37 高亮
组织与决策286 页 · 已索引 · 88% 覆盖
9 笔记 · 12 高亮
平台战略手册338 页 · 深度解读已完成
6 笔记 · 20 高亮
金融与市场微观结构528 页 · 分析中 · 76% 覆盖
3 笔记 · 8 高亮 · OCR 3 页

DOCUMENT MAP

01 为什么复杂系统难以预测
02 反馈回路与延迟
03 局部最优如何制造系统性风险
04 杠杆点:小改变与大结果
05 用模型而不是直觉做决策
结语 · 系统思维的边界
《理解复杂系统》 · PDF 第 67 文本层 ✓   OCR 可用   索引已建立

第三章 · 局部最优如何制造系统性风险

复杂系统的失败,往往不是因为某个节点做了明显错误的决定,而是因为每个节点都在自己的评价函数下做了"正确"的选择。

3.1 局部理性与整体非理性

当组织把一个跨部门目标拆成多个局部指标时,指标会改变行为。销售追求成交率,运营追求周转率,风控追求违约率,每一方都可能通过优化自己的数字,让系统逐渐偏离原本的业务目标。

真正危险的不是某个指标被优化,而是反馈回路之间存在不同的时间尺度:短期指标先给出正反馈,而成本、风险和副作用在更晚的时候才显现。决策者因此容易把"暂时没有代价"误读成"策略有效"。

3.2 从事件解释转向结构解释

事件解释问"这次为什么失败",结构解释则问"什么机制让类似失败可以反复发生"。后者要求我们画出变量之间的连接、方向、延迟和增强/抑制关系。

67

3.3 延迟是最容易被忽略的变量

如果行为的成本在两个季度之后才被观测,那么一个看似理性的组织,会在前两个季度持续加码同一种行为。

因此,系统分析不是追求绝对预测,而是帮助决策者发现哪些假设最脆弱、哪些反馈最慢、哪些变量拥有非线性影响。

68
AI RESEARCH LAYER

证据驱动的深度阅读

全书分析覆盖94%

412 页 · 388 页可提取正文 · 19/19 章节 · Chapter Map-Reduce · 1 失败分块已重试成功

ONE-SENTENCE THESIS

复杂问题的关键不是预测每个事件,而是识别反馈、延迟与激励如何共同塑造系统行为。

↗ p24 ↗ p67 ↗ p212
CURRENT CHAPTER · ROLE IN BOOK

第 3 章把前两章的"反馈回路"概念转成组织决策问题——为什么每个人都做对了,系统仍可能失败。它为第 4 章寻找"杠杆点"提供问题定义。

ARGUMENT MAP
1
局部指标改变局部行为指标不是被动测量,而会主动塑造行动。p65–66
2
不同反馈回路具有不同延迟收益先出现,代价晚出现,导致错误归因。p67
3
事件解释不足以改变系统需转向变量、连接、延迟与激励的结构解释。p67–70
KEY CONCEPTS

反馈回路 p42 局部最优 p67 杠杆点 p89 系统延迟 p156

AI BOUNDARY

"复杂系统一定不可预测"并不是本章的原句。证据不足时不扩大结论。

CITATION VERIFIER✓ PASS

6 个引用中 5 个通过两级校验,1 个支撑度不足已降级。

CLAIM

"短期正反馈会遮蔽延迟出现的风险"

PDF 第 67 页Support 0.96 ✓ "短期指标先给出正反馈,而成本、风险和副作用在更晚的时候才显现。"
PDF 第 68 页Support 0.89 ✓ "如果行为的成本在两个季度之后才被观测……会持续加码同一种行为。"
PDF 第 200 页Support 0.12 ✗ (该页未找到与 claim 直接相关的术语,已从回答中移除该引用)
WHY THIS MATTERS

重要结论不只给"页码标签",还展示实际证据片段与支撑度。如果证据不足,回答会降级或 Abstain。

作者为什么认为 KPI 会制造系统性风险?
【书中内容】检索 6 个候选 → 重排 3 个证据 作者并不是说 KPI 本身有害,而是强调局部指标会改变行为。当不同部门只优化自己的评价函数,同时成本存在延迟,局部"正确"会累积成整体偏离。 p65p67
证据状态 2 个引用通过存在性校验 + 支撑度校验。未使用外部知识。
第 3 章与第 4 章是什么关系?
【书中内容】检索 4 个候选 → 重排 2 个证据 第 3 章负责定义"局部最优造成系统风险"的问题机制,第 4 章进一步讨论如何寻找可以改变反馈结构的杠杆点。二者是"问题机制 → 干预位置"的递进关系。 p67p102
ACTIVE READING

高亮不只是收藏:把"原文 → AI 理解 → 我的判断"连起来

💡 我的想法 · p67AI 已关联

这和很多企业"部门 KPI 都完成,但公司目标反而变差"的情况一致。后续可以和 Goodhart's Law 做对照,但要区分作者原文与外部概念。

🤖 AI 建议追问 · p67刚刚

"延迟"与"激励"是两个独立机制,还是作者把它们视为同一个反馈结构中的变量?

🟡 高亮 · 重点 · p67证据

真正危险的不是某个指标被优化,而是反馈回路之间存在不同的时间尺度。

🔵 高亮 · 观点 · p68

事件解释问"这次为什么失败",结构解释则问"什么机制让类似失败可以反复发生"。

📝 总结 · p67-70AI 辅助

本章核心:局部理性+延迟反馈=系统脆弱性。解决方向是改变信息流和激励结构,而非增加检查节点。

Features

功能全景

12 大核心能力,从 PDF 解析到知识沉淀的完整闭环。

📚本地书库管理

文件夹自动扫描同步、拖拽上传、SHA256 去重检测、分类标签、回收站机制。

📖PDF 阅读器

pdfjs-dist + react-pdf 渲染、连续滚动、页码跟踪、目录跳转、3 种划线高亮。

🧠AI 目录增强

3-tier 提取(书签→印刷目录→推断)、AI 修正 OCR 错误、章节摘要+关键词。

🔍划词 AI 解析

全文分析/关键词双模式、逻辑链拆解、金融含义、市场启示、风险提示。

📊全书深度解读

Map-Reduce 管道、核心命题、论证链、分析框架、关键概念、推荐阅读路径。

💬Ask Book RAG

倒排索引 + BM25 检索 + 重排、双模式(仅本书/混合)、检索证据可查。

Citation Verifier

两级校验(存在性+支撑度)、页码精确回跳、证据不足时 Abstain。

✍️AI 思考辅助

8 种 AI 动作:激发/结构化/润色/质疑/总结/投资映射/标题/标签。

🔊语音朗读

Web Speech API、4 级智能文本分块、中英文、速度控制、偏好持久化。

📤分享卡片

AI 生成标题/解读/视觉方案、多模板多比例、PNG 高清导出。

🔄Job 状态机

12 状态追踪、进度/重试/错误日志、本地持久化、可取消/重试。

🧪Evaluation 框架

20 测试用例、10 项指标、离线运行、一键 npm run eval

AI Pipeline

7 大 AI 工作流 + Map-Reduce 全书分析管道

不是"把 PDF 扔给模型",而是有结构的摄入→分析→检索→校验→沉淀。

INGESTION📥 文档摄入

上传校验 · 文本提取
覆盖度检查 · OCR fallback

STRUCTURE📑 结构化

章节检测 · 目录提取
AI 增强 · 页码校准

ANALYSIS🧠 分层分析

Map-Reduce · 选文解析
思考辅助 · 全书解读

RETRIEVAL🔍 检索问答

倒排索引 · BM25 检索
重排 · Citation 校验

KNOWLEDGE📝 知识沉淀

高亮 · 想法 · AI 辅助
笔记导出 · Evaluation

Map-Reduce Architecture

大书全书解读管道

小书(<30k chars) 直接分析,大书自动进入 5 阶段 Map-Reduce。Honest coverage:绝不截断输入后标记为完整。

PHASE 1📄 文本提取

pdfjs-dist 逐页提取
计算覆盖度

PHASE 2📑 章节检测

Regex 标题检测
+ Heuristic fallback

PHASE 3🗂 MAP: 分块分析

12k chars/块
并发 AI 分析每块

PHASE 4📊 REDUCE: 综合

块→章节聚合
Fallback 降级机制

PHASE 5📕 全书合成

Hierarchical Reduce
includedChapterIds 追踪

Reliability

Citation Verifier — AI 输出的二次校验

不做"信任模型"假设。每个 AI 输出的页码引用都经过两级独立校验。

🔍 Level 1 · Existence Check(存在性校验)
  • 页码是否在 1 ~ totalPages 范围内?
  • 该页是否有可提取文本?
  • 不通过 → 直接标记 failed,不进入 Level 2
PDF 第 67 页✓ Exists
PDF 第 999 页✗ 超出范围 (1-412)
📐 Level 2 · Support Check(支撑度校验)
  • Claim 中的关键术语是否在该页文本中出现?
  • Token-overlap 语义支撑度是否 ≥ 阈值?
  • 不通过 → 降级确定性 或 Abstain
Support Score 0.96✓ Supported"短期指标先给出正反馈,而成本、风险和副作用在更晚的时候才显现。"
Support Score 0.12✗ 支撑不足(未找到与 claim 高度相关的术语,该引用已从回答中移除)
Evaluation

离线评测框架

覆盖正常路径、边界情况与对抗测试。AI 产品的质量必须可量化。

10
核心指标
20
测试用例
7
测试类别
2
校验级别
npm run eval
一键运行
📄 Extraction

文字型 PDF · 扫描版 · 双栏 · 中英混排

📑 Chapter Detection

有目录 · 无目录 · 页码偏移

🔍 Retrieval

精确查询 · 跨章节综合 · 无答案问题

✅ Citation

真实页码校验 · 编造页码拒绝

💬 Answer Quality

正常回答 · Abstain · 诱导编造拒绝

⚠️ Error Handling

PDF 损坏 · API Key 缺失 · 模型超时

10 项指标:Extraction Coverage · Chapter Detection · Recall@K · Citation Existence Precision · Citation Support Precision · Grounded Answer Rate · Abstention Correctness · Schema Valid Rate · Job Success Rate · P50/P95 Latency
Product Methodology

产品设计方法 + 竞品对比

基于 "Agent 视角的需求分析与结构设计" 六步法。不是凭感觉做功能,而是结构化地定义产品。

STEP 1需求分析

三层信息
表面→真实→隐藏

STEP 2需求拆解

5W2H + Agent 四问
Goal/Capability/Boundary

STEP 3市场调研

高频问题验证
价值测算公式

STEP 4竞品分析

三层竞品 · 四维对比
差异化定位

STEP 5-6设计 + 落地

MoSCoW · Workflow
Evaluation · Roadmap

对比维度AI 文档对话类阅读/笔记类AI Reader 定位
功能总结、问答、文档检索批注、摘录、组织、回顾深度分析 + 证据链 + 主动阅读 + 笔记闭环
体验对话优先,阅读上下文易被遮蔽阅读稳定,AI 多为外挂阅读器内完成理解/回跳/追问/沉淀
成本长文档推理成本高AI 成本较低或非核心章节缓存+增量分析+检索式回答控制成本
技术路线RAG / 对话本地索引/笔记结构解析/OCR → Map-Reduce → RAG → Citation Verify → Eval
差异化定位:不是"更会总结 PDF",而是"让 AI 的每个重要结论都有证据,并把理解过程留在阅读流里"。
Tech Stack

技术栈

🖥 Frontend

Next.js 14 (App Router) · React 18 · TypeScript 5 · Tailwind CSS 3 · Lucide Icons · react-pdf · html-to-image

⚙️ Backend

Next.js API Routes (Node.js) · pdfjs-dist · PyMuPDF · Zod Schema · Playwright · Web Speech API

🧠 AI

DeepSeek API (OpenAI SDK) · Map-Reduce Pipeline · Inverted Index + BM25 · Citation Verifier · OCR Adapter

Next.js 14React 18TypeScript 5Tailwind CSSDeepSeek API pdfjs-distZodPyMuPDFPlaywrightWeb Speech APIhtml-to-image
Roadmap

从可用 Demo 到企业级产品

PHASE 1 · ✅ 已完成

可靠性补齐

  • OCR fallback 适配器
  • Honest coverage 覆盖度
  • Citation Verifier 两级校验
  • Runtime Schema 自动修复
  • Job 状态机 + 进度追踪
PHASE 2 · 🔄 进行中

智能升级

  • Ask Book RAG 全书检索
  • BM25 + 重排检索链路
  • Hierarchical Reduce 分层合成
  • Evaluation 离线评测框架
  • Repository 接口抽象
PHASE 3 · 📋 规划中

体验与展示

  • 响应式布局 (mobile/tablet)
  • Showcase 展示页面
  • 任务中心 Dashboard UI
  • 证据链面板可视化
  • Markdown 笔记导出
Application Routes

应用页面索引

🏠 /

主阅读工作台 — 三栏布局、真实 PDF 阅读 + AI 深度分析、需配置 API Key 和本地书库。

📊 /showcase/analysis

产品分析框架展示 — 需求三层信息、5W2H、竞品四维对比、MoSCoW、Roadmap。

🎨 /showcase/product

企业级产品可交互 Demo — Mock 数据、四 Tab 实时切换、选文工具栏、Ask Book 演示。

📖 查看项目文档 npm run dev