/concepts – directory listing# 01-core-architecture 03-quick-start 05-architecture-insights 06-transferable-patterns 07-specweave-implications 百度 Unlimited-OCR 核心架构与设计理念 1. R-SWA机制详解 2. DeepEncoder视觉编码器 3. 固定大小KV cache队列 4. R-SWA vs 标准注意力对比 5. R-SWA注意力计算流程 6. 为什么R-SWA是"免费午餐" 章节导航 百度 Unlimited-OCR 快速上手指南 1. 环境要求 2. 图像模式说明 3. 通用前置处理 4. Transformers方式(快速上手) 5. SGLang方式(高性能服务部署) 6. vLLM方式(生产级部署) 7. infer.py批量推理脚本 8. OmniDocBench评估后处理 9. 三种方式对比表 10. 方式选择建议 章节导航 百度 Unlimited-OCR 架构创新深度启示 1. "归纳偏置"的力量:任务定制架构vs通用参数堆砌 2. "软遗忘"的哲学启示:不是"如何记住更多",而是"哪些该记哪些该忘" 3. 视觉token不参与状态转移的关键洞见 4. 普通Transformer/线性注意力vs R-SWA的本质区别 章节导航 百度 Unlimited-OCR 可迁移模式与行业启示 1. MoE+稀疏激活的效率哲学 2. 专用模型与通用大模型的分化共存 3. "继续训练4000步"的创新路径 4. R-SWA可迁移性分析 5. 附:技术传播模式——爆款技术文章的写作策略 章节导航 百度 Unlimited-OCR 对SpecWeave的可行动启示 启示1:实现"规范前置+对话滑窗"的上下文管理中间件 启示2:建立"文档编码器+按需检索"的长文档处理机制 两条启示的核心共性 章节导航