文澜知微项目实训小组报告记录五(第五-六阶段)
成员:蔺涵霖、秦玮悦、陈秋华
实训周期:5.18-5.31
一、项目整体概述
本项目为“文澜知微”古文沉浸式智慧阅读平台,核心目标是打造一款集古籍阅读、历史人物对话、古文智能翻译、时空地图可视化为一体的综合性智慧阅读平台,聚焦解决传统古籍阅读晦涩、交互单一、历史时空感知薄弱等痛点,为用户提供智能化、沉浸式、场景化的古文阅读体验。
本次整合第五、六两大开发阶段,基于前四阶段完成的项目基础框架搭建、AI大模型接入、语音朗读模块开发、历史人物轨迹数据采集清洗与坐标优化等工作,持续迭代优化核心功能。第五阶段重点完成阅读交互、古音朗读、人物轨迹精度优化三大基础升级;第六阶段聚焦智能化能力深化,落地文章智能摘要、AI全自动轨迹查询校对、古文智能翻译核心功能。通过两阶段迭代,平台彻底实现从“功能可用”到“体验优质、智能闭环”的升级,全面提升了古籍阅读的智能化水平、时空沉浸感与数据准确性。
二、两阶段小组分工及完成情况
小组3名成员结合个人技术特长与阶段项目需求,实行模块化精准分工、协同联动开发,两阶段所有分配任务均按标准高质量完成,无延期、无遗留重大问题,各成员分工及完成情况如下:
|
成员 |
负责阶段模块 |
具体核心职责 |
阶段完成成果 |
|---|---|---|---|
|
蔺涵霖 |
第五阶段:古音朗读增强与朝代发音映射优化第六阶段:AI智能翻译功能开发 |
1. 接入古音数据集,构建朝代音系映射规则,实现多时期古音差异化朗读;2. 完成古音IPA符号可读化转换、文本归一化增强,优化朗读稳定性;3. 设计选中文字翻译交互链路,搭建多翻译源并发架构;4. 开发翻译设置面板,实现用户配置Pinia持久化,联动平台原有阅读功能。 |
✅ 全部完成1. 实现6大历史时期差异化古音朗读,听感区分度显著提升,兼容古今双模式切换;2. 落地多源AI并发翻译体系,选中即译、结果实时展示,个性化配置长期生效。 |
|
秦玮悦 |
第五阶段:阅读页选中文字交互功能开发第六阶段:文章智能摘要功能开发 |
1. 开发阅读页文字选中悬浮菜单,实现问AI、摘要、复制全交互功能;2. 优化菜单位置计算、事件监听与关闭逻辑,解决交互冲突问题;3. 设计全书/章节/段落三层摘要体系,开发后端专属API与数据库结构;4. 搭建摘要缓存机制、优化Prompt工程,实现前端摘要展示与关键词联动追问。 |
✅ 全部完成1. 打通阅读-操作最短交互链路,选中功能响应速度≤100ms,交互流畅无异常;2. 落地全流程三级摘要体系,缓存机制大幅降低API成本,实现摘要-深度问答闭环。 |
|
陈秋华 |
第五阶段:历史人物轨迹多人展示与坐标精度优化第六阶段:轨迹系统DeepSeek智能查询与全流程校对优化 |
1. 手动校对2247条轨迹数据,优化CHGIS坐标匹配逻辑,迭代地图可视化组件;2. 扩展历史人物轨迹数据库,修复AI接口调用异常问题;3. 设计AI动态参数适配策略与结构化提示词,搭建轨迹生成-校对-保存-可视化全闭环流程;4. 优化多人轨迹对比模式,修复各类可视化Bug,提升坐标准确率。 |
✅ 全部完成1. 轨迹高可信度坐标占比从81.23%提升至91.19%,278位人物轨迹加载≤1秒;2. 实现AI全自动轨迹生成校对流程,坐标综合准确率≥85%,支持20人同时轨迹对比。 |
三、第五阶段核心模块完成效果
(一)阅读页选中文字交互功能
1. 核心功能
本阶段完成阅读页选中文字交互功能完整开发,用户在古籍精读过程中,选中任意文本即可触发悬浮菜单,一键完成问AI、生成摘要、复制文本三类操作,彻底简化传统阅读的操作链路,实现古籍阅读与智能工具的无缝衔接,提升阅读连贯性与智能化体验。
完整交互流程:用户选中文字 → mouseup事件触发 → 抓取选中文本 → 计算鼠标坐标 → 弹出浮动菜单 → 执行对应操作 → 菜单自动消失
2. 核心技术实现
采用Vue组件化开发模式,基于mouseup事件监听实现文本精准获取,区别于click事件,mouseup可在浏览器完成文字选中后触发,保障文本抓取准确性。通过window.getSelection()获取选中内容,结合坐标偏移算法精准控制菜单位置,避免页面裁切、文字遮挡问题。
功能内置完善的交互逻辑:通过closest()方法实现区域判断,规避侧边栏、菜单内部选中文本误触发问题;通过mousedown.prevent阻止事件冒泡,解决菜单交互冲突;菜单采用适配项目的古风视觉样式,与平台整体风格统一。
3. 组件通信方案
综合运用Vue三大核心通信方式,实现阅读页与AI侧边栏的高效联动:props实现父组件向子组件传递书籍、章节内容数据;emit实现子组件向父组件推送关闭事件;$refs实现父组件主动调用子组件方法,完成消息发送,形成完整的交互协同闭环。
4. 功能效果
菜单响应速度≤100ms,位置精准无偏移;三大核心功能稳定可用,复制功能兼容全场景环境;菜单与侧边栏交互无冲突,视觉风格统一,大幅降低用户智能操作门槛。
(二)古音朗读增强与朝代发音映射优化
1. 核心功能
将平台语音朗读模块从基础的文字朗读升级为朝代差异化古音朗读,依托专业古音数据集,实现不同历史时期古文的专属发音,让历史人物对话、古籍文本朗读具备时代特征,极大提升沉浸式阅读体验,同时保留现代发音模式,兼顾实用性。
2. 技术实现
接入Ancient-Chinese-Phonology专业古音数据集,构建覆盖中唐、晚唐、宋代、元代、明清、现代六大时期的单字音系映射表,建立标准化朝代-发音映射规则。针对原始IPA古音符号无法直接朗读的问题,设计可读化转换算法,通过字级查表、缺字回退、语句分组、标点停顿优化等策略,实现古音清晰可读。
同步完成文本归一化增强,实现全角字符转半角、阿拉伯数字转中文口语化朗读,优化语句连贯性。同时搭建多重容错机制,古音解析异常可自动回退至现代发音,保障功能稳定可用,且不改变前端原有调用逻辑。
3. 功能效果
支持古今发音一键切换,六大历史时期发音差异化明显、辨识度高;古音朗读从理论可用升级为用户可清晰听懂;数字、特殊字符朗读自然流畅,现代模式运行稳定,无兼容性问题。
(三)历史人物轨迹多人展示与坐标精度优化
1. 核心功能
基于前期轨迹可视化基础,重点完成坐标精度校准、组件功能迭代、数据扩容与接口优化,解决原有坐标偏差、功能单一、数据量不足等问题,实现多人物轨迹精准、流畅、可视化展示。
2. 核心优化内容
坐标精度校对:针对2247条轨迹数据开展逐点手动校对,修正坐标偏差、行政层级匹配错误、地名误匹配等问题,开发三级索引校对辅助脚本,提升匹配精准度。优化后高可信度坐标占比从81.23%提升至91.19%,完全符合CHGIS学术标准。
组件迭代升级:优化HistoricalMap.vue组件,新增轨迹合并展示、播放暂停、倍速调节、节点跳转等手动控制功能,解决自动播放无法干预的问题;优化时间轴、地名点击、AI问答的多模块联动逻辑。
数据与接口优化:将历史人物轨迹数据扩展至278人,覆盖先秦至明清各朝代、各领域历史人物;修复DeepSeek接口批量调用超时、限流问题,优化重试与异常处理机制。
3. 功能效果
重复轨迹标记减少80%以上,页面视觉更简洁;278位人物轨迹加载时间控制在1秒内,播放流畅无卡顿;支持多人物轨迹对比与手动操控,模块联动正常,接口调用稳定。
四、第六阶段核心模块完成效果
(一)文章智能摘要功能
1. 核心功能
创新性搭建全书、章节、段落三级智能摘要体系,覆盖用户选书、精读、段落研读的全阅读场景,搭配差异化缓存策略,兼顾用户体验与接口调用成本。全书摘要用于书籍详情页,帮助用户快速了解书籍核心价值;章节摘要用于阅读页,适配精读场景;段落摘要针对选中文字,满足局部内容研读需求。
2. 技术实现
搭建专属ai_summary数据库,设计高适配联合索引,实现数据高效查询。制定差异化缓存策略:全书、章节摘要内容固定,开启缓存并支持手动强制刷新;段落摘要随机性强,不做缓存,避免资源浪费。
定制分级专属Prompt,以古籍研究专家视角生成标准化摘要,明确字数、结构、输出格式要求,强制JSON结构化返回。同时开发JSON解析容错机制,自动过滤AI冗余话术,格式异常时自动降级兜底,保障功能稳定。
前端实现章节切换自动加载缓存、摘要状态标识、关键词联动AI追问功能,点击关键词可自动跳转对话Tab并发起精准提问,实现“摘要概览-深度探究”的阅读闭环。
3. 功能效果
三级摘要体系全覆盖阅读全流程,缓存命中后响应极速,大幅降低API调用成本;关键词联动问答流畅自然,容错机制有效规避AI输出格式异常问题,整体功能稳定性、实用性极强。
(二)历史人物轨迹系统DeepSeek智能查询与坐标校对全流程
1. 核心功能
实现AI驱动的全自动轨迹生成闭环,打破前期人工校对、手动录入的局限,用户输入任意历史人物姓名,即可自动完成轨迹生成、坐标智能校对、数据持久化、地图可视化渲染全流程,无需人工干预,同时升级多人轨迹对比能力。
2. 技术实现
动态接口适配:针对轨迹查询、坐标查询、普通对话三类场景,动态调整接口最大输出token与随机度参数,搭配超长请求超时优化,适配大规模轨迹数据生成需求,保障输出格式稳定、坐标精准。
结构化Prompt设计:制定高约束性历史学家专属提示词,统一时间、地名、出处、坐标格式标准,强制AI输出纯净JSON数据,便于程序解析处理。
三层智能校对机制:按照预设精准坐标映射表优先、本地CHGIS地名库匹配、AI兜底重查的优先级,层层修正AI生成的坐标偏差,大幅提升坐标准确率。
全流程闭环与Bug修复:实现AI生成-智能校对-双策略数据备份-自动可视化的完整业务流程;扩容20色独立调色板,支持20人同时轨迹对比,修复轨迹残留、模式冲突、弹窗缺失等核心Bug,优化合并节点视觉展示效果。
3. 功能效果
全自动轨迹生成流程落地,无需人工干预;最高支持20人同时轨迹对比,视觉区分度清晰;数据双备份彻底解决丢失问题,轨迹坐标综合准确率≥85%,页面操作流畅无卡顿,具备基础学术辅助研究能力。
(三)AI智能翻译功能
1. 核心功能
深耕古籍精读场景,落地选中文字即时智能翻译功能,将翻译能力深度嵌入阅读流程,用户选中文本后即可自动触发翻译,结果直接展示在悬浮菜单中,无需跳转页面、无需第三方工具,搭配多源翻译对比与个性化配置,适配不同用户研读需求。
2. 技术实现
搭建多翻译源并发架构,内置DeepSeek、通义千问双模型,同时支持用户自定义API接口,多源同步发起翻译请求,单源故障不影响整体功能,实现故障隔离。统一封装翻译服务,标准化古文翻译提示词,保障译文专业性。
开发可视化翻译设置面板,基于Pinia实现用户配置持久化,支持翻译源开关、自定义接口参数、界面样式等个性化设置,刷新页面配置不丢失。同时将翻译功能与问AI、摘要、复制功能深度集成,统一纳入选中文字悬浮菜单,形成完整阅读辅助工具集。
3. 功能效果
翻译触发即时响应,多源译文可实时对照查看;功能稳定、容错性强;个性化配置长期生效,与平台原有功能无缝联动,构建了一站式古籍精读辅助体系。
五、项目现存问题与优化方向
(一)现存核心问题
1. 语音朗读模块
古音朗读依托工程化映射规则,未实现完全语言学重建,五代十国等小众过渡时期发音处理精度不足;部分生僻字无古音数据集支撑,需依赖回退机制,影响沉浸式体验。
2. 选中文字交互与智能摘要模块
文字选中交互仅支持手动触发操作,无上下文感知智能适配能力;段落摘要无缓存机制,高频使用场景下API调用成本偏高;关键词联动仅支持基础问答,未关联知识图谱,深度拓展性不足;全书摘要因Prompt内容较长,生成耗时偏久。
3. 历史人物轨迹可视化模块
偏远地区、消亡古地名的坐标匹配准确率不足;自定义古地名映射库覆盖范围有限;20人高密度轨迹对比时,存在视觉线条混乱问题;合并节点的信息展示层级仍需优化。
4. AI智能翻译模块
译文术语统一性不足,同一古文词汇在不同段落翻译结果不一致;缺乏朝代历史上下文感知,古今异义、专属称谓翻译精准度有限;自定义翻译源配置流程复杂,普通用户使用门槛较高。
(二)后续优化方向
1. 语音朗读优化
采用规则+AI学习混合方案,优化五代十国等过渡时期发音推理模型;扩充古音生僻字数据集;新增用户朗读偏好记忆功能,自动留存音色、发音模式设置。
2. 智能交互与摘要升级
添加上下文感知能力,根据阅读章节自动优化AI提问与摘要生成逻辑;为段落摘要配置LRU轻量级缓存,降低重复调用成本;实现关键词联动知识图谱,展示人物、事件、典籍关联关系;支持多模型摘要对比功能。
3. 轨迹系统深化迭代
扩充古地名精准坐标映射库,补充非CHGIS覆盖区域地名数据;接入RAG检索增强技术,提升AI轨迹生成精准度;优化多人对比视觉渲染效果,通过透明度分层解决线条重叠混乱问题,细化合并节点信息展示层级。
4. 翻译功能精细化优化
搭建古文专属术语库,统一全文术语翻译标准;新增朝代上下文识别机制,适配不同时期称谓、词汇的差异化翻译;预设多场景翻译方案,简化用户配置流程,降低使用门槛。
六、阶段整体总结
本次第五、六阶段迭代开发,是“文澜知微”平台从功能完善走向智能化、专业化、场景化的关键升级阶段。两阶段工作层层递进、稳步落地,第五阶段聚焦基础交互体验与数据精度优化,补齐平台功能短板,夯实用户阅读基础体验;第六阶段聚焦核心智能化能力突破,落地摘要、智能轨迹、AI翻译三大核心智能模块,实现平台核心能力的跨越式升级。
在交互体验层面,通过选中文字多功能悬浮菜单开发,打通了古籍阅读与智能工具的最短链路,搭配差异化古音朗读、即时AI翻译功能,彻底解决传统古籍阅读晦涩、辅助工具割裂的问题,构建了沉浸式、一体化的精读体验。在数据能力层面,通过多轮坐标校对、AI智能查询闭环搭建,将历史人物轨迹数据的精准度、完整性、实用性大幅提升,让平台具备了基础的历史地理学术辅助能力。在智能化层面,三级摘要体系、多源并发翻译、AI全自动轨迹生成等功能的落地,实现了“阅读-概览-深究-验证”的全流程智能闭环,显著降低了古籍研读的学习成本。
本小组三名成员在实训过程中分工明确、高效协同,充分发挥个人技术优势,依托AI辅助开发提升迭代效率,严格遵循标准化开发流程,保质保量完成所有阶段任务。同时,团队精准梳理了各模块现存短板,明确了后续优化迭代方向。下一阶段团队将聚焦OCR图像识别功能开发,持续优化现有功能精度、交互体验与智能化水平,补齐平台能力短板,全力推进项目整体落地,达成项目最终建设目标。
更多推荐


所有评论(0)