前言

起因是需要参考几十本英文标准协议对某个方案书中的参数进行更新。英文标准协议随便几千页,方案书也有五百多页,这活当然不能给人干,但直接扔给大模型多少也有点耗费人力,想直接做成自动处理的工作流。因为方案书篇幅大,自然需要考虑如何分割文档进行分段处理

过程

  • 因为只是为了自己做个记录,画得很粗糙而且比较简单就不多解释了,有问题评论。
  • 2000字为分割步长,中间留有500字重叠,便于逻辑连接,参数可调。
  • LLM的prompt自定。
    框架

循环参数
变量赋值
代码执行

def main(s, doc) -> dict:
    step = 2000
    cross = 500
    if s==1:
        chapter = doc[0][1:s*step]
    else:
        chapter = doc[0][(s-1)*step-cross:s*step]
    return {
        "result": chapter,
    }

LLM
回复

结果

  • 手头没啥文件,看着来吧哈哈哈
    在这里插入图片描述
Logo

中国智能体开发者社区,聚焦智能体与大模型开发,提供前沿资讯、实用工具链、开源项目及行业案例。通过技术沙龙、开发者大赛等活动,促进经验交流与协作,助力开发者快速构建创新智能应用。

更多推荐