记录学习的Day 33 ✅ 今天做了:完成了Python ai项目的文档问答的部分,刚好涉及到了检索效果然后对于文档落库的spliter也做了下优化(先按照段落的格式切割,然后对于每一个小段都会加上对应所属的章节信息,以及对应的后续可能有列表的这种格式也可以去区分,这样不至于把表格弄成两半),但是对于pdf的这种带图片的其实可以用ocr去弄,但是我还在考虑是在做文档切割的时候做个文档类型的判断还是怎么来做这部分文档的落库,还是采用统一的一个形式来弄,还没有搞清楚脑子有点抽抽的了。今天还看了下Harness,感觉最重要的就是Agent循环、上下文压缩、安全边界部分很关键看了下其实还行。面试题目今天没咋看 ⏰ 明天计划:继续python项目,面试题,回顾下harness,看下claude code的源码 📚 今日感悟:不要懈怠了,抓紧背面试题,抓紧去写简历,抓紧去找实习。
0个评论
点击登录,快来和大家讨论吧~
表情
图片
暂无评论
下载 APP