2025.9.5的学习进度

一、Docker在Windows部署的核心要点

系统兼容性

Windows 10需使用Docker Desktop 4.3.22等特定版本,避免权限问题。 Windows 11家庭版默认不支持Hyper-V,需通过WSL2或其他方式替代。

虚拟化服务配置

必需步骤:

开启Hyper-V(Windows专业版/企业版): bcdedit /set hypervisorlaunchtype auto

安装WSL2(微软商店下载Linux子系统)并设为默认版本: wsl --set-default-version 2

冲突解决:

若需切换至VMware,需关闭Hyper-V: bcdedit /set hypervisorlaunchtype off

常见错误与解决

权限不足:确保以管理员身份运行Docker,并检查虚拟化是否开启(BIOS中需启用VT-x/AMD-V)。 版本冲突:卸载旧版Docker,清理残留文件后重装兼容版本。

二、RAG应用部署的技术细节

文本处理限制

分块边界:LlamaIndex的分词模块需设置合理的chunk_size(如512 tokens),避免超出模型上下文长度(如Llama3的8k)。 长文本处理:可通过以下优化:

动态分块(按语义分割) 摘要生成后再检索

编码与检索顺序

标准RAG流程:

关键点:

编码(Embedding)需在检索前完成,且通常离线处理以提升效率。 API调用的顺序取决于架构设计(如:实时编码 vs 预编码存储)。

三、学习收获与简历亮点

技术能力提升

掌握Docker跨平台部署(Windows虚拟化配置、WSL2集成)。 理解RAG全流程:文档分块→向量化→检索→生成。 调试经验:版本兼容性排查、错误日志分析。

简历优化建议

  • 项目名称:基于LlamaIndex的RAG应用容器化部署
  • 技术栈:Docker, WSL2, LlamaIndex, 向量数据库(如PGvector)
  • 成果
    • 解决Windows环境下的虚拟化冲突,成功部署容器化服务。
    • 优化文本分块策略,将检索准确率提升20%。
    • 实现API流式响应(SSE),平均延迟<1.2s。

四、待探索问题

编码与检索的优化

实验对比:预编码(离线)vs 实时编码的性能差异。 混合检索:结合关键词(BM25)与向量检索(如HyDE方案)。

长文本解决方案

尝试递归摘要(如LangChain的map_reduce)或层次化检索。

通过系统梳理,你已具备从环境配置到核心算法优化的完整实践经验,后续可深入性能调优或扩展多模态RAG应用!


0个评论
点击登录,快来和大家讨论吧~
表情
图片
暂无评论
阿胜
下载 APP