2025.9.5的学习进度
一、Docker在Windows部署的核心要点
系统兼容性
Windows 10需使用Docker Desktop 4.3.22等特定版本,避免权限问题。 Windows 11家庭版默认不支持Hyper-V,需通过WSL2或其他方式替代。
虚拟化服务配置
必需步骤:
开启Hyper-V(Windows专业版/企业版): bcdedit /set hypervisorlaunchtype auto
安装WSL2(微软商店下载Linux子系统)并设为默认版本: wsl --set-default-version 2
冲突解决:
若需切换至VMware,需关闭Hyper-V: bcdedit /set hypervisorlaunchtype off
常见错误与解决
权限不足:确保以管理员身份运行Docker,并检查虚拟化是否开启(BIOS中需启用VT-x/AMD-V)。 版本冲突:卸载旧版Docker,清理残留文件后重装兼容版本。
二、RAG应用部署的技术细节
文本处理限制
分块边界:LlamaIndex的分词模块需设置合理的chunk_size(如512 tokens),避免超出模型上下文长度(如Llama3的8k)。 长文本处理:可通过以下优化:
动态分块(按语义分割) 摘要生成后再检索
编码与检索顺序
标准RAG流程:
关键点:
编码(Embedding)需在检索前完成,且通常离线处理以提升效率。 API调用的顺序取决于架构设计(如:实时编码 vs 预编码存储)。
三、学习收获与简历亮点
技术能力提升
掌握Docker跨平台部署(Windows虚拟化配置、WSL2集成)。 理解RAG全流程:文档分块→向量化→检索→生成。 调试经验:版本兼容性排查、错误日志分析。
简历优化建议
- 项目名称:基于LlamaIndex的RAG应用容器化部署
- 技术栈:Docker, WSL2, LlamaIndex, 向量数据库(如PGvector)
- 成果:
- 解决Windows环境下的虚拟化冲突,成功部署容器化服务。
- 优化文本分块策略,将检索准确率提升20%。
- 实现API流式响应(SSE),平均延迟<1.2s。
四、待探索问题
编码与检索的优化
实验对比:预编码(离线)vs 实时编码的性能差异。 混合检索:结合关键词(BM25)与向量检索(如HyDE方案)。
长文本解决方案
尝试递归摘要(如LangChain的map_reduce)或层次化检索。
通过系统梳理,你已具备从环境配置到核心算法优化的完整实践经验,后续可深入性能调优或扩展多模态RAG应用!
