生产环境精排模型选型与落地指南
面向企业知识库和私有化 RAG,介绍 Qwen、BGE、GTE、BCE 及多模态精排模型的选型、候选集设计、服务部署、评测、灰度和降级。
面向企业知识库和私有化 RAG,介绍 Qwen、BGE、GTE、BCE 及多模态精排模型的选型、候选集设计、服务部署、评测、灰度和降级。
从边界依据出发,系统介绍固定大小、语义、递归、结构和 LLM 五类文本分块方法的实现逻辑、适用场景与评测方式。
聚焦生产级 RAG 的文档入库链路,设计 MinerU、MarkItDown 与内置解析器的路由,清洗 Pipeline、结构化分块,以及 Embedding 的批处理、并发、限流和版本发布。
介绍沙箱代码执行的隔离原理,结合 Dify 分析代码节点的调用链、参数注入、运行配置与安全边界。
梳理主流大模型微调(SFT / DPO / 高效参数微调)的方法论、工程框架、数据工程与硬件路径,覆盖 NVIDIA GPU 与海光 DCU K100 两条部署链。LLaMA-Factory 与 unsloth 横评、QLoRA 起步配方、DCU 训练踩坑清单。
梳理 Claude Code 的安装、配置与日常使用方式,涵盖常见命令、最佳实践与排错思路。
从开发痛点出发,介绍 DAG 调度的核心概念、优势以及在 Dify 工作流引擎中的实现原理。
介绍状态机在工作流引擎中的作用,结合 Dify 分析状态流转与上下文传递的实现机制。
前言在使用 ChatGPT、Claude、Copilot 等大模型辅助 Python 开发时,我们经常会发现生成的代码质量参差不齐:有时缺少类型注解,有时文档注释不完整,有时错误处理不规范。通过设置默认提示词(System Prompt),可以让大模型按照你的编码规范生成高质量代码,大幅提升开发效率。 本文将介绍默认提示词的作用、如何设置,以及提供一份生产级的 Python 开发提示词模板。
探讨如何借助大模型高效驱动完整项目开发,梳理典型工作流、关键技巧与需要注意的边界。