基于 RAG 构建企业级智能运维知识库利用 LangChain + Chroma 向量数据库,将历史 Runbook、事故报告和运维文档转化为可检索的智能知识库,实现 On-Call 场景下的快速根因定位。📅 2026-07-15 RAG AIOps LLM ⏱️ 2 min
LLM Infra 搭建与 GPU 集群性能调优从零搭建大语言模型推理基础设施,涵盖 vLLM 分布式部署、GPU 显存优化策略与 NVIDIA MIG 切分实践。📅 2026-07-22 LLM GPU AI ⏱️ 2 min