Skip to content
陌阡博客
搜索文章
K
Main Navigation
🏠 首页
🛠️ 工程实战
📚 学习笔记
🔭 行业前瞻
💎 GitHub宝藏
✍️ 浮生札记
👤 关于我
主题
栏目导航
回到顶部
本页目录
✍️
技术踩坑
2 篇
真实实操报错、避坑总结。CUDA OOM、RAG 召回、Docker 部署排坑,踩过的坑不让别人再踩。
08-16
大模型RAG召回失效深度复盘:90%的落地坑点,我全都踩过了
大模型RAG召回失效深度复盘:90%的落地坑点,我全都踩过了
RAG
大模型
08-11
大模型推理 CUDA OOM 排查实战:显存优化全记录
大模型推理时 CUDA Out of Memory 是最常见的问题。本文记录从定位到解决的完整排查过程,含显存计算公式、优化手段和避坑要点。
模型部署
AI 工程化
技术复盘
📖
本文阅读
--
次
|
📊
全站访问
--
次
|
👥
访客
--
人