Claude Anthropic 大模型AI Claude踩坑记录先复现,再谈优化。记录从 OpenAI 切到 Claude 后,代码审查、写作辅助和排障三个场景里真正管用的用法和踩过的坑。 醉月思📁 技术实践📅 2024-10-03
DPO 直接偏好优化 对齐从RLHF走到DPO:AI直接偏好优化笔记最开始尝试了传统的 RLHF(强化学习人类反馈),但过程太痛苦了——需要训练三个模型,显存要80G,训练时间一… 醉月思📁 技术实践📅 2024-09-25
适配器 前缀 微调选择AI适配器vs前缀:选择不够用了之后但是几个硬性限制摆在面前: 1. **资源限制**:只有一个3090卡,显存24GB,跑不动全量微调 2. **成本敏感**:每个新场景都需要… 醉月思📁 技术实践📅 2024-09-17
IA3 重参数 高效微调从重参数走到高效:AI IA3笔记LoRA 已经用了一阵,参数省了不少,但当我看到 IA3(Infused Adapter by Inhibiting and Amplifyin… 醉月思📁 技术实践📅 2024-09-16
GPT 生成式AI 大语言模型 模型演进 实践踩坑AI GPT系列实践笔记这次不搞那种"从原理到实践"的标准技术文档,就说说跟GPT打交道这几年踩过的坑、花过的钱、学到… 醉月思📁 技术实践📅 2024-09-10
webpack vite build-tools frontend-performance module-bundling现代前端构建工具实践笔记最近在项目里又碰了一次现代前端构建工具,有几处判断值得留下来。 醉月思📁 技术实践📅 2024-09-09