Transformer Attention机制 深度学习 模型训练 性能优化关于Transformer 架构的几点记录后来硬着头皮从头实现了一遍 Transformer,过程中踩了不少坑,也算是对这个架构有了些实际体会。 醉月思📁 学习笔记📅 2024-06-10
前端构建 Webpack Vite 性能优化 开发体验前端构建工具:Webpack不够用了之后但这次把一个跑了三年的 Webpack 项目换成 Vite,不是因为 Vite 新,也不是因为大家都说它快,纯粹是因为每次 都要等上 5 分钟… 醉月思📁 技术实践📅 2024-01-17
AI服务 性能优化 模型部署 系统架构AI模型服务性能踩坑记录线上 Llama2-7B 对话服务跑在 AWS g4dn.xlarge(单卡 T4)上,用户抱怨回答慢:首 token 延迟 2–3 秒,完整回… 醉月思📁 技术实践📅 2023-06-17
深度学习 分布式训练 PyTorch GPU集群 性能优化关于大规模分布式训练的几点记录上个月接手一个图像分类项目,训练数据大概 10TB,模型是 ResNet152 的魔改版。 醉月思📁 技术实践📅 2023-05-05