指尖魔法屋
  • 文章
  • 分类
  • 标签
  • 时间轴
  • 关于
  • 联系
  • 🔍

技术实践

AIOps Prometheus 监控告警 自愈机制
AIOps监控实践笔记
别急着给AIOps监控下定义,先看这次卡在哪。
醉月思 醉月思
📁 技术实践
📅 2024-03-15
AI部署 稳定性 监控告警 实践指南 生产环境
关于AI生产最佳实践的几点记录
至少要把这些信息先确定下来,不然别人给的方案你用不起来:
醉月思 醉月思
📁 技术实践
📅 2024-03-14
模型部署 TorchServe vLLM GPU优化
AI模型部署:推理不够用了之后
先说个最实在的:项目背景是个多模态问答系统,推理环境是 4 张 A100 80GB,PyTorch 2.1.1,CUDA 12.1。
醉月思 醉月思
📁 技术实践
📅 2024-03-11
AI成本管理 预算规划 ROI分析 大模型
AI预算规划实践笔记
AI预算规划相关的坑,多半出在边界条件上。
醉月思 醉月思
📁 技术实践
📅 2024-03-05
浏览器 性能优化 前端
浏览器渲染机制踩坑记录
一开始以为是网络问题,服务器带宽不够,或者 CDN 没配置好。
醉月思 醉月思
📁 技术实践
📅 2024-03-01
AI 产品 战略 踩坑
关于AI创新战略的几点记录
过去两年参与三个 AI 项目落地,记录几条选型、场景和 ROI 上的踩坑判断。
醉月思 醉月思
📁 技术实践
📅 2024-02-24
团队管理 AI工程 组织架构
AI团队组织折腾手记
带 AI 团队两年,最头疼的是人和人的接口怎么划清——比调参烦多了。
醉月思 醉月思
📁 技术实践
📅 2024-02-09
大模型微调 LoRA Q-LoRA 机器学习
大模型微调折腾手记
结果光显存这块就踩了一堆坑:先是用全参数微调直接 OOM,换 LoRA 还是顶不住,最后上 Q-LoRA 才勉强在 24G 显存上跑起来。
醉月思 醉月思
📁 技术实践
📅 2024-02-07
Llama Meta 开源模型
AI Llama:这次怎么落地的
不绕弯子,先说几个现实限制条件:
醉月思 醉月思
📁 技术实践
📅 2024-02-03
AI安全 风险管理 机器学习 模型评估 监控告警
AI风险管理折腾手记
AI风险管理:先看卡点
醉月思 醉月思
📁 技术实践
📅 2024-01-25
上一页 1 ... 12 13 14 ... 37 下一页
Copyright © 2017-2026 指尖魔法屋. All rights reserved POWERED BY thinkBlog · v6.1.0 关于 · 联系 · 隐私政策 · Cookie 政策 本站已顽强运行:加载中...
粤ICP备17055617号