// Sharing
经验分享
精选优质技术资源与实战视频(↗ 资源),以及我在大模型、Agent 落地实战中的心得体会(✎ 心得)。
暂无分享,敬请期待。
// My Watchlist · 每期更新
我的关注 Top 10
前沿部署领域最值得读的资源与讨论 · 第 3 期 · 2026-08-02 ~ 2026-09-27
- 01博客查看原文
FDE落地实战 10|医疗AI从哪里切入,才不会一开始就踩红线?
以病历结构化匿名案例拆解数据最小化、去标识化与分级复核,给出高风险输出人工复核流程。
- 02博客查看原文
FDE落地实战 08|Claude、Codex与多智能体,怎样组成AI交…
把现场材料到上线连成可追溯流水线,给出多智能体任务契约与质量Gate,含内外网隔离实务。
- 03博客查看原文
FDE落地实战 07|让Agent操作业务系统,怎样避免越权和失控?
用低风险工单流程讲清最小权限、工具白名单、凭证隔离与人工确认清单,附权限矩阵。
- 04博客查看原文
8G显存也能跑大模型:本地部署避坑实录与显存优化指南
从权重估算、KV Cache到分层卸载与Ollama显存控制,附8G卡实测可跑模型清单。
- 05博客查看原文
本地大模型GPU部署优化:成本降低50%
量化、KV Cache、批处理与弹性扩缩容的实测配置,A100月成本从数万压到一半。
- 06GitHub查看原文
Karpathy/nanochat:100美元跑起的ChatGPT级训练…
Karpathy开源的极简ChatGPT复现库,单卡可训可推,是理解训练栈的一手代码。【英文,豁免】
- 07GitHub查看原文
李继刚 ljg-skills:Claude Code 技能集(11技能+…
把「李继刚风格」提示词沉淀为可直接装的Claude Code技能与工作流,中文实战可用。
- 08B站查看原文
【闪客】一小时从Transformer到大模型!
58分钟讲透注意力到大模型训练原理,讲原理不卖课,做部署前补底层的一节课。
- 09B站查看原文
零度解说:Qwen3.8-27B本地实测,8GB显存能否媲美闭源
实测Qwen3.8-27B在8G显存下的本地推理表现,给消费级显卡选型与量化一手数据。
- 10博客查看原文
FDE落地实战 06|企业知识库,为什么不能只是「上传文档」?
把RAG当成持续运行的知识供应链,给出解析、权限、重排、拒答与生产就绪检查单。