// Sharing

经验分享

精选优质技术资源与实战视频(↗ 资源),以及我在大模型、Agent 落地实战中的心得体会(✎ 心得)。

暂无分享,敬请期待。

// My Watchlist · 每期更新

我的关注 Top 10

前沿部署领域最值得读的资源与讨论 · 第 3 期 · 2026-08-02 ~ 2026-09-27

查看全部 3 期
  • 01博客

    FDE落地实战 10|医疗AI从哪里切入,才不会一开始就踩红线?

    以病历结构化匿名案例拆解数据最小化、去标识化与分级复核,给出高风险输出人工复核流程。

    查看原文
  • 02博客

    FDE落地实战 08|Claude、Codex与多智能体,怎样组成AI交…

    把现场材料到上线连成可追溯流水线,给出多智能体任务契约与质量Gate,含内外网隔离实务。

    查看原文
  • 03博客

    FDE落地实战 07|让Agent操作业务系统,怎样避免越权和失控?

    用低风险工单流程讲清最小权限、工具白名单、凭证隔离与人工确认清单,附权限矩阵。

    查看原文
  • 04博客

    8G显存也能跑大模型:本地部署避坑实录与显存优化指南

    从权重估算、KV Cache到分层卸载与Ollama显存控制,附8G卡实测可跑模型清单。

    查看原文
  • 05博客

    本地大模型GPU部署优化:成本降低50%

    量化、KV Cache、批处理与弹性扩缩容的实测配置,A100月成本从数万压到一半。

    查看原文
  • 06GitHub

    Karpathy/nanochat:100美元跑起的ChatGPT级训练…

    Karpathy开源的极简ChatGPT复现库,单卡可训可推,是理解训练栈的一手代码。【英文,豁免】

    查看原文
  • 07GitHub

    李继刚 ljg-skills:Claude Code 技能集(11技能+…

    把「李继刚风格」提示词沉淀为可直接装的Claude Code技能与工作流,中文实战可用。

    查看原文
  • 08B站

    【闪客】一小时从Transformer到大模型!

    58分钟讲透注意力到大模型训练原理,讲原理不卖课,做部署前补底层的一节课。

    查看原文
  • 09B站

    零度解说:Qwen3.8-27B本地实测,8GB显存能否媲美闭源

    实测Qwen3.8-27B在8G显存下的本地推理表现,给消费级显卡选型与量化一手数据。

    查看原文
  • 10博客

    FDE落地实战 06|企业知识库,为什么不能只是「上传文档」?

    把RAG当成持续运行的知识供应链,给出解析、权限、重排、拒答与生产就绪检查单。

    查看原文
经验分享 · 52FDE.CN