将Karpathy的LLM编程智慧转化为Claude Code技能集:四大原则的工程化实践
基于Andrej Karpathy揭示的LLM系统性编码失误,构建可编程的Claude Code技能集,实现AI编程常见陷阱的自动化规避。
Latest Essays
继续沿着时间线阅读近期的工程实践与技术观察。
近期的思考与工程笔记。
基于Andrej Karpathy揭示的LLM系统性编码失误,构建可编程的Claude Code技能集,实现AI编程常见陷阱的自动化规避。
深入解析 Pointer Events API 在地图交互中的工程实践,提供多点触控手势识别、缩放平移状态管理与可落地的核心参数配置。
解析 NVIDIA Warp 框架的 Python 到 CUDA 编译管线,对比传统手写 CUDA 的工程化差异,并给出物理仿真开发的实际参数建议。
深入解析SEOMachine的工程化设计,探讨如何通过自定义命令、上下文文件与专业化Agent构建生产级SEO内容生成流水线。
深入解析 botctl 的 Harness Loop 执行周期、状态迁移机制与工程化调度参数,为自主 AI Agent 的运行时进程管理提供可落地的配置清单与监控方案。
深入解析 Google LiteRT-LM C++ 推理运行时的量化融合策略、KV 缓存优化与边缘设备部署工程实践,提供可落地的配置参数。
深入解析 LittleSnitch 从 macOS 独占到跨平台的技术架构,探讨 eBPF 在 Linux 上的工程实现与局限。
深入分析 Anthropic Claude Managed Agents 的企业级部署架构,涵盖多租户隔离、安全设计、监控可观测性等工程实践要点。
深入探索301字节x86-64 ELF可执行文件的极限优化技术,解析系统加载机制与最小化二进制构建方法。
深入解析vLLM推理引擎的连续批处理调度器与PagedAttention分页内存管理机制,提供可落地的GPU利用率优化配置参数与监控要点。
深入解析 Rust 异步运行时中的任务窃取调度器设计,提供多线程负载均衡的参数配置与性能监控要点。
探讨通过 eBPF 在网卡驱动层捕获 QUIC 数据包,实现连接迁移时 IP 切换零丢包的工程化方案与关键参数配置。
聚焦推理部署阶段 KV cache 量化后数值溢出检测与精度保障的工程参数配置,给出可落地的阈值与监控清单。
深入解析Model Context Protocol服务器运行时的核心架构,提供工具描述解析、资源挂载机制与AI模型调用链的工程化参数配置。
深入解析投机解码的draft-verify双模型架构,涵盖候选token生成、验证策略、拒绝重采样等核心工程实现参数。
深度解析分布式训练中梯度压缩的量化方法(QSGD、TernGrad)与稀疏化策略(Top-K),给出工程落地的关键参数与权衡要点。
针对资源受限的嵌入式环境,深入分析cache_size、mmap_size、page_size与synchronous等pragma参数的工程权衡与具体配置值。
针对资源受限的嵌入式环境,深入分析cache_size、mmap_size、page_size与synchronous等pragma参数的工程权衡与具体配置值。
深入解析 Rust 异步执行器中 stackful coroutine 的实现机制,对比 stackless 模式的任务调度权衡,并给出内存参数配置与监控实践。
深入解析 Skrun 工具如何将 Agent Skill 标准化部署为 RESTful API,涵盖技能注册、版本控制、调用路由与多模型配置等工程实践。