用 TLA+ 验证 LLM Agent 协调协议:从 Prompt 工程到形式化规约
将 LLM Agent 的多轮交互视为有限状态机,用 TLA+ 模型检测验证协调协议,实现 Prompt 工程的形式化转型。
Latest Essays
继续沿着时间线阅读近期的工程实践与技术观察。
近期的思考与工程笔记。
将 LLM Agent 的多轮交互视为有限状态机,用 TLA+ 模型检测验证协调协议,实现 Prompt 工程的形式化转型。
分析CISA承包商泄露AWS GovCloud密钥事件,探讨政府云环境的隔离边界机制、密钥泄露检测方法与应急响应流程。
OpenBSD 7.9 在系统安全加固方面带来多项关键更新,包括 pledge/unveil 机制的重大演进、内核信息隔离强化、以及虚拟化安全支持的扩展。
深入解析 ViMax 的四角色多智能体架构,从创意到成片的全自动工作流配置与一致性控制策略。
解析 Regex Chess 如何用正则表达式实现 material counting、位置评分与终局检测,探讨 SIMD 并行评估与状态机编码的工程化策略。
深入解析 nim-presto 如何利用 Nim 的编译期宏实现类型安全的路由生成,以及其基于 BTree 的异步路由匹配机制设计。
分析UUID在LLM上下文中的Token浪费问题,介绍id-agent如何通过BPE优化的词表设计将标识符Token成本降低39%-78%,并提供不同规模应用的词数选择参数。
PhotoGIMP 通过覆盖 GIMP 3 的配置文件层,在不修改源码的前提下复刻 Photoshop 的快捷键、工具布局和面板结构,为创意工作者提供低成本的迁移方案。
基于 agentmemory 项目解析 AI coding agents 的持久化内存架构,涵盖四层记忆模型、三重检索融合与 MCP 集成方案,提供可落地的配置参数与性能基准。
解析阿塔卡马沙漠废弃矿井中超纯赫伯特史密斯石晶体的形成机制,探讨极端干旱环境如何以10倍于人工合成晶体的纯度保持量子材料完整性。
从 WebGL 到 WebGPU,解析 3D Gaussian Splatting 浏览器实时渲染的排序优化、剔除策略与小物体高保真重建的工程化参数。
RTK通过智能过滤、语义压缩和Hook自动重写,在零依赖单Rust二进制架构下实现60-90%的Token节省,支持13种AI编码工具。
解析 ARS 技能包的模块化架构、25模式注册表治理、10阶段流水线编排与 Material Passport 状态传递机制,提供可落地的 Claude Code 学术研究配置参数。
解析 Simon Willison 的「快速实验+公开笔记」知识策展方法论,以及如何用结构化速记降低技术追踪的认知负荷。
基于Benedict Evans最新报告,分析AI基础设施成本模型从训练向推理转移的范式变化,提出tokens per watt per dollar新指标与架构决策框架。
解析 Polypad 的 2D Canvas 渲染策略、2000 元素性能阈值、Viewport 变换与事件分发机制,提供可落地的交互式白板实现参数。
基于Andon Labs的Andon FM实验,解析AI电台多代理系统的架构设计、故障模式与可落地的监控参数清单。
从学术研究技能套件ARS的实践中,提炼AI代理技能的封装格式规范、版本治理策略与跨会话状态传递机制的设计要点。
分析 ZIP Shrinker 如何通过重压缩、元数据清理和目录结构优化,在保持 Deflate 算法不变的情况下实现 5%-30% 的体积缩减,并提供可落地的工程参数与权衡清单。
通过clickclickclick.click项目解析纯DOM事件溯源机制,探讨CSS伪类状态持久化技术及其隐私边界,提供可落地的防御参数与监控清单。