突破余弦相似度瓶颈:嵌入模型表示能力的结构化缺陷诊断与优化路径
深入剖析余弦相似度在高维嵌入空间中的结构性失效模式,给出各向异性诊断、频率偏差矫正与范数感知距离的工程级参数配置方案。
Latest Essays
继续沿着时间线阅读近期的工程实践与技术观察。
近期的思考与工程笔记。
深入剖析余弦相似度在高维嵌入空间中的结构性失效模式,给出各向异性诊断、频率偏差矫正与范数感知距离的工程级参数配置方案。
解析 CERT 一次披露 6 个 dnsmasq 严重漏洞的响应窗口、严重性分级与补丁编排策略。
通过可视化 FSM 编辑器为 AI 编程代理构建确定性行为约束,实现协议级别的工具强制执行与状态转换守卫机制。
深入解析 Hypercubic Hopper 如何用 AI Agent 封装 TN3270 终端交互、JCL 编译与 VSAM 读写,实现遗留大型机的对话式业务流程自动化,并给出企业落地的关键技术参数。
深入解析 Needle 项目如何通过移除 FFN、采用门控残差与 ZCRMSNorm 等技术,在 26M 参数约束下实现高性能工具调用,并给出本地微调与生产部署的关键参数。
深入剖析 DuckDB 在客户端-服务器模式下的二进制协议设计:消息帧结构、请求/响应序列化模式以及与 Arrow 的集成细节。
解析 MutationObserver 回调调度层实现:debounce 批次合并、removedNode 队列管理、与 DOM 遍历的交错策略,规避高频触发导致的渲染抖动与性能塌陷。
剖析 XBOW 发现 Exim 未认证 RCE 的技术路径,聚焦缓冲区溢出根因与利用链构造,提供可落地的检测与防御参数。
从 Amazon 员工为达 AI 使用率指标而人为拉高 token 消耗的案例出发,解析量化目标如何扭曲工具使用行为,并给出企业规避此类指标游戏的可行工程建议。
解析 YC S24 项目 Voker 如何解决 AI Agent 可观测性盲区,从意图检测到业务影响量化,为产品团队提供自服务分析能力。
从攻击者视角解析 LLM 基准测试被 gaming 的具体手段:数据污染的三种形态、前缀补全攻击、超参过拟合与评估协议漏洞,并讨论这些手段为何在结构上难以根除。
在企业级AI SDK中实现精确token计量需权衡原子操作的并发成本、批量聚合的延迟与计费系统的准确性,提供可操作的参数配置与监控方案。
基于Rayleigh-Mie散射与raymarching,详解天空颜色随时间变化的实现、日落橙红渐变的 transmittance 计算,以及行星大气层的 ray-sphere intersection 建模与 LUT 优化路径。
通过分布外检测与对抗采样构建防污染基准测试框架,对抗模型在封闭测试集上的过拟合与性能虚高问题,给出可落地的工程参数与监控清单。
探讨如何通过多智能体协作评估框架与动态基准更新机制,防止LLM在固定测试集上过拟合,从评估方法论层面提升模型泛化能力的可信度。
深入解析Bambu Lab在AGPL合规性争议、Authorization Control固件锁定机制以及生态绑定策略背后的工程实现逻辑。
从工程视角解析 Hysteria 如何通过 HTTP/3 伪装与 BLAKE2b-256 流式混淆实现流量隐蔽传输,并给出 Salamander 加密层配置的工程参数。
解析基于物理的散射模型与 Rayleigh/Mie 近似,涵盖 WebGL 体积光坐标变换、阴影映射、性能优化等工程参数调优。
剖析 Software Internals Book Club 如何以异步邮件组为载体,通过结构化章节领读与真实调试经验分享,填补抽象认知与工程实践之间的鸿沟。
解析 Python 新一代 profiling.sampling 模块的概率采样间隔参数设计、统计置信区间与生产环境部署要点。