使用 CSS 选择器实现无服务器 RSS 源生成器
探讨如何利用 CSS 选择器从动态网页抓取内容,构建个性化 RSS 源,并在无服务器架构中部署,实现内容 syndication 的工程实践。
Latest Essays
继续沿着时间线阅读近期的工程实践与技术观察。
近期的思考与工程笔记。
探讨如何利用 CSS 选择器从动态网页抓取内容,构建个性化 RSS 源,并在无服务器架构中部署,实现内容 syndication 的工程实践。
探讨 macOS 和 Linux 中 LC_COLLATE 导致的 shell 脚本排序不一致问题,提供调试方法和使用 locale 覆盖的便携式修复策略,确保跨平台一致性。
详细介绍 MMR 算法在 Pyversity 中的应用,优化 lambda 参数和余弦相似度以提升 RAG 系统检索效率和多样性。
剖析 Hugging Face Chat UI 的 SvelteKit 实现,提供多 LLM 集成、流式响应处理与模型切换的工程化配置与监控要点。
借鉴 Hugging Face Chat UI 开源代码,指导构建支持多模型切换、实时流式输出和插件扩展的 AI 聊天前端组件,无需后端依赖。
通过像素模式分析和 JavaScript 注入,逆转 Kindle Web 中的文本混淆,恢复图像化保护下的可选择文本,支持离线阅读。提供工程参数和实现清单。
探讨微调在生产 LLM 部署中高效领域适应的战略优势,相比 RLHF 的资源密集型对齐,提供可落地参数和最佳实践。
本文介绍如何在 RAG 系统中集成 Pyversity 库,利用 MMR 算法平衡检索 chunk 的相关性和新颖性,提供集成步骤、参数调优和工程实践要点。
分析 PEFT 方法如 LoRA 如何复兴 LLM 微调实践,提供成本效益定制的生产策略、参数配置与风险管理要点。
基于开源项目,探讨 TypeScript 工程实践,实现多格式内容导出、自定义语音合成集成及模块化 LLM 链式,支持个性化知识合成。
利用 DuckDB WASM 在浏览器中构建无服务器 SQL IDE,支持大型数据集的离线查询、可视化和导出,提供工程化部署参数和 UI 优化要点。
受Immix启发,设计混合标记区域GC,针对高吞吐服务器应用,提供低暂停回收策略、参数配置与监控要点。
探讨 LLM 微调的复兴战略,使用 LoRA 适配器避免全模型重训,实现计算成本与性能的平衡,支持领域特定适应如金融和代码生成。
利用 LLM 和计算机视觉分解复杂浏览器任务,提供动态 UI 适应与失败恢复策略。
Reflex 框架实现纯 Python 全栈 Web 开发,支持响应式组件、状态同步和服务器端渲染,提供高效的 JS 免费开发路径。
BQN 数组语言中使用 •Decompose 实现宏-like功能,变换表达式而不改核心解析器,提供工程化参数与示例。
面向去中心化多人后端,给出 SpacetimeDB 的 Rust 模块设计、CRDT 风格冲突解决与分布式同步参数。
面向 Rust 过程宏开发,给出在 Flowistry 中集成宏展开追踪的可视化方案、卫生作用域参数与 IDE 重构要点。
基于 Open Notebook 项目,探讨如何通过可扩展提示集成多模型 AI、TTS 语音克隆生成个性化播客,以及多格式导出实现自定义 AI 音频/播客从文档生成。
面向 API 客户端的 SSE 流式输出,给出重连逻辑与消息排序的工程化参数与监控要点。