Hotdry.

Category

ai-systems

共 7658 篇文章。

Qwen3-VL中视觉-语言grounding的工程实现

探讨Qwen3-VL中使用交错分词、位置嵌入和跨模态注意力机制实现视觉-语言grounding的工程方法,提供图像-文本对齐的关键参数与实践清单。

2025-10-17ai-systems2025-10

工程化 SWE-Grep 的 RLHF 数据集管道

针对 SWE-Grep 的 RLHF 数据集工程实践,包括平衡代码检索样本的 curation、人类反馈循环的整合,以及去重技术以实现稳定多轮训练。

2025-10-17ai-systems2025-10

通过 Claude Tool Use API 实现自定义技能

面向生产 AI 系统,利用 Claude API 的工具使用功能集成外部工具、函数调用,实现代理行为。提供工程化参数、示例代码与监控策略。

2025-10-17ai-systems2025-10

从 Happy-LLM 剥离:一份极简 Transformer 实现指南

本文从 Datawhale 的 Happy-LLM 项目出发,提供一个最小化的 Transformer 模型实现教程。通过 PyTorch 代码,我们将一步步构建从输入嵌入到输出概率的完整数据流,帮助读者在代码层面深入理解 Transformer 的核心工作原理。

2025-10-15ai-systems2025-10

MineContext:从被动检索到主动式上下文工程

火山引擎的 MineContext 项目展示了一种主动式上下文工程方法,通过持续理解用户屏幕信息,构建动态上下文,赋能 AI 助手进行更深度的推理与协作。

2025-10-15ai-systems2025-10

解构AI口音可视化:从MFCC到UMAP的技术实现

深入分析AI口音可视化的技术核心,揭示模型如何通过MFCC、PLS回归和UMAP等技术将语音特征映射为空间集群,并探讨其对语音识别模型感知的启示。

2025-10-15ai-systems2025-10

阿里巴巴 Spring AI:深度解析Java智能体框架

深入探讨阿里巴巴为 Java 生态系统打造的智能体(Agentic)框架 Spring AI,解析其基于图的多智能体架构、企业级集成能力以及如何简化大模型应用的开发与投产。

2025-10-15ai-systems2025-10

3分钟训练GPT模型:modded-nanogpt优化技巧解析

通过剖析 modded-nanogpt 项目,我们探讨了将1.24亿参数模型训练时间从45分钟缩短至3分钟以内的核心优化技术,重点涵盖系统、算法和混合精度计算的协同设计。

2025-10-14ai-systems2025-10
上一页第 79 / 96 页下一页