Knowledge Base
151AI 落地知识库
覆盖 AI 转型、FDE(前沿部署工程师)方法论、RAG、Agent、知识管理等主题的一线实践与洞察,按主题浏览企业 AI 落地的真实经验。
模型微调
淘宝直播数字人 AgenticRL 实践:从 RLVR 到 MultiAgent RL
针对目前数字人交互深度不足,以及传统 Workflow 互动方案灵活度差、泛化能力弱、维护成本高的问题,我们致力于融合LLM的世界知识与 Agent 的自主规划决策能力,赋予数字人“Agent 大脑”,实现极具情绪价值和专业度的深度互动…
模型微调
AReaL 2.0 正式发布:面向 Agent 应用的 Online RL 微服务架构升级
随着大模型智能体逐步进入真实生产环境,Agent 不再只是一次模型调用,而是包含规划、工具调用、沙箱执行、记忆检索、人类反馈和多轮状态管理的复杂系统。与之相对应,Agent 的学习和进化也不能继续停留在离线数据收集、离线训练、重新部署的…
模型微调
从 BERT 标注到 Agent Skill:短文本标签体系的四次“工业革命”
引言:那场关于“标签重构”的余震
模型微调
多轮 Agent 场景下,滴滴的 EAGLE-3 训推加速实践
过去两年,大语言模型(LLM)的应用形态从 ChatBot 快速演进为 AI Agent。在自动化代码工程、长文档分析、多轮工具调用等复杂工作流中,上下文长度已从千级 token 扩展至数十万级;与此同时,LLM 的自回归生成具有强串行…