智能产品里上下文和工具如何分工

发布时间:2026/8/29 10:40:09

智能产品里上下文和工具如何分工
智能产品里上下文和工具如何分工智能文档、设计软件和代码编辑器都需要让模型理解当前工作区又不能把整个文档、画布或仓库每轮都塞进提示词。判断分工时可以用一个简单标准帮助模型理解当前任务的信息进入上下文需要读取最新状态、做确定性计算或产生副作用的动作交给工具。两者之间还要有权限和数据校验不能只靠模型自觉。1. 上下文保存决策所需信息上下文通常包含系统规则、当前请求、用户主动选择的对象、近期已确认决定和完成任务所需的少量引用材料。每段内容应标明来源与有效期。页面导航、文件修改或选择变化后旧快照要失效长期偏好则单独保存经用户确认后再按需注入。系统规则与外部内容不能混成一段。文档、网页和工具结果都属于不可信数据即使其中写着“忽略规则”也不应获得指令优先级。当前选择也可能含有敏感信息采集前要按产品权限过滤并让用户知道模型正在使用什么。历史不是越多越好。摘要要保留尚未解决的问题、已经执行的副作用和关键约束而不是只压缩措辞。对“准备删除”和“已经删除”这类状态应用应保存结构化记录不能让模型从自然语言摘要里猜。2. 工具读取真相并执行动作画布坐标、文件内容、字数、编译结果和数据库状态会变化适合通过工具按需读取。移动节点、替换文本、保存文件和发起外部请求会改变状态也必须由工具执行。模型负责提出参数工具层负责 Schema 校验、权限、目标解析、超时、幂等和审计。工具不必切得过碎。若完成一次用户动作必然需要连续读取多个内部字段可以由一个业务工具在程序内完成减少模型来回协调。反过来一个“执行任意命令”或“修改任意对象”的万能工具权限太宽也难以准确确认影响。工具粒度应围绕可理解、可授权的业务动作。3. 调度器要管理预算与循环调度器先保留不可丢的系统规则和当前请求再根据任务选择上下文。预算应按真实 Token 计数、模型窗口和预留输出计算不能用固定对话轮数代替。工具调用要有单轮上限与总时间预算连续得到同一错误时应停止并把缺少的信息告诉用户。4. TypeScript 调度模块示例下面的代码展示了工具注册、消息裁剪和调用分发的基本结构。它是一个原型需要结合产品权限继续补全。import { ChatCompletionMessageParam, ChatCompletionTool } from openai/resources/chat; export interface ToolDefinition { name: string; description: string; parameters: Recordstring, any; execute: (args: Recordstring, any) Promiseany; } export class AIContextAndToolManager { private tools: Mapstring, ToolDefinition new Map(); private maxContextTokens: number; constructor(maxContextTokens: number 3000) { this.maxContextTokens maxContextTokens; } // 注册确定性工具 public registerTool(tool: ToolDefinition) { this.tools.set(tool.name, tool); } // 导出 OpenAi 适配的 Tool 描述符 public getOpenAITools(): ChatCompletionTool[] { return Array.from(this.tools.values()).map((tool) ({ type: function, function: { name: tool.name, description: tool.description, parameters: tool.parameters, }, })); } // 上下文预算裁剪模拟按 token 计数裁剪历史 public pruneContext( systemPrompt: string, historyMessages: ChatCompletionMessageParam[], currentSelectionState: string ): ChatCompletionMessageParam[] { const systemMsg: ChatCompletionMessageParam { role: system, content: ${systemPrompt}\n\n[当前视口状态摘要]: ${currentSelectionState}, }; // 仅保留最近 3 轮对话避免长上下文带来的注意力分散与成本拉升 const recentHistory historyMessages.slice(-6); return [systemMsg, ...recentHistory]; } // Tool Call 执行器与分发适配 public async dispatchToolCall(toolName: string, rawArgs: string): Promisestring { const tool this.tools.get(toolName); if (!tool) { throw new Error(未注册的 Tool 名称: ${toolName}); } try { const parsedArgs JSON.parse(rawArgs); const result await tool.execute(parsedArgs); return JSON.stringify({ status: SUCCESS, data: result }); } catch (err: any) { return JSON.stringify({ status: ERROR, message: err.message || Tool 执行失败 }); } } }5. 示例代码的缺口类中保存了maxContextTokenspruneContext却没有使用它只截取最后六条消息。消息长短差异很大这不构成 Token 预算系统提示和当前选择拼接后也可能单独超限。当前选择属于外部数据直接拼进 system content 会模糊指令与数据边界适合改为带明确标签的用户上下文消息并先过滤敏感内容。工具参数与结果都使用anyJSON.parse后没有按parameters校验也没有权限、超时、取消和调用次数限制。execute抛出的错误文本可能含内部细节直接返回模型前应映射为安全的错误类型。结果还要限制大小并处理无法 JSON 序列化的对象。工具名存在于 Map 只证明已注册不证明当前用户可以调用。评估分工效果时用产品自己的任务集比较回答是否引用了正确上下文修改是否命中正确对象工具失败后能否停止延迟和 Token 分别花在哪一步。没有可复查实验时不给出精确的成本下降或准确率数字。6. 落地时逐项确认确定性计算进入程序尺寸、计数、语法解析和对象定位由代码执行模型使用结果做语义判断。工具输入输出有 Schema参数校验后再执行返回最少必要字段并标明截断、版本和错误类型。副作用有权限与确认读取和写入分开授权高风险修改先展示准确目标与预览。循环有停止条件总步骤、总时间和重复错误都有上限停止后保留已完成状态不自动无限重试。上下文按任务选择Focus 或选择可以提示相关范围但 Hover 这类瞬时行为不应自动发送敏感内容采集需符合用户预期。上下文与工具不是此消彼长的两个桶。上下文负责让模型知道正在解决什么工具负责提供最新事实和受控行动调度器负责预算与停止。责任分开后错误也更容易定位材料选错、模型判断错还是工具执行边界没有守住。

相关新闻

AI编码新范式:107页需求文档如何让大模型一次说懂

AI编码新范式:107页需求文档如何让大模型一次说懂

2026/8/29 10:40:09

最近,AI 编码的话题又被推上了一个新高度。这一次的主角不是某个大模型的版本更新,也不是哪家 IDE 插件又出了新功能,而是一位老熟人——Windows 任务管理器之父 David Plummer,以及他打造的 Win11 项目 TMOG。消息一出&#xff0…

AI Coding 落地实践:从 vibe coding 到 spec coding 的工程化路径

AI Coding 落地实践:从 vibe coding 到 spec coding 的工程化路径

2026/8/29 10:40:09

AI Coding 这段时间讨论热度很高,vibe coding、spec coding、AI Agent、多 Agent 协同这些词轮番出现在热搜上。很多人把 AI Coding 理解成“把需求丢给大模型,代码自动生成直接上线”,实际跑过几轮就会发现问题要复杂得多。AI Coding 能处理…

轻量后端中上下文和工具如何分工

轻量后端中上下文和工具如何分工

2026/8/29 10:40:09

轻量后端中上下文和工具如何分工在构建轻量级 Node.js AI 后端服务时,开发者最常踩的误区就是分不清“上下文(Context)”与“工具(Tools / Tool Calling)”的职责边界。把所有的业务逻辑、长文本文档都直接塞进 Prompt…

context-mode Pi Coding Agent安装指南:扩展方式接入全生命周期事件

context-mode Pi Coding Agent安装指南:扩展方式接入全生命周期事件

2026/8/29 11:50:12

context-mode Pi Coding Agent安装指南:扩展方式接入全生命周期事件 【免费下载链接】context-mode Context window optimization for AI coding agents. Sandboxes tool output (98% reduction), persists session memory, and enforces routing across 17 platfor…

数据中心以光代铜:光互连技术路线与部署实践

数据中心以光代铜:光互连技术路线与部署实践

2026/8/29 11:50:12

这次我们来看一个新融资事件:Lumilens 完成了 7 亿美元融资,目标很直接,就是“用光替换数据中心里的线缆”。这个方向听起来没有大模型那么热闹,但影响面一点都不小。AI 集群规模越来越大,传统铜缆在距离、功耗、重量、…

Timeline Visualizer下载安装指南:GitHub Releases获取APK的4个步骤

Timeline Visualizer下载安装指南:GitHub Releases获取APK的4个步骤

2026/8/29 11:50:12

Timeline Visualizer下载安装指南:GitHub Releases获取APK的4个步骤 【免费下载链接】google-timeline-visualizer Visualize your year in travel using your Google Location History (Timeline) data 项目地址: https://gitcode.com/GitHub_Trending/go/google…

事件溯源:让自改进AI Agent的每一次修改都可追溯、可回放、可回滚

事件溯源:让自改进AI Agent的每一次修改都可追溯、可回放、可回滚

2026/8/29 11:50:12

如果你正在做一个“会自己改自己”的 AI Agent 项目,大概率已经遇到过这几个让人头疼的问题:Agent 上一轮表现很好,下一轮忽然变笨了;模型自己改了 Prompt,但没人记得改之前是什么;跑了一晚上实验&#xff…

程序员笔试刷题指南:从牛客模考看算法题解题思路

程序员笔试刷题指南:从牛客模考看算法题解题思路

2026/8/29 11:50:12

前两天整理电脑里的刷题笔记,翻出一份2020年牛客模考四模的编程题记录。正好最近不少朋友在问笔试编程题到底该怎么刷、从哪里找有代表性的套题,我就把这套题重新拿出来逐题过了一遍。这套题虽然年份有点久,但题目结构在当年的模拟笔试里很有…

模型训练工具升级前先做哪些确认

模型训练工具升级前先做哪些确认

2026/8/29 11:40:12

模型训练工具升级前先做哪些确认训练框架、CUDA 驱动、算子库和数据处理工具一起构成运行环境。升级其中一个,未必会立刻报错;更常见的是训练曲线、吞吐或导出的模型在某个数据分布下发生变化。把依赖版本改掉然后直接启动全量训练,风险不在于…

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

2026/8/27 11:10:02

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

2026/8/29 10:22:10

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

2026/8/28 7:34:42

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

四款热门降AI工具测评:研究生和本科生怎么选?

四款热门降AI工具测评:研究生和本科生怎么选?

2026/8/29 0:09:39

马上要交论文了,最近真的被论文ai率折磨的够呛。 明明查重都没问题了,但是ai率就是居高不下,崩溃了,明明都是我自己写的,天杀的,明明都是我亲生的啊 改来改去,终于给我搞出一套完美的降ai方案…

论文降AI率免费攻略:自查、提示词与工具推荐

论文降AI率免费攻略:自查、提示词与工具推荐

2026/8/29 0:09:39

马上要交论文了,最近真的被论文ai率折磨的够呛。 明明查重都没问题了,但是ai率就是居高不下,崩溃了,明明都是我自己写的,天杀的,明明都是我亲生的啊 改来改去,终于给我搞出一套完美的降ai方案…

北京GEO优化服务商推荐:预算型企业如何选北京GEO优化服务商?

北京GEO优化服务商推荐:预算型企业如何选北京GEO优化服务商?

2026/8/29 0:09:39

前言:预算有限的企业更关心投入能否形成可持续的品牌资产。评估北京GEO优化服务商时,不能只比较单篇内容或单月报价,还要看是否能够把问题词、官网、信源和监测串成完整链路。本期重点放在预算配置、试点范围和交付边界,帮助企业先…

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

2026/8/28 7:35:26

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…

导师推荐!2026最新AI论文工具测评与实用推荐

导师推荐!2026最新AI论文工具测评与实用推荐

2026/8/28 7:34:51

2026年真正好用的AI论文工具,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

告别游戏崩溃:XCOM 2模组管理器的智能革命

告别游戏崩溃:XCOM 2模组管理器的智能革命

2026/8/28 7:34:35

告别游戏崩溃:XCOM 2模组管理器的智能革命 【免费下载链接】xcom2-launcher The Alternative Mod Launcher (AML) is a replacement for the default game launchers from XCOM 2 and XCOM Chimera Squad. 项目地址: https://gitcode.com/gh_mirrors/xc/xcom2-lau…