Appearance
工具与模型选择
先按工作形态分类
不同工具的差异,不只是模型能力,而是它能看到什么、能改什么、如何验证以及是否保留过程。
| 工具形态 | 擅长任务 | 主要限制 | 适合谁 |
|---|---|---|---|
| 对话助手 | 解释、调研、方案比较、片段生成 | 默认看不到完整工程,容易缺上下文 | 所有人 |
| 编辑器助手 | 补全、局部修改、代码解释 | 容易只优化当前文件,忽略系统边界 | 日常开发者 |
| 命令行 Agent | 跨文件修改、运行测试、自动排错 | 权限更高,必须控制命令和写入边界 | 熟悉版本管理的开发者 |
| 桌面 Agent | 文件、终端、网页和应用协同 | 操作范围大,需要明确授权与确认 | 跨工具工作流 |
| 零代码/低代码平台 | 快速搭建表单、流程和轻量应用 | 迁移、扩展和复杂逻辑受平台约束 | 原型和轻量业务 |
| Agent 编排平台 | 工作流、工具调用、知识库和多步任务 | 需要处理状态、权限、失败重试和评估 | 自动化方案团队 |
选择模型的五个维度
| 维度 | 要问的问题 |
|---|---|
| 任务能力 | 是写代码、读长文档、看图片、规划多步任务,还是生成结构化结果? |
| 上下文 | 模型需要看到多少文件、历史和业务规则?是否能稳定引用关键约束? |
| 工具能力 | 是否需要终端、浏览器、数据库或内部系统?工具调用能否被审计? |
| 风险 | 数据能否发送到外部?错误输出是否会触发真实动作? |
| 成本与速度 | 交互延迟、调用费用、失败重试和人工复核成本能否接受? |
不要只按一次跑分选模型。用自己的典型任务建立小型评估集,至少包含正常任务、复杂任务、边界任务和失败任务,再比较完成率、返工次数、耗时和成本。
本地、托管与混合方案
| 方案 | 优点 | 代价 | 适用条件 |
|---|---|---|---|
| 托管服务 | 上手快、能力更新快、维护少 | 数据外发、费用和供应商依赖 | 数据允许外发,追求快速验证 |
| 本地部署 | 数据控制强、可做深度定制 | 硬件、运维、模型更新和性能成本 | 数据敏感且具备运维能力 |
| 混合方案 | 敏感数据本地处理,通用任务使用托管能力 | 架构、路由和审计更复杂 | 既要能力又要数据边界 |
工具接入前检查
- 仓库和文件访问是否只开放完成任务所需的范围。
- 是否会读取环境变量、浏览器登录态、密钥文件或个人目录。
- 写文件、发消息、部署、购买、删除等动作是否有单独确认。
- 是否能查看每一步操作、失败原因和最终差异。
- 是否支持版本控制、测试、回滚和中断恢复。
- 供应商停用或价格变化时是否有替代路径。
推荐的选择顺序
- 先确定任务,不从工具名称出发。
- 选择最低权限、最小操作范围的工具形态。
- 用真实样例做短测试,记录成功率和返工原因。
- 对高风险任务增加人工审批和只读预演。
- 把稳定方法沉淀成模板、规则或 Skill,而不是依赖个人记忆。
下一步:把选定工具所需的输入整理到 需求、规格与上下文。
