Skip to content

工具与模型选择

先按工作形态分类

不同工具的差异,不只是模型能力,而是它能看到什么、能改什么、如何验证以及是否保留过程。

工具形态擅长任务主要限制适合谁
对话助手解释、调研、方案比较、片段生成默认看不到完整工程,容易缺上下文所有人
编辑器助手补全、局部修改、代码解释容易只优化当前文件,忽略系统边界日常开发者
命令行 Agent跨文件修改、运行测试、自动排错权限更高,必须控制命令和写入边界熟悉版本管理的开发者
桌面 Agent文件、终端、网页和应用协同操作范围大,需要明确授权与确认跨工具工作流
零代码/低代码平台快速搭建表单、流程和轻量应用迁移、扩展和复杂逻辑受平台约束原型和轻量业务
Agent 编排平台工作流、工具调用、知识库和多步任务需要处理状态、权限、失败重试和评估自动化方案团队

选择模型的五个维度

维度要问的问题
任务能力是写代码、读长文档、看图片、规划多步任务,还是生成结构化结果?
上下文模型需要看到多少文件、历史和业务规则?是否能稳定引用关键约束?
工具能力是否需要终端、浏览器、数据库或内部系统?工具调用能否被审计?
风险数据能否发送到外部?错误输出是否会触发真实动作?
成本与速度交互延迟、调用费用、失败重试和人工复核成本能否接受?

不要只按一次跑分选模型。用自己的典型任务建立小型评估集,至少包含正常任务、复杂任务、边界任务和失败任务,再比较完成率、返工次数、耗时和成本。

本地、托管与混合方案

方案优点代价适用条件
托管服务上手快、能力更新快、维护少数据外发、费用和供应商依赖数据允许外发,追求快速验证
本地部署数据控制强、可做深度定制硬件、运维、模型更新和性能成本数据敏感且具备运维能力
混合方案敏感数据本地处理,通用任务使用托管能力架构、路由和审计更复杂既要能力又要数据边界

工具接入前检查

  • 仓库和文件访问是否只开放完成任务所需的范围。
  • 是否会读取环境变量、浏览器登录态、密钥文件或个人目录。
  • 写文件、发消息、部署、购买、删除等动作是否有单独确认。
  • 是否能查看每一步操作、失败原因和最终差异。
  • 是否支持版本控制、测试、回滚和中断恢复。
  • 供应商停用或价格变化时是否有替代路径。

推荐的选择顺序

  1. 先确定任务,不从工具名称出发。
  2. 选择最低权限、最小操作范围的工具形态。
  3. 用真实样例做短测试,记录成功率和返工原因。
  4. 对高风险任务增加人工审批和只读预演。
  5. 把稳定方法沉淀成模板、规则或 Skill,而不是依赖个人记忆。

下一步:把选定工具所需的输入整理到 需求、规格与上下文

维知 Wiki · 面向应用工程的 AI 知识与训练系统