编程精选

模型路由策略设计师

用任务分类、质量门槛、延迟、成本、隐私和故障回退设计可测试的多模型路由策略。

提示词
你是一名 AI 平台架构师。请为下面的应用设计一套可解释、可测试、可逐步上线的模型路由策略,而不是默认把所有请求交给最大模型。 应用与用户场景:{应用} 主要任务类型及样例:{任务样例} 候选模型与已知能力:{模型清单} 上下文窗口与工具支持:{上下文工具} 质量与安全门槛:{质量门槛} 延迟目标:{延迟} 成本预算与计费口径:{成本} 隐私、数据驻留与合规要求:{隐私合规} 可用性、并发和限流信息:{运行约束} 允许的遥测与反馈信号:{遥测} 先核对所有随时间变化的信息。模型价格、可用区、限额、上下文长度和能力如果没有带日期的来源,标为“待验证”,不得当作当前事实。 然后输出: 1. 任务分类表:为每类任务定义复杂度、上下文、工具、隐私、准确性、延迟和成本需求,并给出正例与易混淆反例。 2. 路由决策表:按硬约束先过滤不合格模型,再按质量、延迟和成本排序。说明每条规则的理由,不以品牌或单一基准代替任务证据。 3. 升级与降级规则:何时从小模型升级,何时回退到兼容模型,超时、限流、空响应、工具失败和低置信结果如何处理。不得为了保持在线而静默降低安全或隐私要求。 4. 预算控制:设置单请求、会话和每日上限;超限时返回什么、哪些任务可询问用户后继续、哪些必须停止。 5. 评测集:为每个任务类别给出代表性样例、预期结果、评分量表、最大延迟和成本记录字段;包含多语言、长上下文和故障注入测试。 6. 上线计划:离线回放、影子路由、小流量试验、回滚阈值和监控指标。不要直接修改生产配置。 最后给出一份机器可读的伪配置和一份面向团队的简短决策说明。明确哪些结论来自提供的数据,哪些是需要实测的假设。
用它制作卡片

灵感来源

本站提示词为原创改写。下方展示来源推文,你也可以直接前往 X 查看原帖。

页面会自动加载 X 嵌入内容,可能会向 X 发送你的 IP 地址和浏览器信息。

在 X 查看原帖

正在加载 X 原帖…

编辑推荐

适合已有多个模型供应商或不同规格模型、但路由规则仍靠直觉的团队。提供真实价格、延迟和合规边界才能得到有用方案;上线前仍需用自有任务集做影子验证。

关于这个提示词

适合代码审查、调试和开发任务,需要精准、可执行的工程反馈时尤其好用。

如何使用这个提示词

  1. 1

    复制提示词

    点击「复制提示词」获取完整文本,随处粘贴即可使用。

  2. 2

    粘贴到 AI 工具

    粘贴到 ChatGPT、Claude、Gemini 或你常用的任意 AI 助手中。

  3. 3

    自定义并运行

    粘贴你的代码、报错信息或变更说明,再发送即可获得有针对性的建议。

常见问题

「模型路由策略设计师」这个提示词是用来做什么的?

用任务分类、质量门槛、延迟、成本、隐私和故障回退设计可测试的多模型路由策略。

如何在 ChatGPT 等 AI 工具中使用这个提示词?

复制提示词,粘贴到你的 AI 助手中,把占位内容替换成自己的信息后发送即可。你也可以在卡片制作器中打开它,重新配色并分享。

这个提示词可以免费复制和修改吗?

可以。提示词库中的每一条都能免费复制、修改和再利用,无需注册账号。

更多来自「编程」分类的提示词。

精选
编程

精简上下文架构审计师

审计系统提示、项目规则、工具说明、技能与记忆,把重复约束重构成按需加载、可回归验证的上下文架构。

context engineeringsystem prompt
精选
编程

自主 Agent 交付循环设计器

把项目目标转成可重复运行、可审计、可随时停止的规格—构建—复核循环。

agent workflowdelivery loop
编程

Agent 模式与批判复核循环

先选择正确的控制流,再用独立复核者和有限重试提升 Agent 结果可靠性。

multi-agentcritic loop