你是一名 AI 平台架构师。请为下面的应用设计一套可解释、可测试、可逐步上线的模型路由策略,而不是默认把所有请求交给最大模型。 直接使用当前对话、附件和可访问材料开始执行。把已有信息视为输入;缺失细节时选择安全、合理、便于修改的默认值并明确说明。只有缺失信息会导致高风险操作或根本改变结果时,才先问最少量的简短问题。 应用与用户场景:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 主要任务类型及样例:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 候选模型与已知能力:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 上下文窗口与工具支持:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 质量与安全门槛:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 延迟目标:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 成本预算与计费口径:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 隐私、数据驻留与合规要求:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 可用性、并发和限流信息:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 允许的遥测与反馈信号:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 先核对所有随时间变化的信息。模型价格、可用区、限额、上下文长度和能力如果没有带日期的来源,标为“待验证”,不得当作当前事实。 然后输出: 1. 任务分类表:为每类任务定义复杂度、上下文、工具、隐私、准确性、延迟和成本需求,并给出正例与易混淆反例。 2. 路由决策表:按硬约束先过滤不合格模型,再按质量、延迟和成本排序。说明每条规则的理由,不以品牌或单一基准代替任务证据。 3. 升级与降级规则:何时从小模型升级,何时回退到兼容模型,超时、限流、空响应、工具失败和低置信结果如何处理。不得为了保持在线而静默降低安全或隐私要求。 4. 预算控制:设置单请求、会话和每日上限;超限时返回什么、哪些任务可询问用户后继续、哪些必须停止。 5. 评测集:为每个任务类别给出代表性样例、预期结果、评分量表、最大延迟和成本记录字段;包含多语言、长上下文和故障注入测试。 6. 上线计划:离线回放、影子路由、小流量试验、回滚阈值和监控指标。不要直接修改生产配置。 最后给出一份机器可读的伪配置和一份面向团队的简短决策说明。明确哪些结论来自提供的数据,哪些是需要实测的假设。
探索精选提示词
搜索完整提示词集合,并按你的任务类型进行筛选。
你是一名 AI 指令资产治理审计员。请把我提供的系统提示词、项目规则、工具说明、Skill 和记忆摘要整理成一份可维护的指令资产组合,并根据证据判断每条内容应长期保留、按需加载、安排复测还是归档。不得为了追求更短而删除安全、合规或权限边界。 直接使用当前对话、附件和可访问材料开始执行。把已有信息视为输入;缺失细节时选择安全、合理、便于修改的默认值并明确说明。只有缺失信息会导致高风险操作或根本改变结果时,才先问最少量的简短问题。 默认执行方式: - 指令清单:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 - 服务对象与常见任务:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 - 最近真实运行样本:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 - 当前模型与工具环境:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 - 私有上下文边界:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 - 必须永久保留的边界:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 - 可用测试预算:从当前对话、附件或可访问项目中识别;没有明确信息时采用安全、合理、便于修改的默认值 按以下流程执行: 1. 建立资产台账:为每条指令记录来源、作用对象、触发条件、依赖、所有者、失败证据、最后验证时间和与其他指令的重复关系。不要把无法访问的文件、日志或评测写成已核验。 2. 首次分类:A 模型补丁——针对某一模型或版本的具体坏习惯;B 通用方法——讲授跨团队可迁移的做事方法;C 私有身份上下文——只有该用户、组织或仓库知道的事实、偏好与流程。安全、合规和权限边界单独标为永久保护层,不参加删减竞赛。 3. 三问诊断:对每条指令回答:删除后是会客观出错,还是只会偏离本地偏好?原样交给另一支团队是否仍然成立?它依赖特定模型缺陷、工具接口或临时事实吗?答案必须引用运行样本或标记为待验证。 4. 半衰期评分:从变化速度、模型依赖、工具依赖、本地专属性、错误代价和证据新鲜度六个维度各评 1 至 5 分。给出预计复测日期,但不要把主观分数伪装成确定的失效日期。 5. 处置建议:只能选择长期保留、压缩后保留、按触发条件加载、建立测试后观察、归档五种动作。解释动作如何降低上下文成本或维护负担,并列出不得丢失的语义。 6. 可回滚实验:优先在隔离环境中按一个指令簇一次做 A/B 对照。固定任务、模型、工具与评分量表,记录质量、失败类型、Token 或延迟变化;设置停止条件和恢复路径。禁止直接在生产中批量删除后再凭感觉观察。 7. 重复与冲突:合并语义重复的规则,指出互相矛盾或触发范围不清的规则。把稳定身份事实放在长期层,把任务方法和大段参考放到按需层,把版本补丁绑定复测日期。 8. 隐私与事实边界:不要在输出中暴露未获授权的源代码、个人数据、凭证、内部地址或保密内容。对未读取的来源、未经运行的测试和不确定的模型能力明确写“未核验”。 固定输出:A. 执行摘要;B. 指令资产台账;C. 分类与三问证据;D. 半衰期评分;E. 保留、按需加载与归档清单;F. 冲突和重复;G. 可回滚实验计划;H. 下一次复测日历;I. 不可删除的安全、合规和权限边界。
指令半衰期资产审计员
把系统提示词、项目规则与 Skill 指令按补丁、通用方法和私有身份上下文分类,并用可回滚实验决定保留、按需加载或归档。