责任使用
按行内建议、Chat 和 Agents 选择合适的人工检查与数据控制。
GitHub 的 Application cards 解释功能用途、模型处理过程、已知限制与风险缓解方式。它们用于理解产品边界,不是某段生成代码已经正确、安全或符合项目要求的证明。
三类使用方式
| 类型 | 用户需要验收什么 | 详细说明 |
|---|---|---|
| 行内建议 | 接受前检查具体插入、修改或删除;接受后测试 | 行内建议与文本补全 |
| Chat | 检查解释与事实、代码、摘要及使用的上下文 | Chat 与生成文本 |
| Agents | 检查授权、工具执行、代码修改、外部系统影响和最终结果 | Agents 与工具执行 |
建议接受率、评测成绩或没有出现报错,都不能独立说明任务已经完成。测试需要与实际验收条件对应,评审也应包括模型可能没有理解的业务和架构约束。
评测说明的范围
Chat 与 Agents 的应用卡说明,GitHub 使用公开开源仓库和合成任务进行评测,关注任务解决率、token 效率、延迟和工具调用可靠性,并重复运行以观察非确定性。安全评估还覆盖不当内容、受保护材料、越狱与代码漏洞。
“评测数据不使用真实用户查询或客户代码”描述的是这些基准评测的数据来源,不能扩展为所有请求不保存、不用于其他处理或全部模型采用相同数据政策。具体数据流按会话记录和模型托管核对。
将控制落到具体入口
代码建议、远程 agent、本地 CLI 和 SDK 应用的执行环境不同。配置时同时核对当前入口的功能说明、政策支持矩阵与实际有效权限,不从一种客户端的默认值推导其他客户端行为。
对于可能显著影响个人权益或产生不可逆后果的应用,官方建议加入适当的人类监督,并评估具体场景的要求。这项建议不意味着 Copilot 能代替领域审查或自动判断部署是否合适。