5daea56e32
流式的收尾门禁只防传输层截断,把模型侧截断当成了正常收尾:is_completion 只 判断 finish_reason 非空,length / content_filter / max_tokens 一律放行;三条 非流式路径同样原样接受 Chat finish_reason、Responses status 和 Anthropic stop_reason。下游没有任何一处对该字段做分支,因此参数恰好闭合成合法 JSON 的 截断调用会被真的执行。格式修复循环对这种形态无从察觉,它看到的 JSON 是合法的。 新增 reject_incomplete_tool_calls,流式与三条非流式路径统一拦截已知的截断、 过滤和失败终态:Chat 的 length / content_filter,Responses 的 incomplete / failed / cancelled,Anthropic 的 max_tokens / pause_turn / refusal。 刻意用黑名单而非白名单,未知值与缺失一律放行,否则会误杀不发或自定义该字段的 兼容网关。只在存在工具调用时生效——正文被 max_tokens 截断仍是可用的降级结果, 一并拒绝会打死所有触及输出上限的长文本回答。 与非流式畸形参数透传同时成立时本检查优先,原用例的 finish_reason 相应改为 tool_calls 以只验证透传本身。补 6 个用例覆盖三协议截断、纯文本截断放行和未知 finish_reason 放行。