Codex Reset
AI快讯
GitHub

QQ·微信群

CODEX / SIGNAL STUDIO

你的 Codex,尽在掌握。

Mistral Large 4 在网络安全基准测试中超越 Opus 5.5 与 GPT-6 Astra

Cline

Cline 报告称,Mistral Large 4 在网络安全基准测试中的表现优于 Opus 5.5 和 GPT-6 Astra。该团队指出,这一性能差异主要由任务拒绝率导致,Mistral Large 4 拒绝的安全相关评估任务数量远少于对手。

相比之下,Opus 5.5 和 GPT-6 Astra 在测试中有约 40% 的基准任务被自身安全过滤器拦截。