CHOOSESecurity & safety
Jev for Cybersecurity Experiment
This project publicly shares an experiment comparing AI models (Typesafe AI's Jev, OpenAI's Terra, Claude Opus) on 100 synthetic cybersecurity cases across 5 passes each.
I haven’t seen much published on Jev for cybersecurity yet, so I made the experiment public.
I tested @typesafeai AI’s Jev vs OpenAI’s Terra in Codex vs Claude Opus in Claude Code.
100 synthetic security cases. 5 passes per model. 1,500 decisions.
Here’s what I found 👇🧵
