Files
oh-my-pi/packages/react-edit-benchmark/runs
can1357 5617184356 chore(react-edit-benchmark/runs): added GPT-5.3 Codex benchmark runs with three edit variants
- Added three new benchmark run reports for GPT-5.3 Codex model with different edit variants (hashline, patch, replace).
- Recorded performance metrics across 60 tasks per variant with success rates ranging from 80-83.3%.
2026-02-12 20:29:22 +01:00
..