Benchmark for evaluating safety of AI agents in irreversible financial decisions (crypto payment settlement, consensus conflicts, replay attacks, finality races).
security distributed-systems benchmark blockchain cryptocurrency alignment ai-safety ai-agents payment-systems llm-evaluation agentic-ai llm-benchmark
-
Updated
Feb 27, 2026 - JavaScript