arxiv:2605.26302
Jianing Zhu
Zfancy
AI & ML interests
None yet
Recent Activity
upvoted a paper about 21 hours ago
StateM: Reaching 95.3% Raw Accuracy, or a \$15 Frontier Run, on Terminal-Bench 2.1 via Harness Scaling upvoted a paper 22 days ago
StateAct: Program State, before Pixels, for Long-Horizon Computer-Use Agents upvoted a paper about 1 month ago
BadWAM: When World-Action Models Dream Right but Act Wrong