arxiv:2407.04185
Yuhang Lai
halfrot
AI & ML interests
NLP
Recent Activity
upvoted a paper about 1 month ago
Are Text-to-Image Models Inductivist Turkeys? A Counterfactual Benchmark for Causal Reasoning upvoted a collection 3 months ago
SSAE upvoted a paper 3 months ago
OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language World Models