Ayaka Nishimura
ayakani
ยท
AI & ML interests
anomaly detection
multi-agent RL
reward hacking
Recent Activity
liked a model about 2 hours ago
773bw-h/my_first_reward_modeling liked a model about 2 hours ago
brouthen/GDG_QAADA_Discover_Reinforcement_Learning upvoted a paper about 2 hours ago
AutoSciBench: Autonomous Benchmark Generation for Evaluating Scientific AgentsOrganizations
None yet