Ayaka Nishimura
ayakani
ยท
AI & ML interests
anomaly detection
multi-agent RL
reward hacking
Recent Activity
liked a dataset about 13 hours ago
youinwww/reinforcement_learning liked a dataset about 13 hours ago
open-source-metrics/reinforcement-learning-checkpoint-downloads liked a dataset about 13 hours ago
liyucheng/zhihu_rlhf_3kOrganizations
None yet