Eugene Choi최유진
Eugene Choi

I am a Senior Member of Technical Staff at Cohere, where I work on reinforcement learning and synthetic data for post-training code agents.

Before Cohere I was a research engineer at Reality Defender. Prior to that I did machine learning research in the Machine Learning for Language (ML²) group at New York University, where I had the privilege of being advised by Kyunghyun Cho and Sam Bowman, and working closely with Cheolhyoung Lee and Jason Phang.

Experience

Aug 2023 – Present

Senior Member of Technical Staff, Cohere

Post-training LLM agents to do useful work for enterprises.

Mar 2023 – Aug 2023

Research Engineer, Reality Defender

Detection models for synthetic and manipulated media.

Research

Self-improvement

Self-Improving Robust Preference Optimization

ICLR 2025

tl;dr  SRPO is a robust direct alignment method that unlocks inference-time self-refinement.

Teaching

Education

Projects