Jason Trinh

Research

EchoKV NeurIPS 2026 Submission

Adaptive per-layer KV-cache precision for large language model serving.

Reward-Filtered Policy Optimization

Improving DPO-style preference optimization with reward-filtered sampling.

Deep Learning: Riding the Polar Express to Convergence

Analyzing maximum stable learning rates for optimizers.