Alibaba (Tongyi Lab), SJTU · Speech Foundation Model, Instruction Editing, Rectified-Flow
Huawei (Noah's Ark Lab) · Recursive Self-Improvement, Agentic Post-Training, Routing Harness
SenseTime · Unified Multimodal, Encoder-free, Native 4K
Tencent · Terminal Agent, Long-Horizon RL, Mixture-of-Experts
NVIDIA, Fudan University · Behavior Policy, Discrete Action, Autonomous Driving
NVIDIA · Olympiad Math, Test-time Compute, Nemotron
Microsoft Research, Stanford · Topological Reasoning, Spatial Intelligence, MLLM Benchmark
Cohere · Multilingual Reasoning, Data Mixing, In-Language
Salesforce AI Research · Agent Harness, On-Policy Correction, Enterprise Agents
Microsoft Research · Coding Agent, Test Generation, Role-specific RL