#scaling
- OpenAI "temporarily slows" frontier model scaling and outlines cyber-capability safeguards OpenAI industry
- Apodex 1.1: Scaling Agentic Intelligence for Complex Work Apodex research
- Mean Mode Screaming: Training Pathology Fix Enables 1000-Layer Diffusion Transformers research
- SU-01: Gold-Medal-Level Olympiad Reasoning via Curriculum SFT and Two-Stage RL SU-01 Team research
- Humanoid-GPT: Scaling to 2B Motion Frames Enables Zero-Shot Generalization in Humanoid Control research
- ByteDance EdgeBench: Agent Learning Speed Doubles Every Three Months ByteDance research
- LLM-as-a-Verifier: verification as an independent scaling axis for LLMs Stanford University / UC Berkeley / NVIDIA research
- Ring-Zero: Scaling Zero RL to 1 Trillion Parameters with Emergent Reasoning Behaviors Ant Group research
- Hidden Decoding at Scale: A New Axis for LLM Capacity Without Backbone Growth research
- Xiaomi-Robotics-1: scaling vision-language-action models with 100K+ hours of real-world trajectories Xiaomi Robotics research
- Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories Xiaomi Robotics research
- EnvHarness: Awakening Static Worlds for Agent Learning Google research
- Will Scaling Improve Social Simulation with LLMs? A Study of 85 Models Stanford / Columbia / Tsinghua research
- xHC: Expanded Hyper-Connections scale residual-stream parallelism past prior limits Shanghai Jiao Tong University / Xiaohongshu / USTC / Peking University / CUHK research
- Scaling Properties of Text Conditioning in Visual Generation ByteDance Seed research