Submitted by taesiri 21 Φ-Bench: Can Large Language Models Engineer the Infrastructure That Powers Them? StepFun 61 1
Submitted by Shuangkang Fang 5 Chat-Edit-3D++: Interactive 3D and 4D Scene Editing via Large Language Models StepFun 2
Submitted by liu 6 Boosting Omni-Modal Language Models: Staged Post-Training with Visually Debiased Evaluation StepFun 2
Submitted by Yongliang Wu 32 GEditBench v2: A Human-Aligned Benchmark for General Image Editing StepFun 62 2
Submitted by Yuhong Dai 21 WebVR: Benchmarking Multimodal LLMs for WebPage Recreation from Videos via Human-Aligned Visual Rubrics StepFun 13 2
Submitted by Shuangkang Fang 4 Dropping Anchor and Spherical Harmonics for Sparse-view Gaussian Splatting StepFun 23 2
Submitted by taesiri 202 Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters StepFun 2.08k 6
Submitted by li haodong 39 GEBench: Benchmarking Image Generation Models as GUI Environments StepFun 53 2