TensorX

Explore · 每周精选

发现最受关注的研究论文,追踪研究趋势,订阅感兴趣的期刊与关键词。

Jul 28 – Aug 3, 2025
本周最热162

Agentic Reinforced Policy Optimization

Guanting Dong, Hangyu Mao, Kai Ma +11 authors

Agentic Reinforced Policy Optimization (ARPO) enhances multi-turn reasoning in large language models by balancing long-horizon capabilities and tool interactions, using entropy-based adaptive rollouts and advantage attribution.

reinforcement learningverifiable rewardslarge language modelssingle-turn reasoningHF ↗arXiv ↗

50 篇论文 · 按点赞排序

07

Deep Researcher with Test-Time Diffusion

Rujun Han, Yanfei Chen, Zoey CuiZhu +15 authors

TTD-DR, a diffusion-based framework, generates high-quality research reports by iteratively refining a preliminary draft with external information and self-evolutionary algorithms, outperforming existing deep research agents.

68Large Language Models (LLMs)Test-Time Diffusion Deep Researcher (TTD-DR)HF ↗arXiv ↗
08

BANG: Dividing 3D Assets via Generative Exploded Dynamics

Longwen Zhang, Qixuan Zhang, Haoran Jiang +4 authors

BANG is a generative approach using latent diffusion models and temporal attention to enable intuitive, part-level decomposition of 3D objects with precise control and multimodal interaction.

65latent diffusion modelexploded dynamicsHF ↗arXiv ↗
16

RecGPT Technical Report

Chao Yi, Dian Chen, Gaoyang Guo +50 authors

RecGPT integrates large language models into recommender systems to focus on user intent, improving content diversity and satisfaction while enhancing merchant and platform performance.

39large language modelsLLMsHF ↗arXiv ↗
17

MetaCLIP 2: A Worldwide Scaling Recipe

Yung-Sung Chuang, Yang Li, Dong Wang +13 authors

MetaCLIP 2, trained on worldwide web-scale image-text pairs, improves zero-shot classification and multilingual benchmarks without system-level confounding factors.

38Contrastive Language-Image PretrainingCLIPHF ↗arXiv ↗
18

Reconstructing 4D Spatial Intelligence: A Survey

Yukang Cao, Jiahao Lu, Zhisheng Huang +8 authors

A survey organizes 4D spatial intelligence reconstruction methods into five levels, from low-level 3D attributes to incorporating physical laws, and discusses challenges and future directions.

383D representationsdeep learning architecturesHF ↗arXiv ↗
21

iLRM: An Iterative Large 3D Reconstruction Model

Gyeongjin Kang, Seungtae Nam, Xiangyu Sun +3 authors

iLRM, an iterative Large 3D Reconstruction Model, improves scalability and efficiency in 3D reconstruction by decoupling scene representation, using a two-stage attention scheme, and injecting high-resolution information.

32feed-forward 3D modeling3D Gaussian splattingHF ↗arXiv ↗
22

Geometric-Mean Policy Optimization

Yuzhong Zhao, Yue Liu, Junpeng Liu +9 authors

Geometric-Mean Policy Optimization (GMPO) stabilizes policy updates in large language models by maximizing the geometric mean of token-level rewards, outperforming Group Relative Policy Optimization (GRPO) on mathematical and multimodal reasoning benchmarks.

32Group Relative Policy OptimizationGeometric-Mean Policy OptimizationHF ↗arXiv ↗
25

Diversity-Enhanced Reasoning for Subjective Questions

Yumeng Wang, Zhiyuan Fan, Jiayu Liu +1 authors

A diversity-enhanced framework with multiple role perspectives improves accuracy and diversity in subjective reasoning tasks through unsupervised data construction and reinforcement learning with reward shaping.

27Large reasoning modelschain-of-thoughtHF ↗arXiv ↗
1 / 2

北京市昌平区探索星信息技术及软件开发工作室

京ICP备2026059466号