每周精选
近7天内社区解读较多的方向与热门关键词,适合先读一眼再决定是否深入。
以下为搜索结果。
| 标题 | arXiv | 发布时间 | 状态 |
|---|---|---|---|
|
UrbanGround: From Local Perception to Spatial Agency in a Real-Scale City
Tianjie Ju, Zheng Wu, Yueqing Sun, Yuhan Cui, Bobo Li, Shengqiong Wu, Pengzhou Cheng, Haodong Zhao, Zongru Wu, Xinbei Ma, Doris Zhang, Kunling Li, Mong-Li Lee, Wynne Hsu, Hao Fei, Qi Gu, Gongshen Liu, Zhuosheng Zhang
cs.CV
cs.CV
|
2608.27456v1 | 2026-08-27 17:59:33 | 待赞助 |
|
CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modes
Yufan Wu, Yinghui He, Zhengyi Hu, Lang Wei, Ruichen Li, Qifan Yang, Ting Zhu
cs.CL
cs.CL
|
2608.27455v1 | 2026-08-27 17:59:30 | 待赞助 |
|
From Static to Dynamic: Benchmarking Real-World Code Review with MCR-Bench
Dewu Zheng, Yanlin Wang, Xiwen Wang, Kefeng Duan, Hongyu Zhang, Xilin Liu, Yuchi Ma, Zibin Zheng
cs.SE
cs.SE
cs.AI
cs.CL
|
2608.27442v1 | 2026-08-27 17:56:24 | 待赞助 |
|
Boosting LLM Exploration via Weak-Model Guidance in RLVR
Xingyu Shen, Huishuai Zhang, Peng Li, Yinchun Wang, Dongyan Zhao
cs.CL
cs.CL
|
2608.27420v1 | 2026-08-27 17:45:50 | 待赞助 |
|
How Language Models Organize and Structure Moral Knowledge
Orion Reblitz-Richardson
cs.CL
cs.CL
cs.AI
cs.LG
|
2608.27402v1 | 2026-08-27 17:30:30 | 待赞助 |
|
CorporateBench: Large-Scale Q&A Benchmarking with Temporal Knowledge Bases
Sil Hamilton, Albert Yu Sun, Oscar J. Romero, Carl-Leander Henneking, David Mimno, Bishan Yang, Igor Labutov
cs.AI
cs.AI
cs.CL
cs.IR
|
2608.27391v1 | 2026-08-27 17:23:04 | 待赞助 |
|
Understanding Evolution Strategies for LLM Reasoning: Broader Reasoning Coverage than GRPO
Yunpeng Ba, Zhi Zheng, Yue Xie, Jiaqing Li, Xialiang Tong, Tao Zhong, Mingxuan Yuan, Zhichao Lu, Xuyang Wu, Zhenkun Wang
cs.LG
cs.LG
|
2608.27351v1 | 2026-08-27 16:48:39 | 待赞助 |
|
INTENT-AS-A-TOOL Makes it Easy to Track Agentic Misalignment
Yutong Zhang, Jianshuo Dong, Peng Xu, Long Wang, Jie Zhang, Tianwei Zhang, Xiaoping Zhang, Han Qiu
cs.CL
cs.CL
|
2608.27348v1 | 2026-08-27 16:47:19 | 待赞助 |
|
One Model, Many Minds: Unlocking Multi-Agent Synergy in a Single Agent via Mixture of Roles
Zhichen Zeng, Huiyuan Chen, Jingru Cheng, Juan Zha, Ming Liu, Ying Chen, Xiyuan Yang, Chaosheng Dong, Haiyang Zhang, Hanghang Tong
cs.MA
cs.MA
|
2608.27338v1 | 2026-08-27 16:40:28 | 待赞助 |
|
LLMs Can Design Near-Optimal OR Algorithms
Jackie Baek
cs.AI
cs.AI
cs.LG
|
2608.27296v1 | 2026-08-27 16:01:11 | 待赞助 |
|
Astar: Learning to Propose Evolution Directions for Self-Evolving Industrial AI Systems
Jinxin Hu, Hao Deng, Haibo Xing, Lingyu Mu, Muyu Zou, Weiqin Yang, Sirui Chen, Bohao Wang, Zhezheng Hao, Hao Zhang, Zulong Chen, Shizhun Wang, Yu Zhang, Xiaoyi Zeng, Jiawei Chen
cs.IR
cs.IR
|
2608.27287v1 | 2026-08-27 15:56:40 | 待赞助 |
|
BrailleBench: Investigating Multi-Criteria Braille Comprehension in Large Language Models
Jinghan Zhang, Fengran Mo, Zhiyu Chen, Xiaoyan Han, Kunpeng Liu, Chang-Tien Lu
cs.AI
cs.AI
cs.CL
cs.HC
|
2608.27268v1 | 2026-08-27 15:48:39 | 待赞助 |
|
STEP: State-Aware Task Estimation and Planning with Multi-Modal LLMs for Human-Robot Collaboration
Maitrey Gramopadhye, Prakash Baskaran, Xiao Liu, Songpo Li, Soshi Iba
cs.RO
cs.RO
cs.AI
|
2608.27225v1 | 2026-08-27 15:08:36 | 待赞助 |
|
BALMS: Benchmarking Agentic LLMs for Longitudinal Mental Health Sensing
Yu Yvonne Wu, Arvind Pillai, Yuliang Chen, Yuwei Zhang, Sudarshan Regmi, Tess Z. Griffin, Michael V. Heinz, Lisa A. Marsch, Nicholas C. Jacobson, Andrew Campbell
cs.CL
cs.CL
|
2608.27219v1 | 2026-08-27 15:00:17 | 待赞助 |
|
LLMs in Digital EDA: A perspective on shifting roles from Generation to Orchestration
Matthew Youngman, Cristian Sestito, Themis Prodromakis
cs.AR
cs.AR
cs.AI
cs.SE
|
2608.27184v1 | 2026-08-27 14:29:35 | 待赞助 |
|
When Text Misleads: Inconsistent-Aware Reasoning for Audio-Grounded Dialogue
Yen-Ju Lu, Yuzhe Wang, Yaohan Guan, Xiluo He, Jiarui Hai, Mingrui Liang, Kaavya Chaparala, Thomas Thebaud, Laureano Moro-Velazquez, Najim Dehak, Jesus Villalba
cs.CL
cs.CL
cs.AI
cs.LG
|
2608.27176v1 | 2026-08-27 14:26:46 | 待赞助 |
|
Prediction of Prediction (PoP): Inter-Layer Activation Fusion for Single-Pass Hallucination Detection in Large Language Models
Himal Badu
cs.CL
cs.CL
|
2608.27165v1 | 2026-08-27 14:17:14 | 待赞助 |
|
STAR : Sentence Translation Alignment Rate for Document-to-Document Machine Translation
Yichen Dong, Hao Wang, Junhui Li, Linlong Xu, Longyue Wang, Weihua Luo
cs.CL
cs.CL
|
2608.27161v1 | 2026-08-27 14:12:45 | 待赞助 |
|
AgentDV: Closed-Loop Agentic AI for Hardware Design Verification
Navya Goli, Junzhe Liu, Zhenge Jia, Umamaheswara Rao Tida
cs.SE
cs.SE
|
2608.27148v1 | 2026-08-27 14:00:16 | 待赞助 |
|
GRAIN: Bridging Name and Narrative Shifts in Real-World Graph Reasoning through Invariance-Rewarded Agentic RL
Zike Yuan, Han Zhang, Jianzhi Yan, Le Liu, Cai Ke, Huozhi Zhou, Jian Xie, Jiran Yin, Yukun Cao, Yue Yu, Hui Wang, Ming Liu, Bing Qin
cs.AI
cs.AI
|
2608.27142v1 | 2026-08-27 13:53:52 | 待赞助 |