firstlight_$ early ai & robotics signals — the convergence monitor
sweep 18|exposure live|● updated 4h ago|

$ papers — cs.AI · cs.LG · cs.RO · 30 papers

  1. 2026-08-05Argus: A General-Purpose Agentic Runtime for Long-Horizon ReasoningBoxiu Li, Zimo Wen, Yijia Fan +2
  2. 2026-08-05OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context ModelingIndraneil Paul, Falko Helm, Goran Glavaš +1
  3. 2026-08-05Toward Skill-Native LLMs: Skill Entropy for Benchmarking and Training Long-Horizon ReasoningYinghui He, Ling Yang, Jiarui Liu +2
  4. 2026-08-05Teaching Nemotron Greek: Mining a Corpus, Adapting Retrieval, and Grounding Generation for Modern Greek across Specialist DomainsAyoub Kirouane, Christos Petrocheilos
  5. 2026-08-05The Loss Does Not See the Basis, but Adam DoesDevender Singh
  6. 2026-08-05Predicting Brain Morphometry with MT-GNN: Mesh Evolution in Continuous Time with Graph-Based Metric Tensor EmbeddingsHao Ding, Daniel Semchin, Paul M. Thompson +1
  7. 2026-08-05OPD-V: Visual On-Policy Self-Distillation with Modality BalanceAniri, Jinhe Bi, Peng Liao +2
  8. 2026-08-05SSTQ:Privacy-Preserving Vector Quantization via Subsampled Stochastic TurboQuantAdel Javanmard, David P. Woodruff, Vahab Mirrokni
  9. 2026-08-05Chained Recursive Language Models for Multi-Iteration ReasoningPurbesh Mitra, Sennur Ulukus
  10. 2026-08-05DASyR-LLM: Domain-Aware Symbolic Regression with LLMs for Kinetic Model DiscoveryRoberto Aliaga Medina, Paulina Quintanilla, Antonio del Rio Chanona
  11. 2026-08-05Robust and Efficient Motion Reasoning for Privacy-Aware Classroom Incident RecognitionParitosh Parmar, Landy Lan, Hong Yang +2
  12. 2026-08-05Stable Density Ridges: Consistency and Convergence of Subspace Constrained Mean ShiftWanli Qiao
  13. 2026-08-05Reward Structure Shapes the Interaction Between Episodic Exploration and Neural Memory in Reinforcement LearningJai Malegaonkar, Rohan Patil, Henrik I. Christensen
  14. 2026-08-05Representational separation between unitary and channel quantum generative models via shared classical randomness at shallow depthArunava Majumder, Marius Krumm, Hendrik Poulsen Nautrup +1
  15. 2026-08-05AI-based single-shot structured-light depth reconstruction for real-time laparoscopic surgical guidanceWayne Wonseok Rodgers, Xiangyi Le, Seonghoon Jang +2
  16. 2026-08-05CoPlan: A Trustworthy Co-Intelligence Interface for Care Planning through Role-Based Contestable Argument GraphsHung Truong Thanh Nguyen, Hélène Fournier, Piper Jackson +2
  17. 2026-08-05BnBERT-iPET: Sparse Few-Shot Language Modeling for Bengali via Lottery Ticket PruningSajib Hossain, Md Kamrus Samad, Anan Ghosh +2
  18. 2026-08-05Multimodal Spatiotemporal Atmospheric Data Assimilation with Latent Flow-matchingDibyajyoti Chakraborty, Romit Maulik
  19. 2026-08-05ABSeeker: Training Long-Horizon Search Agents via Answer-Backtracked Credit AssignmentYijun Lu, Rui Ye, Jiajun Wang +2
  20. 2026-08-05Hierarchical Graph Memory for LLM Agents with Path-level Localization and RewriteXiawei Yue, Boran Wang, Xiaoqing Zhang +2
  21. 2026-08-05MALT: Lightweight Curvature-Aware Muon via Diagonal PreconditioningTongle Wu, Huanyu Dong, Ying Sun +1
  22. 2026-08-05Item Response Theory for AI SafetyJoshua Fonseca Rivera, Neil Shah, David Demitri Africa +1
  23. 2026-08-05Capability-Gated Planning: Cost-to-Goal Discovery and the Limits of Myopic Experiment SelectionAhmed Hassoon, Mark Dredze
  24. 2026-08-05Learning When to Stop: Prefix-Optimal Dynamic Diffusion Policies for Continuous ControlRohit Kumar Salla, Manoj Saravanan, Simon Stepputtis
  25. 2026-08-05Optimizing What Policies Learn From: Recoverability-aware Rollout Intervention LearningZheyuan Zhang, Manqing Mao, Hong Wang +2
  26. 2026-08-04TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated ReasoningChangle Qu, Sunhao Dai, Hengyi Cai +2
  27. 2026-08-04Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and ReproducibilityMohsen Hariri, Weicong Chen, Nahal Shahini +2
  28. 2026-08-04Assessment of Conditional Diffusion Model for Synthetic Histopathology Image GenerationSeyed Kahaki, Shijie Li, Weijie Chen +1
  29. 2026-08-04Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss?Hailong Jiang, Feng Yu, Emran Hossain +2
  30. 2026-08-04Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch AgentZhen Fang, Yu Zeng, Wenxuan Huang +2