arXiv | Sep 1, 2026 | 1 min read
Evaluating Multimodal LLMs as Generalist Vision-Language-Action Agents for Drone Control: Commanding, Approaching, Tracking and Searching Focuses on Evaluating Multimodal LLMs as Generalist Vision-Language-Action Agents for Drone Control: Commanding, Approaching, Tracking and Searching.
arXiv | Aug 31, 2026 | 1 min read
When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI Focuses on When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI.
arXiv | Aug 31, 2026 | 1 min read
Autonomous robotic bridging using distributed swarm control without inter-agent communication Focuses on Autonomous robotic bridging using distributed swarm control without inter-agent communication.
arXiv | Aug 30, 2026 | 1 min read
EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA Agents Focuses on EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA Agents.
arXiv | Aug 30, 2026 | 1 min read
LUCID: An Agentic AI Framework on Digital-Twin in the Loop for QoS-Guaranteeing Robotic Control Focuses on LUCID: An Agentic AI Framework on Digital-Twin in the Loop for QoS-Guaranteeing Robotic Control.
arXiv | Aug 30, 2026 | 1 min read
Cooperative Risk-Aware Exploration in Heterogeneous Multi-Robot Systems Using Algorithmic Altruism Focuses on Cooperative Risk-Aware Exploration in Heterogeneous Multi-Robot Systems Using Algorithmic Altruism.
arXiv | Aug 30, 2026 | 1 min read
Dual Process Motion Planning Focuses on Dual Process Motion Planning.
arXiv | Aug 30, 2026 | 1 min read
LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation Focuses on LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation.
arXiv | Aug 29, 2026 | 1 min read
Provably Safe Decentralized Contingency MPC under State-Only Information and Limited Sensing for Nonlinear Multi-agent Systems Focuses on Provably Safe Decentralized Contingency MPC under State-Only Information and Limited Sensing for Nonlinear Multi-agent Systems.
arXiv | Aug 29, 2026 | 1 min read
STEGNav: Spatio-Temporal Event Graph Reasoning for Multimodal Lifelong Object Navigation Focuses on STEGNav: Spatio-Temporal Event Graph Reasoning for Multimodal Lifelong Object Navigation.
arXiv | Aug 29, 2026 | 1 min read
CoCoBench: A Cooperative Coordination Benchmark for Embodied Multi-Agent Task Planning Focuses on CoCoBench: A Cooperative Coordination Benchmark for Embodied Multi-Agent Task Planning.
arXiv | Aug 28, 2026 | 1 min read
Picking Bins Empty: A Hierarchical Hybrid Approach with Online Self-Learning of Grasp Points for Reliable Industrial Bin-Picking Focuses on Picking Bins Empty: A Hierarchical Hybrid Approach with Online Self-Learning of Grasp Points for Reliable Industrial Bin-Picking.
arXiv | Aug 28, 2026 | 1 min read
CLAP: Cross-Embodiment Video World Models are Zero-Shot Physical Simulators Focuses on CLAP: Cross-Embodiment Video World Models are Zero-Shot Physical Simulators.
arXiv | Aug 28, 2026 | 1 min read
Embodied Scene Rearrangement Planning Focuses on Embodied Scene Rearrangement Planning.
arXiv | Aug 26, 2026 | 1 min read
BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes Focuses on BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes.
arXiv | Aug 26, 2026 | 1 min read
Praxist: From Experimental Artifacts to Solution Lineages Focuses on Praxist: From Experimental Artifacts to Solution Lineages.
arXiv | Aug 25, 2026 | 1 min read
Arbitrary Polygon Oscillator: Generalizing Polygonal Synthesis to Arbitrary Shapes, Morphing, and Three-Dimensional Polyhedra Focuses on Arbitrary Polygon Oscillator: Generalizing Polygonal Synthesis to Arbitrary Shapes, Morphing, and Three-Dimensional Polyhedra.
arXiv | Aug 25, 2026 | 1 min read
Trust-Aware Sequential Decision Making and Rollout Planning for Resilient Multi-Robot Systems Focuses on Trust-Aware Sequential Decision Making and Rollout Planning for Resilient Multi-Robot Systems.
arXiv | Aug 25, 2026 | 1 min read
Reward-Free Continual Adaptation for Resilient Space Robots Focuses on Reward-Free Continual Adaptation for Resilient Space Robots.
arXiv | Aug 24, 2026 | 1 min read
Advantage-Driven Explicit Memory for Social Navigation Focuses on Advantage-Driven Explicit Memory for Social Navigation.
arXiv | Aug 21, 2026 | 1 min read
Video2DoorTraversal: Push Door Traversal via Simulated Door Twins Focuses on Video2DoorTraversal: Push Door Traversal via Simulated Door Twins.
arXiv | Aug 20, 2026 | 1 min read
Multi-Agent Orchestration with the Common-Sense Reasoning Capabilities of LLMs for Autonomous Driving Focuses on Multi-Agent Orchestration with the Common-Sense Reasoning Capabilities of LLMs for Autonomous Driving.
arXiv | Aug 20, 2026 | 1 min read
G-MARK: Grounded Multi-Agent Reasoning for Cooperative Driving via Knowledge Graphs Focuses on G-MARK: Grounded Multi-Agent Reasoning for Cooperative Driving via Knowledge Graphs.
arXiv | Aug 18, 2026 | 1 min read
Beyond Placement and Articulation: Usage-Driven Code Scenes for Embodied Interaction Focuses on Beyond Placement and Articulation: Usage-Driven Code Scenes for Embodied Interaction.
arXiv | Aug 18, 2026 | 1 min read
Calming Robot Pitches? Exploring the Influence of Robot Voice Pitch on Children's Stress Levels Focuses on Calming Robot Pitches? Exploring the Influence of Robot Voice Pitch on Children's Stress Levels.
arXiv | Aug 17, 2026 | 1 min read
Orienteering Problem with Uncertain Time-Varying Rewards: Framework and Benchmark for Everyday Service Robotics Focuses on Orienteering Problem with Uncertain Time-Varying Rewards: Framework and Benchmark for Everyday Service Robotics.
arXiv | Aug 17, 2026 | 1 min read
Progressive Experience Fusion for Multi-Task World Model Control in Endovascular Navigation Focuses on Progressive Experience Fusion for Multi-Task World Model Control in Endovascular Navigation.
arXiv | Aug 13, 2026 | 1 min read
Mind the Context: Continual Learning of Socially Appropriate Robot Actions via Environmental-Social Disentanglement Focuses on Mind the Context: Continual Learning of Socially Appropriate Robot Actions via Environmental-Social Disentanglement.
arXiv | Aug 12, 2026 | 1 min read
Risk-Aware Kinodynamic Motion Planning Under Uncertainty For Safe Navigation on Planetary Environments Focuses on Risk-Aware Kinodynamic Motion Planning Under Uncertainty For Safe Navigation on Planetary Environments.
arXiv | Aug 12, 2026 | 1 min read
S2-HWM: Sparse Event-Structured Hierarchical World Model for Long-Horizon Surgical Robot Manipulation Focuses on S2-HWM: Sparse Event-Structured Hierarchical World Model for Long-Horizon Surgical Robot Manipulation.
arXiv | Aug 11, 2026 | 1 min read
Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL Focuses on Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL.
arXiv | Aug 11, 2026 | 1 min read
Semantic Radiance Fields as Simulators for Spatial Reasoning in Real-World Scenes Focuses on Semantic Radiance Fields as Simulators for Spatial Reasoning in Real-World Scenes.
arXiv | Aug 11, 2026 | 1 min read
XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment Focuses on XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment.
arXiv | Aug 11, 2026 | 1 min read
Agentic Harnesses: LLM-Driven Verification Layers for Robot Autonomy Focuses on Agentic Harnesses: LLM-Driven Verification Layers for Robot Autonomy.
arXiv | Aug 10, 2026 | 1 min read
GESTO: Human-Centric Spatio-Temporal Memory for Reasoning in Dynamic Scenes Focuses on GESTO: Human-Centric Spatio-Temporal Memory for Reasoning in Dynamic Scenes.
arXiv | Aug 10, 2026 | 1 min read
DaViNCi: A Dataset Towards Outdoor Vision-and-Language Navigation with Continuous Actions and Dynamic Elements Focuses on DaViNCi: A Dataset Towards Outdoor Vision-and-Language Navigation with Continuous Actions and Dynamic Elements.