{"as_of":"2026-08-21T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e5443f769c9ba163d6b5e9f4b131b8df07faecb752c151d451da8b0fc6df957","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:49:35.893945Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:27:31.616619Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T12:04:50.484951Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2508.13073","last_updated":"2025-09-01T08:10:01Z","snapshot_observed_at":"2026-08-07T15:40:31.068428Z","submitted_at":"2025-08-18T16:45:48Z","title":"Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey","version":2},"reference_index":157,"source":"pdf_text","source_observed_at":"2026-05-17T20:28:15.818016Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2508.13073"},"observation_digest":"sha256:b63afdb5c8c2eccfe4cc0442d860efed948e5f460cae892935750733ca91c8b7","observation_id":"c1fc3edf-4d67-46db-b8cd-f60af0b31192","resolution":{"observed_at":"2026-05-17T20:28:15.994977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2603.25044","last_updated":"2026-03-30T07:44:33Z","snapshot_observed_at":"2026-08-02T12:22:24.189474Z","submitted_at":"2026-03-26T05:26:56Z","title":"ThermoAct:Thermal-Aware Vision-Language-Action Models for Robotic Perception and Decision-Making","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T00:46:03.360770Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2603.25044"},"observation_digest":"sha256:b57172655ef7a1a663442961d8788f4fbec321b041f5f98b1a312ed5d608bec1","observation_id":"40837d7a-c78d-4c57-b691-259da894a6a5","resolution":{"observed_at":"2026-05-15T00:48:24.847308Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2604.07395","last_updated":"2026-04-08T08:01:35Z","snapshot_observed_at":"2026-08-11T09:56:23.406299Z","submitted_at":"2026-04-08T08:01:35Z","title":"A Physical Agentic Loop for Language-Guided Grasping with Execution-State Monitoring","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:34:06.704114Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2604.07395"},"observation_digest":"sha256:40a16435477f651c0b94b6a4cbe44c9f013787b18b11e207b4b15e796c172f29","observation_id":"c7a1923a-aedf-429e-820d-4135e15fe09a","resolution":{"observed_at":"2026-05-11T00:20:55.310763Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2604.13654","last_updated":"2026-04-15T09:20:02Z","snapshot_observed_at":"2026-07-06T23:01:37.207817Z","submitted_at":"2026-04-15T09:20:02Z","title":"Vision-and-Language Navigation for UAVs: Progress, Challenges, and a Research Roadmap","version":1},"reference_index":185,"source":"pdf_text","source_observed_at":"2026-05-10T13:48:08.135538Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2604.13654"},"observation_digest":"sha256:5103cc36c0eefa054cb958c482c89a798b0653b8166e540ef5054a567b1b4ed9","observation_id":"307446db-3a34-4c0c-be65-ae56f1fc4a17","resolution":{"observed_at":"2026-05-10T14:10:29.738474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2604.27699","last_updated":"2026-04-30T10:43:55Z","snapshot_observed_at":"2026-08-10T22:01:12.810595Z","submitted_at":"2026-04-30T10:43:55Z","title":"Bridging Values and Behavior: A Hierarchical Framework for Proactive Embodied Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-07T07:46:25.550238Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2604.27699"},"observation_digest":"sha256:50886d4d25704ee68a2a7f565177eb1575515cf6d922d81b12b941522aea9782","observation_id":"f75cafd3-bc3a-44a0-a7f7-acfc82c34efa","resolution":{"observed_at":"2026-05-12T10:06:29.508278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2605.13119","last_updated":"2026-05-13T07:40:34Z","snapshot_observed_at":"2026-08-15T12:36:13.668405Z","submitted_at":"2026-05-13T07:40:34Z","title":"Towards Long-horizon Embodied Agents with Tool-Aligned Vision-Language-Action Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-14T18:35:22.595183Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2605.13119"},"observation_digest":"sha256:69107974cda565182afcec183d4c6e5413a79dee1ad6146002e7f90169e02308","observation_id":"b23c1271-9265-47b0-8160-d64f0aae333b","resolution":{"observed_at":"2026-05-14T18:37:35.447650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2606.00145","last_updated":"2026-05-29T02:48:13Z","snapshot_observed_at":"2026-08-19T18:43:06.538567Z","submitted_at":"2026-05-29T02:48:13Z","title":"Completion at the Boundary (CaB): Deployable Switching with Completion-Aware Control under Limited Calibration","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T22:38:27.562345Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2606.00145"},"observation_digest":"sha256:514e587d375b64fc892d550ea4613f94da488f4a5ec4da4599a8a8b2c40703be","observation_id":"b3a95fe3-ab54-49b9-8bec-b2c7f7c0eee9","resolution":{"observed_at":"2026-06-28T22:42:46.699503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2606.07723","last_updated":"2026-06-05T16:21:27Z","snapshot_observed_at":"2026-08-02T03:37:35.733251Z","submitted_at":"2026-06-05T16:21:27Z","title":"VoLo: A Physical Orchestrator for Open-Vocabulary Long-Horizon Manipulation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T21:40:00.330510Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2606.07723"},"observation_digest":"sha256:6b631e9bbc97fcc7dc54c33a7219a95f712ec61eb2434d7c58db3378e7024a70","observation_id":"1d1e3e86-c332-4ff1-9812-7d813c40fa2e","resolution":{"observed_at":"2026-07-02T19:07:18.172070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":"2505.23450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-08T12:04:50.484951Z","title":"Agentic robot: a brain-inspired frame- work for vision-language-action models in embodied agents","venue":"cs.RO","work_id":"53785374-9987-44a2-a09c-582020be8cd7","year":2025},"citing_paper":{"arxiv_id":"2607.06256","last_updated":"2026-07-15T12:10:06Z","snapshot_observed_at":"2026-08-15T06:48:33.158793Z","submitted_at":"2026-07-07T13:24:37Z","title":"Diagnosing Semantic Handoff Failures in Agent-Orchestrated Vision-Language-Action Skill Composition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-08T12:00:14.336135Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.06256"},"observation_digest":"sha256:258f4f59a19058bf57f003818abd97e8d34f12cbbdb897d2caa912665563b53a","observation_id":"9b9c7d2b-f8c5-41e7-8ec1-6f0e0bb9081a","resolution":{"observed_at":"2026-07-08T12:04:50.487184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-08-02T08:21:39.024057Z","title":"Agentic robot: A brain- inspired framework for vision-language-action models in embodied agents.arXiv preprint arXiv:2505.23450, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06256","last_updated":"2026-07-15T12:10:06Z","snapshot_observed_at":"2026-08-15T06:48:33.158793Z","submitted_at":"2026-07-07T13:24:37Z","title":"Diagnosing Semantic Handoff Failures in Agent-Orchestrated Vision-Language-Action Skill Composition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:39.024057Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.06256"},"observation_digest":"sha256:1eda9c3e00a08edecd7edaf3d9e585cdd3183242e9948781856aedb965c218f9","observation_id":"2a7face0-0a48-4b3e-87d8-62c078f4c5fe","resolution":{"observed_at":"2026-08-02T08:21:39.024057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-07-14T12:26:27.446079Z","title":"Agentic robot: A brain-inspired framework for vision-language-action models in embodied agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10350","last_updated":"2026-07-17T17:27:03Z","snapshot_observed_at":"2026-08-21T01:27:52.742063Z","submitted_at":"2026-07-11T15:24:43Z","title":"ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-07-14T12:26:27.446079Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.10350"},"observation_digest":"sha256:78d3ad9f3abf3a86de36fb00443925e5e6ece48fa1d6e348d500778af0c94c32","observation_id":"72f1dbf5-7b8a-457e-9303-25f70d223ca7","resolution":{"observed_at":"2026-07-14T12:26:27.446079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-08-02T07:21:35.267367Z","title":"Agentic robot: A brain-inspired framework for vision-language-action models in embodied agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10350","last_updated":"2026-07-17T17:27:03Z","snapshot_observed_at":"2026-08-21T01:27:52.742063Z","submitted_at":"2026-07-11T15:24:43Z","title":"ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory","version":3},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-02T07:21:35.267367Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.10350"},"observation_digest":"sha256:02092623a5c161601780fa1b7545febf5017cb85b536c2652a8c6b8007ba3f40","observation_id":"24f1332b-af98-404c-8af8-8e8a48fb8632","resolution":{"observed_at":"2026-08-02T07:21:35.267367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-08-02T03:39:46.108100Z","title":"Agentic robot: A brain-inspired framework for vision-language-action models in embodied agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.108100Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:9d1cbecd4408dd0bddadea9968e2eb9e42e78e188afdd152a7623324a357e75e","observation_id":"bc029bc7-ec60-4a7f-83a7-c706913c876e","resolution":{"observed_at":"2026-08-02T03:39:46.108100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-08-01T03:06:07.841166Z","title":"Agentic robot: A brain-inspired framework for vision-language-action models in embodied agents.arXiv preprint arXiv:2505.23450, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27703","last_updated":"2026-08-04T12:14:50Z","snapshot_observed_at":"2026-08-21T10:12:02.561042Z","submitted_at":"2026-07-30T05:39:01Z","title":"SpatialCLI: Learning to Reason With Spatial Tools, Then Without Them","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T03:06:07.841166Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.27703"},"observation_digest":"sha256:ee889dd58b5d8b0195cad41cb931c7f253fd8a535d6105c7e461bb5e1a25e9fb","observation_id":"7d238bda-fd2b-48eb-8ff7-73b90a11b6d8","resolution":{"observed_at":"2026-08-01T03:06:07.841166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-08-05T04:27:31.616619Z","title":"Agentic robot: A brain-inspired framework for vision-language-action models in embodied agents.arXiv preprint arXiv:2505.23450, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27703","last_updated":"2026-08-04T12:14:50Z","snapshot_observed_at":"2026-08-21T10:12:02.561042Z","submitted_at":"2026-07-30T05:39:01Z","title":"SpatialCLI: Learning to Reason With Spatial Tools, Then Without Them","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:31.616619Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.27703"},"observation_digest":"sha256:843dad41f907cbe0f8acebac9aabc2256fc47e12a460e7a9be234e9cc7bb8032","observation_id":"d82b96bd-144b-40c4-b02f-1daf503d4f4b","resolution":{"observed_at":"2026-08-05T04:27:31.616619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23450/citation-record","integrity":"/paper/2505.23450/integrity","json":"/paper/2505.23450/citation-record.json","paper":"/paper/2505.23450"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T12:49:31.647116Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.647116Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:c8388e944d3a1fb6a449a3c7992e38691e4dd074d6af09115d655e52e46eb3e8","observation_id":"07b3175a-981f-4d7e-a52e-2d6e42b38bd8","resolution":{"observed_at":"2026-08-07T12:49:31.647116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T12:49:31.708324Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.708324Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:78180f6e547b8c39cb0ecbce04c4eea4e0cbc9a2d3f595da897d8003ce5f778f","observation_id":"37f4e001-5881-4f48-9366-1e7cfdf4aabb","resolution":{"observed_at":"2026-08-07T12:49:31.708324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:38.345097Z","title":"Do as i can, not as i say: Grounding language in robotic affordances","venue":null,"work_id":"47eabe8c-ceb4-4208-80af-8c30a8b8ea60","year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.766548Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:b722d95005e8a83fbdd3f8fb7cf5bb52d0e5533739897150ec82dd8675e9356d","observation_id":"fb419ca2-0df5-4ead-af57-62c7f4432c95","resolution":{"observed_at":"2026-08-07T12:49:38.421389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:38.193400Z","title":"Scar: Refining skill chaining for long-horizon robotic manipulation via dual regularization","venue":null,"work_id":"73a2d9fe-2391-41f7-94d1-3e5bce83ec4b","year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.826481Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:e91bd7ef1e84db5a54369c8c0f83e7c52f26dfecc0c6ee6b20ea91fb0836ea49","observation_id":"7839d018-0eab-4cfd-b081-89523ba87169","resolution":{"observed_at":"2026-08-07T12:49:38.262669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:31.901414Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.901414Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:9497791e5d2a908fe70d579e3b35eb2549080565fd65a88cb872caf9e853a780","observation_id":"f0dc7b5e-0f89-464f-b3b6-bf3684a46dfb","resolution":{"observed_at":"2026-08-07T12:49:31.901414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:31.982629Z","title":"Palm-e: An embodied multimodal language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.982629Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:5beaf0406cfe5bd6c97e10abd99babf0970ee27b1fb497a1ec905c315ac1ef11","observation_id":"868b6e62-1111-499d-aa96-81f401789321","resolution":{"observed_at":"2026-08-07T12:49:31.982629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16707","last_updated":"2025-02-23T20:42:15Z","snapshot_observed_at":"2026-08-19T15:54:59.272939Z","submitted_at":"2025-02-23T20:42:15Z","title":"Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16707","snapshot_observed_at":"2026-08-07T12:49:31.987931Z","title":"Reflective planning: Vision-language models for multi-stage long-horizon robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.987931Z"},"links":{"cited_paper":"/paper/2502.16707","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:9da355c26011fd2edde60d56cf1174fa0544c00b54411ee4abd132e60cbe5346","observation_id":"1af3a251-9a8a-4eb6-a97d-cfd41ff38f99","resolution":{"observed_at":"2026-08-07T12:49:31.987931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:49:31.993601Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:31.993601Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:c5307b7f676f9675a550cfed34deddc023ea480aaf554a4779174585fe82b4dc","observation_id":"69a2d934-f88a-43f7-9938-6699fabae562","resolution":{"observed_at":"2026-08-07T12:49:31.993601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-08-12T16:02:21.969968Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-07T12:49:32.054170Z","title":"Metagpt: Meta programming for multi-agent collaborative framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:32.054170Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:38b0214e5641ef8c8b2d47adf2bcc10f38aa9400839364b4d56c0bf89f171c01","observation_id":"950a3357-adb5-444b-879c-65bb47f46f7b","resolution":{"observed_at":"2026-08-07T12:49:32.054170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:32.166252Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:32.166252Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:934f822833fd0e1a6ca50e7a35963eb8db2af60e4afd8f91fe9d3797cd1d4b61","observation_id":"32fb7241-ac6c-4eae-9f67-c9be919cf253","resolution":{"observed_at":"2026-08-07T12:49:32.166252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-08-17T09:42:08.942018Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-07T12:49:32.305377Z","title":"Inner monologue: Embodied reasoning through planning with language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:32.305377Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:f3f462140adf8891ff4dee578caa85953ab0052561d449efdf8fc27a06921905","observation_id":"749944ae-5b24-4ac8-9989-584ca442e286","resolution":{"observed_at":"2026-08-07T12:49:32.305377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:37.994425Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models","venue":null,"work_id":"760c8c8e-5315-4125-a9c4-5a437d462963","year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:32.461049Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:9f875d9f20d2e299cb3a1f67f9dd36d3d31adb9de5876822d5290de8511b5d50","observation_id":"8c8ee4b2-0c9a-46ba-9f6d-887327888b86","resolution":{"observed_at":"2026-08-07T12:49:38.075939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03094","last_updated":"2023-05-28T07:32:38Z","snapshot_observed_at":"2026-08-16T16:26:20.587132Z","submitted_at":"2022-10-06T17:50:11Z","title":"VIMA: General Robot Manipulation with Multimodal Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03094","snapshot_observed_at":"2026-08-07T12:49:32.585908Z","title":"Vima: General robot manipulation with multimodal prompts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:32.585908Z"},"links":{"cited_paper":"/paper/2210.03094","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:fe4cf19c9d3e5601f705934bd1574a532d2262baf3eab4fd7d7dcff4c2342b5d","observation_id":"a8eca4fa-6151-461e-b687-e19a2e5942c6","resolution":{"observed_at":"2026-08-07T12:49:32.585908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-07T12:49:32.701971Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:32.701971Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:dd3a31b461b15631002ff9b2d46cb110f34c1afe8415139f33ce70dd41e2b5ef","observation_id":"0a339f41-1d52-4630-a4a1-123bcc0afd5f","resolution":{"observed_at":"2026-08-07T12:49:32.701971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15068","last_updated":"2025-02-05T08:49:14Z","snapshot_observed_at":"2026-08-18T01:24:03.436765Z","submitted_at":"2025-01-25T04:19:33Z","title":"An Atomic Skill Library Construction Method for Data-Efficient Embodied Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15068","snapshot_observed_at":"2026-08-07T12:49:32.866537Z","title":"An atomic skill library construction method for data-efficient embodied manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:32.866537Z"},"links":{"cited_paper":"/paper/2501.15068","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:cfd5000acf6941e5e3758c0dcd331754969464de283eb3d422ac6959334470c9","observation_id":"701e24d9-11d1-42db-a3e1-a9c93656eebe","resolution":{"observed_at":"2026-08-07T12:49:32.866537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:33.003910Z","title":"Code as policies: Language model programs for embodied control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.003910Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:43e31fec05222888074ae9715d0ef6ff586afd59839cb6637e6ad4979f06d1ad","observation_id":"d57de53c-332a-43a2-ac21-3ca6e1c1b8d9","resolution":{"observed_at":"2026-08-07T12:49:33.003910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:37.763632Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":"9941f749-604d-46bb-bb57-b5fe8c36ca8e","year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.106104Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:2350aae55113e3708dad6aab0fc64d42e81e811f831f685db13cbecc89c4b0ad","observation_id":"217b65f9-7d49-441f-89af-aa5eceb772a7","resolution":{"observed_at":"2026-08-07T12:49:37.869354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:37.539131Z","title":"Robomamba: Efficient vision-language-action model for robotic reasoning and manipulation","venue":null,"work_id":"29305dbb-cda4-4f67-b8ad-9cf51d6b4154","year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.245568Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:2905eccce40ac0ba918c7b96a24de417af6ae42cb240be518a13ee9e55580c0f","observation_id":"167d7aa0-df7f-4f1c-9dde-fb1bc9423f04","resolution":{"observed_at":"2026-08-07T12:49:37.642776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18084","last_updated":"2025-07-29T13:17:05Z","snapshot_observed_at":"2026-08-18T20:11:29.757564Z","submitted_at":"2024-09-26T17:27:15Z","title":"GSON: A Group-based Social Navigation Framework with Large Multimodal Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18084","snapshot_observed_at":"2026-08-07T12:49:33.358579Z","title":"Gson: A group-based social navigation framework with large multimodal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.358579Z"},"links":{"cited_paper":"/paper/2409.18084","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:529e608b8e27646e66df2d957ae0438ac5de369342b3e3191bdc73ce896ddd59","observation_id":"2949a8d8-733e-4756-8152-d8aa7c1911d5","resolution":{"observed_at":"2026-08-07T12:49:33.358579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-13T20:16:31.803514Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T12:49:33.499902Z","title":"Mm-eureka: Exploring visual aha moment with rule-based large-scale reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.499902Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:957ec6ed52dbb480c22f5f780078a4c8c3a8ec5a533c59357ef33b8a274d09cc","observation_id":"132d569b-376f-4681-88eb-edca5e24113c","resolution":{"observed_at":"2026-08-07T12:49:33.499902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:37.374365Z","title":"Data-efficient hierarchical reinforce- ment learning","venue":null,"work_id":"8f9da4c0-cfe3-4e36-b4b6-e2167f95f281","year":2018},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.572404Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:dcf0eff6c5328c49701c5f193aef18a73b3e0ed9c330a301142f0599d1ee4c37","observation_id":"e6a5dee1-f574-4996-9181-e235de475e1f","resolution":{"observed_at":"2026-08-07T12:49:37.466185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:33.724173Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.724173Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:4f1c21af9c242aefb70092034ad72612491077ec846472bde31ba2d7c8465a8c","observation_id":"3f7bcbdf-bbbe-469d-a038-7a1993752dac","resolution":{"observed_at":"2026-08-07T12:49:33.724173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-08-20T05:57:34.826209Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-07T12:49:33.799678Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.799678Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:06b0494546049563c82cccaef73b041ec1254750e20eaa40a6037a6a825c8fee","observation_id":"cca39330-68b0-4ad6-b9c9-ea1328258d4d","resolution":{"observed_at":"2026-08-07T12:49:33.799678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-08-14T23:38:19.973422Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-07T12:49:33.934161Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:33.934161Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:03bb6285773c69fd8a5495c39ad6c8ebeb2717c0f1ff930da625e035c22b9c38","observation_id":"445bbfe5-ae23-4d83-a8aa-97c74c6f4c31","resolution":{"observed_at":"2026-08-07T12:49:33.934161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:37.189152Z","title":"Vlm-social-nav: Socially aware robot navigation through scoring using vision-language models","venue":null,"work_id":"7f9b4540-5369-4fce-bcf7-3141b75e3ed8","year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.025327Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:4aac4ef6381f4f1d35da776077b0164fec016c1c19a267d9bc3065dbbb2a13a7","observation_id":"676af8f2-772d-4eaf-b204-2295bfb959a6","resolution":{"observed_at":"2026-08-07T12:49:37.266362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:34.111610Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.111610Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:1ee6d707889ca65ed5d6a470f9a7d280461ed648c9fe5b133c0a4a26be0dece4","observation_id":"028e56a5-8ae6-46a8-b8c9-e8600267bf04","resolution":{"observed_at":"2026-08-07T12:49:34.111610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:49:34.174528Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.174528Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:9340ee460010ec05f09075d31e42658bde1afd40fb0235598f4cf2c81c2dbb7c","observation_id":"7637e2df-5957-4ea1-ad5a-9cef938465fd","resolution":{"observed_at":"2026-08-07T12:49:34.174528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-07T12:49:34.236703Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.236703Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:61a7892e55481fbe87f61a312b8dce651c046bdd9437298bba24e41acc898d0e","observation_id":"6e9c6d8c-0a5e-4424-951c-df25ac59003e","resolution":{"observed_at":"2026-08-07T12:49:34.236703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06072","last_updated":"2025-08-01T01:52:05Z","snapshot_observed_at":"2026-08-16T12:51:59.712632Z","submitted_at":"2025-03-08T05:41:42Z","title":"A Survey on Post-training of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06072","snapshot_observed_at":"2026-08-07T12:49:34.413285Z","title":"A survey on post-training of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.413285Z"},"links":{"cited_paper":"/paper/2503.06072","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:1984c5075ea3e62b246742e7fe9e177827ad01d93e9c5911ca0ba45dc4ac4373","observation_id":"749fe4ba-84ee-499d-b40c-a4addda8c2c6","resolution":{"observed_at":"2026-08-07T12:49:34.413285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:36.980538Z","title":"Omnijarvis: Unified vision-language-action tokenization enables open-world instruction following agents","venue":null,"work_id":"b782ce77-137b-41b1-a028-0c9da03faaeb","year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.533852Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:fb1bd118b102d3db254a7e960f5e1ae09b5297a825da473ca6be6d22b1019915","observation_id":"212ee4e1-3406-4cd8-a49a-4d42d5e645ef","resolution":{"observed_at":"2026-08-07T12:49:37.079557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-07T12:49:34.687637Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.687637Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:209a9f84670693e1755bbffba76b4ac372cfea79478ce9b85dd966234cd83185","observation_id":"391d3068-1dcb-4f7b-8eb2-89a9e8058095","resolution":{"observed_at":"2026-08-07T12:49:34.687637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:34.838379Z","title":"Dpmpc-planner: A real-time uav trajectory planning framework for complex static environments with dynamic obstacles","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.838379Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:5320c71fac4d701c76f7a1c54ae7a46c815f26cd525df70340f1b5f2f75af2b8","observation_id":"1eb1c284-96dc-4b22-a9aa-7791cb7f84c0","resolution":{"observed_at":"2026-08-07T12:49:34.838379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:34.935143Z","title":"Robomm: All-in-one multimodal large model for robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:34.935143Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:026f4bc6d746676def459ecc9ff6fb26fc4a414d9e79a3922bac9bfa14fe2213","observation_id":"7bb82601-f268-427d-8dc2-a3a5a9a4f35c","resolution":{"observed_at":"2026-08-07T12:49:34.935143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:36.783293Z","title":"Deer-vla: Dynamic inference of multimodal large language models for efficient robot execution","venue":null,"work_id":"acfa1cd7-af03-4533-a520-85ba5724ea6d","year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.028019Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:4653f42bd44bf5a27390558602ef685212c009498328c7354b101cd10aa38647","observation_id":"5f38e9c5-ef59-41a1-90ec-b3355cc26ac4","resolution":{"observed_at":"2026-08-07T12:49:36.864478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08693","last_updated":"2025-03-06T19:29:03Z","snapshot_observed_at":"2026-08-07T02:44:43.738657Z","submitted_at":"2024-07-11T17:31:01Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08693","snapshot_observed_at":"2026-08-07T12:49:35.156044Z","title":"Robotic control via embodied chain-of-thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.156044Z"},"links":{"cited_paper":"/paper/2407.08693","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:0f6982b4945abe1ad881279ba7d571a707ad19ce41acb38ae5f8e8e2e8aa81cf","observation_id":"e74ad650-c13b-4690-98bb-0100dd5465d8","resolution":{"observed_at":"2026-08-07T12:49:35.156044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-08-18T12:12:42.503422Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15852","snapshot_observed_at":"2026-08-07T12:49:35.263383Z","title":"Navid: Video-based vlm plans the next step for vision-and-language navigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.263383Z"},"links":{"cited_paper":"/paper/2402.15852","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:aac70740b468e0c3cb429008f2619a448b1c7ff8c9cd13561070b755e5e48197","observation_id":"ec8f3e0b-5897-46b3-bcc2-cead05f6f881","resolution":{"observed_at":"2026-08-07T12:49:35.263383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:36.644658Z","title":"Unifying modern ai with robotics: Survey on mdps with diffusion and foundation models","venue":null,"work_id":"07cfd22f-93c1-447c-9bb4-2b55cefb7937","year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.384041Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:80d01d1f3ad07e4701799375909c04c77abbe5e92cac0d0683d2c58074a99f7a","observation_id":"7e64bab8-3716-4a6a-9c8a-640cef8291ea","resolution":{"observed_at":"2026-08-07T12:49:36.712774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-12T18:17:40.083518Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-07T12:49:35.479145Z","title":"Tracevla: Visual trace prompting enhances spatial-temporal awareness for generalist robotic policies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.479145Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:1e5d469e61bf6f28f1932ed5e820bffc817aac01b9ce5205e4cc8f64d32cdff4","observation_id":"e7a02642-da1b-4d23-9c3f-4eed442f0a08","resolution":{"observed_at":"2026-08-07T12:49:35.479145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14420","last_updated":"2025-02-21T07:28:36Z","snapshot_observed_at":"2026-08-20T00:02:56.415565Z","submitted_at":"2025-02-20T10:16:18Z","title":"ChatVLA: Unified Multimodal Understanding and Robot Control with Vision-Language-Action Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14420","snapshot_observed_at":"2026-08-07T12:49:35.637019Z","title":"Chatvla: Unified multimodal understanding and robot control with vision-language-action model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.637019Z"},"links":{"cited_paper":"/paper/2502.14420","citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:744154023c7491c18e7523527a3f957b4f21c565706548e9e910d25643a77233","observation_id":"15ee6829-a0a9-4ab3-a46f-971d4b4f73f7","resolution":{"observed_at":"2026-08-07T12:49:35.637019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:35.718105Z","title":"Hierarchical planning for long-horizon manipulation with geometric and symbolic scene graphs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.718105Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:74ba1972dd8144a6a0a966d19c0a927d7dcf75864ad0b16da5b88ea0f7ff312a","observation_id":"d417ec4b-bbe2-4a0e-8ce9-2c15c21a19d2","resolution":{"observed_at":"2026-08-07T12:49:35.718105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:36.449112Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","venue":null,"work_id":"66c9c9f5-bd4e-4482-b554-3a67a4de280b","year":2023},"citing_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:35.893945Z"},"links":{"citing_paper":"/paper/2505.23450"},"observation_digest":"sha256:97316e2b628fa15f8099567c82b47d61529e6fde71cf725ada9763243f2f4291","observation_id":"cc0d619b-b6af-49f6-8e72-f4f78749d0fe","resolution":{"observed_at":"2026-08-07T12:49:36.532530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 15 inbound Pith citation observations for arXiv:2505.23450."}