{"as_of":"2026-08-07T04:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d2d2a74d0615c7ca0906e2959a14f93462bfa4254c292389922ff83e143184d3","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T17:30:08.755545Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.02812/citation-record","integrity":"/paper/2604.02812/integrity","json":"/paper/2604.02812/citation-record.json","paper":"/paper/2604.02812"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of behavior trees in robotics and ai","venue":null,"work_id":"ac9834a9-70ac-47c4-8de9-e73f3504273a","year":2022},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:efb6fb62bf015b32798bff9780186890f5f7f6db0692b7e2af540e2be5fcac02","observation_id":"cbd0df6a-3bb5-47e7-af9a-ee44b0b63aaa","resolution":{"observed_at":"2026-05-19T17:32:42.098301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Behavior trees in robotics and ai: An introduction","venue":null,"work_id":"ae8a6eb6-c8f7-4878-930d-965a1d55e4d0","year":2018},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:35d14e315a4e98bc39939de09e0f1868647be60555d2adc891ae459572aefdde","observation_id":"48bd1363-340c-4cae-b254-f6126415d67e","resolution":{"observed_at":"2026-05-19T17:32:42.093309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03968","last_updated":"2025-01-10T10:38:49Z","snapshot_observed_at":"2026-08-03T16:46:30.377889Z","submitted_at":"2025-01-07T18:06:27Z","title":"VLM-driven Behavior Tree for Context-aware Task Planning","version":2},"cited_work":{"arxiv_id":"2501.03968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.03968","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vlm-driven behavior tree for context-aware task planning","venue":null,"work_id":"e84acfaa-6407-4fa6-a43c-a55876e8f962","year":2025},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2501.03968","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:4f017a573ebab047540dcf58636f08ece41ef7a157e220a9122c5fab3454dcb0","observation_id":"151689d2-67c9-49f5-bdb1-eda6125173e0","resolution":{"observed_at":"2026-05-19T17:32:41.673798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real2sim based on active perception with automatically vlm-generated behavior trees","venue":null,"work_id":"22d00ad4-0b6f-4b38-81b9-2d0f659ddaa1","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:13ea6d3a39e737f920f85d4601d7711d15cce982877a015f376e540876520ab5","observation_id":"9b4f9199-7d1a-4ea5-ac97-b544187f2531","resolution":{"observed_at":"2026-05-19T17:32:42.090786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.08454","last_updated":"2026-05-17T09:37:30Z","snapshot_observed_at":"2026-07-06T22:41:33.987055Z","submitted_at":"2026-01-13T11:28:46Z","title":"Real2Sim via Active Perception with Behavior Trees Automatically Generated by VLMs","version":2},"cited_work":{"arxiv_id":"2601.08454","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.08454","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available: https://arxiv.org/abs/2601.08454","venue":null,"work_id":"272c3263-6d71-4f3a-9db5-0af6d09d9c42","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2601.08454","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:82913db60609352a96d86eb979cd43a242bf0bdeb9a1151b1726e8e5de814ad7","observation_id":"cdaea39d-150c-455a-b102-92be5f68a99a","resolution":{"observed_at":"2026-05-20T00:03:02.105623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:cfb8296befd1fe4242b2324281a31aeb4f82940c455f58e93bd46c2c7706ed0e","observation_id":"7e887a0c-8029-4b13-b426-0adc75092672","resolution":{"observed_at":"2026-05-19T17:32:41.676662Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":"6fc6147f-3a82-4e82-a8ea-61af7df7abbe","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:f7720ebdbf5f8dce000d0767a2a5ca7790b406a9801f4c194ae69e08d2fe32d6","observation_id":"ce2ef84f-bc70-4283-b501-2ce32f5c3162","resolution":{"observed_at":"2026-05-19T17:32:42.096184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:f2b5802f1bc398c798eca44dbd735e4b5924f54902d031fdc539e7abac3f090c","observation_id":"2de4e5e9-a9ef-419c-b0d0-dedeac56777d","resolution":{"observed_at":"2026-05-19T17:32:41.679399Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":"2307.15818","doi":"10.48550/arxiv.2307.15818","metadata_source":"pith","pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","venue":"cs.RO","work_id":"ff438a8a-8003-4fae-9131-acd418b3597b","year":2023},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:59f53c75fac68ecdeafadae0918980dce77f50a57d85af66a5224787be77a09f","observation_id":"0d522c56-9231-4047-8128-3269c3e1633c","resolution":{"observed_at":"2026-05-19T17:32:41.682804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07549","last_updated":"2024-06-13T08:16:05Z","snapshot_observed_at":"2026-08-06T22:58:03.641625Z","submitted_at":"2024-06-11T17:59:55Z","title":"A3VLM: Actionable Articulation-Aware Vision Language Model","version":2},"cited_work":{"arxiv_id":"2406.07549","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07549","snapshot_observed_at":"2026-07-01T09:25:41.561165Z","title":"Huang, H","venue":null,"work_id":"f8e8c244-b08b-44da-ab88-7921d87ddc3e","year":2024},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2406.07549","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:cb5a4673a2043d8f197f73f5cb71606e4453726c4fc47d2c741750c863f19701","observation_id":"da4cd735-0823-4434-8962-3efec54418bc","resolution":{"observed_at":"2026-05-19T17:32:41.689570Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.11440","last_updated":"2026-05-29T13:40:10Z","snapshot_observed_at":"2026-08-03T22:13:48.348551Z","submitted_at":"2025-11-14T16:07:18Z","title":"Synthetic Stimuli, Real Gains: Rethinking VLM Fine-Tuning Through Fully Controlled Data Generation","version":3},"cited_work":{"arxiv_id":"2511.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.11440","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From synthetic scenes to real performance: Enhancing spatial reasoning in vlms","venue":null,"work_id":"24dc9c9e-bfd8-488e-8d7f-06b78e1be04f","year":2026},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2511.11440","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:9c89fa0d326923fc25f96be71893148b9da8677f9723c5c332cf533d78d8f03e","observation_id":"d2dfba28-d0b1-4370-91e8-61f472f0de65","resolution":{"observed_at":"2026-06-01T02:03:29.524259Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm-brain: Ai-driven fast generation of robot behaviour tree based on large language model","venue":null,"work_id":"c67083ab-bee5-4026-a99b-dfec16033d04","year":2024},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:4aca2ae280215c3f6a702acbaa8aed45987594ed0f7f030199df092ceb322d89","observation_id":"c83b0340-f8da-4121-b449-1c68106cc77b","resolution":{"observed_at":"2026-05-19T17:32:42.102574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stanford alpaca: An instruction-following llama model","venue":null,"work_id":"683701c2-4ab8-426c-8332-31fb5c6a87c1","year":2023},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:5786fb912b876e80cce7a72a3b935c80ed415ab5102e87d931f580751867c2a7","observation_id":"b42da8c6-2b69-4d08-ab2b-ddf7f5218969","resolution":{"observed_at":"2026-05-19T17:32:42.104817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.01870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Btgenbot-2: Efficient behavior tree generation with small language models","venue":null,"work_id":"1064040e-d589-436e-b8ea-670ee6d65220","year":2026},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:0630f978c48fd1b71b66149a65d9f3116ddfcbfa37ce3baa677c8202d720cab5","observation_id":"8747a24b-9817-4b86-9299-e1b8008650a9","resolution":{"observed_at":"2026-05-19T17:32:41.707529Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm-as-bt-planner: Leveraging llms for behavior tree generation in robot task planning","venue":null,"work_id":"2f86553b-3b63-4aeb-80e3-9650ff1d5835","year":2025},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:4b9cdc3e2556d1338b83d89fb24c2be4d4cafd73c1e3cc600b86d4305827af22","observation_id":"6f1e139d-0629-458f-b0e3-56e6fb42c58a","resolution":{"observed_at":"2026-05-19T17:32:42.112545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.06084","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal behavior tree generation: A small vision-language model for robot task planning","venue":null,"work_id":"cc2b6d81-2441-4515-971c-18f88de3a19d","year":2026},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:74bda86b26b283b40dab92bc1800fbf4a040978426c3da59098fe0f68fc8563c","observation_id":"2e020f4e-1394-4926-b545-456e11ec490e","resolution":{"observed_at":"2026-05-19T17:32:41.704766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ontology-guided diffusion for zero-shot visual sim2real transfer","venue":null,"work_id":"756472ff-5715-48eb-8947-f206b2e0a4c7","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:297d1cacbcac56f152935f48a79bb360d8576c5503605712b332b3188513279b","observation_id":"7b3b23d3-e1ec-46ef-87e6-89108addbfd0","resolution":{"observed_at":"2026-05-19T17:32:42.117296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.18719","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available: https://arxiv.org/abs/2603.18719","venue":null,"work_id":"d5f2eb8d-411e-4c05-a29e-20e2766e2244","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:9587db93f29da3622d0086189241a47bee126b564b87b806b19f0144fac10677","observation_id":"9075f5ca-a2f1-4f48-95d7-2aff25bb39a1","resolution":{"observed_at":"2026-05-19T17:32:41.670854Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sim2real VLA: Zero-shot generalization of synthesized skills to realistic manipulation","venue":null,"work_id":"12074a15-edd1-4c77-99b0-aebe4f40aa5e","year":2026},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:1b63701e02e0895cda006d10251d5f77eb24f9ca393f15f1c7ff571216ad88fa","observation_id":"26ba65a9-c9b9-42f1-9c10-191f2f1f862e","resolution":{"observed_at":"2026-05-19T17:32:42.100358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A study on training and developing large language models for behavior tree generation","venue":null,"work_id":"e247aa9f-56f6-4b6a-a295-d0d1e3af5639","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:feb463b7aedba65c9e59f8e9ae895155ba3ccd87c22511cadb76d27c8ef48009","observation_id":"03b104bb-bf04-4c6b-a6fe-67dc77c0be6b","resolution":{"observed_at":"2026-05-19T17:32:42.119567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08089","last_updated":"2024-01-16T03:28:29Z","snapshot_observed_at":"2026-08-02T00:14:39.845983Z","submitted_at":"2024-01-16T03:28:29Z","title":"A Study on Training and Developing Large Language Models for Behavior Tree Generation","version":1},"cited_work":{"arxiv_id":"2401.08089","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.08089","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available: https://arxiv.org/abs/2401.08089","venue":null,"work_id":"f90653af-48a0-454c-bb9a-fda2d8409863","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2401.08089","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:46cc0b609fe6df5989dac062e8838cfa9d420a930c796356c9989661238b5886","observation_id":"5304b2e5-2f69-4c3f-87ec-7cc7a7cf63e1","resolution":{"observed_at":"2026-05-19T17:32:41.698623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FoundationPose: Unified 6d pose estimation and tracking of novel objects","venue":null,"work_id":"814640ae-711b-467f-b14d-444e7c68df87","year":2024},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:e14822032fe8dbe0531276af8610244a7f9a764c7a3b1ef76c8f903141212bc7","observation_id":"8e355e1c-d971-4938-b412-cb43ee9e38ee","resolution":{"observed_at":"2026-05-19T17:32:42.114766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep object pose estimation for semantic robotic grasping of household objects","venue":null,"work_id":"6284a87e-a716-4783-a34d-429af73b4b16","year":2018},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:cecc382d3f6a67ebe6059631fd9e1c1ecd0df8f3ce2be7901569958bf84e2ffd","observation_id":"cc2178c9-78b7-45c7-90d9-81e847e85c8e","resolution":{"observed_at":"2026-05-19T17:32:42.122028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10276","last_updated":"2024-08-05T04:52:16Z","snapshot_observed_at":"2026-08-05T10:25:06.999919Z","submitted_at":"2023-05-17T15:07:50Z","title":"Chain-of-Symbol Prompting Elicits Planning in Large Langauge Models","version":7},"cited_work":{"arxiv_id":"2305.10276","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.10276","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain-of- symbol prompting elicits planning in large langauge models","venue":null,"work_id":"2eb84299-0729-4e7b-8a63-675c1a3afda3","year":2023},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2305.10276","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:75d8e113c8ce339a2d58e709e750346c3a190b618f1a6125ada0a4ab0fa497a0","observation_id":"5aab1eff-2bce-4e79-937f-b0145172d945","resolution":{"observed_at":"2026-05-19T17:32:41.686291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":"2410.07073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-07-04T13:59:52.216141Z","title":"Pixtral 12B","venue":"cs.CV","work_id":"9ad2b071-82d8-4cfa-b994-b9975094b575","year":2024},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:f34d40d5f19e37259304e60c3b8fb259d30c6ddad6c944454b0df7223d128cfe","observation_id":"4ae575cc-aacf-4610-9a05-e979a0dc61c7","resolution":{"observed_at":"2026-05-19T17:32:41.692298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:45:49.567649Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"c1b2881c-73fa-42d2-99e8-8a05a499981a","year":2012},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:e4787398ea35a3eece1a2fc53a6dce588c5eb4bb8c07a548ee34caa060145611","observation_id":"dff51883-a82c-4459-980f-c7dafb2bce29","resolution":{"observed_at":"2026-05-19T17:32:42.107682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"0bdc8d61-98f7-441e-a6b3-8ed8bbabcf3f","year":null},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:13ff72d99b1836c12c555b9f83fa3e86d1e75a8d8f7915339cd932ba44dddc12","observation_id":"9693f8a7-1944-4bbc-ad70-9741977957b3","resolution":{"observed_at":"2026-05-19T17:32:42.110082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":"2106.09685","doi":"10.4088/pcc.v03n0609","metadata_source":"pith","pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","venue":"cs.CL","work_id":"0426219a-789e-4964-adc8-a04538510818","year":2021},"citing_paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.755545Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2604.02812"},"observation_digest":"sha256:fa8b8fc0a588ec9f1cf307179943d8958d53aea94635d179d817461eb67ef972","observation_id":"79bbcd0e-0cac-4f65-b3ae-9eb61889b7b8","resolution":{"observed_at":"2026-05-19T17:32:41.695284Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.02812","last_updated":"2026-05-15T14:52:29Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:27:33Z","title":"Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":0,"verified_exact":11,"verified_fuzzy":14},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2604.02812."}