{"as_of":"2026-08-08T03:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2cba905dccb5838f6180b8283ad3a936e5607a54db633b3df585fd4ffaad2252","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:03:14.710041Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18580/citation-record","integrity":"/paper/2607.18580/integrity","json":"/paper/2607.18580/citation-record.json","paper":"/paper/2607.18580"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-01T15:03:11.310160Z","title":"Bjorck, F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.310160Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:f552d1051a4aa911ff5bf1d9690ceb5e6893a5729644e1b0cd08cbc1522364f0","observation_id":"f05236e2-6e7f-497f-9a1e-ce00239784d0","resolution":{"observed_at":"2026-08-01T15:03:11.310160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:11.366792Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.366792Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:0c5bb35c72ca6fd8975af7509453d4f7669ef3e1cb4a84a8b92b720ca2c1cd0b","observation_id":"f6f0ddf6-8350-48f5-981f-852396b55e43","resolution":{"observed_at":"2026-08-01T15:03:11.366792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:11.408940Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.408940Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:83047a631b70d8510573e30467c5f166c5c26242f79c6b054ea1ddc29e374687","observation_id":"3e4df725-45dd-4d12-ba47-d9f9f58c507c","resolution":{"observed_at":"2026-08-01T15:03:11.408940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:11.645129Z","title":"Maler and D","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.645129Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:bc95470a40841275305918788f5b48401aa93f849c695491b42cb3272c08fe99","observation_id":"ddb53cb4-3f0c-43ce-8944-b94c84ecf491","resolution":{"observed_at":"2026-08-01T15:03:11.645129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:11.727187Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.727187Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:74b4c92d1acbf81c16ca596c8a6650c0beae203de84cbc07a69a834ef80e0105","observation_id":"885e0a95-a137-40c1-9c46-806f91ad9139","resolution":{"observed_at":"2026-08-01T15:03:11.727187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:11.834097Z","title":"Donz ´e and O","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.834097Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:53f808fdf1bcf8549a9ec6f40ae96f13de2f2350a37c61c1f132e8c3728d9b6c","observation_id":"b6c115a6-17a9-41c2-b303-e03d2d98b927","resolution":{"observed_at":"2026-08-01T15:03:11.834097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:11.902071Z","title":"Sadraddini and C","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.902071Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:1a2a524a66dd40a3c17cb3121d3cde94551975592272852742c71cad3e21670b","observation_id":"adbdc499-b6f4-45f2-a6c5-cb4b2d9e2e63","resolution":{"observed_at":"2026-08-01T15:03:11.902071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-01T15:03:11.982185Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.982185Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:cec19f988b3ba6bc6347d3fd78ea494242af265d4099cf46d933d8ad0e82ae50","observation_id":"06eb53a9-2ef3-4e5e-80c9-6f736edaf938","resolution":{"observed_at":"2026-08-01T15:03:11.982185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-01T15:03:12.094817Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.094817Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:f536e9664beffb1acb5f2a8125d09ba3ffcca84ea7558ab8ed2a1e3e6a84e1a8","observation_id":"461253fd-b39a-4aa5-b62c-10f786c17354","resolution":{"observed_at":"2026-08-01T15:03:12.094817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03471","last_updated":"2017-03-02T15:39:11Z","snapshot_observed_at":"2026-07-06T05:22:15.069403Z","submitted_at":"2016-12-11T20:43:30Z","title":"Reinforcement Learning With Temporal Logic Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.03471","snapshot_observed_at":"2026-08-01T15:03:12.171301Z","title":"Li, C.-I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.171301Z"},"links":{"cited_paper":"/paper/1612.03471","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:b266c4c3d7afdd60e0744ee0af8f28696461ba5467f0a188e344b17cb38179e6","observation_id":"ee8f0a61-9898-414e-aa8d-ccd1648230ce","resolution":{"observed_at":"2026-08-01T15:03:12.171301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04054","last_updated":"2024-10-17T00:21:46Z","snapshot_observed_at":"2026-08-07T06:50:22.679686Z","submitted_at":"2024-08-07T19:30:08Z","title":"PLANRL: A Motion Planning and Imitation Learning Framework to Bootstrap Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04054","snapshot_observed_at":"2026-08-01T15:03:12.264259Z","title":"Bhaskar, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.264259Z"},"links":{"cited_paper":"/paper/2408.04054","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:0e0da9a206420221b133bd6ecfb4c6adebf052fe310c3113cb734e74694fc633","observation_id":"13d00245-7b83-41f2-9bbf-f491c2ac7b97","resolution":{"observed_at":"2026-08-01T15:03:12.264259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17237","last_updated":"2023-11-03T19:15:51Z","snapshot_observed_at":"2026-07-06T15:48:32.547396Z","submitted_at":"2023-06-29T18:06:15Z","title":"HYDRA: Hybrid Robot Actions for Imitation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17237","snapshot_observed_at":"2026-08-01T15:03:12.384180Z","title":"Belkhale, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.384180Z"},"links":{"cited_paper":"/paper/2306.17237","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:2205943570f184219feed8e72be4424f2eb306d561ea27a2c3161e2dd3316f73","observation_id":"a1380a5d-e00c-40a3-b925-c67c9fa84b6d","resolution":{"observed_at":"2026-08-01T15:03:12.384180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:12.458000Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.458000Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:68ad488e3d6143bb87167b0ee13103b502c39b71c760c2dfeb7708914b2f23ba","observation_id":"a3368697-d395-45b7-8656-516c054dcea5","resolution":{"observed_at":"2026-08-01T15:03:12.458000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11302","last_updated":"2022-09-22T20:29:49Z","snapshot_observed_at":"2026-08-06T05:32:03.407339Z","submitted_at":"2022-09-22T20:29:49Z","title":"ProgPrompt: Generating Situated Robot Task Plans using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11302","snapshot_observed_at":"2026-08-01T15:03:12.642197Z","title":"Singh, V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.642197Z"},"links":{"cited_paper":"/paper/2209.11302","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:43055aaaff57d14bd71538c34ac08b8418fb54fb2d6dc7c31a5b64b699fcfb03","observation_id":"17739505-1cad-4f8e-aeaf-bb0af9e30ef5","resolution":{"observed_at":"2026-08-01T15:03:12.642197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07753","last_updated":"2023-05-25T03:50:11Z","snapshot_observed_at":"2026-08-05T02:35:14.331933Z","submitted_at":"2022-09-16T07:17:23Z","title":"Code as Policies: Language Model Programs for Embodied Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07753","snapshot_observed_at":"2026-08-01T15:03:12.690111Z","title":"Liang, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.690111Z"},"links":{"cited_paper":"/paper/2209.07753","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:f51381615251c1d65ea5f3e16f99a7f04f9db932e7bcacbf68b1ce6b7cd121ec","observation_id":"8ae5cf1e-22d9-419a-b707-562464bd150f","resolution":{"observed_at":"2026-08-01T15:03:12.690111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-01T15:03:12.746298Z","title":"Huang, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.746298Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:42eb0b5cca44ff2a14a148f15b28037b6a99f886f4c72eb7296755d55d76068e","observation_id":"6d7c9225-aa43-4567-bc63-cc19a0771733","resolution":{"observed_at":"2026-08-01T15:03:12.746298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01652","snapshot_observed_at":"2026-08-01T15:03:12.805968Z","title":"Huang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.805968Z"},"links":{"cited_paper":"/paper/2409.01652","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:c56a9b088fad88cf89651ed03f4a9b431a0b4874725e123b19edf76742fdc640","observation_id":"f1d322be-58e1-4e52-8d64-dd7d5c04ed3d","resolution":{"observed_at":"2026-08-01T15:03:12.805968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:12.878289Z","title":"Singh, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.878289Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:e39dea8c74f891f910bfa9bb3ee1646aceadf4daad203ec13a0305fa87630b6b","observation_id":"889f92c9-086c-4c8b-a81e-e675cbb8e538","resolution":{"observed_at":"2026-08-01T15:03:12.878289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21924","last_updated":"2026-04-23T17:59:04Z","snapshot_observed_at":"2026-08-03T07:06:59.184119Z","submitted_at":"2026-04-23T17:59:04Z","title":"Long-Horizon Manipulation via Trace-Conditioned VLA Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21924","snapshot_observed_at":"2026-08-01T15:03:12.951601Z","title":"Liu, A.-C","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.951601Z"},"links":{"cited_paper":"/paper/2604.21924","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:22c0c6ae60643475e5a6fa8b814d0fbc2dc2bb0f71b7c8cf94fb438e47431fd6","observation_id":"15c38214-8b61-48fa-b7bb-223418edee39","resolution":{"observed_at":"2026-08-01T15:03:12.951601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.043036Z","title":"Kress-Gazit, G","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.043036Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:619000750591914e48924c966dac3bb5c81111c8aa5c2ef9d8e3728ef76da182","observation_id":"289d7b0f-2770-4acd-a546-c9fa1967d55e","resolution":{"observed_at":"2026-08-01T15:03:13.043036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.197103Z","title":"Kloetzer and C","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.197103Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:e9d517f965273185e636a83147fd18571bb0059b88ef7963c761c81690506ccb","observation_id":"29d031bc-9e0e-408a-858e-e6b7c39c0d27","resolution":{"observed_at":"2026-08-01T15:03:13.197103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.361871Z","title":"Kress-Gazit, T","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.361871Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:74f2eecae1269b60a7101da39503be431adbda507221abfae4ab6f76c3822ab4","observation_id":"1f79d482-f91a-4e87-8cd2-78bf4a7ce582","resolution":{"observed_at":"2026-08-01T15:03:13.361871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.508048Z","title":"Wells and E","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.508048Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:fd8129ca3ada32e837be87985fd177189f69db2ea635b12ea34d67ec53073386","observation_id":"d39bb2f3-6d25-4f3e-a3dc-be08e7812706","resolution":{"observed_at":"2026-08-01T15:03:13.508048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.676924Z","title":"Raman, A","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.676924Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:77bd240e89f9ff7b991abc5dc20de3eae9bda82b8b70c8f044da6e0bdbb3b2ac","observation_id":"3a319e3e-59c4-4a52-b3f5-07c68a747a06","resolution":{"observed_at":"2026-08-01T15:03:13.676924Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.795227Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.795227Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:536274320707c4ed6e58bda47b2609a3ae45d9ebcdd63844d93990f8bfdfee0b","observation_id":"e213d8da-0542-44a8-abaf-536b1e34aece","resolution":{"observed_at":"2026-08-01T15:03:13.795227Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.888354Z","title":"Kapoor, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.888354Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:02df457fb907ac9ba8414e086a07a106469c301a177bc19295989ff0c812991f","observation_id":"1bacfca1-0b52-4dae-a938-278c2a36dbd5","resolution":{"observed_at":"2026-08-01T15:03:13.888354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00097","last_updated":"2021-12-27T17:15:34Z","snapshot_observed_at":"2026-07-06T09:43:38.845298Z","submitted_at":"2020-07-31T22:01:39Z","title":"Backpropagation through Signal Temporal Logic Specifications: Infusing Logical Structure into Gradient-Based Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00097","snapshot_observed_at":"2026-08-01T15:03:14.047521Z","title":"Leung, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:14.047521Z"},"links":{"cited_paper":"/paper/2008.00097","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:4b7c314cc3d2ba5b9e630ef33b67af846b675a4bff4a42e10ca7515839de4ca9","observation_id":"8c1d6108-7ca7-4833-986e-57ba6351895b","resolution":{"observed_at":"2026-08-01T15:03:14.047521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10294","last_updated":"2022-03-24T10:02:00Z","snapshot_observed_at":"2026-08-04T11:43:58.023616Z","submitted_at":"2021-09-21T16:13:29Z","title":"DeepSTL -- From English Requirements to Signal Temporal Logic","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.10294","snapshot_observed_at":"2026-08-01T15:03:14.154055Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:14.154055Z"},"links":{"cited_paper":"/paper/2109.10294","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:fbe4607832fe2855309dd002d9e349939950965190f13609ed36f7e39e98c5fa","observation_id":"9ad969d9-a916-4bd3-8ad2-45d629300e4c","resolution":{"observed_at":"2026-08-01T15:03:14.154055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:14.245920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:14.245920Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:e027e5b3502864b88e2b245b3f09064701b6fa3752ff17a6390327f3503f571d","observation_id":"7486480a-2a70-434c-8056-30d25c0125b6","resolution":{"observed_at":"2026-08-01T15:03:14.245920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20658","last_updated":"2025-07-24T09:02:40Z","snapshot_observed_at":"2026-08-07T13:47:31.138300Z","submitted_at":"2025-05-27T03:07:25Z","title":"Enhancing Transformation from Natural Language to Signal Temporal Logic Using LLMs with Diverse External Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20658","snapshot_observed_at":"2026-08-01T15:03:14.393164Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:14.393164Z"},"links":{"cited_paper":"/paper/2505.20658","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:8c1bdaff6306f2d7a355fe761c026175079273079adc07d377b221e59e65c581","observation_id":"1d8db18d-6099-46f6-9aac-f1622f98623b","resolution":{"observed_at":"2026-08-01T15:03:14.393164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:14.518626Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:14.518626Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:c7e672ae1dd67c61965f6021e2fc35f3fe74afa64e986091f6dc2f229087ef8d","observation_id":"11056abc-296a-457b-8cc2-c513d0e4ec7e","resolution":{"observed_at":"2026-08-01T15:03:14.518626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-75632-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bartocci, J","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","work_id":"4e9054cc-751e-41ca-9c74-e3ae5b82c142","year":2018},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:14.710041Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:b3482105a49f2435b64d390afa8e70ef004fe4aa0360d1568c8a7101dd343239","observation_id":"0f1b1abc-feda-4c32-bb6a-6c1252268461","resolution":{"observed_at":"2026-08-01T15:03:22.236544Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-01T15:03:12.566593Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:12.566593Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:229802725fd9b28fc44e8f31d779e03512fb0147212fe88b4bb003c46c763479","observation_id":"93b0719a-b900-475e-a8c6-a04940a6e1b7","resolution":{"observed_at":"2026-08-01T15:03:12.566593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15549","last_updated":"2024-10-21T00:36:02Z","snapshot_observed_at":"2026-08-07T13:57:47.043583Z","submitted_at":"2024-10-21T00:36:02Z","title":"A Dual Process VLA: Efficient Robotic Manipulation Leveraging VLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15549","snapshot_observed_at":"2026-08-01T15:03:11.534813Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:11.534813Z"},"links":{"cited_paper":"/paper/2410.15549","citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:d5593f747943d5d307aa87ba893c6640eefddc99b3af1b97ebfe11605ea31588","observation_id":"9b47f653-f786-4400-b933-97937f772eae","resolution":{"observed_at":"2026-08-01T15:03:11.534813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:03:13.950854Z","title":"doi:10.1109/lra.2025.3588389","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T15:03:13.950854Z"},"links":{"citing_paper":"/paper/2607.18580"},"observation_digest":"sha256:a469b9f308255e23b5e186e3ba5633c563ea43865c8b81e15ec234e6f1366988","observation_id":"962c64ca-ea26-4204-9539-bd106d5a4e2f","resolution":{"observed_at":"2026-08-01T15:03:13.950854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18580","last_updated":"2026-07-20T23:26:32Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T13:58:14.804380Z","submitted_at":"2026-07-20T23:26:32Z","title":"STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2607.18580."}