{"as_of":"2026-08-11T05:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf5672dcef1ea11518b04e3491a6fad6c066e03704ac7c6fd5566a8054102342","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T22:09:40.738075Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.18880/citation-record","integrity":"/paper/2501.18880/integrity","json":"/paper/2501.18880/citation-record.json","paper":"/paper/2501.18880"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.514502Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.514502Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:c99491fba58ccc48821d83bdbc57b42f28de911f02a567ba0d5176eb79b3c0c7","observation_id":"de3fed06-c367-43de-a994-64f42b9bf650","resolution":{"observed_at":"2026-08-09T22:09:40.514502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.399295Z","title":"Ash, Chicheng Zhang, Akshay Krishnamurthy, John Langford, and Alekh Agarwal","venue":null,"work_id":"cd0743ae-1e8d-4785-bfff-532296320c26","year":2020},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.520700Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:2598b88599d82f077ddffeb5d852a32647fd5602680282a8720ef69def8ac76d","observation_id":"0cfbb13a-06fc-4685-934d-294fed8ac83f","resolution":{"observed_at":"2026-08-09T22:09:42.436367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.321148Z","title":null,"venue":null,"work_id":"c81f6113-e151-42c0-94bb-30337d130512","year":2023},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.525642Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:b3282bc9798e4ef6ab71d2676a1b2a835998759a016b223f8c4849fc8c344172","observation_id":"ce6917bb-7263-46dc-b14f-d61b1c222ec3","resolution":{"observed_at":"2026-08-09T22:09:42.351689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-09T22:09:40.530847Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.530847Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:1106697afd6ad59361d020a148df3a86639dcca64725d3da1a96a880e937083c","observation_id":"e2ddf588-9775-443a-b975-5da9d2965dfe","resolution":{"observed_at":"2026-08-09T22:09:40.530847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-09T22:09:40.536506Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.536506Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:c589a2cbae92554151241679b01d01a590b85a66da2df2d09412382c05707637","observation_id":"13d8f59e-8a72-40ec-8128-f08d57cc98cc","resolution":{"observed_at":"2026-08-09T22:09:40.536506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.303776Z","title":null,"venue":null,"work_id":"0fee8980-b74a-4e09-8948-67333804b221","year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.542593Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:0fecc308346238bd233cf7d6749cb6fb941ef13a60ab595131d46e20f2ae6528","observation_id":"10ad32f0-5b1d-4f62-abb3-915f5de1249b","resolution":{"observed_at":"2026-08-09T22:09:42.308993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.283959Z","title":null,"venue":null,"work_id":"023db2e1-3f17-46ee-a555-8da42e17af7b","year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.548417Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:246dcd1f9b28b26a2c6faf7b636685d766403d7b009381119b39e2062dc2df44","observation_id":"587a9522-296c-461a-8124-a3999261de9a","resolution":{"observed_at":"2026-08-09T22:09:42.289739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.266394Z","title":null,"venue":null,"work_id":"72fa8b2c-9a24-4627-9a97-e5a000d4faf2","year":2017},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.554026Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:00b6de71e1604f33efe35147961ac52df5cac20337dbf5614cc2406ba3f5e456","observation_id":"c40cb96f-e682-4694-9bdb-48e7ddcb94eb","resolution":{"observed_at":"2026-08-09T22:09:42.271684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.246298Z","title":null,"venue":null,"work_id":"ea3f38aa-d7f5-4bdf-a242-9920d132b6a2","year":2017},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.559397Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:01929c4368c8a628db4b6e97f2f61022ca8f351c292bc409caa207876950c5ff","observation_id":"75f69ebc-beaf-4c39-b67b-acbf43599410","resolution":{"observed_at":"2026-08-09T22:09:42.252930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02561","last_updated":"2024-03-03T08:12:36Z","snapshot_observed_at":"2026-07-06T16:14:56.479402Z","submitted_at":"2023-09-05T20:21:03Z","title":"Physically Grounded Vision-Language Models for Robotic Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02561","snapshot_observed_at":"2026-08-09T22:09:40.564525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.564525Z"},"links":{"cited_paper":"/paper/2309.02561","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:c06340e235d96d9e07973faad4714a1b7a36bd13cdc460539250cbed23276cc5","observation_id":"2064c73e-c4e2-4bee-a8b1-9a30c133e8ec","resolution":{"observed_at":"2026-08-09T22:09:40.564525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.575218Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.575218Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:18afc479ef728d639ffbb3e478f87506606df3113ebcbc622c3b431a496d5d1d","observation_id":"a775237c-77e4-43fd-8d2b-4dec53b725b7","resolution":{"observed_at":"2026-08-09T22:09:40.575218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:41.867934Z","title":"Zahid Hasan, Jiajing Chen, Jiyang Wang, Mohammed Shaiqur Rahman, Ameya Joshi, Senem Velipasalar, Chinmay Hegde, Anuj Sharma, and Soumik Sarkar","venue":null,"work_id":"a524c14e-53d3-43d8-a04c-ec1a036f58ef","year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.579690Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:361474d38dcdfb9cbc7d17df16233fa4f88a6cf58423414caa80adc98f3b406c","observation_id":"79054ad6-3009-437f-8d27-06307751050b","resolution":{"observed_at":"2026-08-09T22:09:41.873510Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.584663Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.584663Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:638cb12208391cf7f407afe91c134613b2249e4049c9355e6b878afeaa83f778","observation_id":"a570b44f-3883-41c2-9c0a-6b86bab3edeb","resolution":{"observed_at":"2026-08-09T22:09:40.584663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.595433Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.595433Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:c3ee5df4ad88ec7d0d40c00e6f9ac0dde18673a3b71773a69e69446a8ba8a449","observation_id":"8c27f7b1-4c15-4220-82cc-8270aec56621","resolution":{"observed_at":"2026-08-09T22:09:40.595433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02627","last_updated":"2020-05-06T17:59:11Z","snapshot_observed_at":"2026-08-09T11:59:19.022308Z","submitted_at":"2018-09-07T18:13:25Z","title":"Unity: A General Platform for Intelligent Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02627","snapshot_observed_at":"2026-08-09T22:09:40.601188Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.601188Z"},"links":{"cited_paper":"/paper/1809.02627","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:bdae01064d3bb58a77b5c4d1dcfefd8666bae8f289feb667d5d5cdb0ed311d83","observation_id":"9d6dc674-c2d9-4982-a453-fcaa5af1022f","resolution":{"observed_at":"2026-08-09T22:09:40.601188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.607012Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.607012Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:de9cad3b2c24ce1bdab4a15cc73f6ee0e4d8e7592cc29c81253d25305dc34a09","observation_id":"cb8cb14b-4c45-4b75-b12f-4a93b0aa75ac","resolution":{"observed_at":"2026-08-09T22:09:40.607012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/14759217221150376","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Structural Health Monitoring","work_id":"190adb54-712f-4e81-ada1-8bdb9a1d96a7","year":2023},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.611956Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:15b6d665893555e69364b58d211015a826cc540695afbe7ec29a9e03d15223c4","observation_id":"e12b3adb-4106-4ca3-b6c8-baee845dd29f","resolution":{"observed_at":"2026-08-09T22:09:40.793006Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:41.646653Z","title":null,"venue":null,"work_id":"ac6eb736-1ca1-4c86-9c24-f6d36dbfe072","year":2022},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.617882Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:744c6fb4b4972b7274957e706e58d7d70532b3de337771c39ad3f5b902c21710","observation_id":"7835c526-878b-4776-8627-94c9b8eba80c","resolution":{"observed_at":"2026-08-09T22:09:41.651804Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15228","last_updated":"2024-08-24T03:51:44Z","snapshot_observed_at":"2026-08-11T04:09:57.462214Z","submitted_at":"2024-04-23T16:59:02Z","title":"Re-Thinking Inverse Graphics With Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15228","snapshot_observed_at":"2026-08-09T22:09:40.622742Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.622742Z"},"links":{"cited_paper":"/paper/2404.15228","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:306d8189bd63d7d1b45e92a2346ef7639a9210661fdd4de8ccb3d18a76939e86","observation_id":"00aff4be-1dd1-4cb9-b1e3-103d6b220d2c","resolution":{"observed_at":"2026-08-09T22:09:40.622742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-09T22:09:40.627623Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.627623Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:a9bc6fddbe85b239b6665cce4e13125aba1ef42cc2bfb8e6f466f6cfb8b9987c","observation_id":"eca4d9dd-b8b6-4138-96d8-23b80e962e9d","resolution":{"observed_at":"2026-08-09T22:09:40.627623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-09T22:09:40.633127Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.633127Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:282a933212ff4df150bb0ebdee21c0782f246e112df366ff21554de9ac2714ec","observation_id":"6606cd35-c758-4480-aa4c-56202f079c4d","resolution":{"observed_at":"2026-08-09T22:09:40.633127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08967","last_updated":"2024-12-13T04:44:11Z","snapshot_observed_at":"2026-08-10T22:26:40.697702Z","submitted_at":"2024-01-17T04:43:21Z","title":"ReFT: Reasoning with Reinforced Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08967","snapshot_observed_at":"2026-08-09T22:09:40.638196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.638196Z"},"links":{"cited_paper":"/paper/2401.08967","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:d497a71c024db33c52677728d226a56d7bf5213211cea7200a3de94878d40070","observation_id":"3d6c17ff-4ef0-461f-8d0e-1a695620c4ba","resolution":{"observed_at":"2026-08-09T22:09:40.638196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10055-019-00399-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Virtual Reality","work_id":"dd105bdf-9799-47d5-aa71-86a0767ef691","year":2020},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.643230Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:4a98d85fe2283395f9c083d3b7cc2966022672f096df2ce7581e3b8cf0909560","observation_id":"f1819311-eadd-425b-8b72-22515561f45e","resolution":{"observed_at":"2026-08-09T22:09:40.776690Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.647722Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.647722Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:e9d03494e2dc96dbf0195471ea6ad157da2352665bcf728f237bc7071831ca2b","observation_id":"279b4513-b517-45ca-a037-46b93502800d","resolution":{"observed_at":"2026-08-09T22:09:40.647722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.652483Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.652483Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:9c15224a568db11eacf0974a029a4c7dd5164f987ec727489999b236e36bf94c","observation_id":"a030b979-4d68-4e03-8bfc-34af25a48469","resolution":{"observed_at":"2026-08-09T22:09:40.652483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:40.662974Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.662974Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:6a3f4a48b8f19ed41df4fe43bf7392eec85bb309bee3ddd25049bf1e0089f21a","observation_id":"0667e12e-b076-48bd-bfd8-a9ed4736e42b","resolution":{"observed_at":"2026-08-09T22:09:40.662974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.00236","last_updated":"2021-12-05T22:20:32Z","snapshot_observed_at":"2026-07-06T09:51:44.763077Z","submitted_at":"2020-08-30T04:28:31Z","title":"A Survey of Deep Active Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.00236","snapshot_observed_at":"2026-08-09T22:09:40.668196Z","title":"Gupta, Xiaojiang Chen, and Xin Wang","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.668196Z"},"links":{"cited_paper":"/paper/2009.00236","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:76b4a89a07a6b325d36c21a3e2e818f7643ba9d157073dd3eb711b4ed557db0b","observation_id":"a369790b-103a-41ef-a243-aae1bcd63d17","resolution":{"observed_at":"2026-08-09T22:09:40.668196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03275","last_updated":"2023-12-06T04:02:28Z","snapshot_observed_at":"2026-08-08T06:32:05.983146Z","submitted_at":"2023-12-06T04:02:28Z","title":"VLFM: Vision-Language Frontier Maps for Zero-Shot Semantic Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03275","snapshot_observed_at":"2026-08-09T22:09:40.673725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.673725Z"},"links":{"cited_paper":"/paper/2312.03275","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:d953d917d200c401fad761640558191671a118ed74085e71d95cbe9f2935c4ec","observation_id":"0a51abdb-b03a-45aa-b2eb-2c767d7e2247","resolution":{"observed_at":"2026-08-09T22:09:40.673725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-09T22:09:40.679213Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.679213Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:9879c848d930ab45f6fcce01aa7a6db64f2ab21419ef4766d6ee419c8861b51a","observation_id":"184bef16-7f46-4ab5-94a6-9f0974e6eb1a","resolution":{"observed_at":"2026-08-09T22:09:40.679213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.080386Z","title":null,"venue":null,"work_id":"1df09d6e-5a75-43e8-afde-7b24dd2767a7","year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.684911Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:62ddd8e28bca490a8ef5697a9c1315b2adeb0820e2bc9c310967d08b6db23ca6","observation_id":"4181fd91-b2a0-42c3-9f62-70d8beb7773c","resolution":{"observed_at":"2026-08-09T22:09:42.090751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.061250Z","title":null,"venue":null,"work_id":"3c8f0539-7075-4c05-8603-959f3ddcfc88","year":2018},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.690428Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:78cdf2890723731a542e20ddf76627ba1b67f35db455b82febc6e70eafa5b818","observation_id":"2db77c9d-41e6-4f7f-93fa-85a5547657a5","resolution":{"observed_at":"2026-08-09T22:09:42.067000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.025155Z","title":"2022.Unity","venue":null,"work_id":"dbec9920-45a0-42c6-9b67-f3841378c47c","year":2022},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.695363Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:574fa2df9c564d7229a2c79a9ce949cf2034c103da5d6cb6df53e4bc495d38b1","observation_id":"861e4fd5-b28d-4d62-9daa-34b85176af7a","resolution":{"observed_at":"2026-08-09T22:09:42.037308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03381","last_updated":"2023-09-06T21:58:58Z","snapshot_observed_at":"2026-07-06T16:15:31.848927Z","submitted_at":"2023-09-06T21:58:58Z","title":"Active shooter detection and robust tracking utilizing supplemental synthetic data","version":1},"cited_work":{"arxiv_id":"2309.03381","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.03381","snapshot_observed_at":"2026-08-09T22:09:41.319708Z","title":"Active shooter detection and robust tracking utilizing supplemental synthetic data","venue":"cs.CV","work_id":"a277e9b7-9159-4d38-9516-49d64ed5b4ca","year":2023},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.700923Z"},"links":{"cited_paper":"/paper/2309.03381","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:b7cdcfae9636e890dec287b33f9b483e389609013d5e353dec73fabd0ecdbfa9","observation_id":"99d8f9f7-4635-4950-9e2f-4b41725b0491","resolution":{"observed_at":"2026-08-09T22:09:41.325350Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:42.000340Z","title":null,"venue":null,"work_id":"e92f0fd1-4eca-445f-ac77-2497e2598721","year":2023},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.706296Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:9a061fe0de782006551a923d97924d48cf46074c6bfe6db247d6194c98c81c68","observation_id":"a3a8a757-4023-4492-8e43-b5ee0d251d48","resolution":{"observed_at":"2026-08-09T22:09:42.006382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19062","last_updated":"2024-09-19T04:05:36Z","snapshot_observed_at":"2026-07-06T17:52:18.041492Z","submitted_at":"2024-03-27T23:59:23Z","title":"GENESIS-RL: GEnerating Natural Edge-cases with Systematic Integration of Safety considerations and Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2403.19062","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.19062","snapshot_observed_at":"2026-08-09T22:09:41.295065Z","title":"GENESIS-RL: GEnerating Natural Edge-cases with Systematic Integration of Safety considerations and Reinforcement Learning","venue":"eess.SY","work_id":"bf483049-7807-4d79-b291-8059cf44f005","year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.711217Z"},"links":{"cited_paper":"/paper/2403.19062","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:1713fcdb5c2c231fac7d8ba475abfe6bd4d73b6988a00f33c1eb84d7596a014b","observation_id":"3ed4f953-c9f3-47ec-9735-d63b93fa5540","resolution":{"observed_at":"2026-08-09T22:09:41.301858Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:41.980484Z","title":null,"venue":null,"work_id":"bb5418fe-d2f1-46fa-99f9-015f19982c73","year":2019},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.716935Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:fef336469a2f9a71dc66363f870bd95e250c6276583725b5b0fb3bf227d585c2","observation_id":"ffff8f40-1c8e-40a4-8cda-36a000e9836c","resolution":{"observed_at":"2026-08-09T22:09:41.985759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:41.963239Z","title":null,"venue":null,"work_id":"add101dd-a52a-467c-8405-5b05d0af18f0","year":2023},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.722524Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:26ec0460d5c23781da515775d2c1f386a561e1b319aeaf400c02c7bdeadd0433","observation_id":"0cc4c80b-08ad-4cc2-ab9a-6f6f5bf717a4","resolution":{"observed_at":"2026-08-09T22:09:41.968533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10292","last_updated":"2024-10-07T19:13:47Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:50:19Z","title":"Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10292","snapshot_observed_at":"2026-08-09T22:09:40.727564Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.727564Z"},"links":{"cited_paper":"/paper/2405.10292","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:27ecf6f592e2111bcffd8b48496a129c5888b57fa660acf9388ef85a7610cf07","observation_id":"2c5a9231-ac47-4a73-8c04-215769c5d976","resolution":{"observed_at":"2026-08-09T22:09:40.727564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:41.252056Z","title":null,"venue":null,"work_id":"ef866b2f-9f3b-4392-aeb5-d085b931efbe","year":2020},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.733078Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:6e4700fa414699dd2c7202c50dd7c9429143990a3259cfaf9ff38c957cefdc15","observation_id":"bddde0f6-bafa-4d4b-88b1-92ed8b8b382b","resolution":{"observed_at":"2026-08-09T22:09:41.257306Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:09:41.060799Z","title":null,"venue":null,"work_id":"e55fc26c-d146-4060-918c-787f6a6fc00a","year":2024},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.738075Z"},"links":{"citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:307aef0874e6c75d901377d297f16d586d37a23ac1af6b2af223c49d42a971df","observation_id":"20fa3dd5-b67b-4ded-9972-f9526ddf9089","resolution":{"observed_at":"2026-08-09T22:09:41.065472Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1112.5745","last_updated":"2011-12-24T17:53:19Z","snapshot_observed_at":"2026-07-06T02:40:01.191970Z","submitted_at":"2011-12-24T17:53:19Z","title":"Bayesian Active Learning for Classification and Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1112.5745","snapshot_observed_at":"2026-08-09T22:09:40.590213Z","title":"arXiv:1112.5745 [stat.ML] https://arxiv.org/abs/1112.5745","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.590213Z"},"links":{"cited_paper":"/paper/1112.5745","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:7a301123355aa324db884ba9ac07a4eeb1e56bba772ea8b814e485a941fec4dc","observation_id":"12909de4-3f83-41ff-b2a6-ed1b848d4277","resolution":{"observed_at":"2026-08-09T22:09:40.590213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-09T22:09:40.657997Z","title":"arXiv preprint arXiv:2103.00020 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T22:09:40.657997Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2501.18880"},"observation_digest":"sha256:f92038a1b3cc14978f929e385a4ed546a1ad2a3d757e19204c167046f24d9c8e","observation_id":"c67f38fd-d960-4392-95d9-c9e5dc46e8a8","resolution":{"observed_at":"2026-08-09T22:09:40.657997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.18880","last_updated":"2025-01-31T04:30:42Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T22:03:52.783228Z","submitted_at":"2025-01-31T04:30:42Z","title":"RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":32,"verified_exact":7,"verified_fuzzy":2},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2501.18880."}