{"as_of":"2026-08-09T02:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3c32bef5ddaf8a3d1111bdd1a77f4173ce21b269f63160957fc54cc779d78f0","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:57:50.043630Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05333/citation-record","integrity":"/paper/2509.05333/integrity","json":"/paper/2509.05333/citation-record.json","paper":"/paper/2509.05333"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.02524","last_updated":"2024-02-01T22:06:51Z","snapshot_observed_at":"2026-07-06T17:11:46.822922Z","submitted_at":"2024-01-04T20:23:51Z","title":"Comprehensive Exploration of Synthetic Data Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02524","snapshot_observed_at":"2026-08-05T12:57:49.932433Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.932433Z"},"links":{"cited_paper":"/paper/2401.02524","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:8e206f1db8b8f4dc8b248a9bc44bd68b4b3ee9f0068cff8d80b3ee72bb810e11","observation_id":"a9cb7832-0809-4b8f-a89b-47c88582f113","resolution":{"observed_at":"2026-08-05T12:57:49.932433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-07-06T21:44:22.901650Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-05T12:57:49.936216Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.936216Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:7bfbfca4746c11e3f687ab33f34e30b0e3c8794a2ae77e7f31f9aa0f2d8cb053","observation_id":"069d9977-c186-493b-86b3-33b791266ae6","resolution":{"observed_at":"2026-08-05T12:57:49.936216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.404208Z","title":null,"venue":null,"work_id":"85e25ff1-480a-4fab-b907-382314531efa","year":2020},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.939661Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:46a88049868111ab7c969b9c1f5f0bfb17fa19fb69aa0fa31ee2488f1d566f78","observation_id":"e0011386-8ae1-4aac-933b-4eca585abc40","resolution":{"observed_at":"2026-08-05T12:57:50.407109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-05T12:57:49.943388Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.943388Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:8c67878fe01791fcd2500bd1a1f09aeb708107bde2b218481ef5c86677251423","observation_id":"c62b17c4-81a9-43fd-884c-47acded4c33f","resolution":{"observed_at":"2026-08-05T12:57:49.943388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-05T12:57:49.946863Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.946863Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:55285c4572777a6e37a0110595107f34bc6defb47da506cab0b6ca9b2d491794","observation_id":"feb77488-855d-47d3-b5b5-32216d3995c5","resolution":{"observed_at":"2026-08-05T12:57:49.946863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-05T12:57:49.950164Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.950164Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:5ec7dd1f375d1931ca1d96efab652ea9424d8534f5b38a5e968e6abd95be15b0","observation_id":"fcf66b6d-d4eb-4f60-a4e3-2dc58c49a832","resolution":{"observed_at":"2026-08-05T12:57:49.950164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.396004Z","title":null,"venue":null,"work_id":"8f3ed02e-e24d-4cf5-aa38-4bdaf12dedbe","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.953434Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:0b1113341b63a94e7161ff43ff3ce5895722f3b0050589644d8f58335be9045a","observation_id":"00e74be6-12ec-43f5-a9c8-d9c1a1b407ec","resolution":{"observed_at":"2026-08-05T12:57:50.398791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.387263Z","title":"V.; Williams, C","venue":null,"work_id":"19b66e3d-7feb-4198-8c0d-fb694d157968","year":2010},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.956374Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:bc77a911ffed63e80bb3dae6a2dc79768cac878d812d6d94238ee5a3b75af167","observation_id":"ba6a7179-9bec-46a2-89a2-4fbe1624debb","resolution":{"observed_at":"2026-08-05T12:57:50.390233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.378603Z","title":null,"venue":null,"work_id":"c6dfea9e-bf43-4728-a371-ee43547e9d8a","year":2016},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.959140Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:e2c60407d68e2388b2202de959acd3600db8f2e4d3e254bc62e9cdb02122df54","observation_id":"2e6e5224-cb7e-4522-a04c-465c38858d5f","resolution":{"observed_at":"2026-08-05T12:57:50.381644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12740","last_updated":"2022-05-25T12:46:21Z","snapshot_observed_at":"2026-07-06T13:13:51.722554Z","submitted_at":"2022-05-25T12:46:21Z","title":"SIoU Loss: More Powerful Learning for Bounding Box Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12740","snapshot_observed_at":"2026-08-05T12:57:49.961961Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.961961Z"},"links":{"cited_paper":"/paper/2205.12740","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:3178bf3a24de6a24fffa00b2228cdc650269b1f6b8dfeac549cde898291fc500","observation_id":"903e82d3-1963-411a-bdf9-0fd72d47f791","resolution":{"observed_at":"2026-08-05T12:57:49.961961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T12:57:49.965062Z","title":"H.; de Wit, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.965062Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:bcd9cf5ae1966c6c7cbdfdedfb6fddada7e8996349865bcff103a36f18d57041","observation_id":"7e648f74-b7d8-45a9-8dd8-9ec0b2cce9b0","resolution":{"observed_at":"2026-08-05T12:57:49.965062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.370485Z","title":null,"venue":null,"work_id":"eb2327d8-98b2-4fff-86e6-cf69f7c62811","year":2019},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.968714Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:369a32195ffd4e1d1d9ab0833afbc0e08f40ac3d4366a6f744f7fd568549e5a6","observation_id":"974c6768-4e22-4c69-bbe5-e85489ab2292","resolution":{"observed_at":"2026-08-05T12:57:50.373182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.361476Z","title":null,"venue":null,"work_id":"a234892e-d1a9-4dc4-97b4-72109dbe178e","year":2021},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.971449Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:144acbed081baafcf35e99f86af1625f33d8e4708404b0986ea8945e53f48f46","observation_id":"fd89def3-5cdd-4101-b04c-8723e734b8ed","resolution":{"observed_at":"2026-08-05T12:57:50.364556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.353011Z","title":"D.; Gesmundo, A.; Attariyan, M.; and Gelly, S","venue":null,"work_id":"958620cf-d19c-4f82-bb55-3d45d7bd7690","year":2019},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.974236Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:56e40a3de06c2b9d9c8b885266c8c8b18f3f27c2c69928fc05aea9670028c17d","observation_id":"b5c885dc-ff38-47a2-9c7f-aca8799df3ef","resolution":{"observed_at":"2026-08-05T12:57:50.355842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.344325Z","title":null,"venue":null,"work_id":"9d853255-93c3-46a3-ae4d-69ae34a8e21a","year":2012},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.976986Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:4ff6c04c12e4171b872035f07b53cd355747b3f30f3e040eb7d3e98bd087437d","observation_id":"fc15d74a-015b-4e5e-ac10-4d73555f98b6","resolution":{"observed_at":"2026-08-05T12:57:50.347195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.335359Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":"3257b3e9-f41b-4f53-b14c-9550b8d23dac","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.979613Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:7956be99d0979755d699595e652d9692c23b71c5bad964e6fba36882b9767948","observation_id":"f3d31dc5-8998-47e6-aa88-4c6f6edd3ef3","resolution":{"observed_at":"2026-08-05T12:57:50.338460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.326765Z","title":"H.; Zhang, P.; Zhang, H.; Yang, J.; Li, C.; Zhong, Y.; Wang, L.; Yuan, L.; Zhang, L.; Hwang, J.-H.; and Gao, J","venue":null,"work_id":"78dcda57-eab4-4cdc-a334-ee0611816bf1","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.982278Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:a54c56b2e4fbc29d8ab75b963d5352c4d30af975295eb532dd728d099ad2a5ac","observation_id":"bbbde29e-b1ff-4171-9594-26fbe585d450","resolution":{"observed_at":"2026-08-05T12:57:50.329692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.318473Z","title":null,"venue":null,"work_id":"4528769a-78d7-46ed-8fd1-6b1ac93691f3","year":2020},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.984977Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:bd527aa01ed0658bc7bdf8ce0d4ab2d49d2c16c478db5d3d10c6d780734cda56","observation_id":"5b678613-6200-4975-9205-13080c3c1ed8","resolution":{"observed_at":"2026-08-05T12:57:50.321359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.310053Z","title":null,"venue":null,"work_id":"e8cb2cea-e2ad-4079-888c-e02f3bc62177","year":2017},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.987763Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:c4f1df1ea04cc981f1e1f7fe9659c65523defe3ec841488b00975f23537a33dd","observation_id":"febfe0e4-208b-4c24-8ee5-f79714228d92","resolution":{"observed_at":"2026-08-05T12:57:50.312697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.301616Z","title":null,"venue":null,"work_id":"5c8730f6-5d9d-422a-97bf-c6ee6f08da22","year":2014},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.990909Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:1d375c9c744d26fb3654c3547d8c0ffa364a1e0eb9dedf70a851a6f47d87365d","observation_id":"d33ac3c9-822f-47cd-b915-7e88e0fdedbe","resolution":{"observed_at":"2026-08-05T12:57:50.304358Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.292324Z","title":null,"venue":null,"work_id":"5511f85e-2b4d-4335-a67a-bc235ab0d5dd","year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.993538Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:7c7104d4418c552be55b4cbd73c706082c5bd8c68421be8700134ce84d34ac41","observation_id":"e0daeb7a-0fac-480a-8019-9551f71e8aec","resolution":{"observed_at":"2026-08-05T12:57:50.295450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-05T12:57:49.996179Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.996179Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:ed4112e6faa849a1fae672e749cfd7ba72fb41dd740be73fd3b88c51d0d39403","observation_id":"3623ce49-775a-4d5e-a774-1a04e89016d1","resolution":{"observed_at":"2026-08-05T12:57:49.996179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.283398Z","title":"P.; Gupta, S.; Yazdanbakhsh, A.; and Clark, P","venue":null,"work_id":"fa4e2490-80a7-4c16-873a-38c785f45efd","year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:49.998889Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:80440998c1ef3e59355902accf9891d8934b0ff8b6708f0c840d5c6b68803e84","observation_id":"fa91769f-ad0b-4ee4-b4d3-2f4d2c9f3747","resolution":{"observed_at":"2026-08-05T12:57:50.286762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.275013Z","title":null,"venue":null,"work_id":"a767e208-95c8-42d9-aeb3-25c4a451d567","year":2002},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.001658Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:81bacad9e61d479b30b0ad49551d157a2ffa764f28c0d25a6f02157317f5193c","observation_id":"0db3b4c5-137c-407f-98cb-fa592f189cae","resolution":{"observed_at":"2026-08-05T12:57:50.277912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.266544Z","title":"A.; Wang, L.; Cervantes, C","venue":null,"work_id":"fbe8c300-670c-4dd4-8181-a9d800a60453","year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.004503Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:652189523d6b82a067bac4c59d80113aacd9b201eb585b1f2acebf4043ada4c0","observation_id":"f5608100-2cf7-402e-9dfb-40c81ab30eb7","resolution":{"observed_at":"2026-08-05T12:57:50.269345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.256555Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":"5aeb4348-325d-42a8-acb5-b562cd408e9a","year":2021},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.007374Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:917a907a2810f7da8467862f7f7a5ab54801ee7df11a2b96103a32beeee3b505","observation_id":"c6067edf-571e-4a21-a93a-ff8f449932e9","resolution":{"observed_at":"2026-08-05T12:57:50.260662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.247657Z","title":null,"venue":null,"work_id":"988521fd-4eec-4b4f-948e-710eb9a4efcc","year":2016},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.010060Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:d6f90aad5467a628a555424c5b17c042a199b381dfbfbe16f8aa4a9d54aaea2f","observation_id":"d8946a98-7f49-48ee-b1ac-3dd646110ac6","resolution":{"observed_at":"2026-08-05T12:57:50.250612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.238833Z","title":null,"venue":null,"work_id":"33960e71-cace-4c85-99b5-d152bd80dd2c","year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.012968Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:d59c2576697f5b761ae650699bb4a7650635ab84b6dcc84f7e973b830aed5fcd","observation_id":"4e74eaaf-38fa-413c-bec6-0f521b2b2dae","resolution":{"observed_at":"2026-08-05T12:57:50.241667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.230249Z","title":null,"venue":null,"work_id":"14f65362-1a3c-4186-a0c2-5bc35179dc46","year":2000},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.015601Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:259a764ae71a74ecdf64c3aabfc5a33db44f0b7fb3afb4138466b761177b97ce","observation_id":"0b1ec3a6-76e0-41da-826b-6ec0dae7de72","resolution":{"observed_at":"2026-08-05T12:57:50.233111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12524","last_updated":"2025-02-18T04:20:14Z","snapshot_observed_at":"2026-07-06T20:38:20.545914Z","submitted_at":"2025-02-18T04:20:14Z","title":"YOLOv12: Attention-Centric Real-Time Object Detectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12524","snapshot_observed_at":"2026-08-05T12:57:50.018357Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.018357Z"},"links":{"cited_paper":"/paper/2502.12524","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:462bf929683fea5105b2e8c414aa378c465674d1ec414f68ce661ff0b6780798","observation_id":"f5723c00-55b2-472a-a5d5-b736346a5e27","resolution":{"observed_at":"2026-08-05T12:57:50.018357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.220750Z","title":null,"venue":null,"work_id":"2c1ff1af-e200-4c1a-be59-b396860511d1","year":1979},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.021455Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:2efd9152120747844c0cf5fafd80d92ebab7e6ad6684ecf652d3f51b0b635bea","observation_id":"c02d1aeb-1f7a-4742-82bb-e9a20f45e119","resolution":{"observed_at":"2026-08-05T12:57:50.224074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.211186Z","title":"L.; and Parikh, D","venue":null,"work_id":"cd07ea3e-18d8-4160-9a60-283f0ab869d1","year":2015},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.024170Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:997401f2a8d149b0dc41729a7407f26561caf9b23d0b77ceefee0d6cea0ee25b","observation_id":"493e68d7-0132-4c6c-bb78-9870002fc4e9","resolution":{"observed_at":"2026-08-05T12:57:50.214251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.201616Z","title":null,"venue":null,"work_id":"15a269df-75d8-44dd-ba8b-2b17f74eb70e","year":2020},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.027049Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:4313aec527017e8c7ce48a484c0de40923c5cc6b8762b2b661df19b12df3a6c9","observation_id":"b16a4f94-cb9d-4a24-9235-83d5c27cdc6f","resolution":{"observed_at":"2026-08-05T12:57:50.204763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06024","last_updated":"2024-09-14T21:47:21Z","snapshot_observed_at":"2026-07-06T15:25:28.320467Z","submitted_at":"2023-05-10T10:19:31Z","title":"A Survey on the Robustness of Computer Vision Models against Common Corruptions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06024","snapshot_observed_at":"2026-08-05T12:57:50.029553Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.029553Z"},"links":{"cited_paper":"/paper/2305.06024","citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:5e67c024bfae05147c9b4dfa24e7c95e4333e8c16a6bb4f4764573250efed39e","observation_id":"8839ae85-9f93-4934-a8f1-0e3938841847","resolution":{"observed_at":"2026-08-05T12:57:50.029553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.191723Z","title":null,"venue":null,"work_id":"28d1c6b9-d74a-4005-b1f9-dce4297387ec","year":2022},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.032638Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:19b34ce097a2bbac34bc47ac7de95f2401e85eea5672050d995f840c994302db","observation_id":"777d05b0-e4d6-4c86-91c4-afc9085c1317","resolution":{"observed_at":"2026-08-05T12:57:50.194746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.182674Z","title":"B.; Su, H.; Mottaghi, R.; Guibas, L.; and Savarese, S","venue":null,"work_id":"a40a614e-3bbc-48ae-b174-824d3c8b8772","year":2016},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.035476Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:a2dce4f6628d8652ddd15c1e8ed88424440c70d36c1270a2e5cf0366f8f1d198","observation_id":"8fde0c18-c56b-4565-b7c1-42da6660c414","resolution":{"observed_at":"2026-08-05T12:57:50.185557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.172031Z","title":null,"venue":null,"work_id":"8275b29f-74b2-45c9-9439-e812246aff97","year":2014},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.038184Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:edcc2e50f491eefffd0a6ce6334ef15e7b24b1445a0fa2a330b21ae6de49cce4","observation_id":"62f35f80-48be-40fe-a891-3f8212fd7e74","resolution":{"observed_at":"2026-08-05T12:57:50.176176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.040779Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.040779Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:df9e76cc950a6c47df089b48a66aee207f0c397524dc3246167787fddaaa7cdc","observation_id":"cd2b7515-09d4-40bc-a0d1-0ea44af0365c","resolution":{"observed_at":"2026-08-05T12:57:50.040779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:57:50.043630Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T12:57:50.043630Z"},"links":{"citing_paper":"/paper/2509.05333"},"observation_digest":"sha256:95b62b2895cc1b292224fd46f17ecfc272fb348b109eac9cd4717c26af94e3ea","observation_id":"6ee52ded-9dfc-411f-b851-06bbab47848a","resolution":{"observed_at":"2026-08-05T12:57:50.043630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.05333","last_updated":"2025-09-01T02:13:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T12:57:46.958193Z","submitted_at":"2025-09-01T02:13:00Z","title":"RT-VLM: Re-Thinking Vision Language Model with 4-Clues for Real-World Object Recognition Robustness"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2509.05333."}