{"as_of":"2026-08-09T13:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f62ebe2390a83649b3c54b415086470ac2fb3abddf9395da9015cf9c6b3fd5ae","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:41:15.950528Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T10:27:02.358494Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-08-07T14:41:15.950528Z","title":"An open and comprehensive pipeline for unified object grounding and detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18015","last_updated":"2025-05-23T15:17:45Z","snapshot_observed_at":"2026-08-07T23:41:34.613590Z","submitted_at":"2025-05-23T15:17:45Z","title":"SemSegBench & DetecBench: Benchmarking Reliability and Generalization Beyond Classification","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:15.950528Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2505.18015"},"observation_digest":"sha256:e772a408ad03448105cec5d4bf678c90d389ebc4906d5ffe89affea69048ae59","observation_id":"4b86998f-e0b9-4839-8036-bb0f69105d49","resolution":{"observed_at":"2026-08-07T14:41:15.950528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-08-07T12:43:41.692788Z","title":"An open and comprehensive pipeline for unified object grounding and detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24025","last_updated":"2025-08-01T10:10:37Z","snapshot_observed_at":"2026-08-09T10:06:18.400948Z","submitted_at":"2025-05-29T21:58:06Z","title":"DINO-R1: Incentivizing Reasoning Capability in Vision Foundation Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:43:41.692788Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2505.24025"},"observation_digest":"sha256:b576bebaeccb9a5b3cc661f800d6949f93a9a6079602856527716d0a6ad4fe74","observation_id":"1efe85d8-c42e-4f8a-a403-3af50ae9eedf","resolution":{"observed_at":"2026-08-07T12:43:41.692788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-08-06T10:42:01.065564Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion.arXiv preprint arXiv:2401.02361, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23567","last_updated":"2025-09-05T15:41:13Z","snapshot_observed_at":"2026-08-08T01:12:00.953493Z","submitted_at":"2025-07-31T13:56:41Z","title":"3D-MOOD: Lifting 2D to 3D for Monocular Open-Set Object Detection","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T10:42:01.065564Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2507.23567"},"observation_digest":"sha256:e0ac9992fa98f570a6dd8aff436b9fe5dae2579435a297867b14ee333efe4daf","observation_id":"45e8d754-781f-409c-999e-6debc3a739d7","resolution":{"observed_at":"2026-08-06T10:42:01.065564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-08-04T10:18:44.680887Z","title":"Long-clip: Unlocking the long-text capability of clip","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.10921","last_updated":"2026-05-25T02:35:42Z","snapshot_observed_at":"2026-08-04T10:18:40.408381Z","submitted_at":"2025-10-13T02:32:07Z","title":"FG-CLIP 2: A Bilingual Fine-grained Vision-Language Alignment Model","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T10:18:44.680887Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2510.10921"},"observation_digest":"sha256:ed9bce57dd8b6895993db3ae93feb7553d20cfbd2500d830aa45904f2416c808","observation_id":"e99a1f33-3852-4387-84a7-c1421d2a9899","resolution":{"observed_at":"2026-08-04T10:18:44.680887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2512.06673","last_updated":"2026-05-09T07:46:05Z","snapshot_observed_at":"2026-07-06T22:37:59.340166Z","submitted_at":"2025-12-07T06:11:15Z","title":"Detector-Empowered Video Large Language Model for Efficient Spatio-Temporal Grounding","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-17T00:54:53.789523Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2512.06673"},"observation_digest":"sha256:98f70a91a8e244f1f2ed8fa4925773b619082201d68a48b64d0db5127d2dd353","observation_id":"5c190997-ec5f-41ba-b72f-d5d5304883e6","resolution":{"observed_at":"2026-05-17T00:58:46.594864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2601.19640","last_updated":"2026-04-08T15:46:26Z","snapshot_observed_at":"2026-07-06T22:43:12.468415Z","submitted_at":"2026-01-27T14:17:04Z","title":"Focus on What Really Matters in Low-Altitude Governance: A Management-Centric Multi-Modal Benchmark with Implicitly Coordinated Vision-Language Reasoning Framework","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T11:03:37.176829Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2601.19640"},"observation_digest":"sha256:2346a10d35172d6e719da9a1e9b436b547d9a2dfe8fc2c79a02e0a613849f23a","observation_id":"e88c9d94-71db-4dde-bb93-b8fa46b96bbd","resolution":{"observed_at":"2026-05-16T11:07:48.345220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2604.00503","last_updated":"2026-04-07T03:29:58Z","snapshot_observed_at":"2026-07-06T22:51:22.254518Z","submitted_at":"2026-04-01T05:36:47Z","title":"PET-DINO: Unifying Visual Cues into Grounding DINO with Prompt-Enriched Training","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T22:19:21.723963Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2604.00503"},"observation_digest":"sha256:144f19e746ac4a2c267904b0f42056ca53e60bf7c063dd1f2c4f367cd27a5ce8","observation_id":"7f335ee2-8af0-41d3-bc57-160cecb213a3","resolution":{"observed_at":"2026-05-13T22:23:21.416722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2604.03841","last_updated":"2026-04-04T19:45:25Z","snapshot_observed_at":"2026-07-06T22:52:57.182669Z","submitted_at":"2026-04-04T19:45:25Z","title":"Training a Student Expert via Semi-Supervised Foundation Model Distillation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T16:50:57.376622Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2604.03841"},"observation_digest":"sha256:92af2a29705f14b23bf3beae10dd2417a61ffc272a1c5c1484e53bb9c90c453c","observation_id":"540a292e-b921-46dc-a206-39bcb5603324","resolution":{"observed_at":"2026-05-13T16:53:00.102253Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2604.05393","last_updated":"2026-04-07T03:43:01Z","snapshot_observed_at":"2026-07-06T22:54:08.897942Z","submitted_at":"2026-04-07T03:43:01Z","title":"Beyond Semantic Search: Towards Referential Anchoring in Composed Image Retrieval","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T19:42:23.224746Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2604.05393"},"observation_digest":"sha256:b3516b1328500efb8dd7267ac3381225b4842db8760ab202653152acbc33019b","observation_id":"209b0ead-cc99-482c-8f98-a1d7eaf71716","resolution":{"observed_at":"2026-05-10T22:35:50.534296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2604.11998","last_updated":"2026-04-13T19:38:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T19:38:49Z","title":"The Second Challenge on Cross-Domain Few-Shot Object Detection at NTIRE 2026: Methods and Results","version":1},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-05-10T16:05:16.070144Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2604.11998"},"observation_digest":"sha256:a7fb4e58bb7a9b1175b84c6fb9a0e61608bf65d998f1c7ca49b5a5d462c0c230","observation_id":"463a44b0-acb2-4e75-b519-aeb67b593d8c","resolution":{"observed_at":"2026-05-11T09:21:00.707452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2604.14684","last_updated":"2026-05-26T13:10:47Z","snapshot_observed_at":"2026-07-12T20:05:14.844082Z","submitted_at":"2026-04-16T06:40:44Z","title":"DETR-ViP: Detection Transformer with Robust Discriminative Visual Prompts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T12:07:21.203513Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2604.14684"},"observation_digest":"sha256:d9261b87407e67e9917588ffb431a152eb7a886c2dc2151ecb3a5a4f717b68ab","observation_id":"2f0e812a-c15e-440b-9b25-eca914c50af2","resolution":{"observed_at":"2026-05-10T12:10:21.951732Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-12T20:05:20.702092Z","title":"Con- trastive learning of medical visual representations from paired images and text","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.14684","last_updated":"2026-05-26T13:10:47Z","snapshot_observed_at":"2026-07-12T20:05:14.844082Z","submitted_at":"2026-04-16T06:40:44Z","title":"DETR-ViP: Detection Transformer with Robust Discriminative Visual Prompts","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T20:05:20.702092Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2604.14684"},"observation_digest":"sha256:f2917c6c2ecf3767812eae270b101b3517b863a644cec9d3a3a23305b41937e3","observation_id":"f9b45074-bd74-46d8-9c0b-962acfd60426","resolution":{"observed_at":"2026-07-12T20:05:20.702092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2605.03456","last_updated":"2026-05-09T04:48:21Z","snapshot_observed_at":"2026-08-05T18:06:31.983558Z","submitted_at":"2026-05-05T07:44:03Z","title":"VL-SAM-v3: Memory-Guided Visual Priors for Open-World Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T01:24:56.236650Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2605.03456"},"observation_digest":"sha256:85bfc8bccb9a6df2d1b99db0f318b410cf0497c15728f9c0bce5504d9d4c1697","observation_id":"1cd0ed13-1760-4394-8ae9-705145babb7e","resolution":{"observed_at":"2026-05-12T11:01:30.276802Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2605.03456","last_updated":"2026-05-09T04:48:21Z","snapshot_observed_at":"2026-08-05T18:06:31.983558Z","submitted_at":"2026-05-05T07:44:03Z","title":"VL-SAM-v3: Memory-Guided Visual Priors for Open-World Object Detection","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T19:14:12.092478Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2605.03456"},"observation_digest":"sha256:a1dcfc3146300198ffe58aaf83e0a55e8b607182d5fa8da172b92d81691f89ab","observation_id":"9d01a686-8cd3-4429-8355-412294974194","resolution":{"observed_at":"2026-05-09T06:00:35.797463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2605.03456","last_updated":"2026-05-09T04:48:21Z","snapshot_observed_at":"2026-08-05T18:06:31.983558Z","submitted_at":"2026-05-05T07:44:03Z","title":"VL-SAM-v3: Memory-Guided Visual Priors for Open-World Object Detection","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T01:33:55.317107Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2605.03456"},"observation_digest":"sha256:1cdfde3720efdae1d6ec9ae48dbf00983afe39990e639fcf9cf12d43fb9a3b50","observation_id":"baa1efb4-1ade-4b71-a36d-6a1bf977a9e0","resolution":{"observed_at":"2026-05-12T07:51:48.454982Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2605.10190","last_updated":"2026-05-11T08:40:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T08:40:25Z","title":"DetRefiner: Model-Agnostic Detection Refinement with Feature Fusion Transformer","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-12T03:25:49.511875Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2605.10190"},"observation_digest":"sha256:384e8da30caeb77100c0f929f4603c21d20d018f38b2e5689e2a3809d593cebf","observation_id":"61f9333f-e049-465d-bad7-866ed712caeb","resolution":{"observed_at":"2026-05-12T03:26:18.879905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2606.26734","last_updated":"2026-06-26T22:08:10Z","snapshot_observed_at":"2026-08-08T16:00:23.593832Z","submitted_at":"2026-06-25T08:16:42Z","title":"Robust Onion: Peeling Open Vocab Object Detectors Under Noise","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-26T05:33:25.373918Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2606.26734"},"observation_digest":"sha256:608b3fcad73708f3d88f01db2e5f8f5831724f13eacb284a498a2be1dfe773a8","observation_id":"9ddef33d-510d-4ed1-9cb8-6cc45a0324a5","resolution":{"observed_at":"2026-07-04T12:59:53.215985Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2606.26734","last_updated":"2026-06-26T22:08:10Z","snapshot_observed_at":"2026-08-08T16:00:23.593832Z","submitted_at":"2026-06-25T08:16:42Z","title":"Robust Onion: Peeling Open Vocab Object Detectors Under Noise","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-30T00:42:36.605869Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2606.26734"},"observation_digest":"sha256:ea9beebbf797c66a72157c26f3c92ebf942a4ae8401d0fd5d78d39d15e74d4c6","observation_id":"439bc8e2-3a67-4be8-8230-69ae5c0e53a5","resolution":{"observed_at":"2026-07-01T16:15:49.989638Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2607.00338","last_updated":"2026-07-01T02:27:40Z","snapshot_observed_at":"2026-08-07T09:28:37.215060Z","submitted_at":"2026-07-01T02:27:40Z","title":"DroneFINE: Domain-Aware Parameter-Efficient Fine-Tuning of Vision-Language Detectors for Drone Images","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-02T15:23:42.245556Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2607.00338"},"observation_digest":"sha256:b3dc326eb9e62bbe6b14911d773c5b541a486e8ccf65b88b08eebb57f2d09b40","observation_id":"509f46f5-f5b3-43df-bde3-c13a696c041e","resolution":{"observed_at":"2026-07-02T15:27:04.695200Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":"2401.02361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-07-10T10:27:02.358494Z","title":"An open and com- prehensive pipeline for unified object grounding and detec- tion","venue":"cs.CV","work_id":"e2d251e7-a46b-4b55-9ddb-9364d020f415","year":2024},"citing_paper":{"arxiv_id":"2607.08267","last_updated":"2026-07-09T09:09:31Z","snapshot_observed_at":"2026-08-07T06:37:37.175361Z","submitted_at":"2026-07-09T09:09:31Z","title":"UniRef-UAV: A Multimodal Benchmark for Universal Referring in UAV Imagery","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-10T10:22:14.308951Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2607.08267"},"observation_digest":"sha256:bb3efb3d7bbcd39847c32a8f8cbb9c91b0141dc59a2ecc6fa8998e31f0d6ffb2","observation_id":"5fc73722-0554-4add-84c8-b5d95d9b9f21","resolution":{"observed_at":"2026-07-10T10:27:02.359976Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02361","snapshot_observed_at":"2026-08-06T18:44:51.853525Z","title":"arXiv preprint arXiv:2401.02361 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04698","last_updated":"2026-08-05T11:07:22Z","snapshot_observed_at":"2026-08-08T23:12:18.742707Z","submitted_at":"2026-08-05T11:07:22Z","title":"Teaching MLLMs to Say No: Generalized Referring Expression Comprehension via Refusal Calibrated GRPO","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-08-06T18:44:51.853525Z"},"links":{"cited_paper":"/paper/2401.02361","citing_paper":"/paper/2608.04698"},"observation_digest":"sha256:af6f0a27b7cd2496d9015bc12dc03b10c06741c4a66dd1ff80e57f8dfc603c46","observation_id":"c4342e8e-9501-4f06-ab95-cf5278aac247","resolution":{"observed_at":"2026-08-06T18:44:51.853525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2401.02361/citation-record","integrity":"/paper/2401.02361/integrity","json":"/paper/2401.02361/citation-record.json","paper":"/paper/2401.02361"},"outbound":[],"paper":{"arxiv_id":"2401.02361","last_updated":"2024-01-05T06:21:19Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T12:00:25.208070Z","submitted_at":"2024-01-04T17:00:49Z","title":"An Open and Comprehensive Pipeline for Unified Object Grounding and Detection"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2401.02361."}