{"as_of":"2026-08-08T08:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:643238f860d923468170e893a864f0dc1f743c884929a9d8948ba6090afd3737","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:25.746289Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:22.983604Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:11:25.945105Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"cited_work":{"arxiv_id":"2506.00333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00333","snapshot_observed_at":"2026-08-07T12:11:25.945105Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","venue":"cs.CV","work_id":"c47c338e-bf0a-40f8-b295-50dee1fd5c2e","year":2025},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:22.983604Z"},"links":{"cited_paper":"/paper/2506.00333","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:47124aea7fb380c3b19a03c04aeaed6095da000941ae76aae7cefc207df2f117","observation_id":"ea5fb744-e34e-43cf-8c0f-435f1654b4f4","resolution":{"observed_at":"2026-08-07T12:11:25.995481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00333/citation-record","integrity":"/paper/2506.00333/integrity","json":"/paper/2506.00333/citation-record.json","paper":"/paper/2506.00333"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"cited_work":{"arxiv_id":"2506.00333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00333","snapshot_observed_at":"2026-08-07T12:11:25.945105Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","venue":"cs.CV","work_id":"c47c338e-bf0a-40f8-b295-50dee1fd5c2e","year":2025},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:22.983604Z"},"links":{"cited_paper":"/paper/2506.00333","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:47124aea7fb380c3b19a03c04aeaed6095da000941ae76aae7cefc207df2f117","observation_id":"ea5fb744-e34e-43cf-8c0f-435f1654b4f4","resolution":{"observed_at":"2026-08-07T12:11:25.995481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:30.241857Z","title":null,"venue":null,"work_id":"c18df27c-f05c-4301-b51f-73e65fc480de","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.087268Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:273f08b9ea5d9d537c8bc4c900f03e6dfa58a3ead58ea82ecb15fa7d0f6b3229","observation_id":"1af24e8a-27cb-482b-b97e-205e9ac0198a","resolution":{"observed_at":"2026-08-07T12:11:30.356093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.984161Z","title":"a {Class Name}","venue":null,"work_id":"5e2c3450-3828-4e12-bbbe-9138c8c10189","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.161571Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:cf7a9d4107ec2734c81c58809da44cab887d6c1b98b38887208156d6c4adc057","observation_id":"816ce4c2-bbb5-44d4-a34f-b7cd1a255011","resolution":{"observed_at":"2026-08-07T12:11:30.095869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.785399Z","title":"Storage Box","venue":null,"work_id":"0e4bdc4f-d8b2-4794-b811-93f1fc90945b","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.270329Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:af1a0a3ee6bbbc5871b19e5c59414ce0cf09b10fa509033d5c4cf257c0fe68c6","observation_id":"bfa57c94-eb9e-4e60-b324-cf032e51038a","resolution":{"observed_at":"2026-08-07T12:11:29.885945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.542684Z","title":"Inspired by our Ora- cle results—where removing distracting classes yields large gains—we introduce V ocAda, aplug-and-playmodule foroff- the-shelfOvOD detectors","venue":null,"work_id":"fec6e021-8a57-4c8b-b559-0aa4779f1ed3","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.381545Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:888ec9c29ab3f7a5051bb4a440320231f4b5b6cf57b4379997016396b7269327","observation_id":"d3193821-eb74-4ee8-831b-770c0c929c5c","resolution":{"observed_at":"2026-08-07T12:11:29.700201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.318533Z","title":"Seeing the unseen: Visual common sense for semantic placement,","venue":null,"work_id":"fca26abc-5759-4003-9012-6559b8b4f03f","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.459038Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:c2bec72f2937ca96adaef44c633b34ef2b3ea9099347a8d2fb6434d233dc04da","observation_id":"d08d66a7-25a4-4a65-8853-701b03823871","resolution":{"observed_at":"2026-08-07T12:11:29.416710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.141683Z","title":"Mask r-cnn,","venue":null,"work_id":"7ef19d62-96d7-4715-b82d-e08a7c8557cc","year":2017},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.534081Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:161ddd19b7de4279c4005983de99e5368d6c7960cb0cabdcdf70d35b1e6e4480","observation_id":"f096de54-b746-439a-bdee-5bfb6aea849c","resolution":{"observed_at":"2026-08-07T12:11:29.217007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02767","last_updated":"2018-04-08T22:27:57Z","snapshot_observed_at":"2026-08-06T11:09:16.409556Z","submitted_at":"2018-04-08T22:27:57Z","title":"YOLOv3: An Incremental Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02767","snapshot_observed_at":"2026-08-07T12:11:23.644738Z","title":"Yolov3: An incremental improvement,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.644738Z"},"links":{"cited_paper":"/paper/1804.02767","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:06dd2a9d23b371d27f2e48727837642d2d683f21a2dbe0ad9b5e16376fd6bd7a","observation_id":"07b9fff2-34dd-43dc-9581-485aff2f3dc8","resolution":{"observed_at":"2026-08-07T12:11:23.644738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.941363Z","title":"Learning Transferable Visual Models From Natural Language Supervision,","venue":null,"work_id":"3ed3b9c4-93ce-42fc-aeda-60fbbcf2872c","year":2021},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.722337Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:e8b4bc766b0ff0b974bc9522d37f6be597de6e59868c1cab1fd8a7d5e434de3c","observation_id":"7c45c2b7-feee-4980-b379-94fa58a1a19c","resolution":{"observed_at":"2026-08-07T12:11:29.043208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.861036Z","title":"Detecting Twenty-thousand Classes using Image-level Supervision,","venue":null,"work_id":"4728b991-6c0d-4e47-ad48-532844d3a153","year":2022},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.828062Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:0cdcede65ad6243beca0c17e6634e1a20b2fb033383db89fed85fe52e4e4dee7","observation_id":"54aaa979-d26a-4c68-841f-99ff800a4f9c","resolution":{"observed_at":"2026-08-07T12:11:28.934056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.743176Z","title":"LLaV A-NeXT: Improved reasoning, OCR, and world knowledge,","venue":null,"work_id":"3f731e01-688f-435d-a7cd-14ded7f3156d","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.921430Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:8d0d5e966d23b7dbf5a399e8b05be97844e83ae2b5ffcf44411f6a07be09f7c8","observation_id":"3d556e66-bc85-4205-8d96-35c5f49e5109","resolution":{"observed_at":"2026-08-07T12:11:28.794646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.589343Z","title":"Learning object-language alignments for open-vocabulary object detec- tion,","venue":null,"work_id":"02872a98-ca77-4f72-897b-840cc2b52d1f","year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.004108Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:ae11b4fdd620ccdbdadb72b5a3f015b38a265215a3d61c9bb4b8e6b3a887204f","observation_id":"c30e048f-d147-4a02-a264-1c25c41e1e73","resolution":{"observed_at":"2026-08-07T12:11:28.680919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.439056Z","title":"CoDet: Co-Occurrence Guided Region-Word Alignment for Open-V ocabulary Object Detection,","venue":null,"work_id":"ae8329d4-c0e4-4458-a663-5e05bcf7ff8f","year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.151619Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:9859b1fa90c4b8e59b188dd9b41a4791f7bc2b2e1becfad966051e0296c2f7ef","observation_id":"168ad95c-3ade-4fbd-9a01-ab47ef738621","resolution":{"observed_at":"2026-08-07T12:11:28.504905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.294040Z","title":"Microsoft COCO: Common Objects in Context,","venue":null,"work_id":"fbb9253b-b258-4622-97e7-7599cdaeeded","year":2014},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.262699Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:59147af29e1685afe785a90631713ef6f37d3872eadb396983809b53d6a0a4a9","observation_id":"3e00f64e-8355-48a4-b369-ffcf983341ec","resolution":{"observed_at":"2026-08-07T12:11:28.368384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.183599Z","title":"Objects365: A large-scale, high-quality dataset for object detection,","venue":null,"work_id":"4fc39b5a-44ab-44a8-b197-25cd873e1722","year":2019},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.346139Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:4866b42bb4fed7444fbdc0c1e2d296f3e22350099f7401b94a9367e48ad303ee","observation_id":"42eecc17-515a-4d29-9c5d-ad778e9434e5","resolution":{"observed_at":"2026-08-07T12:11:28.231753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09220","last_updated":"2024-04-15T02:47:01Z","snapshot_observed_at":"2026-07-06T15:55:21.408850Z","submitted_at":"2023-07-18T12:52:49Z","title":"A Survey on Open-Vocabulary Detection and Segmentation: Past, Present, and Future","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09220","snapshot_observed_at":"2026-08-07T12:11:24.449511Z","title":"A Survey on Open-V ocabulary Detection and Segmentation: Past, Present, and Future,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.449511Z"},"links":{"cited_paper":"/paper/2307.09220","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:e90e4dc854f099fe1494d917d7ab153de6d3f3becb0968c414b5f1bc64ffcc31","observation_id":"683fc60c-b58d-4226-af5e-2421db00953c","resolution":{"observed_at":"2026-08-07T12:11:24.449511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.022055Z","title":"LVIS: A Dataset for Large V ocabulary Instance Segmentation,","venue":null,"work_id":"f2bb6d14-5c42-4f59-b2c2-f153ebb16182","year":2019},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.561964Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:5b27ae9362c1e05c41d8da279b6e5508b17d96534e9e66a6f0523b24ded3a367","observation_id":"b7b253ed-edaf-4d33-96ea-72293accf513","resolution":{"observed_at":"2026-08-07T12:11:28.088310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.884961Z","title":"ImageNet: a Large-Scale Hierarchical Image Database,","venue":null,"work_id":"fa529286-975d-48e8-83f3-60c5dbdfe153","year":2009},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.673069Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:3a4fd0403d97d9a1f07704956d5144c74b0904bd2416ea7597b9abfcff7d906c","observation_id":"b17ad004-3731-40dc-84a2-81f253c9aab8","resolution":{"observed_at":"2026-08-07T12:11:27.950594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.740355Z","title":"RegionCLIP: Region- based Language-Image Pretraining,","venue":null,"work_id":"72b8cb1d-1229-4f3e-9407-44a8a921faf2","year":2022},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.783852Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:6d6d2b53ff5c4a4b9624ab060554c279cd745520e7ef6dd032d9c662bd173ea8","observation_id":"83602ec1-0e50-4222-a102-0fe68b95f13d","resolution":{"observed_at":"2026-08-07T12:11:27.809183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.567742Z","title":"SHiNe: Semantic hierarchy nexus for open-vocabulary object detection,","venue":null,"work_id":"77c1adde-4332-4c83-9baa-30da1e6c5ce4","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.891021Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:82631092ed7f06972ecba10eba721f266b761eb0322a733e1c7b2afdb03ce588","observation_id":"96c0984f-ee3c-49f2-9618-e71ac387a121","resolution":{"observed_at":"2026-08-07T12:11:27.641700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.374637Z","title":"mplug-owl2: Revolutionizing multi-modal large language model with modal- ity collaboration,","venue":null,"work_id":"0538af7f-c982-4cb8-b125-eb9b5c6da776","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.967515Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:d9d32248778ae1ab1eb82206f4b2d01b55f131667a9bc82e77ad3ccb4707d43b","observation_id":"4efe6322-3c98-4dc0-8f7b-80e52192f052","resolution":{"observed_at":"2026-08-07T12:11:27.489417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.191640Z","title":"spaCy: Industrial-strength Natural Language Processing in Python,","venue":null,"work_id":"f03d2399-425d-4276-92bb-e183fde77dc1","year":2020},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.076611Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:aa303f38a049d055a8f6eacddf3d89efb962f16d467e4d78d4651dd5a6c3b2a2","observation_id":"a8d7c058-8878-41ea-b27e-1ade7af4dba0","resolution":{"observed_at":"2026-08-07T12:11:27.278684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.043254Z","title":"Introducing meta llama 3: The most capable openly available llm to date,","venue":null,"work_id":"0f6a77bd-75f6-4dec-a2c5-a12bf699fd15","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.187191Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:e40be222519f1dcfbe3090546ccaf6486759b8282efe29cde2fcb154d0baeae4","observation_id":"88623871-c9dc-4db9-867d-29c632c270ff","resolution":{"observed_at":"2026-08-07T12:11:27.108763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.826082Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows,","venue":null,"work_id":"398bc65f-390d-4e4a-8a2f-84c67d0a372b","year":2021},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.260169Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:3c902a394e630fd8c01529f0e280841e83c700637a855722d8024b94614c8982","observation_id":"1a00f052-a281-4861-b9c6-1c77e65a859f","resolution":{"observed_at":"2026-08-07T12:11:26.945534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.609004Z","title":null,"venue":null,"work_id":"05e7c43c-7f5a-442b-80bd-a10210e137ef","year":1998},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.342440Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:415c5374f5966075867b9319f2514bcefecf8fb834efb532c8d950ae53715878","observation_id":"11c7a68e-bc20-473a-9adc-fc1031150e0b","resolution":{"observed_at":"2026-08-07T12:11:26.702182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15200","last_updated":"2023-11-16T07:11:02Z","snapshot_observed_at":"2026-07-06T16:37:23.707569Z","submitted_at":"2023-10-23T08:13:33Z","title":"Open-Set Image Tagging with Multi-Grained Text Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15200","snapshot_observed_at":"2026-08-07T12:11:25.418349Z","title":"Open-set image tagging with multi-grained text supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.418349Z"},"links":{"cited_paper":"/paper/2310.15200","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:8ed0f08f51524f6ffb6e16b00eb91379897d669ff494ffbf0f04b2c9641016ca","observation_id":"f6307555-cb22-48a7-be0c-7d5b246b061a","resolution":{"observed_at":"2026-08-07T12:11:25.418349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.454855Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks,","venue":null,"work_id":"94000b1a-8ab8-4293-a4c5-d15eb81d7808","year":2019},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.509368Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:dbd3ec856280773cf59482bd8312fef2343dd2459f46800f3b5cc57e9c0ae9b1","observation_id":"687284bf-9488-4727-9463-48b700796cba","resolution":{"observed_at":"2026-08-07T12:11:26.527236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T12:11:25.578752Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.578752Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:5d53baeaa083b4b2f8c24a3e32602186da4e2c8e9c04c67594fb285ad321bcf9","observation_id":"e3239dfc-aac5-420b-8faa-d5adaa4a9286","resolution":{"observed_at":"2026-08-07T12:11:25.578752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.267829Z","title":"ChatGPT: A Large-Scale GPT-3.5-Based Model,","venue":null,"work_id":"1dc56106-a8aa-4625-91d9-2fc4b7be5911","year":2022},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.654814Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:2fc89b01665aaf7534981ed01c270462826f26a41a7a7fd5b0d9be708c7f1d20","observation_id":"86df7a91-60ef-4800-a018-0277ba9ea0aa","resolution":{"observed_at":"2026-08-07T12:11:26.356184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.077315Z","title":"Visual Classification via Description from Large Language Models,","venue":null,"work_id":"f36931ff-b24b-4cbf-80cc-83a94ba2ebd4","year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.746289Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:dcbfb0ec5735e215d63802959980388df167a8a8aa3c0d71ccbd91ef66695661","observation_id":"0fa20980-9495-435e-85d9-9823f47d5ec5","resolution":{"observed_at":"2026-08-07T12:11:26.150864Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2506.00333."}