{"as_of":"2026-08-06T01:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d9dba187c04d8eaaa445042b3a5752851918dfe7740b7a5f35a11b9befc35d43","coverage":[{"denominator":126,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:36:14.803899Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03471/citation-record","integrity":"/paper/2608.03471/integrity","json":"/paper/2608.03471/citation-record.json","paper":"/paper/2608.03471"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:13.860317Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:13.860317Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:a6e7a203f3aa88d8a2d2b7c2af6b6f7f0dcceb71ddb4ce8f79e729202788c265","observation_id":"05c3162f-6d2a-408b-a95e-37f4b85049cb","resolution":{"observed_at":"2026-08-05T18:36:13.860317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:13.959326Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:13.959326Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:a2535c7647501649bb41f80007b4b85ee7d93c288efc98b3e3a55660bba836c5","observation_id":"54b014f6-175d-4ef0-ba27-4cfce696f196","resolution":{"observed_at":"2026-08-05T18:36:13.959326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.095082Z","title":"Chandra and Dexter C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.095082Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:7e1f3932bf194ea592e4d3aa1e0fd320f3e119cc276675daa10a6fca7a27444c","observation_id":"d24b2112-894a-470e-99b2-a8be3dc11edc","resolution":{"observed_at":"2026-08-05T18:36:14.095082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.196479Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.196479Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:eb5c04f1fa193879531e9a58eab8a130ae06adb85793ee3da0ff1c7215c6256f","observation_id":"e1cba9e6-bf5b-4dab-ac21-6ff082c2e4d4","resolution":{"observed_at":"2026-08-05T18:36:14.196479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.252169Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.252169Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:749938eff410829304d768b6fb0e169bc30c5b7285c95b1101563b19da544a2b","observation_id":"9d888703-ce66-42ba-8600-8e289b2e8f2c","resolution":{"observed_at":"2026-08-05T18:36:14.252169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.318273Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.318273Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:221eb49a37824ce984fd1cba7a5c4df5b9bc239780cacccb61d021232a98801d","observation_id":"333c3386-ae19-455e-a7eb-5d862dd416f1","resolution":{"observed_at":"2026-08-05T18:36:14.318273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.373855Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.373855Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:2395456a7d7737a4ec10b93c21e44315386896f4987ae5544a67b4b89fdc38a0","observation_id":"5ecdbba9-8f5a-455e-8374-c08784fc8301","resolution":{"observed_at":"2026-08-05T18:36:14.373855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-05T18:36:14.439009Z","title":"arXiv preprint arXiv:2306.15195 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.439009Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:1b33aed4f77bbe3cbe66a738bfa037590b8e1ca1e39604afaafbacd0e514b46c","observation_id":"19e70131-1cf2-4559-861a-fa854be07c75","resolution":{"observed_at":"2026-08-05T18:36:14.439009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.515588Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.515588Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:581393b3352c68c7751eaa0aee3287d74eb9f517226ca53393ae92085e0a55af","observation_id":"13e70be9-86e7-4f0b-9090-4a0540bd7953","resolution":{"observed_at":"2026-08-05T18:36:14.515588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-05T18:36:14.543800Z","title":"arXiv preprint arXiv:2306.14824 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.543800Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:2b03364eb90d8bf444571b1a9a5d1858c27d8c48a38a09b2c274942058771170","observation_id":"fe1fd85f-c79e-45e3-a8fb-a1e07ca46600","resolution":{"observed_at":"2026-08-05T18:36:14.543800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.547050Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.547050Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:0a6ec06c1ad81494725d383c78024e93d2de2edb37c8ffe48102ee663ef0e8b7","observation_id":"6ecee1bb-f700-4674-92f2-7e1b14877597","resolution":{"observed_at":"2026-08-05T18:36:14.547050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.550050Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.550050Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:f652f2f3b2df019b4693597b119a74f8c5ce51918cf0d3865f7b12320b271f67","observation_id":"93b98021-1470-4af8-b933-706a2d89beeb","resolution":{"observed_at":"2026-08-05T18:36:14.550050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.552467Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.552467Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:f8714206fd8fee75d1ce7ea09e9b9aa51da0012bfc792b308f7345079b913a8f","observation_id":"0060fbc9-b1ff-4999-bb98-47fe00d1b609","resolution":{"observed_at":"2026-08-05T18:36:14.552467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.555084Z","title":"3D Gaussian Splatting for Real-Time Radiance Field Rendering , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.555084Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:27bf62d53d8b8235cb1a6a957d869530d69753dc0ad6b05c4276b085053d05ea","observation_id":"09c5f823-f13d-4697-bae8-673e8e01f5d9","resolution":{"observed_at":"2026-08-05T18:36:14.555084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.558285Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.558285Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:285670cabf7c1df8acb0c31450ad671f5df88c98a8faaef0f57f068de79552ae","observation_id":"f75d8397-0c6d-40a0-9657-20bec030ab9e","resolution":{"observed_at":"2026-08-05T18:36:14.558285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.560960Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.560960Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:78753c10b19abff615862656e6f10e2fd13a820490ea492482656c1d73c3794a","observation_id":"9172e7a4-c935-4a31-a021-a0ecefe775ab","resolution":{"observed_at":"2026-08-05T18:36:14.560960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14249","last_updated":"2025-06-23T08:10:31Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:01:32Z","title":"CLIP-GS: CLIP-Informed Gaussian Splatting for View-Consistent 3D Indoor Semantic Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14249","snapshot_observed_at":"2026-08-05T18:36:14.563725Z","title":"arXiv preprint arXiv:2404.14249 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.563725Z"},"links":{"cited_paper":"/paper/2404.14249","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:c43515c7b147216a6dcb2ac1012b66ad5e0e101118ccabcb02dea4d6a87928c6","observation_id":"0e933b49-98d6-45a8-a97c-b8415e87b4c3","resolution":{"observed_at":"2026-08-05T18:36:14.563725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.567052Z","title":"ECCV , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.567052Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:274d1babaca108154924867f7e3328f3ead8fec142f22923481bd88e5a279a73","observation_id":"dedc46c5-2812-43f0-b4f0-8dbfd93f988c","resolution":{"observed_at":"2026-08-05T18:36:14.567052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.569863Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.569863Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:655af532bae147a84e22b4402ba0aec47119049b9ec499c13d4901eecbe196dd","observation_id":"fa306d27-4251-4715-aaa6-1fc6ca4d0f77","resolution":{"observed_at":"2026-08-05T18:36:14.569863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.572930Z","title":"European Conference on Computer Vision (ECCV) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.572930Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:a179d3dc84f1aa22c7aba43fa34fd045a97c8e709fe91f5d7dbc450c1096b895","observation_id":"2c2f5c4f-b80b-4733-b35b-96be2ef67995","resolution":{"observed_at":"2026-08-05T18:36:14.572930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.575502Z","title":"ECCV , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.575502Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:acb5ca3dfa0d41941bfe4433b2cec3e9675258ef51e75a5d594aab1a267fa20c","observation_id":"eb9f62f0-d8cf-47f1-b969-695855e7bd9e","resolution":{"observed_at":"2026-08-05T18:36:14.575502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.577966Z","title":"2024 , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.577966Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:282c7d940389bae3e71a7543b1d618020fb74e4da6a0b7f823146203a7bd8560","observation_id":"6832af4a-1904-4a6c-b94a-abd91115b37d","resolution":{"observed_at":"2026-08-05T18:36:14.577966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-07-06T15:12:37.953383Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-05T18:36:14.580950Z","title":"arXiv:2304.02643 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.580950Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:592a902ca9b7d846a3275edaaed4a8abdd156c987f4b2a7a56a0f75f548699e4","observation_id":"d5724fae-a287-4852-a469-4fa6814f76e5","resolution":{"observed_at":"2026-08-05T18:36:14.580950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.584356Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.584356Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:4a03df971713313bfe254731ec75f2a7df3f93f0918c1e5c7cd2156114a6e521","observation_id":"b500cd3e-e284-4f18-8053-eeebd9576da8","resolution":{"observed_at":"2026-08-05T18:36:14.584356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-05T18:36:14.587342Z","title":"arXiv preprint arXiv:2303.05499 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.587342Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:755d5eb6c7d131f2630306ddad181cfa511b75e5eea1bdde17dd05968baff2a2","observation_id":"984530ff-1746-4615-949f-21ff8e1d4765","resolution":{"observed_at":"2026-08-05T18:36:14.587342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.590589Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.590589Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:398289531677033fe51e44e1018769f5aea4bc7b55481acc58220f00df1b9cd8","observation_id":"5d1f6b00-ad32-41d2-938d-f4420549b662","resolution":{"observed_at":"2026-08-05T18:36:14.590589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.593499Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.593499Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:84572135d5fdb4b8defc6dbae5a0d4bce544efe9ccc021f1b802cc73a30bd063","observation_id":"d6bfdac7-4e3d-409b-9f2c-aa1a4128443e","resolution":{"observed_at":"2026-08-05T18:36:14.593499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.596518Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.596518Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:9d2bd43c5e630e6d4f6967678931d5e00355951b8f84048ad0c7c2cc4f98b6c9","observation_id":"21519a13-8ce4-4d64-a9ef-96a0e804d476","resolution":{"observed_at":"2026-08-05T18:36:14.596518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.600646Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.600646Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:ec283f6b0d3036f4abc44621a83111764e1bf695bb7d8f33de2a952db26b2013","observation_id":"94b22ef0-efd1-4705-bda1-9631af4c04d8","resolution":{"observed_at":"2026-08-05T18:36:14.600646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.604110Z","title":"International Conference on Computer Vision (ICCV) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.604110Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:62c7adc321b891fc69082ffddfd0e8375fdb77cfab923fd47fed26281bad3d4c","observation_id":"607df9cc-1ebd-4889-87bc-b7ad7a3aed2e","resolution":{"observed_at":"2026-08-05T18:36:14.604110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.606971Z","title":"Proceedings of the Winter Conference on Applications of Computer Vision (WACV) , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.606971Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:1b61cbe1ad90907fb56311fdc66bb07a166f5e3a7d70373e739a083d82b3ecde","observation_id":"b5c5d949-c060-448d-a15f-5b2eb42f02ca","resolution":{"observed_at":"2026-08-05T18:36:14.606971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.609915Z","title":"The Thirty-eighth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.609915Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:86731c6139e93a9cdf588c2f4146dd7305531d25e78a4fa8c2956b2aa90a3355","observation_id":"639fe5a3-eeb7-4c38-9e67-a2fa34fa97bf","resolution":{"observed_at":"2026-08-05T18:36:14.609915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.612453Z","title":"ECCV , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.612453Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:f7a7d1d81f2937a0f3bbb557496ccbb21edc5e1cc8debb2d4b2089e579c033ee","observation_id":"44dac702-e502-4f95-a393-5a72d52e4649","resolution":{"observed_at":"2026-08-05T18:36:14.612453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.19290","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.609237Z","title":"arXiv preprint arXiv:2411.19290 , year=","venue":null,"work_id":"e65b40f0-953e-40de-8ab2-fe2549011e75","year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.615057Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:57122ae484c1c746fb2ed043cc015db40b1c4c5b755ef47aaa99c0af0562c806","observation_id":"f2003e9f-a638-4613-94fc-0efffcd7fc79","resolution":{"observed_at":"2026-08-05T18:36:15.614687Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.617805Z","title":"2023 , journal=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.617805Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:64226bc5329fbf3748bbdcb0af75427dc445bdd76d46f8aa7001a23a34a039ed","observation_id":"d7b81250-a476-4678-83cf-68ccfad85164","resolution":{"observed_at":"2026-08-05T18:36:14.617805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.620365Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.620365Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:ad8c58c432c2500c65d15c881f54a3238809d8e28015fb918b6aa6aa45590f95","observation_id":"f9fbc4dc-e079-4fe4-908d-9a74b9fa5fd5","resolution":{"observed_at":"2026-08-05T18:36:14.620365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.623197Z","title":"European Conference on Computer Vision , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.623197Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:6ab778c2367959f5d7d8b27574d507a018d1dd74286c33e4930dfed386f0870e","observation_id":"04d26ee5-0f5d-4e2a-bd3a-a7043358822c","resolution":{"observed_at":"2026-08-05T18:36:14.623197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.626283Z","title":"2024 , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.626283Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:a22cc86a82bdcc5f118543b71347c38d39f44584c3758c0e685641c5532aa8f3","observation_id":"ad32a23b-1cd0-4256-b70e-d247a3fb2570","resolution":{"observed_at":"2026-08-05T18:36:14.626283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19615","last_updated":"2024-03-28T17:32:58Z","snapshot_observed_at":"2026-08-03T13:03:45.248447Z","submitted_at":"2024-03-28T17:32:58Z","title":"SA-GS: Scale-Adaptive Gaussian Splatting for Training-Free Anti-Aliasing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19615","snapshot_observed_at":"2026-08-05T18:36:14.629252Z","title":"arXiv preprint arXiv:2403.19615 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.629252Z"},"links":{"cited_paper":"/paper/2403.19615","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:229cebc88e4d056d0053995e68850d3bdffaa84f9962ec8ce2b030dda2ccb648","observation_id":"e0d42a2c-33d2-4bf7-a3e1-49e9be20809e","resolution":{"observed_at":"2026-08-05T18:36:14.629252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.632341Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.632341Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:1a46b6e7f05b9a425fbd124a64ca3839db540aa328b82280fec496d130ca8d8b","observation_id":"091b3332-70bb-4c2f-a77c-a7835605fceb","resolution":{"observed_at":"2026-08-05T18:36:14.632341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.635230Z","title":"2025 , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.635230Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:85a7c081cbb31cd5dc5243a6caf9e9f282c0445816071ccaa18b81cbb296a8b9","observation_id":"20accd26-1e80-4a13-8e8e-ba456773966f","resolution":{"observed_at":"2026-08-05T18:36:14.635230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.637847Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.637847Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:8c5747e7ee4c4a5af332b93c92ba6a158e6a1e0f381d17d288e560c10b025ccb","observation_id":"d66a3beb-9366-4ccd-beed-63afae58a40a","resolution":{"observed_at":"2026-08-05T18:36:14.637847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.640344Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.640344Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:c5331ef92eb3464b57c0ba6581fbac4c33400254f45e6167bc11a932960bcbf4","observation_id":"97dd1e0a-499e-47fc-a135-c206b607a10b","resolution":{"observed_at":"2026-08-05T18:36:14.640344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.642886Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.642886Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:30bf3a58c0088231006504b962a2ac6a414c7169b91d00d344a53fb6c7193338","observation_id":"0f239f91-c7d0-4aaa-9cf5-f6cdb6bb98ee","resolution":{"observed_at":"2026-08-05T18:36:14.642886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.645821Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.645821Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:c5145af9e14c39890e084759f23d7cc66ff60ce1291917339c85c334b8fce9fa","observation_id":"0b97ad58-2bb4-4be4-bc0c-03521e7d6af9","resolution":{"observed_at":"2026-08-05T18:36:14.645821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.648836Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.648836Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:5fcd7a6bffcf872e2d33f37fa6525011ede2a9a8d4a42561d341a12e11d4420d","observation_id":"89e7ba27-0e36-48a3-8d8e-8f7beea3dc2a","resolution":{"observed_at":"2026-08-05T18:36:14.648836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.651545Z","title":"and Millis, Bryan A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.651545Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:65a13de7bea64b176a833979fa0658e9fa31f757803fd186af293487b904403c","observation_id":"b080ae90-66c8-4bb5-b7ba-b3131b353c18","resolution":{"observed_at":"2026-08-05T18:36:14.651545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.654342Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , month =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.654342Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:c209f28d551af18b9514771ff469c90d033531eb90c3fae7ed9095c4ac932806","observation_id":"d03b04aa-19b3-4476-a555-a8eb0852b2fa","resolution":{"observed_at":"2026-08-05T18:36:14.654342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.656929Z","title":"European Conference on Computer Vision (ECCV) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.656929Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:8ec22c526a3b2b565deab2fce1cba4d036293e3dafb695b3e6343510526f4cc9","observation_id":"cd210cab-5328-437c-922e-a5153215639b","resolution":{"observed_at":"2026-08-05T18:36:14.656929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.659368Z","title":"Thirty-seventh Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.659368Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:72422fa2cd68cdc9e981a0ff6d9c675ea6236d03a9d638787eaa0c1ba6663f01","observation_id":"b5124f8d-946d-4508-8edd-33cc19b7bd0d","resolution":{"observed_at":"2026-08-05T18:36:14.659368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.661779Z","title":"Proceedings of the 38th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.661779Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:210eb7e1550b9d2601946eed7c8275525735255ab9641fba2516badddaffa08c","observation_id":"4180f029-f831-4143-8cef-3c835b974ad8","resolution":{"observed_at":"2026-08-05T18:36:14.661779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.664285Z","title":"and Tancik, Matthew and Barron, Jonathan T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.664285Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:edc630e2671b81f46a5b98ce9f4fad946d01153c2f86d2c8440d12696be94135","observation_id":"a72e51cc-7dad-49ed-966b-a34af6a55d21","resolution":{"observed_at":"2026-08-05T18:36:14.664285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.667144Z","title":"ACM Trans","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.667144Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:478ef8cdb94324718886d47d3de71cf98d7cbf05ff582d2fe4c1daad88aca786","observation_id":"165fb722-f1b0-40b7-9b84-12fa6262e611","resolution":{"observed_at":"2026-08-05T18:36:14.667144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.669705Z","title":"and Kowalski, Marek and Johnson, Matthew and Shotton, Jamie and Valentin, Julien , title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.669705Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:db3bcb0219742188d1621cf5e19d37bfe1340d4542982aff16f38d450db7f040","observation_id":"50a05ee8-ec97-47e3-9315-13f644972de3","resolution":{"observed_at":"2026-08-05T18:36:14.669705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.672877Z","title":"2022 , booktitle=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.672877Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:3a740aa2e2d68e4bc1c6b21d9b9d324e2ed65c3a1fb740bcae10fc63f8a10499","observation_id":"46c85408-9cda-4be3-8888-11c8b0c280a3","resolution":{"observed_at":"2026-08-05T18:36:14.672877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10275","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.396796Z","title":"2025 , issn =","venue":null,"work_id":"91d25ab6-cbc9-40c9-90f6-e18acc729a1e","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.675502Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:5e7e8d485c183d9dbb6560ba2296f5616d36deb288be4ba301551073fc8b8199","observation_id":"a5e66d65-a3fe-400f-a6f9-4e2c3e920718","resolution":{"observed_at":"2026-08-05T18:36:15.401488Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.678610Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.678610Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:709b48f2842586d5b9193e533c62b4b8c38627fc8394c9e49b771aea85ad7765","observation_id":"5ca604eb-c6a7-456b-8e45-2e91a36338b7","resolution":{"observed_at":"2026-08-05T18:36:14.678610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.681520Z","title":"2024 , isbn =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.681520Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:91588878136738361e5c57ac042291be60551d8aebd3a682ddfd9fe15f312888","observation_id":"9b9832d0-d9eb-4629-b234-047e630a6212","resolution":{"observed_at":"2026-08-05T18:36:14.681520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.684278Z","title":"ICCV , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.684278Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:dba779bafecd1346770e5cfcaf3dab4085e70ef57ffa4a819b2a141217b13d18","observation_id":"ff7a1039-ca97-4ef8-805b-69ba98a64c69","resolution":{"observed_at":"2026-08-05T18:36:14.684278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.686842Z","title":"Conference on Computer Vision and Pattern Recognition (CVPR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.686842Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:3da7dc5f72eda27b45db98c7b03826cc1eb2c5bf27ca5c0465b8d012721ba8bd","observation_id":"1e290908-5103-486b-8dda-340095c2e9f1","resolution":{"observed_at":"2026-08-05T18:36:14.686842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.689405Z","title":"CVPR , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.689405Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:3f93ada39103ace46330eefdfe44cae8b5fa9fcbbb45d2246de6e5930dec6467","observation_id":"274061cb-60d2-4eef-9e09-e4971b900e96","resolution":{"observed_at":"2026-08-05T18:36:14.689405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06908","last_updated":"2024-04-08T16:16:56Z","snapshot_observed_at":"2026-08-03T17:14:02.563149Z","submitted_at":"2024-03-11T17:00:27Z","title":"FreGS: 3D Gaussian Splatting with Progressive Frequency Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06908","snapshot_observed_at":"2026-08-05T18:36:14.692379Z","title":"arXiv preprint arXiv:2403.06908 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.692379Z"},"links":{"cited_paper":"/paper/2403.06908","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:202775a482f3e8d97455879727b311389147a82842582e5dcd85f8e0c0548fd9","observation_id":"125db4cc-6fca-4220-b9a6-8b5d32753da2","resolution":{"observed_at":"2026-08-05T18:36:14.692379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:16.059636Z","title":"ECCV , year=","venue":null,"work_id":"d22d4a5d-e807-4c5a-a1db-4d99e0e65ec5","year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.695922Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:bf4af435a573fb6cddbc805bc22eba7d34ee0118be07df0d18c8a566b05fee85","observation_id":"f8a09337-e6e1-4722-8b2c-42a3fd0eb80d","resolution":{"observed_at":"2026-08-05T18:36:16.062246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:16.049876Z","title":"CVPR , year =","venue":null,"work_id":"84636a73-8469-4440-9bb9-7abb1abe4293","year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.698691Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:ea9b72d18feda4818bf47f210afe0edfe06fb24fe90d028657ef2dd09816758d","observation_id":"a0c77da9-fa0a-4add-a4b0-7ae9c2034270","resolution":{"observed_at":"2026-08-05T18:36:16.053120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:16.040421Z","title":"2025 , eprint=","venue":null,"work_id":"a8931663-1cdb-4b18-b7c9-b4c095b77cd1","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.701451Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:7e0626562c76cff58a114d18d4319667d57fab79edf770bfa3f4467ae16f45e3","observation_id":"87e49cbb-908c-4931-b09e-4238afe500e1","resolution":{"observed_at":"2026-08-05T18:36:16.043449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17898","last_updated":"2024-10-17T07:11:31Z","snapshot_observed_at":"2026-08-03T23:05:42.089043Z","submitted_at":"2024-03-26T17:39:36Z","title":"Octree-GS: Towards Consistent Real-time Rendering with LOD-Structured 3D Gaussians","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17898","snapshot_observed_at":"2026-08-05T18:36:14.704072Z","title":"arXiv preprint arXiv:2403.17898 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.704072Z"},"links":{"cited_paper":"/paper/2403.17898","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:ec3c73a14a417959db5d90a128afe372de1edab5a18d466fc70c7f3a152a5240","observation_id":"d9013983-e860-438e-8046-3f37bb35fda1","resolution":{"observed_at":"2026-08-05T18:36:14.704072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.707311Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.707311Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:9cd1b6cb785f5197c95bdd003dc8cea8c73d669b828642ad24c17c1d81b015e6","observation_id":"edcf8857-984e-48d1-bb2d-3671ecad3910","resolution":{"observed_at":"2026-08-05T18:36:14.707311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:16.024117Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"6b84978b-13d3-42f5-b78d-06e5b2b8ed53","year":2022},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.709994Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:2838cdc5c0ec8aa641f9fdad4798602ed83a7b84fae1e6c1a6d037492701087e","observation_id":"9796b80f-975e-4142-ab68-eb575f672958","resolution":{"observed_at":"2026-08-05T18:36:16.027668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:16.013666Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise , year =","venue":null,"work_id":"45fcbade-9cff-4a29-8280-4c14e46b78bb","year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.712561Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:5aa31f86e8f908d688e7f431a25a4db566e66838e513b026b560e96ca2cf554c","observation_id":"863a96d1-c9ab-44a2-bd5d-20c10f828aa7","resolution":{"observed_at":"2026-08-05T18:36:16.016845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.715458Z","title":"doi:10.21105/joss.00205 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.715458Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:a304609012e25bbf304d80e2da810d6d2bf9fb0836da8a97c6166396e5635f19","observation_id":"1003449b-e1fc-4887-82a1-a746218ebc59","resolution":{"observed_at":"2026-08-05T18:36:14.715458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.718636Z","title":"Xu and Jun-Mei Song and Mingchuan Zhang and Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.718636Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:bf2e3a0b9b1a54f133dcbbfa86e27890fc361b70972389592d90a1eaef30605c","observation_id":"299134e9-7c70-4c1d-81f5-0f28527118df","resolution":{"observed_at":"2026-08-05T18:36:14.718636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.721367Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.721367Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:6bfedd3f2b27ad07f40d4e9d8b95c9548260f96f9c2a7de72d3ad9c6b26fe2d9","observation_id":"a12cc7d4-d603-455f-b5ee-dc8af1939765","resolution":{"observed_at":"2026-08-05T18:36:14.721367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.723902Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.723902Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:72b2a041cef75195ab7b41d6aa329fd3ad6c409808d732a758469b906e916ead","observation_id":"85b4120e-510a-4779-83d3-e98bfcbcf2dc","resolution":{"observed_at":"2026-08-05T18:36:14.723902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.726271Z","title":"European conference on computer vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.726271Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:0c0720f6158ab1192d7e1bb4037dccef933db48c7223ffd70c71bfd0896186a9","observation_id":"ec5dca0e-6adc-46f2-8424-8c4b712f10f9","resolution":{"observed_at":"2026-08-05T18:36:14.726271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.728848Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.728848Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:9c2f84c70c547213e93896f427baa7907e2233be99f53b6fe489adb6c58f1e1d","observation_id":"45c5bfd4-edd2-419c-9810-8fc85b943616","resolution":{"observed_at":"2026-08-05T18:36:14.728848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10967","last_updated":"2025-07-01T08:19:08Z","snapshot_observed_at":"2026-07-06T21:41:14.693158Z","submitted_at":"2025-06-12T17:59:09Z","title":"Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10967","snapshot_observed_at":"2026-08-05T18:36:14.731592Z","title":"arXiv preprint arXiv:2506.10967 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.731592Z"},"links":{"cited_paper":"/paper/2506.10967","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:6dcb2b408748848ce54024648ff1df6f969522a0754334dc2159fb2b1d4137d0","observation_id":"9355748a-d097-48c7-a5bc-667d093bcbcd","resolution":{"observed_at":"2026-08-05T18:36:14.731592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.970726Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision , year=","venue":null,"work_id":"fdf2ccd2-46f6-44fd-b491-e7f9e4037fb1","year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.734354Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:9c9d5a8c3d338f1e2fbc88ed58f1904db0e00da0573e238ae515ee7cbb5cbefb","observation_id":"edd1b9e8-2c5c-4a53-8c4f-9068b2169152","resolution":{"observed_at":"2026-08-05T18:36:15.973991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19930","last_updated":"2025-08-27T15:21:58Z","snapshot_observed_at":"2026-08-03T23:42:29.864142Z","submitted_at":"2024-11-29T18:42:28Z","title":"On Domain-Adaptive Post-Training for Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19930","snapshot_observed_at":"2026-08-05T18:36:14.737043Z","title":"arXiv preprint arXiv:2411.19930 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.737043Z"},"links":{"cited_paper":"/paper/2411.19930","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:4fccf2158cb5419da0753089bebfc712d3ee7cc4b295727041dd0280954e149d","observation_id":"f9bb392c-f221-447c-84e3-f9fdb1c63606","resolution":{"observed_at":"2026-08-05T18:36:14.737043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T18:36:14.741007Z","title":"arXiv preprint arXiv:2412.05271 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.741007Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:26dc8d69bfd9ef1e467c4eb50cfd8a3d300772aa1b1fc1d3fde148863155a3d8","observation_id":"d2108742-3e95-426e-b50b-3dace0d1c5f2","resolution":{"observed_at":"2026-08-05T18:36:14.741007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10442","snapshot_observed_at":"2026-08-05T18:36:14.744181Z","title":"arXiv preprint arXiv:2411.10442 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.744181Z"},"links":{"cited_paper":"/paper/2411.10442","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:1bac84197cbaf1bf6662006311ba150244f15d0eb6459fa4117b898b3b402234","observation_id":"67f09ea6-a15b-4325-b152-6bb155e95d75","resolution":{"observed_at":"2026-08-05T18:36:14.744181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-05T18:36:14.746975Z","title":"arXiv preprint arXiv:2404.16821 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.746975Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:5c8c46f85f860b2dc7c0e1984c9d9a233305e6a49604e8c738561a19c0a710ce","observation_id":"5320eee2-ef43-45af-8062-96e8f15dea71","resolution":{"observed_at":"2026-08-05T18:36:14.746975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.749734Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.749734Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:77a91bd9f9817192882b6ee0e480e2c8ee72a7d53b9d28bfc6e35e86b795d482","observation_id":"4f915a16-4597-48ef-bd90-e0ed70cf8307","resolution":{"observed_at":"2026-08-05T18:36:14.749734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.955364Z","title":"Dynamic-","venue":null,"work_id":"4c47106b-85a3-4137-b6f5-c9399ecd6224","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.752396Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:71e1c8445fe4c7f629fc495a20189822d08f7bc1af3f7c074a38e6d4ba9e5ee5","observation_id":"de2133fa-493e-4bf3-b9c8-67d500387708","resolution":{"observed_at":"2026-08-05T18:36:15.958426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.945398Z","title":"2025 , eprint=","venue":null,"work_id":"83379a33-343e-4f38-bdcb-29cd73250f6a","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.755072Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:4ccd398bb25be0f255d385d7d5c223cc0a28c46d06f0206e5814df4a640de0b8","observation_id":"d3a55338-94bd-4959-9b15-74fe5f20232f","resolution":{"observed_at":"2026-08-05T18:36:15.948870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T18:36:14.757890Z","title":"arXiv preprint arXiv:2308.12966 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.757890Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:0abf7f4b454819963847795eb554945584d4c31aa4d945de61d72daeb2c88abb","observation_id":"1ae8f730-c647-437e-b9e9-cad3c2c62aaf","resolution":{"observed_at":"2026-08-05T18:36:14.757890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T18:36:14.760712Z","title":"arXiv preprint arXiv:2502.13923 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.760712Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:c91c03e2a41f63492f066db37e583a6127020ebac654d2f6089d03b05032062a","observation_id":"73b433f7-57d6-4b69-b6af-9ca0be0fd714","resolution":{"observed_at":"2026-08-05T18:36:14.760712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.763796Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.763796Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:6774e9db4f1ae8c5e9cf40e3a546c8118b7d75f09209c255f129f939ecea0e28","observation_id":"afd57f44-22ec-41bb-a7f5-47a8b0314b96","resolution":{"observed_at":"2026-08-05T18:36:14.763796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.766290Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.766290Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:16082da958422230c94b95d9d0780174570a60df26de736cbc9ebb3a6b22d123","observation_id":"3d73370b-643c-4655-b2c4-db090aa72b50","resolution":{"observed_at":"2026-08-05T18:36:14.766290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.922705Z","title":"2025 , eprint=","venue":null,"work_id":"526114aa-9d61-44e2-8c88-1c18eb7d75c9","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.768777Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:fa26646538c23e28d95b005caad3760cb1a33a82b35a1c25cd367fcfd7b69341","observation_id":"d0f6e653-8f73-445f-91a5-3f87ae7d70b9","resolution":{"observed_at":"2026-08-05T18:36:15.926067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.911833Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"60048508-386e-4c50-8a04-e970664630ce","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.771571Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:2b95eac84310e90ab301f6bf6b6918e51c0c6236025f8f0e801440ccfc12408f","observation_id":"adefc786-89ee-4e48-bbbb-ad08ff67ff98","resolution":{"observed_at":"2026-08-05T18:36:15.915470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.901911Z","title":"2025 , eprint=","venue":null,"work_id":"a183644f-5224-477c-b023-f9db615c980b","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.774269Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:8985ceb901e72b43a62a4cf1a226e898cbdb559b64d6b2b4553c11febbae2080","observation_id":"ccf344dc-7e06-4fbf-b026-e43eac6e8ac8","resolution":{"observed_at":"2026-08-05T18:36:15.905571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.891542Z","title":"2025 , eprint=","venue":null,"work_id":"85d534f5-3761-4104-9498-5ce8140216e9","year":2025},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.777014Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:36ff6ed982bc962f5dcd838ef296d07e773dfff1741c9c4bdb64647d2b656a6e","observation_id":"ebffcaf4-9bfc-43b7-8efa-d03e60dfa5cf","resolution":{"observed_at":"2026-08-05T18:36:15.894685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.779510Z","title":"LLaVA-NeXT: Improved reasoning, OCR, and world knowledge , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.779510Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:aae08f27cc7548b823bb7927208c8bf584d52bc09c1c19a1609f72490bd2f77b","observation_id":"57d321ba-38ea-42a0-a613-11e24ea3cdf2","resolution":{"observed_at":"2026-08-05T18:36:14.779510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.782277Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.782277Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:7f878eede48d47d923073ffd5276acb11640b14f1444ad4b5c409faeb68b7219","observation_id":"43cc1454-4748-4029-bfdb-d54a198905e3","resolution":{"observed_at":"2026-08-05T18:36:14.782277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.785722Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.785722Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:ce49876690513f7814270d5011b1cf844ddd65aaa6537dcbf425d73f7b7da74f","observation_id":"e2713971-5904-4f97-a970-10538dc241ee","resolution":{"observed_at":"2026-08-05T18:36:14.785722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.788960Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.788960Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:5f6455cdca6a472273adce008f145a051338fc547b184e3634019307873bc74f","observation_id":"db3f4a05-53d7-4565-b7cc-9aff9ca5ccd6","resolution":{"observed_at":"2026-08-05T18:36:14.788960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:14.792785Z","title":"European conference on computer vision , pages=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.792785Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:c66de001ba467f2298110ffdd1a43c6e8ba2747c8e8f35a41d139fb56110508c","observation_id":"5dce6c34-6f76-4223-b228-c530208476d6","resolution":{"observed_at":"2026-08-05T18:36:14.792785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.850547Z","title":"and Murphy, Kevin , title =","venue":null,"work_id":"286dc7f9-cc05-4b9d-bbf3-42c8acb48071","year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.796456Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:684a8008e84dd871b7276919300f77ca5421dd4446714cb188547b7bd2445440","observation_id":"701deacf-b1bf-4335-9f6f-40bf15d92b80","resolution":{"observed_at":"2026-08-05T18:36:15.853345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00329","last_updated":"2025-08-20T19:09:06Z","snapshot_observed_at":"2026-07-06T20:44:49.893232Z","submitted_at":"2025-03-01T03:29:02Z","title":"ABC: Achieving Better Control of Multimodal Embeddings using VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00329","snapshot_observed_at":"2026-08-05T18:36:14.800007Z","title":"arXiv preprint arXiv:2503.00329 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.800007Z"},"links":{"cited_paper":"/paper/2503.00329","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:3c62ef6a5d5572e5928ad235f9e2726d1bf46304c398c7acad5e8bac67570971","observation_id":"4f30652e-612e-4a03-bc1e-603f0945d86a","resolution":{"observed_at":"2026-08-05T18:36:14.800007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:36:15.840661Z","title":"and Mildenhall, Ben and Verbin, Dor and Srinivasan, Pratul P","venue":null,"work_id":"66970f7f-7bbc-432a-b4b9-8354c72d9462","year":2022},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.803899Z"},"links":{"citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:8fec0eebebeab7c40333298b4fae755b04f84a59bbc5bcd0b5bbcc421da3aba4","observation_id":"910fdb95-56c3-4b7d-b6b4-a054da3c06db","resolution":{"observed_at":"2026-08-05T18:36:15.844615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-04T11:07:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T01:00:17.535959Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":84,"verified_exact":1,"verified_fuzzy":14},"total_outbound_references":126},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 100 of 126 outbound references and 0 inbound Pith citation observations for arXiv:2608.03471."}