{"as_of":"2026-08-07T16:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d1105fd205e0a4c10574a4704855206122955bcf7ce4a39a4ee5c820c305d17c","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:43:56.908824Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:10:00.825855Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:09:55.172195Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":"2507.12883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12883","snapshot_observed_at":"2026-07-04T15:09:55.172195Z","title":"Hrseg: High-resolution visual perception and enhancement for reasoning segmenta- tion.CoRR, abs/2507.12883","venue":null,"work_id":"c5f9fd1a-6116-4b6a-8f15-04e71677bb2b","year":2025},"citing_paper":{"arxiv_id":"2604.15670","last_updated":"2026-07-24T04:48:23Z","snapshot_observed_at":"2026-08-02T16:09:56.976755Z","submitted_at":"2026-04-17T03:48:56Z","title":"PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T09:20:54.635375Z"},"links":{"cited_paper":"/paper/2507.12883","citing_paper":"/paper/2604.15670"},"observation_digest":"sha256:8459e8c37099a7aed541080b1ba72e6b892ad6864404ece20c56c0fe505f70be","observation_id":"1d490a71-82b7-4f5e-9e3f-ea6c6f0788e2","resolution":{"observed_at":"2026-05-10T09:23:37.129948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12883","snapshot_observed_at":"2026-08-02T16:10:00.825855Z","title":"Hrseg: High-resolution visual perception and enhancement for reasoning segmenta- tion.CoRR, abs/2507.12883, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.15670","last_updated":"2026-07-24T04:48:23Z","snapshot_observed_at":"2026-08-02T16:09:56.976755Z","submitted_at":"2026-04-17T03:48:56Z","title":"PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T16:10:00.825855Z"},"links":{"cited_paper":"/paper/2507.12883","citing_paper":"/paper/2604.15670"},"observation_digest":"sha256:0d797e59874defeb344290eff96c6ac6d8e9c02e2656aefb525f4a81816dd658","observation_id":"163701c9-58a1-4fd9-8e93-6b573c1ceae5","resolution":{"observed_at":"2026-08-02T16:10:00.825855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":"2507.12883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12883","snapshot_observed_at":"2026-07-04T15:09:55.172195Z","title":"Hrseg: High-resolution visual perception and enhancement for reasoning segmenta- tion.CoRR, abs/2507.12883","venue":null,"work_id":"c5f9fd1a-6116-4b6a-8f15-04e71677bb2b","year":2025},"citing_paper":{"arxiv_id":"2606.26196","last_updated":"2026-06-24T15:20:32Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-06-24T15:20:32Z","title":"From Structure to Synergy: A Survey of Vision-Language Perception Paradigm Evolution in Multimodal Large Language Models","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-06-26T01:50:54.242508Z"},"links":{"cited_paper":"/paper/2507.12883","citing_paper":"/paper/2606.26196"},"observation_digest":"sha256:e972302748ff66c88669de9228974345d320b40185ecf64c14127e238aba7fd0","observation_id":"70a90b17-b560-4412-8e59-10a8514f0276","resolution":{"observed_at":"2026-07-04T15:09:55.174796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12883/citation-record","integrity":"/paper/2507.12883/integrity","json":"/paper/2507.12883/citation-record.json","paper":"/paper/2507.12883"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T16:43:47.361319Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.361319Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c64b0716b31473fd47be8de453256c400521b2062c7bf1ea2940f1735b30caee","observation_id":"b4fbaf8d-d552-4755-980f-eae49a54c405","resolution":{"observed_at":"2026-08-06T16:43:47.361319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T16:43:47.409989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.409989Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d23ea628f0d8eb9e01aea4dc29502155b75d2da5861cea7c3d2340665adb96e9","observation_id":"d84de3fb-3ff0-4658-8787-7039d56c6a88","resolution":{"observed_at":"2026-08-06T16:43:47.409989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:47.461645Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.461645Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:043ba3051b1463c63b518cd90afdd5a9248ce7702e952db033aa97cec48c03d4","observation_id":"672884fe-99a4-42a7-896b-32519588bad6","resolution":{"observed_at":"2026-08-06T16:43:47.461645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:47.529940Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.529940Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:de46611c8b7dec564d0b5ae7e173ff1b478f6a29b66567c275b87d2c8a8a40c7","observation_id":"dea80ed6-3aee-42f9-87f1-bcdadd986b71","resolution":{"observed_at":"2026-08-06T16:43:47.529940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-06T16:43:47.866503Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.866503Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:dab3de977f35a42a4c75f14adf4d36c4a3d0e3dc57ca14173787b620b2f78639","observation_id":"eb864c1a-4403-4f41-a3f0-ab3a359467cc","resolution":{"observed_at":"2026-08-06T16:43:47.866503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.005704Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.005704Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:8af05ac57a135ef59472769020889757f8881b40f176fd118b3b784b0be8acda","observation_id":"cb1403f2-b205-4c10-96d8-27a0af9e9390","resolution":{"observed_at":"2026-08-06T16:43:48.005704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.165706Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.165706Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:8bbed9620fcc7a34927272d59618e8e939d6e0a13862b7b4ae4c82b62c0a149f","observation_id":"725c9031-d5a6-420e-8090-c16e800c82bd","resolution":{"observed_at":"2026-08-06T16:43:48.165706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.282288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.282288Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:3fb1b8019f491a435036156335c152756c829570b73d3cdaebc950b361027f35","observation_id":"ebf61b2a-a83c-4acd-ab1d-3c99fb441e48","resolution":{"observed_at":"2026-08-06T16:43:48.282288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.407356Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.407356Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:69b88166479f5972dd481291b57dd3f6ce6397f3654cbed595aa69396e611fc3","observation_id":"0363cc6b-aa9a-402a-b6c3-aee68be95874","resolution":{"observed_at":"2026-08-06T16:43:48.407356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.578756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.578756Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:24650d09888402c205eb67d5afb87e3d8ab155451d34a149c9ca88fb60379da0","observation_id":"33aa40a4-c51e-43df-8c59-7151b73c8215","resolution":{"observed_at":"2026-08-06T16:43:48.578756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.971224Z","title":null,"venue":null,"work_id":"3855df4b-9ad2-4f04-8af7-0e000d920fd8","year":2021},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.692579Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:43f6846cc2ea82becece92d1306badb843fe315137ab4e2020c86d74efe77513","observation_id":"688dfb71-fb09-4f1b-9bbb-e3800ede1479","resolution":{"observed_at":"2026-08-06T16:44:03.032249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06512","last_updated":"2024-04-09T17:59:32Z","snapshot_observed_at":"2026-08-06T19:00:20.787763Z","submitted_at":"2024-04-09T17:59:32Z","title":"InternLM-XComposer2-4KHD: A Pioneering Large Vision-Language Model Handling Resolutions from 336 Pixels to 4K HD","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06512","snapshot_observed_at":"2026-08-06T16:43:48.858848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.858848Z"},"links":{"cited_paper":"/paper/2404.06512","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:8adbae7b6f8ba9693b9e9e3f609638186d105d3beebe2b732cd66791c0b576e6","observation_id":"e9fad850-b5ef-4891-9b5d-9be2706e2685","resolution":{"observed_at":"2026-08-06T16:43:48.858848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T16:43:49.003114Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.003114Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c18696e2def4a41f6d1d6df3aa9b4f44529558273e867efa31aba19533e33ded","observation_id":"351e12bd-1c61-4b65-b8cf-bcdef4f556ec","resolution":{"observed_at":"2026-08-06T16:43:49.003114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:43:49.145112Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.145112Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:338fadf79b18dfe4eb4bd4d5870db345887f704bdcf762fab340a5132dba1338","observation_id":"68d52b33-6259-492f-887b-58d4127d853a","resolution":{"observed_at":"2026-08-06T16:43:49.145112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.799944Z","title":null,"venue":null,"work_id":"dcdf1885-ebde-4aa5-a897-a5476aa3f292","year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.275432Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c2193993578b97909febcc9af97a481269ffa210dc2e0bf0d059f063f94aace3","observation_id":"501aee8e-76be-4d30-8463-3cd87820ad29","resolution":{"observed_at":"2026-08-06T16:44:02.886533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:49.404924Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.404924Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:9754ac007850c2f5bfe1a9e7e5dd398d84f327ad81a4545db2f3d146853b8cc3","observation_id":"1200db5d-9f4c-4582-8970-06e04c404a04","resolution":{"observed_at":"2026-08-06T16:43:49.404924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.645499Z","title":null,"venue":null,"work_id":"91107e66-c044-4289-8ddb-a1544db49999","year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.518214Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:0135c94e0ad797e1e10bc5897aba9c62043aa4d23eca727c11df1105930edc92","observation_id":"9a569c7a-8ef0-4ccd-aa0b-79da15efe202","resolution":{"observed_at":"2026-08-06T16:44:02.703619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12895","last_updated":"2024-03-19T16:48:40Z","snapshot_observed_at":"2026-08-07T02:52:27.054968Z","submitted_at":"2024-03-19T16:48:40Z","title":"mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12895","snapshot_observed_at":"2026-08-06T16:43:49.641010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.641010Z"},"links":{"cited_paper":"/paper/2403.12895","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:5cd62a186d22a18e18d4bbad80ab08227666ba398b29469474e1024c92a485ad","observation_id":"2921b240-0064-4586-9758-4014f25367d4","resolution":{"observed_at":"2026-08-06T16:43:49.641010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.470029Z","title":null,"venue":null,"work_id":"17f93c87-f275-494d-b2c9-b5368ee7ccfb","year":2016},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.804373Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d7e37be296ec842c858195e13aed68757649e70c6b6f056887ffd222efe556a2","observation_id":"e65ba92e-535c-40c7-bb93-7250167598f4","resolution":{"observed_at":"2026-08-06T16:44:02.540897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02034","last_updated":"2024-10-28T07:40:49Z","snapshot_observed_at":"2026-07-06T18:56:40.234434Z","submitted_at":"2024-08-04T13:55:58Z","title":"Mini-Monkey: Alleviating the Semantic Sawtooth Effect for Lightweight MLLMs via Complementary Image Pyramid","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02034","snapshot_observed_at":"2026-08-06T16:43:49.933618Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.933618Z"},"links":{"cited_paper":"/paper/2408.02034","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:02af0e5978bc586ba8fc0f35e952d9e6a346b0fa6a8b52733d9fd8a4f8860eee","observation_id":"2a234bd9-2c76-4500-b588-a30ff55ea878","resolution":{"observed_at":"2026-08-06T16:43:49.933618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13881","last_updated":"2025-03-18T04:23:09Z","snapshot_observed_at":"2026-08-06T08:29:10.530602Z","submitted_at":"2025-03-18T04:23:09Z","title":"MMR: A Large-scale Benchmark Dataset for Multi-target and Multi-granularity Reasoning Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13881","snapshot_observed_at":"2026-08-06T16:43:50.099882Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.099882Z"},"links":{"cited_paper":"/paper/2503.13881","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:81f8ede8b2972aad73fe0d51b2870e2914d1cdb3b12bf4b8926c85bb70ead992","observation_id":"63fa77bf-0abc-490d-96ab-1cf1ac32b99b","resolution":{"observed_at":"2026-08-06T16:43:50.099882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-07T13:04:50.040909Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-06T16:43:50.211047Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.211047Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e620cb96e24dba45e8656cd36142c6e3b69a9bd2a410069e546181f0640b126e","observation_id":"f72c8dae-ea0a-43b7-9c56-e6c3d6d36d1b","resolution":{"observed_at":"2026-08-06T16:43:50.211047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.340815Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.340815Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c9cbf754409682271170cf2b60695cbdb0b2922877e98e1ced85619e26b14e17","observation_id":"29862914-a019-4e53-b6fc-cacd9b115cce","resolution":{"observed_at":"2026-08-06T16:43:50.340815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.485749Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.485749Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:8c767ae5fc1493130983e397e9970e86459b0de2e34b8de55ff2bf5631ccfb1a","observation_id":"64e1f6d4-8342-4ad2-a00b-f88dbd9488ec","resolution":{"observed_at":"2026-08-06T16:43:50.485749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.763505Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.763505Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:ae913a72d5b1cdd98a8335b6af49754180a1c27fcba74d98878e7390adde25cd","observation_id":"9bd06a67-3cf1-4d34-93a4-50034163341a","resolution":{"observed_at":"2026-08-06T16:43:50.763505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.583947Z","title":"In Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.583947Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:2815ac92a4644dcf3cef78b19ba157af20dc115fc257051000972696bb7e36fe","observation_id":"6cf22db7-b41a-4579-a74e-82cb939a07e9","resolution":{"observed_at":"2026-08-06T16:43:50.583947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02392","last_updated":"2024-08-28T08:49:57Z","snapshot_observed_at":"2026-07-06T18:40:22.951929Z","submitted_at":"2024-07-02T16:10:55Z","title":"TokenPacker: Efficient Visual Projector for Multimodal LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02392","snapshot_observed_at":"2026-08-06T16:43:51.265156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.265156Z"},"links":{"cited_paper":"/paper/2407.02392","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:951acd422ee26e82aa71ae81ba2bf2f35700847c1f1823e9fcd28596067c4027","observation_id":"d3e74dd7-8293-4ec6-9204-f21aaa904a8f","resolution":{"observed_at":"2026-08-06T16:43:51.265156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.972260Z","title":null,"venue":null,"work_id":"acb699d1-6e79-4190-968f-a37f7b04dd14","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.400140Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c16a9ff2b9bd510e8df7f249d25c2e0dd566247ea14c68d61bf3d99490ec06a8","observation_id":"15a83dc0-2d54-4a39-9301-e5c0132a1d0f","resolution":{"observed_at":"2026-08-06T16:44:02.087465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:51.049516Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.049516Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:bfb5031cbfe24b7234f92181d95e2d9924ff05bd9d5a65c9911b71745fe2e893","observation_id":"5abf3b1b-82de-4d80-99ff-143763e6a20e","resolution":{"observed_at":"2026-08-06T16:43:51.049516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.766571Z","title":null,"venue":null,"work_id":"5e5d5ace-8dd7-4045-a03c-0d9b5237a248","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.643698Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:8e25525ee499cc6b3008cf93d0a9078765e07d61d09193233aadcf6adcac68a7","observation_id":"3c4331e6-03d4-4f23-a643-5ecb019345ac","resolution":{"observed_at":"2026-08-06T16:44:01.882301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:51.781887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.781887Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:de5ac66c36525d558f6a8aada0a8df73c1124a2d0b163a48a8a44d4b2a261096","observation_id":"27e3d3c5-f8db-4396-b0e7-312cdbca4cde","resolution":{"observed_at":"2026-08-06T16:43:51.781887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-06T16:43:51.508542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.508542Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:2e1f5e812bc4527b79375c1629df7624f45c8c9cbb45a033a8a07e76a156797b","observation_id":"3ec79ca1-5eb3-4b50-934a-56290612e0ca","resolution":{"observed_at":"2026-08-06T16:43:51.508542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T16:43:52.052333Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.052333Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:dca4e286e52030753154401005c9a026dc7d1b43394e443b7958860449afbe64","observation_id":"64823629-5e6c-4283-b269-11d3b5b67136","resolution":{"observed_at":"2026-08-06T16:43:52.052333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.205526Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.205526Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:671020662c7781a877ac91eee713a5643e5e015181cfef8e57e7d8eba46b8f0c","observation_id":"3b1d4abd-a982-4152-af09-bcd2ca71b845","resolution":{"observed_at":"2026-08-06T16:43:52.205526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-06T16:43:51.943317Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.943317Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:81bc4e6a8eb261f482384d5ef0f1fb8be3617da08a4e3ae46a649346ca877c65","observation_id":"45837cd8-55a3-40e9-9089-ce8fddbe13bb","resolution":{"observed_at":"2026-08-06T16:43:51.943317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-06T16:43:52.509406Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.509406Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:4f0f7b41a6e38ecaf389cf05d8f419479dc6155f82f434445554b2ba56428fd9","observation_id":"3db8b887-d3e1-489e-b7b6-f23757780013","resolution":{"observed_at":"2026-08-06T16:43:52.509406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.586888Z","title":null,"venue":null,"work_id":"e9d5f835-672d-4923-aa7d-d2320d4307da","year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.590816Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:f89cd28a819b25cb90fb53abb4d02b3d88aa0c2349c9203589bf45cf8ad92221","observation_id":"8d58f549-d919-4b75-a5a3-240c9552de7e","resolution":{"observed_at":"2026-08-06T16:44:01.650239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.336062Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.336062Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:9f3861013e3b0b2a89bf426cf28922d50b17c709a6bdb3a0a5a8deb8acae67c6","observation_id":"e9ff0d91-dbf6-4c3f-9ce0-78077e5ac913","resolution":{"observed_at":"2026-08-06T16:43:52.336062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.765354Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.765354Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:fdc57dc335bd461e151b5809e3258bf8779e4d8c6384a0f5062aa38b03057b2b","observation_id":"27f71173-ea88-459b-bb14-955fe2c93624","resolution":{"observed_at":"2026-08-06T16:43:52.765354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.884479Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.884479Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:827687d4399358a908a76c73963ff402302a763ea453ce5891c9d5eb02e22da2","observation_id":"cb202816-4351-4480-b87c-abb0158eff63","resolution":{"observed_at":"2026-08-06T16:43:52.884479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06520","last_updated":"2026-05-31T09:29:40Z","snapshot_observed_at":"2026-08-05T01:42:30.194131Z","submitted_at":"2025-03-09T08:48:51Z","title":"Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06520","snapshot_observed_at":"2026-08-06T16:43:52.676691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.676691Z"},"links":{"cited_paper":"/paper/2503.06520","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:02e327dce9799a6cfaa7dd85283090f562a08472ecdbceb085147a28c993ed5c","observation_id":"038edbdd-32aa-4dff-a919-2d75aa12626a","resolution":{"observed_at":"2026-08-06T16:43:52.676691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T16:43:53.029321Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.029321Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:ae253f42639aec99ff6745e512530b2c8965b11575b1c1f9681d4bb23db666a1","observation_id":"4646c361-0e2a-476a-ad46-67ca93cbcbe7","resolution":{"observed_at":"2026-08-06T16:43:53.029321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12961","last_updated":"2025-02-27T06:09:46Z","snapshot_observed_at":"2026-07-06T19:18:17.523057Z","submitted_at":"2024-09-19T17:59:51Z","title":"Oryx MLLM: On-Demand Spatial-Temporal Understanding at Arbitrary Resolution","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12961","snapshot_observed_at":"2026-08-06T16:43:52.831200Z","title":"arXiv preprint arXiv:2409.12961 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.831200Z"},"links":{"cited_paper":"/paper/2409.12961","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d62dc1ac96ab49ba9cdbce0cb86305c4024042d576aa15dc3c6675ef35a12d60","observation_id":"28d07efb-3f67-463c-a1ed-a519d52b2c8c","resolution":{"observed_at":"2026-08-06T16:43:52.831200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:53.248714Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.248714Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:11aba5e6aa5364fde84689c881dc832878fb0bf5292460dc0512b934a7d247bd","observation_id":"ff919307-73b9-4a23-b184-e4388c49cc7e","resolution":{"observed_at":"2026-08-06T16:43:53.248714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.377524Z","title":null,"venue":null,"work_id":"0867ecec-ef33-44b5-84d7-8a4f2409f77b","year":2021},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.945960Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:5e7840fb0cf43b8995e5cb96a8978e8f6c04eae39ad148efe75a05158194a03c","observation_id":"3e764c9d-2e63-4cd7-a9c9-fdebabd06aaa","resolution":{"observed_at":"2026-08-06T16:44:01.451004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:53.364850Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.364850Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:7f3b1f5767f7c3ae3eecf60b37e325a419343920801fb7c24ebaf45a46662437","observation_id":"8086f695-8a91-44ec-86b8-9eaed92663c4","resolution":{"observed_at":"2026-08-06T16:43:53.364850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-06T16:43:53.162783Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.162783Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:08c4d0bf023fa33bed06fc753a724f3ec27f8b593cf1a901fbd5d8ec917b6f72","observation_id":"de16e036-beec-47ee-9e25-c5ac81485b28","resolution":{"observed_at":"2026-08-06T16:43:53.162783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T16:43:53.540519Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.540519Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:b2b1165554c30feb9a994fe9217ad785cc2563ffaebb01a0d673cda6330d2a48","observation_id":"5653f500-1d51-4c98-be41-21c6fb527e54","resolution":{"observed_at":"2026-08-06T16:43:53.540519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16198","last_updated":"2024-07-23T06:02:30Z","snapshot_observed_at":"2026-07-06T18:50:31.528338Z","submitted_at":"2024-07-23T06:02:30Z","title":"INF-LLaVA: Dual-perspective Perception for High-Resolution Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16198","snapshot_observed_at":"2026-08-06T16:43:53.305279Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.305279Z"},"links":{"cited_paper":"/paper/2407.16198","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:cfcc75243730f74e1d89643d896f0acbbe02076afa3b009c32841d993e36236c","observation_id":"1fd773a2-4ec3-4fb1-b3ca-f5417220a7d4","resolution":{"observed_at":"2026-08-06T16:43:53.305279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.989152Z","title":null,"venue":null,"work_id":"d9d38baa-fb25-4493-bac2-f6e3d7719205","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.709651Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:f31f44b047a7e0d36424358b1b016acb1dae20799c068d115f4787d6fd25d7f9","observation_id":"eedfc238-00b9-4297-b8b7-0ea3636b04c0","resolution":{"observed_at":"2026-08-06T16:44:01.088692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.181501Z","title":null,"venue":null,"work_id":"c4d5a51a-8a92-4ad9-ab86-348ad3a67a3b","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.489908Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:773db4946de77f6af03b2690c1008be1591e57b239283aeff4d80e6f0d194a61","observation_id":"106dab9b-8e00-4ec8-bc73-6c8c335c45ea","resolution":{"observed_at":"2026-08-06T16:44:01.261988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.600225Z","title":null,"venue":null,"work_id":"ef6d3b0d-1037-4b8d-9ebf-a2a24acd807e","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.023358Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:8a8b0b95a6d36f844ff2f04b1ae7bf858d008c23b08f23ee2384011268294fda","observation_id":"5d57e128-0253-47fe-b491-2f685bf3f4bc","resolution":{"observed_at":"2026-08-06T16:44:00.643564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T16:43:53.623603Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.623603Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e93031b24ef68fcf6b78e5001753cb325f4ecca0c0b0fec061486e7e07c9ccc6","observation_id":"dc8d151c-281c-4df7-ac28-2e6230376712","resolution":{"observed_at":"2026-08-06T16:43:53.623603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T16:43:54.192003Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.192003Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:9907482748ae7070a42ae96e0d3143bdb24c7bf31902ea88b8542e2cd9cdb060","observation_id":"a6a33ce5-4d18-4c35-bffc-fa6d17a63187","resolution":{"observed_at":"2026-08-06T16:43:54.192003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.781437Z","title":"InProceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"b175f1da-3683-4d0f-b771-e3d0fad69b45","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.822623Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e98911d56dc2f20c073ebfe38b816988feef4a87c9c23e29bc8f313aac634a7c","observation_id":"db5dd7a9-8902-450f-97fa-7a4f8e035cc9","resolution":{"observed_at":"2026-08-06T16:44:00.880457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:53.946285Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.946285Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:be8265b349fe86ebbe2c2f80fb84a83b81499ceab4a17cba61f04a0b4693b602","observation_id":"d77ceb5b-b6e2-40da-97b8-e039dc5c0752","resolution":{"observed_at":"2026-08-06T16:43:53.946285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T16:43:54.487107Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.487107Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:175d070880814a438e48b08ce5c52bca17e151d817c6c7c9773e84acfc076fbe","observation_id":"fbe7a195-67b3-4392-9ea5-62acedae83b8","resolution":{"observed_at":"2026-08-06T16:43:54.487107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.433298Z","title":null,"venue":null,"work_id":"14d2625d-27f3-48c5-9a33-bbe37ad4116a","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.109627Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c8adf48c039937a71e3227f77d1d876378426f9a34d44b7e42ed689760d95b60","observation_id":"07e3e86f-de02-46fd-905f-db37dd46fc9d","resolution":{"observed_at":"2026-08-06T16:44:00.503622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18923","last_updated":"2024-10-31T19:44:05Z","snapshot_observed_at":"2026-08-07T00:25:33.233087Z","submitted_at":"2024-10-24T17:11:52Z","title":"SegLLM: Multi-round Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18923","snapshot_observed_at":"2026-08-06T16:43:54.686970Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.686970Z"},"links":{"cited_paper":"/paper/2410.18923","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:a5035c33d425b62954e37f824d7011142c5f5d6933f93066f198f300c0438f26","observation_id":"a988da79-d75b-4b85-bae9-d7a0c65a76a1","resolution":{"observed_at":"2026-08-06T16:43:54.686970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-06T16:43:54.271119Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.271119Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e04c0296bd55a8162018c37268c2fbf66dbdb036ac3fa99910973edabb9498a1","observation_id":"4c10b730-28df-466e-8ce1-3657ac0127c3","resolution":{"observed_at":"2026-08-06T16:43:54.271119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.252098Z","title":null,"venue":null,"work_id":"258527fb-ee7b-4482-980b-2d8f3f371847","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.346952Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:3220ce9fc83366ceba1178194d9f44ac81e94a021e7540606844d9535fa9915b","observation_id":"74e8f15e-daf9-457f-ace4-261a43b076f8","resolution":{"observed_at":"2026-08-06T16:44:00.329269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08394","last_updated":"2024-12-31T05:35:05Z","snapshot_observed_at":"2026-08-06T17:31:18.801416Z","submitted_at":"2024-06-12T16:44:50Z","title":"VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08394","snapshot_observed_at":"2026-08-06T16:43:54.904999Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.904999Z"},"links":{"cited_paper":"/paper/2406.08394","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:4f99148275afa02df55c07f5d765af96b76511700e6acd246a47a6f766087150","observation_id":"d3964afb-e158-4a4a-aa01-3eb146b337d8","resolution":{"observed_at":"2026-08-06T16:43:54.904999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.084461Z","title":null,"venue":null,"work_id":"7f0a3887-08c2-42e6-843b-06c785c89041","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.599796Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:9d782dc96ec7233b20d45958bb34ebf931d7f8c3b0ba6b883fc7a5978f29c702","observation_id":"539b68c2-4ba6-4fdf-aaca-754c28b92e14","resolution":{"observed_at":"2026-08-06T16:44:00.152992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.320127Z","title":null,"venue":null,"work_id":"91d5fa4f-ddc7-4f63-a792-a0c832ee79fb","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.142594Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:1bd9454228a677c6b1a7f42cb6e5ad7f9e7eec55359cfd13b70267d7521b216b","observation_id":"29a914b8-afa4-464f-8644-4a66e577f0a5","resolution":{"observed_at":"2026-08-06T16:43:59.408123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.897466Z","title":null,"venue":null,"work_id":"aeb5f13d-87be-4099-b0d2-7b032692ee20","year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.751107Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:9a9c1e9148f706c3b747fe80f519fd3ecbb7cfb91293ebc249a0ce8d786c2439","observation_id":"b5cad76f-45dc-436d-b845-5953c04b0e5a","resolution":{"observed_at":"2026-08-06T16:43:59.981747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14006","last_updated":"2024-12-18T16:20:40Z","snapshot_observed_at":"2026-07-06T20:09:24.415233Z","submitted_at":"2024-12-18T16:20:40Z","title":"InstructSeg: Unifying Instructed Visual Segmentation with Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14006","snapshot_observed_at":"2026-08-06T16:43:54.814425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.814425Z"},"links":{"cited_paper":"/paper/2412.14006","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:b54d18a521e28b599720c197cf3c3adb03b08c3b579cfb1053896ef510bb85c3","observation_id":"1efbfe80-8fd5-4616-ab54-82ac981fb412","resolution":{"observed_at":"2026-08-06T16:43:54.814425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14141","last_updated":"2024-03-21T05:36:25Z","snapshot_observed_at":"2026-07-06T17:48:03.807374Z","submitted_at":"2024-03-21T05:36:25Z","title":"Empowering Segmentation Ability to Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14141","snapshot_observed_at":"2026-08-06T16:43:55.434020Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.434020Z"},"links":{"cited_paper":"/paper/2403.14141","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:342583b977cc29e03b2861a7978b2d930a46217bffce1c8999e6ddb479d6202a","observation_id":"cbe9196e-3292-48cd-8283-79d7e716a3a3","resolution":{"observed_at":"2026-08-06T16:43:55.434020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.694149Z","title":null,"venue":null,"work_id":"4f956a0c-5ec2-43c0-bf98-4f2e4a61a9ed","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.958662Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c3d5d33fbd712ab3ee0158ef44a54328d6b9d23791a37e9672eae476ed853a99","observation_id":"449acf4e-b631-4c61-af8f-b0aab5b22db0","resolution":{"observed_at":"2026-08-06T16:43:59.790119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.523021Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"5e7694fe-1fd7-4579-a52b-687c6329aceb","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.032776Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:172cc03a29d9789a2068824f72ad6356a7697469f9fed173d6c893e95be6f0e4","observation_id":"c26dfec2-5e5b-4784-803f-88c673a505e8","resolution":{"observed_at":"2026-08-06T16:43:59.608812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05126","last_updated":"2023-10-08T11:33:09Z","snapshot_observed_at":"2026-07-06T16:29:23.853368Z","submitted_at":"2023-10-08T11:33:09Z","title":"UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05126","snapshot_observed_at":"2026-08-06T16:43:56.033608Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.033608Z"},"links":{"cited_paper":"/paper/2310.05126","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:557260e23c1d61bee359a9afcb3c242d2aa49fde094a6de5a1131325fb90717c","observation_id":"0190d4b3-deae-47a2-960d-9ef4e1052993","resolution":{"observed_at":"2026-08-06T16:43:56.033608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T16:43:55.219024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.219024Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e2ec2761860044c59c8e1c1f27d252d261f238faf8c569cd8d4c4f3a9c5ffc06","observation_id":"b19e87cf-09bf-43e5-a0e9-268045be74ea","resolution":{"observed_at":"2026-08-06T16:43:55.219024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-06T16:43:55.305583Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.305583Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:209b32f5a10f74353d2c56dcbe2a5df78cb61ac0d6e5176ceb3ef4ffc1266c89","observation_id":"61131abb-d351-468e-868e-806cff1112c9","resolution":{"observed_at":"2026-08-06T16:43:55.305583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19389","last_updated":"2024-10-01T06:07:24Z","snapshot_observed_at":"2026-07-06T18:38:05.229292Z","submitted_at":"2024-06-27T17:59:01Z","title":"OMG-LLaVA: Bridging Image-level, Object-level, Pixel-level Reasoning and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19389","snapshot_observed_at":"2026-08-06T16:43:56.223743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.223743Z"},"links":{"cited_paper":"/paper/2406.19389","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:0adf8ad0590177e782db642c40057fa0960d5b94d58d2321847bccb8c64f38ab","observation_id":"2128d1d5-c66d-4c11-a088-7b1be00deb2d","resolution":{"observed_at":"2026-08-06T16:43:56.223743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.125314Z","title":null,"venue":null,"work_id":"f2050083-169f-4a9f-9a34-341dd4d1c8fa","year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.653574Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:a0b4c95df4c9049afa1efb8c7f3d37b8fc92919b3a4421ab73ec5c9ae052fd75","observation_id":"77530967-a57f-4950-80c6-a23bcc16844d","resolution":{"observed_at":"2026-08-06T16:43:59.215507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.941217Z","title":null,"venue":null,"work_id":"4c2a0123-d158-476a-9ad5-1d6ca070802d","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.745286Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:764d3354c6b4de46584b6b211ed9bb2a9576a88fea4939ffd8b6bca8a6f776da","observation_id":"e6972c33-94dd-4dc0-8c62-9ff180e0aa40","resolution":{"observed_at":"2026-08-06T16:43:59.035101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.728730Z","title":"IEEE transactions on pattern analysis and machine intelligence 45, 9 (2023), 10870–10882","venue":null,"work_id":"db37e704-a7f6-4d71-bf31-5801434961cb","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.891093Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:378cdf7e4b00037d9ac02f62196c6908366d0365e1830b6732a27e7d35b4614d","observation_id":"1d367824-32af-400b-887c-809811f99219","resolution":{"observed_at":"2026-08-06T16:43:58.832277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.422696Z","title":null,"venue":null,"work_id":"fbbb1705-dbb9-446e-80b8-e6c57a905f0e","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.645201Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:326a2b32d6dd1b72ad01dbad0013e286d143b2a368b9c4f28d42d3bafc0546dc","observation_id":"820c5c7f-1772-48bc-8ede-e4008de35aae","resolution":{"observed_at":"2026-08-06T16:43:58.484312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04498","last_updated":"2023-12-18T12:15:26Z","snapshot_observed_at":"2026-08-06T14:33:43.511633Z","submitted_at":"2023-11-08T07:15:05Z","title":"NExT-Chat: An LMM for Chat, Detection and Segmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04498","snapshot_observed_at":"2026-08-06T16:43:56.096102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.096102Z"},"links":{"cited_paper":"/paper/2311.04498","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:9fbb670926952c209125367f900b316c5a66a6b2e68386dfcfc3a11dbf0077ad","observation_id":"8df77128-ee58-44d8-88f3-598d45721f14","resolution":{"observed_at":"2026-08-06T16:43:56.096102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-07T03:38:32.486362Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-08-06T16:43:56.153323Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.153323Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:ad96bf000e2c1aca5537f5d1f061070f9f5c5446f9c87ac9c2b0a2d98361fd2e","observation_id":"f14cccc8-ccfb-4048-80f6-e27b417d6479","resolution":{"observed_at":"2026-08-06T16:43:56.153323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.060819Z","title":null,"venue":null,"work_id":"ceff6f9e-2698-46d4-b13b-b9e2d801edb4","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.908824Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:a7f5c3a178f2ed2e434fa7087c919a23d55555cd045e1eab87c5f6232449ab4b","observation_id":"1a59e300-49da-4caa-aadb-8b592eaaa66d","resolution":{"observed_at":"2026-08-06T16:43:58.123169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:56.327288Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.327288Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:a0c6d530e142c8fd437577298cec2490ec6d1066b2c611a06ba8d0346864606f","observation_id":"779e050d-3b2c-4fc8-82c0-37fff66d0a0c","resolution":{"observed_at":"2026-08-06T16:43:56.327288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14500","last_updated":"2025-03-16T14:39:54Z","snapshot_observed_at":"2026-08-03T02:01:04.625797Z","submitted_at":"2024-07-18T17:59:17Z","title":"ViLLa: Video Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14500","snapshot_observed_at":"2026-08-06T16:43:56.438861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.438861Z"},"links":{"cited_paper":"/paper/2407.14500","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:740171625371b51b1d2dedd91b1c1f2428aaa635dc8f5b973579608a46710626","observation_id":"51c74104-c7d0-4941-bc6f-b74ebc17b510","resolution":{"observed_at":"2026-08-06T16:43:56.438861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.575560Z","title":null,"venue":null,"work_id":"297eb3c0-0cf6-44fe-83ad-4fe7daf51dae","year":2017},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.562407Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:96d918d5be7a91a75a0642eb77d23b2cb70a125798cc1014570426741160e225","observation_id":"2692be33-23e0-4d03-adc8-036c18703da8","resolution":{"observed_at":"2026-08-06T16:43:58.649122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T16:43:56.742905Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.742905Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:fc15d40793deb6fea1f57f0f83932c7b9bb1f537e229c9ba4e9c67ab2ac90e16","observation_id":"ca6fa2cf-931f-4009-9dfa-d76ae7263bb0","resolution":{"observed_at":"2026-08-06T16:43:56.742905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.223424Z","title":null,"venue":null,"work_id":"c921c948-0537-4520-b8b5-845605dea0e5","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.840419Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:b0202d924e534e980c4f6af9df58176ac4f89f9166cc730bcdfeee386ae30224","observation_id":"1a01e4f2-15cd-41e3-9e7e-9001d523c6a2","resolution":{"observed_at":"2026-08-06T16:43:58.280306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:47.679285Z","title":"In Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.679285Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:91bcfddd58b7ed2311e5414ddda94a462062fc79705b25a8500e351b8d5bda06","observation_id":"c7dfce56-4a06-4f92-885f-b178596c0dbe","resolution":{"observed_at":"2026-08-06T16:43:47.679285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.224270Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"fa2cd600-9b20-4b3c-b6be-bd1dc1b48b09","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.913344Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:7bf6c47db9b22e72b7becaff80b0aac127ee3ce13bbbc892e9f65392209f8d18","observation_id":"38fafdee-2a21-4060-9ee1-00f714337a4d","resolution":{"observed_at":"2026-08-06T16:44:02.296635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T16:33:30.327495Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":83,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 3 inbound Pith citation observations for arXiv:2507.12883."}