{"as_of":"2026-08-11T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:955e79fed96f27527729c8ec4eb3db319ebc3901c8df076b70ed895c11548b95","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T08:05:39.980715Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.29461/citation-record","integrity":"/paper/2605.29461/integrity","json":"/paper/2605.29461/citation-record.json","paper":"/paper/2605.29461"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:04c4220cff9aa3e19ab441d755a18b6a8512f3d621a01adf180f041a5658517d","observation_id":"a50cb164-1675-45aa-9219-d9e205126a6a","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"F., and Chen, C.-S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:54673f2b0a64cfbb4c246f55716fd326f7579f0f53bcf53bc67d5f270923719f","observation_id":"fade93ac-c225-47e0-895a-a621e914018d","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"C., and Kirillov, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:ac7f072fdb21c23898e754a130ebf92a078d483364527c39b86c02c42c73fbaf","observation_id":"e7221c23-1ba4-4045-b56e-780cc8470b9b","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Per-pixel classification is not all you need for semantic segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:728642dd80041d3f14754e711750401bf3f1b3f224f19ed5bc7627c618a7048f","observation_id":"9a6c6b0e-9a0d-4a45-a481-b6577e7679c5","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"G., Kirillov, A., and Girdhar, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:ab57954b01bcf07684a8f1677dee91b9fe229d157a5d9457b70a10e393c89a23","observation_id":"9aae2ee4-6541-45a6-a802-658790dd1701","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Mathematical morphology in image processing","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:b1bf51722761f089b1d869f23589b5921b1ce65230aefb7117489be296295672","observation_id":"5039f788-fbc9-49e2-ba7b-01f27aeb42ae","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Segmentation from natural language expressions","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:ac5aba3c14f5f2e6ccbb1a0b5bb1ebd8f3809a9c698e75eb48c9af6191643014","observation_id":"4a607c1e-c9c2-401c-92ca-3731788ce703","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Referitgame: Referring to objects in photographs of natural scenes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:3af8e5dc9e91dd8443015e60432c4df830f045d0c52acfbea2b7e3d2804a5994","observation_id":"43618a6d-cc23-4b77-b200-54b050498d8b","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"C., Lo, W.-Y., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:48e95f3c8ce2f3d404ebd0624649714f922ff4b26566a11f98f394da205ea71e","observation_id":"9bf70268-c6b5-4aef-b59e-2bd9e4f615d4","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"C., Lo, W.-Y., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:63710f3c9f923d7c4807e8e6dae0b86945ffc763df632cd1d46e75ec62fb9a85","observation_id":"06d0e4b6-e3fb-41de-8a8d-eef18457eab8","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Lisa: Reasoning segmentation via large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:816ed9ce1816715815d7e2d6f6a1d705811f707a229dbe4c04ea1155c74eba92","observation_id":"c36dac7c-ef9d-4e2a-81d0-7c67e3a789d9","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Referring image segmentation via recurrent refinement networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:353c283304aec96b3564d2c691ff934d62d53ac75ad2d3d2dd7fa1d3bfc9e0be","observation_id":"4cecd09d-5d52-4479-b4ea-080f122f0c9c","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:efbcde32c9e3dc93f0134d94df25ca0dbaea9638a9ab69760febb58577cd43d6","observation_id":"d6a89188-f0bc-48e9-8b47-d5a9a4134eb4","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"L., and Murphy, K","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:dde341d8c7f032a73d2cbce7778db515620a0cb6e6995dabe863cf2de3f7f72a","observation_id":"3d9dbc8f-5878-4aa4-a947-2d7f3ded359b","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Pixellm: Pixel reasoning with large multimodal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:6d2b1d12086c7295a2425f5181e7aca11a00a1ecf8046615dacca8d158f7ef9c","observation_id":"21a045ef-0a89-443a-b9f8-226f012288ec","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Morphological gradients","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:129d32bbc3656bd872e7bc3346d37a7270a182e164838787168cac7ff0828d34","observation_id":"66dc4466-cbf1-4de1-a757-8025cf7fa73c","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Segmenter: Transformer for semantic segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:37a86050c54e8201a0fb4d1a0b74fda2ea45e28b62d776b5e003ad122129a3e3","observation_id":"b9b1f842-121e-42bb-ada0-0461f20a76d3","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":"2502.14786","doi":"10.48550/arxiv.2502.14786","metadata_source":"pith","pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","venue":"cs.CV","work_id":"50eec732-2d41-432f-9dcf-ac7fff235ea5","year":2025},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:be7eca6125afdc5d03667197b6420bb58a5f65583e2e7fd2df3c6aa5e55c155a","observation_id":"8e95e93d-1bc6-4c59-8439-93ab99044ae7","resolution":{"observed_at":"2026-06-29T08:13:15.857262Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.04655","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T19:57:19.144351Z","title":"X-sam: From segment anything to any segmentation","venue":null,"work_id":"ffea9edb-b57e-4a1d-a21c-9c0bfe9c157c","year":2025},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:7b64d697725ef78ec90e79663b135dba0cded243754a1c7791496b7d09a848b4","observation_id":"18cb95ab-5eeb-4e85-ac76-733203cbd41c","resolution":{"observed_at":"2026-06-29T08:13:15.859715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17606","last_updated":"2024-12-02T03:19:04Z","snapshot_observed_at":"2026-08-09T10:15:00.225568Z","submitted_at":"2024-11-26T17:18:20Z","title":"HyperSeg: Towards Universal Visual Segmentation with Large Language Model","version":2},"cited_work":{"arxiv_id":"2411.17606","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17606","snapshot_observed_at":"2026-07-03T00:47:30.621522Z","title":"Hyperseg: Towards universal visual segmentation with large language model","venue":null,"work_id":"027e4858-ce79-47ad-a12b-af062f5af5e8","year":2024},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"cited_paper":"/paper/2411.17606","citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:d3799f08c60fb3f7578c335015d28fd677aa1db460806b3191d5b2a159b0d9e7","observation_id":"a52b1daa-0dd5-435f-883c-9321a2f63e79","resolution":{"observed_at":"2026-06-29T08:13:15.849992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Gsva: Generalized segmentation via multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:b1ff7e4e002cc4d2f9589dba6bac5920cd680aeaaddfe935b837720e4ca4c48c","observation_id":"5c232775-a369-4b90-9f07-4adbfd523267","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"M., and Luo, P","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:5ec4a6f2990485c80068c077e56301264a757b29a783c4fef7d8811c9d13f42a","observation_id":"c31a6871-b820-472a-b9f0-d9d54cccd402","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:52fd3bbb2e6d7439aa868f552a0676430e7790d185957c895afd4fb7fc79e18a","observation_id":"dfd3f880-f139-47c0-81f1-1695e2215d27","resolution":{"observed_at":"2026-06-29T08:13:15.852405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Cross-modal self-attention network for referring image segmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:d273fcd59c2200b620fe3d7a36bfd7eb9a2eed84f1067f581e1dc44d752faedb","observation_id":"906f6d2e-38f1-4a5f-a865-bd9d2d9f2edd","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:a9f3aa9a01bda05e81070cec10715f2809d5bba58c85a05ad414e458a76af21c","observation_id":"4fe3c79e-8d84-409f-997f-b85a4fe75a17","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04001","last_updated":"2025-11-03T17:35:29Z","snapshot_observed_at":"2026-08-08T01:58:42.644918Z","submitted_at":"2025-01-07T18:58:54Z","title":"Sa2VA: Marrying SAM2 with LLaVA for Dense Grounded Understanding of Images and Videos","version":3},"cited_work":{"arxiv_id":"2501.04001","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.04001","snapshot_observed_at":"2026-07-10T03:06:43.598138Z","title":"Sa2VA: Marrying SAM2 with LLaVA for Dense Grounded Understanding of Images and Videos","venue":"cs.CV","work_id":"fbffda10-106c-432c-b84e-5d0908666921","year":2025},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"cited_paper":"/paper/2501.04001","citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:9f33c6653742b639dd0214932d9a30d7ab3139d24af52214fcd2cf04e10a8032","observation_id":"a9f17795-4a89-4997-9904-6ac4c78cb05e","resolution":{"observed_at":"2026-06-29T08:13:15.854863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:acc4b43f25ba551c8f5372ea0652d27681d145e8ef0029851308cc5ac3db6afc","observation_id":"7541cd03-95ef-4cba-9405-eab92b644cc6","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"C., and Yan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:093a5c37a24d1150d927b9c17a31ea2d0fc9e4335b9f533f8d49543aa664eb61","observation_id":"0c25034c-3088-4ca7-bb35-f9b2685291f1","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:55e059e82fe020169787463429ac72382ce8df75d8a7bd1b9420db5e7cd58c2a","observation_id":"43c9570b-af8a-4d1d-8c67-72a2cf956e51","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Psalm: Pixelwise segmentation with large multi-modal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:b9a733e534b72dfd7b9f45a26617312bed383b543f50180a189cc5aa8e7d055f","observation_id":"cc9af6fc-e17a-4b01-83c7-6cec3012c606","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"H., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:d043f72891c53f11ee5b0ea06ef338157f3e6920623b4eaab09eb1ac2f7a48c1","observation_id":"b3a878dd-2db7-41dd-ab35-4d032dccd8eb","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":"Generalized decoding for pixel, image, and language","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:c66fbae8177f25bb01b2ee582de1b46e19d649f6e7b64818764914ce863507f3","observation_id":"0449e2d9-c9a1-4d54-acf6-b494d217c442","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:05:39.980715Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-29T08:05:39.980715Z"},"links":{"citing_paper":"/paper/2605.29461"},"observation_digest":"sha256:66ccf4c61f3bbab493f82e08a075d022cbabf224df7209f20499f25bd4a2a67b","observation_id":"f0e92224-ac7a-4485-9869-4d592dd29664","resolution":{"observed_at":"2026-06-29T08:05:39.980715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.29461","last_updated":"2026-05-28T06:55:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T12:44:05.364481Z","submitted_at":"2026-05-28T06:55:35Z","title":"FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":28,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2605.29461."}