{"as_of":"2026-08-08T04:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d238415ac503515ed21f29f3671ebe8e40fbd74d3b407426d6f6ca36c4c09ad6","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:24:02.661925Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19242/citation-record","integrity":"/paper/2505.19242/integrity","json":"/paper/2505.19242/citation-record.json","paper":"/paper/2505.19242"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:55.231201Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.231201Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:e5a7dccd396a2b60e0c225f0dcd427f336f9b9e2ae221baa8697c783977a4644","observation_id":"3f6410fe-6fb1-4bb9-98fb-caba500f279a","resolution":{"observed_at":"2026-08-07T14:23:55.231201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:55.291714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.291714Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:20df4441f0ce74a3ac2bb964840ba6a9e5566bfe3a79740ecc2f4e3ef0f790b6","observation_id":"cdb46eb2-b735-48be-978c-ca6a962ed597","resolution":{"observed_at":"2026-08-07T14:23:55.291714Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.05547","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.264624Z","title":null,"venue":null,"work_id":"f012b8bf-7b0a-4dde-98b4-6dbae2beaa65","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.366792Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8909d96b937693cdbdbc7be72ef369dfdea9414035304a02446b9936c1272a46","observation_id":"412683ca-6f9b-4dd5-8200-2bc36d88cd40","resolution":{"observed_at":"2026-08-07T14:24:05.388730Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s24206539","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:03.106768Z","title":"Yu, Y.-D","venue":null,"work_id":"ff96f7ed-862b-4b95-b211-b06de003cd94","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.463304Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:bd1e12272da832b2656005d50799709e0786458f717b6135d89c0271dbe96966","observation_id":"c2f9cadf-12fe-4657-8c24-7907b677958d","resolution":{"observed_at":"2026-08-07T14:24:03.176683Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:15.043895Z","title":"Zhang, Y","venue":null,"work_id":"e1cc4813-55bc-4b9e-a18a-494c5d5693e0","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.588072Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:de0df90c7058f893e1a7337eb72d9aa20dae05cec70f888379dac7bb091f94be","observation_id":"0df95f99-df1f-445d-9ae1-b661898d6657","resolution":{"observed_at":"2026-08-07T14:24:15.153992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.869037Z","title":null,"venue":null,"work_id":"ae196bff-90fc-4946-b870-0fd852858a5a","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.695336Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b0d163c5706d90579ac09a3b446765bf29a6d35ace15819dcd7e690d65be9988","observation_id":"54530ca0-a14c-449c-8991-f03757b523e5","resolution":{"observed_at":"2026-08-07T14:24:14.939368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.651523Z","title":null,"venue":null,"work_id":"3244e2e1-4e78-4308-aa9c-860a282bbd02","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.774266Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:ef49b121e8bd4757942f876d128c026cb3afaf487f45e64015e1652a77218ab4","observation_id":"848018ab-c4e8-4435-b19e-ae27ce6660eb","resolution":{"observed_at":"2026-08-07T14:24:14.745038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14969","last_updated":"2023-05-24T10:02:27Z","snapshot_observed_at":"2026-08-04T01:19:25.211298Z","submitted_at":"2023-05-24T10:02:27Z","title":"MMNet: Multi-Mask Network for Referring Image Segmentation","version":1},"cited_work":{"arxiv_id":"2305.14969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14969","snapshot_observed_at":"2026-08-07T14:24:04.997922Z","title":"MMNet: Multi-Mask Network for Referring Image Segmentation","venue":"cs.CV","work_id":"8cb8d1d6-7851-4ee4-abbd-fe8597f7e04f","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.863064Z"},"links":{"cited_paper":"/paper/2305.14969","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:896642baa253a383e19772455dfa37b0b203c9407eef1c48a12398fb0055e46e","observation_id":"5eee0ec0-c900-4f14-bce0-ac7b9b2f14b9","resolution":{"observed_at":"2026-08-07T14:24:05.093098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.10747","last_updated":"2021-11-25T03:43:26Z","snapshot_observed_at":"2026-07-06T12:10:31.435159Z","submitted_at":"2021-11-21T05:54:17Z","title":"MaIL: A Unified Mask-Image-Language Trimodal Network for Referring Image Segmentation","version":2},"cited_work":{"arxiv_id":"2111.10747","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.10747","snapshot_observed_at":"2026-08-07T14:24:04.784748Z","title":"MaIL: A Unified Mask-Image-Language Trimodal Network for Referring Image Segmentation","venue":"cs.CV","work_id":"2f80e924-a618-43cc-bddf-2f7355593adb","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.923057Z"},"links":{"cited_paper":"/paper/2111.10747","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:15e94c12328557ed833345647ccd986d6cb7f8ad06480c58000fe4775a9fafe8","observation_id":"2edc4afd-c848-419c-913f-0508787ae2c6","resolution":{"observed_at":"2026-08-07T14:24:04.861073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05565","last_updated":"2021-08-12T07:24:35Z","snapshot_observed_at":"2026-07-06T11:37:42.469163Z","submitted_at":"2021-08-12T07:24:35Z","title":"Vision-Language Transformer and Query Generation for Referring Segmentation","version":1},"cited_work":{"arxiv_id":"2108.05565","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.05565","snapshot_observed_at":"2026-08-07T14:24:04.564620Z","title":"Vision-Language Transformer and Query Generation for Referring Segmentation","venue":"cs.CV","work_id":"0c800f62-9d8f-4624-a502-b59d20a3a1c3","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.019878Z"},"links":{"cited_paper":"/paper/2108.05565","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:27d9d8003f577fce2355f7a3bb492f7cdbeb9bdae27536c88a8d882bccf1242c","observation_id":"ac1b0ce9-8dab-4242-9879-a2119c0bbea0","resolution":{"observed_at":"2026-08-07T14:24:04.682750Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.456850Z","title":null,"venue":null,"work_id":"591666b5-13dd-495a-bd10-29af34018c97","year":2025},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.123163Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2a8e462f5f2b4e83f64e53305d5f6adfe3798b575b2e6f4882adc1f713f30e9e","observation_id":"1b93d672-0cb6-4b6f-8022-ab749369de45","resolution":{"observed_at":"2026-08-07T14:24:14.552615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08021","last_updated":"2024-10-25T16:25:26Z","snapshot_observed_at":"2026-08-06T16:06:24.686113Z","submitted_at":"2024-10-10T15:18:19Z","title":"OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling","version":2},"cited_work":{"arxiv_id":"2410.08021","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.08021","snapshot_observed_at":"2026-08-07T14:24:04.368528Z","title":"OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling","venue":"cs.CV","work_id":"092d0445-7b78-4407-839c-2add4fe7af6f","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.247306Z"},"links":{"cited_paper":"/paper/2410.08021","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:ae5af6367d978030d7f4d707cb7028259adedc8865c3898315a5d6e5b6e87557","observation_id":"d2c58a35-5ffa-41a2-bd3c-8a8a7b6918d4","resolution":{"observed_at":"2026-08-07T14:24:04.432677Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/ojsp.2023","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.984251Z","title":null,"venue":null,"work_id":"718848fa-fad2-4c79-a07f-ad956631186f","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.317625Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:9a10f3644f81e5d86567ff6ee03138c49db8b427023ee414eaf5c1a941827408","observation_id":"b35ca022-fd38-4b79-bf1f-4c981d69bec8","resolution":{"observed_at":"2026-08-07T14:24:03.024883Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T14:23:56.388050Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.388050Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:9ec64285e977047fc2e3aa7a63c9af8e1355c8bef8fdd8ff463839428a647e4c","observation_id":"b53b66ad-3e8f-4f5b-842a-6cd644faa492","resolution":{"observed_at":"2026-08-07T14:23:56.388050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.309502Z","title":null,"venue":null,"work_id":"258c3bff-d506-479c-857b-fc8f16fca07f","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.466157Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:f66b967951cc6693285020b375ac42a016b558cc9f03b746b918d4d5d87009f1","observation_id":"c54f4648-76c2-456f-ab7b-d9d613a3b96d","resolution":{"observed_at":"2026-08-07T14:24:14.380077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06718","last_updated":"2023-07-11T18:13:14Z","snapshot_observed_at":"2026-08-05T05:31:21.900215Z","submitted_at":"2023-04-13T17:59:40Z","title":"Segment Everything Everywhere All at Once","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06718","snapshot_observed_at":"2026-08-07T14:23:56.532387Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.532387Z"},"links":{"cited_paper":"/paper/2304.06718","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:4766de2542b0b5bc16da6603f3554f565fe914493f1c2a44c9c446355d6a2f12","observation_id":"abf5aaca-21bb-4d6a-a111-80dc9d3d8b09","resolution":{"observed_at":"2026-08-07T14:23:56.532387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-02T08:01:43.194717Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-07T14:23:56.621484Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.621484Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:25ffaac17731aea89b355b42460cd69d2c4c5aa3fab91f1df3d0dc2d36c9abb9","observation_id":"16464c40-9da1-4e3c-a1af-1ab136a3a7b7","resolution":{"observed_at":"2026-08-07T14:23:56.621484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.105971Z","title":null,"venue":null,"work_id":"1c33cd59-b62b-4026-8ab7-a0b752b9ed53","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.695977Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:bd3dc1bdf145e1f1f0145c4131f954288a061d6838a080b0baa5cc0ba040f350","observation_id":"e2fa1244-118e-4fd5-a092-22e8fec15f3f","resolution":{"observed_at":"2026-08-07T14:24:14.209386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.950712Z","title":null,"venue":null,"work_id":"e18da8de-762d-4f25-b8aa-b30ab9bd94b4","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.763694Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:1752a996fc0f24f3b32ac59ae7fabf2cc54f339aaa027ed6a0ba774d1d1a6d65","observation_id":"d1b7499d-b955-4fb2-9811-4fb21a275e80","resolution":{"observed_at":"2026-08-07T14:24:14.034285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.762695Z","title":null,"venue":null,"work_id":"b61f8090-488e-474a-84cd-1d8bab78cb0c","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.826515Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:846ebea809077e0bcb1fec3047fafb84d4598f45208d1ac084f8d7acf36f463f","observation_id":"2cdfde7c-6275-4341-9fcc-578f69b3ef8c","resolution":{"observed_at":"2026-08-07T14:24:13.849499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.576171Z","title":null,"venue":null,"work_id":"fac59cee-f1fc-4190-b261-7fe0835e3e11","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.927064Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2da64ad38523e8b4263241a6777a252768a2adc587d40a31d5e414c66f410489","observation_id":"f539b3f7-0aa0-41dc-a64e-ffbbdcad97c2","resolution":{"observed_at":"2026-08-07T14:24:13.653021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.390478Z","title":"Liu, et al., Referring image segmentation using text supervision, in: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), IEEE, 2023, pp","venue":null,"work_id":"c00d62ea-0da1-46ce-a972-3e0510cbd100","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.022949Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:059df45ac0a8db6d0243062aef95d44d8381b798c622f30905c97d3f33f7f235","observation_id":"888f1f31-1e12-4423-bd9e-642a46b3f33e","resolution":{"observed_at":"2026-08-07T14:24:13.488439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.253145Z","title":"Alalyani, N","venue":null,"work_id":"2670bd30-629f-48cd-a150-d705dbca04f5","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.136273Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:d72ee13d121a2ab354f6e1190d08de087ffc8e865bc590703ed125b5f775420a","observation_id":"afb4b531-4dd5-4fe7-8ffd-49b1fbc76b48","resolution":{"observed_at":"2026-08-07T14:24:13.304568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.076997Z","title":"Alalyani, N","venue":null,"work_id":"7bc4f10c-f4b8-486c-af91-3bef2bbc59b7","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.285282Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:5aa30fe71f8a748a3e58771a6f64a2b0f5102ce2904fce9be5f96151968c3319","observation_id":"17d8670d-381a-441b-86b2-75bceeb4afef","resolution":{"observed_at":"2026-08-07T14:24:13.174981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:57.397914Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.397914Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:5e330727a50e4206bd7dbeae1dc7ba8e7dd5794cd43610663f3209209fef2317","observation_id":"26e14445-2226-47ed-b3cd-a706bdf235dd","resolution":{"observed_at":"2026-08-07T14:23:57.397914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.922463Z","title":"Shridhar, D","venue":null,"work_id":"6929876f-74bd-473b-a416-ec272f3d03bf","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.517867Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:39778db7ff81681e1b6494e7e67ec5cb73347bbc1f4a27fc068aab6cc8e81824","observation_id":"0c5918fa-4d25-4102-83dc-1ab4d6a164d2","resolution":{"observed_at":"2026-08-07T14:24:13.004080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.708541Z","title":null,"venue":null,"work_id":"e42549b4-42ac-4fc4-adff-af1dd02fcfcd","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.635202Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8e199b88b15700c951be1de1270150267b6308ae8e99b1f9aea025adcadf91c0","observation_id":"d17e2835-d6cf-4d28-aa8b-0219b9c1225f","resolution":{"observed_at":"2026-08-07T14:24:12.831559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.445903Z","title":null,"venue":null,"work_id":"e3d104b2-c839-459e-91e4-4228d32802c1","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.816518Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:91c4bb57d9bc0f2d789b831e16a659815a27f51d4a495d20012e069c0ae8528f","observation_id":"231ae591-fd23-4d3b-ab01-2ea7ef7d12b6","resolution":{"observed_at":"2026-08-07T14:24:12.574482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.193667Z","title":null,"venue":null,"work_id":"385f49d7-e62f-48de-8cff-7af692745ed0","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.935540Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8f56acbd48631f605717ce1997952995ca091583d60aa1c3c78cbd64123c1058","observation_id":"0bec7c59-e0cb-47eb-9141-51e28bd49d4d","resolution":{"observed_at":"2026-08-07T14:24:12.319447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.001875Z","title":null,"venue":null,"work_id":"3ed75c1c-7114-45c3-86e8-31debc2294b7","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.043937Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c99fa58f7ce865f94e455d855aa57892f1529b2440bf837e371a2a73566f076b","observation_id":"067cbf1f-f58b-496c-b010-350c67dc83ef","resolution":{"observed_at":"2026-08-07T14:24:12.107304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.734372Z","title":null,"venue":null,"work_id":"159ae1c7-f20a-4e66-b475-44996fc18cec","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.212888Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:ea4dec345b5f8fcc6eb10c8ef8d1a58759eb697aa1c334f4d13627460075cb73","observation_id":"0e0ff6f3-8991-4445-858b-fd4f36765da6","resolution":{"observed_at":"2026-08-07T14:24:11.870863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.513650Z","title":null,"venue":null,"work_id":"94a4a148-a2f6-4104-8b43-0f8493f46540","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.326136Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:84489fbaa8c6f711bb355eac90b43c20c831def5ef4cedbb5fd2848d79e90edd","observation_id":"69d98dbe-b2af-4509-aae5-63d680b17fe7","resolution":{"observed_at":"2026-08-07T14:24:11.611389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:58.434580Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.434580Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:a3611d88b09e062339662c269af4cdb46132d05c59478e2796573a87331c4416","observation_id":"0ea30ce3-ac38-4b4e-842f-a35c32a162ba","resolution":{"observed_at":"2026-08-07T14:23:58.434580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.287588Z","title":null,"venue":null,"work_id":"323c9e5f-fefe-4c09-9ea8-424e5d9893df","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.563432Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:97f00d9da92ebd7cd6234eedc7eaa52eea99f613beb81007b042e6afb082f158","observation_id":"19a68453-b557-43ee-a567-2d93bf862482","resolution":{"observed_at":"2026-08-07T14:24:11.370014Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.10442","last_updated":"2022-08-31T02:26:45Z","snapshot_observed_at":"2026-07-06T13:44:15.000595Z","submitted_at":"2022-08-22T16:55:04Z","title":"Image as a Foreign Language: BEiT Pretraining for All Vision and Vision-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.10442","snapshot_observed_at":"2026-08-07T14:23:58.697195Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.697195Z"},"links":{"cited_paper":"/paper/2208.10442","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:737b1e22bfff468b6c488878fc47630392321f5c455b8975d112385e0a53923a","observation_id":"55dda319-a44a-484b-af45-a7782b2d1cda","resolution":{"observed_at":"2026-08-07T14:23:58.697195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T14:23:58.809623Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.809623Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b5c8b5e6b2f702521f2031bc0a48fb0387209d7d5653b90c9c7fd370d5f02d5b","observation_id":"b2516255-6c1a-4c0e-821b-184673f4e58f","resolution":{"observed_at":"2026-08-07T14:23:58.809623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.053254Z","title":null,"venue":null,"work_id":"5af28754-4d7c-49db-ba54-8615d7ed879e","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.931516Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:f1a70994e0a0378a793d8e18600de5b443bf01137fde823e0d92bc870846093e","observation_id":"d5f05b20-233d-43e2-9996-0314f6808bc1","resolution":{"observed_at":"2026-08-07T14:24:11.166259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.776803Z","title":null,"venue":null,"work_id":"87eeb3a7-a7e0-492a-9dee-bddb0f438594","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.035287Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:21c7a4a4f84f4b59e6b5750c5aebeadc05edb8ba7889727605f8f5c725bb0042","observation_id":"2466b221-5558-4a6e-b063-2e49e8e0c6d1","resolution":{"observed_at":"2026-08-07T14:24:10.906943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.497761Z","title":"Radford, J","venue":null,"work_id":"a6e20ef0-5263-48e5-8253-7ca21a55d7d9","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.180506Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c23d8ee7de41ee5c30a1f27692d0e73e1655400825bbab85ad50d3730e411165","observation_id":"b631d4ea-e6c3-4389-b97b-ed3feb4a376a","resolution":{"observed_at":"2026-08-07T14:24:10.632179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:59.281949Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.281949Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:26274653d6e5532690b980f73392dc6a5bc6444853c065940a2bf8ef2f414bc1","observation_id":"423aeafe-d9f9-46ae-aa6a-09fdc8f09f43","resolution":{"observed_at":"2026-08-07T14:23:59.281949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.261984Z","title":"not specified, Referring expression comprehension using language adaptive dynamic subnetworks, in: Proceedings of the AAAI Confer- ence on Artificial Intelligence, Vol","venue":null,"work_id":"b4116683-64ba-4c30-b394-239c880af55c","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.439204Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b412941b3177b9bc2b769c24b87b5827cf413ac9090e13e3cdb6f12e29642b4f","observation_id":"96126dca-0cb7-44ca-898a-c6196cbc6fc2","resolution":{"observed_at":"2026-08-07T14:24:10.371389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.043126Z","title":"Hemanthage, H","venue":null,"work_id":"6f387a40-eafc-43c3-9e49-f9a2abbb9893","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.553531Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:d46c058d10a6fe79bade1bcce52530375ee969157c7749096248ab47ae67688c","observation_id":"d220c982-4abf-40f4-8120-a7b4dd6171cf","resolution":{"observed_at":"2026-08-07T14:24:10.148740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.814694Z","title":null,"venue":null,"work_id":"e2d19629-740d-4e87-a785-60ed0b78543e","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.703413Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:3c965aec3418005d9cd69cd67572ab89632b3c994746c950918e01c8a1bcd6a0","observation_id":"9da7424e-4c4d-4846-a2a1-f9677a5c425d","resolution":{"observed_at":"2026-08-07T14:24:09.926052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.643613Z","title":null,"venue":null,"work_id":"63a5cbb2-e057-4147-b3cb-d5c520412626","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.781051Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:da7881919b5850d95f9eb052f5081bb06ac619568455d7b1eec3dff0e42dc6ab","observation_id":"aaf930b9-ce87-4ab2-985e-1ade0322aa45","resolution":{"observed_at":"2026-08-07T14:24:09.714408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.472817Z","title":"Zou, Z.-Y","venue":null,"work_id":"771b2373-5964-4a4c-8e5f-e87b3012d2a6","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.839299Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c39fcb14a00c252b928d5b15787b4e00a49e691f8dbb9b45c693c1cd858e6eeb","observation_id":"412f41f1-7c08-49d3-b47a-22ebc342fad5","resolution":{"observed_at":"2026-08-07T14:24:09.546223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.283593Z","title":null,"venue":null,"work_id":"eccb7685-8d75-421b-8bb2-6b3d8bcd819d","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.925614Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2d4ede6120a0b8ba903fa1f4232e5b8aa7aeb2818424a18b11ef54865060f1e6","observation_id":"5185efd4-c16d-4bb5-88df-51b35726cb53","resolution":{"observed_at":"2026-08-07T14:24:09.366169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.115277Z","title":null,"venue":null,"work_id":"f7a26d0c-24ec-496a-ac56-ee277ff6bbca","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.030773Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:377d92b62b16a9e4a3681f222edc4e7688905659954855d8ec920b1bd0f3efd1","observation_id":"d765574d-0b72-4cf6-93ca-9dfa43452022","resolution":{"observed_at":"2026-08-07T14:24:09.201043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.111259Z","title":"Hadsell, S","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.111259Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2a09b06c22e9ec85771be803a1f72e10aa8358bebf1eab20e9e7af5a0fbfd67c","observation_id":"32441750-473c-4ecb-9aaf-c3d84bdd4c1a","resolution":{"observed_at":"2026-08-07T14:24:00.111259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.913305Z","title":null,"venue":null,"work_id":"083bf5f6-405e-4223-9dd9-0cf72f4a7ffb","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.220749Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:7b5874eacd08b21691d7ac6d7b6308cd0a2d6f3abf7b96746ad4bfa452b1fdef","observation_id":"acc1b547-e3e8-47be-8666-0e3f053482b0","resolution":{"observed_at":"2026-08-07T14:24:09.026516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-19809-0_17","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.870019Z","title":null,"venue":null,"work_id":"825d5941-5355-4a1d-a380-9f4fe6929c5f","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.317061Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:fd9c452d0b70499bf53824b7cfa94a6f00cbff78d51b07418716ab1ac127fc5d","observation_id":"2c8164a5-158e-4815-a5d4-275aa7826736","resolution":{"observed_at":"2026-08-07T14:24:02.906483Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.726346Z","title":null,"venue":null,"work_id":"914356b7-cea8-492f-90cd-189074b52aab","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.398671Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:d054a1ace921ed236b747eec8123430f248b9c5710f379f4fb0b235e8469d925","observation_id":"29267644-e5a1-402c-a845-f44a2f1e0dcd","resolution":{"observed_at":"2026-08-07T14:24:08.828284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.565964Z","title":"Zhang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.565964Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:15b42bfd0934b91d8a74f353899d5ca760da19a1ca922e53744f39fe55bf69b3","observation_id":"82b3b28e-75cc-4fc8-995b-71d5d638f3a6","resolution":{"observed_at":"2026-08-07T14:24:00.565964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.620701Z","title":"Zhang, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.620701Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:744d1869cf7de393694d6a03f6df1c83710b142631b661d4dba9e622b21421d7","observation_id":"848d770f-30f1-44e2-8721-41cfbb2e4972","resolution":{"observed_at":"2026-08-07T14:24:00.620701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.05499","last_updated":"2020-12-07T20:16:40Z","snapshot_observed_at":"2026-08-03T13:46:04.879736Z","submitted_at":"2020-11-11T01:28:11Z","title":"Unsupervised Learning of Dense Visual Representations","version":2},"cited_work":{"arxiv_id":"2011.05499","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.05499","snapshot_observed_at":"2026-08-07T14:24:03.760774Z","title":"Unsupervised Learning of Dense Visual Representations","venue":"cs.CV","work_id":"bbe40933-7e60-45ae-87d4-dd06a8c9852f","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.697079Z"},"links":{"cited_paper":"/paper/2011.05499","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b8795848989c7a19ccabc0089808c433c60516ded2b0856823d604813edb1160","observation_id":"df32b2a5-cb45-4aac-af94-7e79b4cc9678","resolution":{"observed_at":"2026-08-07T14:24:03.849322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.775943Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.775943Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:54811e7d9383a0fd60b4517b6f0b4cab7be2ce1d9ddca715b2de48c225255b7e","observation_id":"1ef81135-eba8-4072-afa4-5b6318bd3adc","resolution":{"observed_at":"2026-08-07T14:24:00.775943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.577605Z","title":null,"venue":null,"work_id":"48771372-576e-4b3c-ad0e-4fc988a547ea","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.862978Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:da6f41b9a1088dd7511a18858e8df6ced2c1945af3004952e1f5820d46dbc7e0","observation_id":"1432f7da-eaef-47c4-b0fd-bff5cf8c402e","resolution":{"observed_at":"2026-08-07T14:24:08.657255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.436569Z","title":null,"venue":null,"work_id":"0eb67b29-52ff-423d-bd22-f7526e0eb330","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.943994Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:a4d8bdd2d64feceabfa1cff699f6f650bcf6a87321b37a9bea652b64a7de1bed","observation_id":"5fa0e70c-cc02-4fb3-b329-db3f9de29aa5","resolution":{"observed_at":"2026-08-07T14:24:08.500465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.314673Z","title":"Margffoy-Tuay, J","venue":null,"work_id":"53e94ec6-263f-4717-9c75-01c0caacc98e","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.017186Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:03d91caa139d6c3ccf68cea06f45f436fc01811e08249d7ddf0f85f650c30263","observation_id":"118f7de5-60b4-4621-a25b-0bd88916e34c","resolution":{"observed_at":"2026-08-07T14:24:08.368385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:01.094938Z","title":"Hochreiter, J","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.094938Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:d9af80224870bac8172e0b7c8fe9349a8b3cc518ae9eb7defe64610f39d9182f","observation_id":"ea41c28b-7846-4fdd-8f49-bb51bb337cd1","resolution":{"observed_at":"2026-08-07T14:24:01.094938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.159529Z","title":null,"venue":null,"work_id":"6cb02767-d949-49ef-87a9-61c7f41f96fb","year":2015},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.141345Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b3e6a35b9e81ce7f5fa1e6443fb4e1f223f388a2b22684087658b56eb0347494","observation_id":"7950053c-14fa-4d21-8639-71daafe7955f","resolution":{"observed_at":"2026-08-07T14:24:08.227758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.959342Z","title":null,"venue":null,"work_id":"24cc4439-4c90-4786-8524-a7bd7534e78b","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.188503Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:de1aa2dcf67efdcaa6ed4155f35803f6d0fbd3c95a1c5ed9c1d5764f2e21d881","observation_id":"e2491f1b-6bdf-4638-be67-e5bec3bedc0c","resolution":{"observed_at":"2026-08-07T14:24:08.053768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.777437Z","title":null,"venue":null,"work_id":"c979ee3b-b776-4063-a9f8-0f812c3d4b32","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.282692Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:35cf6d9d8473456ba2f8d68985f6be30e5ce1cf369e3fcbb9c9499466781d043","observation_id":"9f254d5f-8998-4e6a-ad90-44ab246303e1","resolution":{"observed_at":"2026-08-07T14:24:07.877328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15727","last_updated":"2024-05-21T10:06:33Z","snapshot_observed_at":"2026-07-31T16:58:58.312059Z","submitted_at":"2023-11-27T11:24:25Z","title":"RISAM: Referring Image Segmentation via Mutual-Aware Attention Features","version":4},"cited_work":{"arxiv_id":"2311.15727","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.15727","snapshot_observed_at":"2026-08-07T14:24:03.577171Z","title":"RISAM: Referring Image Segmentation via Mutual-Aware Attention Features","venue":"cs.CV","work_id":"bbd097ed-fad3-4503-88b4-0c81646f94a5","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.366937Z"},"links":{"cited_paper":"/paper/2311.15727","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c9508c4d455e75c28d2b790e203a66fcb15d58b8683e32fc6fc28ef53f6a2559","observation_id":"c85775b8-f1e0-4042-84db-a1d5dea91816","resolution":{"observed_at":"2026-08-07T14:24:03.639776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:01.450292Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.450292Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c2a4a674f86da7811eade590eb8d6c9bdc9e62b1dc31eeb2b69bf1a8f42e63b0","observation_id":"ee341433-de90-4bb6-aae0-1890f69eca37","resolution":{"observed_at":"2026-08-07T14:24:01.450292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.594473Z","title":"Ouyang, H","venue":null,"work_id":"ae5f2d18-e908-4237-956c-ad84354461c9","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.571934Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:90cdaf790ef5f5cc2cebf9ef8957e8f9cdae9c5d747f212407c2477c9e7c4e27","observation_id":"a0331324-08cc-486a-bec5-faafbe7a564a","resolution":{"observed_at":"2026-08-07T14:24:07.693966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.431100Z","title":null,"venue":null,"work_id":"df940cc2-de09-4166-9f2f-37f3d66cf5b9","year":2019},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.630230Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:bfe77e4ba6c7472112e9829362c12f045a128c58b87387e2201f0b7c786e8571","observation_id":"967f50e9-1f7e-49bf-9cb5-15f106fa7f31","resolution":{"observed_at":"2026-08-07T14:24:07.488342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.284961Z","title":null,"venue":null,"work_id":"d1b90935-6ec4-42b5-903e-079b473aa18a","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.713039Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2797c4e436642acbb1616b9398943b313b9f03d596b8df6c978abb4ba997c3ad","observation_id":"208ff8a1-b668-4e2b-b72f-0dfca595616e","resolution":{"observed_at":"2026-08-07T14:24:07.339062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11205","last_updated":"2024-05-18T07:21:12Z","snapshot_observed_at":"2026-07-06T18:16:07.706911Z","submitted_at":"2024-05-18T07:21:12Z","title":"Fuse & Calibrate: A bi-directional Vision-Language Guided Framework for Referring Image Segmentation","version":1},"cited_work":{"arxiv_id":"2405.11205","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.11205","snapshot_observed_at":"2026-08-07T14:24:03.430865Z","title":"Fuse & Calibrate: A bi-directional Vision-Language Guided Framework for Referring Image Segmentation","venue":"cs.CV","work_id":"858b486f-64d4-492c-974c-2f7357e43206","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.789143Z"},"links":{"cited_paper":"/paper/2405.11205","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:a4a05328d42de4678ebf45588f8acc67c12ebcae1c82274b234c372edc3c9422","observation_id":"6930561c-3ab8-4c66-b906-7ad4467d85c1","resolution":{"observed_at":"2026-08-07T14:24:03.476176Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.neucom.2024.01.123","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.741702Z","title":"Shang, Z","venue":null,"work_id":"bbfbcd47-34a6-4537-a91f-7ca9199a314d","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.893751Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:cd68a3a3c5648fae2b21f309cf3af785767532a844b4621f7525dbff8e679e3d","observation_id":"92f42f8a-7bb5-47d9-88ac-83235de47f5f","resolution":{"observed_at":"2026-08-07T14:24:02.784627Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.120741Z","title":null,"venue":null,"work_id":"3f2c57ef-879c-40e6-87c6-886889bc2df8","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.943222Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:5c6564df92319fcdeaa4367d47c1178715051e44823ec5a9cf7e9f3b588036dd","observation_id":"eb10da80-9867-4d9c-8759-206e9dd2e0f4","resolution":{"observed_at":"2026-08-07T14:24:07.209822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.009939Z","title":"Goodfellow, Y","venue":null,"work_id":"223c9bee-c94c-4504-aa5f-182348830797","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.987299Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:d87cb2316ec68589d66aabde4e5ff9531c01ed4380b59d5de56fcd6c5bc0337d","observation_id":"e60e183c-2ac1-4506-8ec1-48aea573963c","resolution":{"observed_at":"2026-08-07T14:24:07.054842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.069128Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.069128Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:6c8142a668e5b6926dc4ce386bd1928e530580786a2d8e4666d839e1a6306ea9","observation_id":"cdd47221-99d3-487f-a880-387df5b5678a","resolution":{"observed_at":"2026-08-07T14:24:02.069128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.803438Z","title":"Milletari, N","venue":null,"work_id":"206b45e7-7a1a-4d15-aa95-858e7e74d96a","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.129152Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2f5dac3a0159263c6a2aa70cf51a3f6e6dc00d0829fae34e99a1257aff344a66","observation_id":"b97f4a7b-0dbd-4738-aa1f-76de91858788","resolution":{"observed_at":"2026-08-07T14:24:06.907686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.183604Z","title":"Chu, Howard chu on lightning memory-mapped database, IEEE Soft- ware 36 (6) (2019) 96–100.doi:10.1109/MS.2019.2936273","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.183604Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:19dc5cb341228db08d96e54000b82f5b7c81f9e80d25f5abab8fa70716720cb8","observation_id":"657c85b3-bd2b-42d5-aa8d-744e2377e846","resolution":{"observed_at":"2026-08-07T14:24:02.183604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.631497Z","title":"Zhang, K","venue":null,"work_id":"ace5e33e-ede0-45dd-8d71-9f49c9aec613","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.246308Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:a2ee07db7b683d021de38daf60ba0b8d31bad9275c52363384dc401d8b82e134","observation_id":"d6d44d36-cc52-4043-915d-e8f1f799e65b","resolution":{"observed_at":"2026-08-07T14:24:06.715852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.429925Z","title":"Pascanu, T","venue":null,"work_id":"9b24f5ff-f5bc-4670-ac87-2741e8c38824","year":2013},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.298821Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:9d4635934524a096e952e579a7dbe711e51538aef4ef3da8664ee75c7fa776a2","observation_id":"0abecf9b-1314-4c10-af9e-c2d1198ec91a","resolution":{"observed_at":"2026-08-07T14:24:06.522769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.323116Z","title":null,"venue":null,"work_id":"901abc4e-28c4-435f-b282-366a0355185c","year":2015},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.356175Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:7c9d525d257f2c674f2321902d11b64f00fdaeb134bdf314c08390aadfeff3a2","observation_id":"f14f776b-07f1-4c25-9094-62683d3e14c1","resolution":{"observed_at":"2026-08-07T14:24:06.384126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.169420Z","title":"Kamath, M","venue":null,"work_id":"50e284f8-bfac-423b-9342-b7e00ae43d60","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.425363Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:a1553c6aa15552037e31be590e6411b0d1e232a76234786906bce94a44d72ac5","observation_id":"d37c73cd-245b-4974-aa88-8b0a11904bc2","resolution":{"observed_at":"2026-08-07T14:24:06.249451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.470522Z","title":"Zhang, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.470522Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:886b2e46b9f00639739d7e4d3f85d223476014012cb8f2cc4c7fd8fd2c12d27e","observation_id":"187f4fd2-7bbd-43e5-901f-b3729b9139de","resolution":{"observed_at":"2026-08-07T14:24:02.470522Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.961312Z","title":"Zhang, Z","venue":null,"work_id":"db721785-3fca-40ad-a647-2bd724115562","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.528517Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2970e50609df2ee0f6a4fc3ee3c3f09be30c9ee801a83a894b01c34f4466daa5","observation_id":"dbd738ab-6934-4fcb-bcfa-a17f2ecf76f8","resolution":{"observed_at":"2026-08-07T14:24:06.043579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.721375Z","title":"Everingham, L","venue":null,"work_id":"7d063d7b-6912-4808-b27d-3a95740ece65","year":2010},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.623529Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2e18205b47db12ac0ea3c8c621b873496ab83fd9809400b4fc438853a186258d","observation_id":"a165994a-ccc8-433b-94f9-cdeec58b8462","resolution":{"observed_at":"2026-08-07T14:24:05.841465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.525907Z","title":null,"venue":null,"work_id":"c04f1c7b-434d-4f49-b7bf-37fe5faa623d","year":2014},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.661925Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:692648c33fce5ede3dd26cda70afe0c0440a8fd028af51f90be95356f1a1ffb5","observation_id":"a7147e71-1754-48d6-a910-ef431c5cdf82","resolution":{"observed_at":"2026-08-07T14:24:05.605840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:15:59.943939Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":50,"verified_exact":11,"verified_fuzzy":18},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 0 inbound Pith citation observations for arXiv:2505.19242."}