{"as_of":"2026-08-04T19:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5993629f5dbcb392b9c75ebb95d0868bdc2fd0adab58856f20e93d3ef257aa14","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T17:37:43.652138Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T02:04:26.295057Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2503.06520","last_updated":"2026-05-31T09:29:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-09T08:48:51Z","title":"Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T12:31:43.494099Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2503.06520"},"observation_digest":"sha256:347e4def967440aef1266f2bd0d86f7886df5525ba78f037487d087941dc3a37","observation_id":"187437e8-6175-4583-8aab-06a929c0177a","resolution":{"observed_at":"2026-05-16T12:31:43.561548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2507.12455","last_updated":"2026-05-22T04:17:50Z","snapshot_observed_at":"2026-08-02T08:13:56.451097Z","submitted_at":"2025-07-16T17:55:43Z","title":"Mitigating Object Hallucinations via Sentence-Level Early Intervention","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-25T08:31:24.173135Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2507.12455"},"observation_digest":"sha256:47a43c433345256cc22f6bf83f1b44e1602e9cb0d9058481331dc5b9bc58a664","observation_id":"9ec78942-fa8f-4d43-9ca0-bbefc02526b5","resolution":{"observed_at":"2026-05-25T08:35:32.505195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-04T17:37:43.652138Z","title":"arXiv preprint arXiv:2312.17240 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10748","last_updated":"2025-09-12T23:36:52Z","snapshot_observed_at":"2026-08-04T17:37:42.798846Z","submitted_at":"2025-09-12T23:36:52Z","title":"SCOPE: Speech-guided COllaborative PErception Framework for Surgical Scene Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T17:37:43.652138Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2509.10748"},"observation_digest":"sha256:adbdd5a618604c3d98e1301d5ce6ea24e3a09687199e8ee64a1754c37ff1b9d5","observation_id":"62f8d31d-e6ab-4856-8fba-4b6b33b1b816","resolution":{"observed_at":"2026-08-04T17:37:43.652138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-03T22:08:38.407309Z","title":"Lisa++: An improved baseline for reasoning segmentation with large language model.arXiv preprint arXiv:2312.17240, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.12110","last_updated":"2026-07-01T13:10:45Z","snapshot_observed_at":"2026-08-03T22:08:32.356329Z","submitted_at":"2025-11-15T08:59:21Z","title":"MediRound: Multi-Round Entity-Level Reasoning Segmentation in Medical Images","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T22:08:38.407309Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2511.12110"},"observation_digest":"sha256:bf82856eabfbf8db3278ac01fb0a2b6927a111b301977d000c2c5a002b2e901d","observation_id":"b8e6c691-003d-4ddb-9931-4eabec1e20c5","resolution":{"observed_at":"2026-08-03T22:08:38.407309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2512.10554","last_updated":"2026-04-02T03:14:28Z","snapshot_observed_at":"2026-07-30T11:23:08.233438Z","submitted_at":"2025-12-11T11:38:50Z","title":"Grounding Everything in Tokens for Multimodal Large Language Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-16T23:31:05.422935Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2512.10554"},"observation_digest":"sha256:229769ab47f26e78afdbeb1b5228e9f4c3c93e0b8bafa6d7afa6a4f650d95f5b","observation_id":"a4c3445f-89dd-4afc-95ac-78bf5213f0a9","resolution":{"observed_at":"2026-05-16T23:31:21.918494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2601.03054","last_updated":"2026-04-07T14:46:22Z","snapshot_observed_at":"2026-07-31T17:41:45.462465Z","submitted_at":"2026-01-06T14:37:50Z","title":"IBISAgent: Reinforcing Pixel-Level Visual Reasoning in MLLMs for Universal Biomedical Object Referring and Segmentation","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T17:31:33.903063Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2601.03054"},"observation_digest":"sha256:bef882a63da95c9d2b45a536da96aad7262f5358d2c397a37464162d65c9e015","observation_id":"42dec495-3e45-4b10-b056-02b1f948c5e3","resolution":{"observed_at":"2026-05-16T17:33:10.089758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-02T18:14:38.024845Z","title":"arXiv preprint arXiv:2312.17240 (2023) 7","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.14382","last_updated":"2026-07-26T18:24:27Z","snapshot_observed_at":"2026-08-03T11:42:25.133695Z","submitted_at":"2026-03-15T13:43:34Z","title":"StAR: Segment Anything Reasoner","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T18:14:38.024845Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2603.14382"},"observation_digest":"sha256:207fa6372e9a933e9a9b2c5233453dbf2446ef388d4fb5c12adeba00ba2a6138","observation_id":"09cc0b98-6fe9-4af3-849a-c95f70d962c9","resolution":{"observed_at":"2026-08-02T18:14:38.024845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2603.16024","last_updated":"2026-04-16T02:26:32Z","snapshot_observed_at":"2026-07-06T22:49:19.323519Z","submitted_at":"2026-03-17T00:15:17Z","title":"Speak, Segment, Track, Navigate: An Interactive System for Video-Guided Skull-Base Surgery","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T09:49:10.948061Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2603.16024"},"observation_digest":"sha256:933ac1ac40da4e012d8bdc168ce7f9c738bc496bb080bc69bde834bef0f84e25","observation_id":"a7783ed9-6660-4ed5-a53b-1abea29bc48d","resolution":{"observed_at":"2026-05-15T09:49:54.432320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2604.07916","last_updated":"2026-04-09T07:37:09Z","snapshot_observed_at":"2026-07-30T08:49:19.495595Z","submitted_at":"2026-04-09T07:37:09Z","title":"Tarot-SAM3: Training-free SAM3 for Any Referring Expression Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:13.376684Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2604.07916"},"observation_digest":"sha256:b05d4f0fc2a22d458696236786040f16c874be5f45d832c7697e6a9f2cddf09f","observation_id":"4da97aa2-503b-4371-bb13-ba41ad31e781","resolution":{"observed_at":"2026-05-11T05:21:01.049928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2604.08626","last_updated":"2026-04-17T22:49:55Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T16:00:10Z","title":"WildDet3D: Scaling Promptable 3D Detection in the Wild","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T17:38:13.336003Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2604.08626"},"observation_digest":"sha256:9a8fd35a4d0bf688ef60d288b21135824c3b379c28be3c72bf525770ba52a5a8","observation_id":"a5064ee8-1523-4465-bc78-854d3e1168a2","resolution":{"observed_at":"2026-05-11T06:26:00.559406Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2604.11411","last_updated":"2026-04-13T12:55:56Z","snapshot_observed_at":"2026-08-03T03:42:10.089825Z","submitted_at":"2026-04-13T12:55:56Z","title":"Online Reasoning Video Object Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:03.843441Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2604.11411"},"observation_digest":"sha256:71b072674bd517bef50329f06a19eb373b818fbc58ae25fd74db5f93a3b47424","observation_id":"0fb09e23-dbbf-4626-9f6d-71729ae88fd2","resolution":{"observed_at":"2026-05-11T10:26:03.169679Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2604.15670","last_updated":"2026-07-24T04:48:23Z","snapshot_observed_at":"2026-08-02T16:09:56.976755Z","submitted_at":"2026-04-17T03:48:56Z","title":"PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T09:20:54.635375Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2604.15670"},"observation_digest":"sha256:c6b599339a618fc4d052be5bf2b67b9840c2063e1dc245e25c4469df1c3a13a0","observation_id":"4ae23ad6-39e9-4c56-82c5-b0cc1aa60114","resolution":{"observed_at":"2026-05-10T09:23:37.155620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-02T16:10:02.902806Z","title":"An improved baseline for reasoning segmentation with large language model.CoRR, abs/2312.17240, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.15670","last_updated":"2026-07-24T04:48:23Z","snapshot_observed_at":"2026-08-02T16:09:56.976755Z","submitted_at":"2026-04-17T03:48:56Z","title":"PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T16:10:02.902806Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2604.15670"},"observation_digest":"sha256:83e8a90fbaea5565bd7f60d29c4603721b4319c094e94b9722287a5a8415b837","observation_id":"ff21ad11-394f-41f6-a46c-ea23bfa7bf56","resolution":{"observed_at":"2026-08-02T16:10:02.902806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2605.15951","last_updated":"2026-05-15T13:41:41Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T13:41:41Z","title":"From Failure to Feedback: Group Revision Unlocks Hard Cases in Object-Level Grounding","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-20T18:39:11.904941Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2605.15951"},"observation_digest":"sha256:3bbebfd94152c4d8815f31535736b262e5ce1c73e6b9284d280b06fb3b95d65e","observation_id":"bb6eae89-5126-4dbd-85e7-df2787c76d0d","resolution":{"observed_at":"2026-05-20T18:43:38.823338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2605.16903","last_updated":"2026-05-16T09:28:46Z","snapshot_observed_at":"2026-07-06T23:27:57.805018Z","submitted_at":"2026-05-16T09:28:46Z","title":"WOW-Seg: A Word-free Open World Segmentation Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T21:23:14.311122Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2605.16903"},"observation_digest":"sha256:02b2df05ab21400ec81e6cc1ec2f9df7550ef5365e885adbc8257b0fbf3a3379","observation_id":"ecc43556-e6ee-4412-8332-5cae09ad7d80","resolution":{"observed_at":"2026-05-19T21:27:47.990120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2605.19410","last_updated":"2026-05-19T06:04:23Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T06:04:23Z","title":"Vision Harnessing Agent for Open Ad-hoc Segmentation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-20T05:52:40.429412Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2605.19410"},"observation_digest":"sha256:084fa3c4a794d7f7bceb50cb78d005bf4fd9d1a659d8f6ed6aa050a029bce206","observation_id":"5bbb6738-9c8a-4fe4-bfba-e452482681fd","resolution":{"observed_at":"2026-05-20T05:53:04.398084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2605.23500","last_updated":"2026-06-01T11:20:54Z","snapshot_observed_at":"2026-08-01T15:40:53.796804Z","submitted_at":"2026-05-22T11:04:12Z","title":"B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-25T04:27:15.911342Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2605.23500"},"observation_digest":"sha256:27b2122c794a1b81f7d38d22026483d7d444bdfc4688fbd3aa324184dfa17715","observation_id":"5ffc6271-2490-4f0f-8c69-6b8fbb0dbb25","resolution":{"observed_at":"2026-05-25T04:30:20.640538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2605.23500","last_updated":"2026-06-01T11:20:54Z","snapshot_observed_at":"2026-08-01T15:40:53.796804Z","submitted_at":"2026-05-22T11:04:12Z","title":"B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-30T16:00:40.812912Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2605.23500"},"observation_digest":"sha256:d6ba2a73226cc1b3dadb6ebd3d21c9e8609106f8930ea437fc6ecb5cac2ba7c4","observation_id":"07be46d9-400d-43f4-9488-337d668c1e1b","resolution":{"observed_at":"2026-06-30T16:04:52.970627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2605.26102","last_updated":"2026-05-31T07:20:32Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:58:03Z","title":"InstructSAM: Segment Any Instance with Any Instructions","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T22:34:00.442420Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2605.26102"},"observation_digest":"sha256:b942cf751e3df6370a227bffeb2c1569d1cac86d8700c308d8d8c4f7198c6993","observation_id":"4ff49ed0-1aca-4349-8b64-8134dcd75b98","resolution":{"observed_at":"2026-06-29T22:44:02.057177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.00987","last_updated":"2026-05-31T04:01:10Z","snapshot_observed_at":"2026-07-06T23:41:39.172310Z","submitted_at":"2026-05-31T04:01:10Z","title":"An Open-Source Benchmark and Baseline for Multi-temporal Referring Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T17:40:16.265708Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.00987"},"observation_digest":"sha256:959e2a2b8a8f83fab5b99ab9b749c8522e150c6277666b69ce5ce2ae3ffddac8","observation_id":"24910f6d-07cf-422e-b5f3-ece4397050b8","resolution":{"observed_at":"2026-07-01T20:46:14.171607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.06760","last_updated":"2026-06-04T22:54:59Z","snapshot_observed_at":"2026-08-02T20:21:08.495061Z","submitted_at":"2026-06-04T22:54:59Z","title":"MedSIGHT: Towards Grounded Visual Comprehension in Medical Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T01:29:27.353291Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.06760"},"observation_digest":"sha256:c8000d1b6d3a41e5f9f1cdf3e0758fbfc0d5cb60ac193ab570202f90a3ef248f","observation_id":"19b7584a-bc32-4046-8aba-13d03e401982","resolution":{"observed_at":"2026-07-02T13:16:58.468492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.09303","last_updated":"2026-06-08T10:10:55Z","snapshot_observed_at":"2026-07-06T23:48:39.574979Z","submitted_at":"2026-06-08T10:10:55Z","title":"Reason Twice: Segmentation via Candidate Discovery and Comparative Reasoning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-27T17:01:13.745646Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.09303"},"observation_digest":"sha256:2c318ab7a71bc76a40437cbc2f12fc832b0ccd3c5bc11b1aa2af8bc39025cb53","observation_id":"1d4fe45b-f45e-43ee-b123-c5cadbbc5314","resolution":{"observed_at":"2026-07-03T00:47:30.643650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.19258","last_updated":"2026-06-17T16:35:23Z","snapshot_observed_at":"2026-07-06T23:54:37.596257Z","submitted_at":"2026-06-17T16:35:23Z","title":"CABLE: Cloud-Assisted Bandwidth-efficient LMM-based Encoding for V2X Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T21:35:12.989339Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.19258"},"observation_digest":"sha256:315f21acf8e64aff1d2323b5fdf6ae07c7e918027d4ae6d2a2a1378b19d55fa1","observation_id":"f3eaae0c-7e12-4fe9-b534-50f7d44475b9","resolution":{"observed_at":"2026-07-03T23:59:06.851192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.26120","last_updated":"2026-05-27T02:47:50Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-05-27T02:47:50Z","title":"Dynamic-dLLM: Dynamic Cache-Budget and Adaptive Parallel Decoding for Training-Free Acceleration of Diffusion LLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T13:27:45.796650Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.26120"},"observation_digest":"sha256:6a6222a82c800e0546524a908dc85dbb1e8f5d0dfe0e94ce555f21d0b45e3961","observation_id":"0d660b49-7be2-4f8c-aab7-0ee0e76fd5de","resolution":{"observed_at":"2026-06-29T13:33:28.303947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.26196","last_updated":"2026-06-24T15:20:32Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-06-24T15:20:32Z","title":"From Structure to Synergy: A Survey of Vision-Language Perception Paradigm Evolution in Multimodal Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-26T01:50:54.242508Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.26196"},"observation_digest":"sha256:6ad5fb87acf44f9429705f23881176a48dcb84f9576ff5f7547ed48d07dcd1b8","observation_id":"2d52c394-2ed8-4cbf-972e-56ff8d57e683","resolution":{"observed_at":"2026-07-04T15:09:55.038018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.28724","last_updated":"2026-06-27T04:07:31Z","snapshot_observed_at":"2026-07-07T00:02:47.924620Z","submitted_at":"2026-06-27T04:07:31Z","title":"CCRC: A Change-Aware Captioning and Reasoning Chain for Image Change Captioning and Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T09:58:18.387486Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.28724"},"observation_digest":"sha256:826aff8d1d774fe79a0f6cdb09add9a93a0cd712942d4138e0382e14f1c78b27","observation_id":"c5298ee2-f63a-4f7a-aa66-fbad1f611bc4","resolution":{"observed_at":"2026-06-30T10:04:36.252137Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2606.31924","last_updated":"2026-06-30T16:33:03Z","snapshot_observed_at":"2026-08-01T22:17:51.863711Z","submitted_at":"2026-06-30T16:33:03Z","title":"InstanceControl: Controllable Complex Image Generation without Instance Labeling","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-01T05:37:41.030752Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2606.31924"},"observation_digest":"sha256:4142ec9a1241e0469210f2b0d285080655a482dab007a8eb487db2a3ed1cfdfa","observation_id":"578b0448-f727-4d2e-aeb4-fc2f4c601403","resolution":{"observed_at":"2026-07-01T10:15:45.101408Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":"2312.17240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-07-08T02:04:26.295057Z","title":"An improved baseline for reasoning segmentation with large language model","venue":"cs.CV","work_id":"65f7318c-50ed-477a-9f4c-ed321aa0df93","year":2023},"citing_paper":{"arxiv_id":"2607.06560","last_updated":"2026-07-07T17:58:33Z","snapshot_observed_at":"2026-07-10T23:18:28.655344Z","submitted_at":"2026-07-07T17:58:33Z","title":"Vision as Unified Multimodal Generation","version":1},"reference_index":204,"source":"pdf_text","source_observed_at":"2026-07-08T01:54:30.649092Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2607.06560"},"observation_digest":"sha256:94d9b2823074e73e7f9562d3f0c84691944270f70494dbfdaecab55d658cf175","observation_id":"9fe1f4f0-f427-4707-9a59-8a177d12232d","resolution":{"observed_at":"2026-07-08T02:04:26.296286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-01T23:38:50.776533Z","title":"arXiv preprint arXiv:2312.17240 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15374","last_updated":"2026-07-16T18:18:31Z","snapshot_observed_at":"2026-08-03T21:00:43.071180Z","submitted_at":"2026-07-16T18:18:31Z","title":"Reasoning-Guided Part-Level Visual Grounding via Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T23:38:50.776533Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2607.15374"},"observation_digest":"sha256:d0fcf964046b1e15600729daa1c366934412bdd714053966105f73c94a35546f","observation_id":"ac68ccb2-f914-4178-9ab5-9416b617993c","resolution":{"observed_at":"2026-08-01T23:38:50.776533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-01T11:00:26.207266Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20061","last_updated":"2026-07-22T12:05:13Z","snapshot_observed_at":"2026-08-02T17:20:52.061941Z","submitted_at":"2026-07-22T12:05:13Z","title":"ReferTrack: Referring Then Tracking for Embodied Visual Tracking","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T11:00:26.207266Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2607.20061"},"observation_digest":"sha256:ff03adeb09ec22711f1134c33e173a4c60505c40c3fab5b96a7b2d263de3cec8","observation_id":"b69baf3e-d8ac-470a-b82b-1b371b2783bc","resolution":{"observed_at":"2026-08-01T11:00:26.207266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.17240/citation-record","integrity":"/paper/2312.17240/integrity","json":"/paper/2312.17240/citation-record.json","paper":"/paper/2312.17240"},"outbound":[],"paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2312.17240."}