{"as_of":"2026-08-13T15:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d20fadf7cad2c12a813fafc86d53d70a3a79501a67dfe939e86f869ba49f7535","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:17:06.263351Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.08125/citation-record","integrity":"/paper/2412.08125/integrity","json":"/paper/2412.08125/citation-record.json","paper":"/paper/2412.08125"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.079046Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.079046Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:d9a454c03a8b215c5e1d01eac1d6620c3d192cd7633280c19b9b0501900e8e32","observation_id":"f58d82cd-87ce-46f3-a166-18ebcd28082a","resolution":{"observed_at":"2026-08-11T18:17:06.079046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.085685Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.085685Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:6fab8a2752116ae15208553da6e20a70887aa6a4d843184314c284d3a3b6c331","observation_id":"c4433e12-1f80-4d58-8798-a1b500086249","resolution":{"observed_at":"2026-08-11T18:17:06.085685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.748209Z","title":null,"venue":null,"work_id":"0d52d1a2-b5ba-4e3d-a88b-f2b488ef1b06","year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.091748Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:88130ea508536acf4ed43a969bca32378c809de430bff4268c11b8d2dadb17b4","observation_id":"01676e43-0156-4087-a744-d4304cac726a","resolution":{"observed_at":"2026-08-11T18:17:06.753232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-11T18:17:06.096170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.096170Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:dc18028e59b730568d6eec899462565be9074eef2a3a43e2a24cfbe759a4b25f","observation_id":"b6fcd400-8301-48bc-82c6-abd86eff57b7","resolution":{"observed_at":"2026-08-11T18:17:06.096170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.734814Z","title":null,"venue":null,"work_id":"adfcf387-5783-482c-9197-f61bf0aa8517","year":2014},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.100611Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:0eec75159ff4cefa3c872ace10e57fff837a570d646b96320cfc016c2ad7635f","observation_id":"8727d7ad-35d7-4b03-af51-3ec900946da0","resolution":{"observed_at":"2026-08-11T18:17:06.739123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.720042Z","title":null,"venue":null,"work_id":"8530a771-a03f-45c8-9987-8186917ffdda","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.106330Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:496a7c03e74dadd9cd9dbc4e019ad25be24d84f317c38ce7159c9fc776e88dad","observation_id":"4382c04f-cf82-4f6a-bc8e-e778f1c4b2fd","resolution":{"observed_at":"2026-08-11T18:17:06.724956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-11T18:17:06.110320Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.110320Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:07cb98d5735e330638b60fa6676ae931bab3767e84f7c64dcc27d4870e77430d","observation_id":"1ade942e-534b-4990-94c9-5b05bc528533","resolution":{"observed_at":"2026-08-11T18:17:06.110320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.708058Z","title":null,"venue":null,"work_id":"376bd63b-d654-4acb-9210-e648d7ef7cf9","year":1960},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.115606Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:5eeb7e9803dff7754be0cc068df729b645e6cb0d8ad60f02b9174a66747ff65c","observation_id":"0db20106-e84b-4b2b-9867-3cdb193824d0","resolution":{"observed_at":"2026-08-11T18:17:06.712027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.695426Z","title":null,"venue":null,"work_id":"fed943f0-c83c-4124-8fb5-fb14e02fa401","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.120616Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:4db861b3c0c954de846c5b6b6f23d0ac4117909094ac4abe2393440fcf3b6d1a","observation_id":"ad22c261-1b7d-4da3-bb11-4d68780fbb53","resolution":{"observed_at":"2026-08-11T18:17:06.698817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13432","last_updated":"2021-08-25T11:36:26Z","snapshot_observed_at":"2026-08-10T03:15:11.377266Z","submitted_at":"2021-06-25T05:12:42Z","title":"Hierarchical Object-oriented Spatio-Temporal Reasoning for Video Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13432","snapshot_observed_at":"2026-08-11T18:17:06.124939Z","title":"H.; Le, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.124939Z"},"links":{"cited_paper":"/paper/2106.13432","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:ea5e4ffa2fceca8a6132b6361975900c22c20ab7996d686d5c8f6abb0d350e6e","observation_id":"b05edda5-4524-4746-ab28-b565712ff025","resolution":{"observed_at":"2026-08-11T18:17:06.124939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.685717Z","title":null,"venue":null,"work_id":"a4532426-a3ca-42c0-999c-79c308c49ca0","year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.129699Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:2c723707bbba5a241aa95df1d4d6851ec5cbd119f12d072e2c8295640615bed1","observation_id":"b676201f-1da9-4b11-b2da-f9550e9be93d","resolution":{"observed_at":"2026-08-11T18:17:06.688823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.673606Z","title":null,"venue":null,"work_id":"65852f13-0951-46e3-837f-e035fdaab700","year":2012},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.135136Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:aa5263cc763ec43b74ecfb72d6a1f45a4635a675aa219ccfaa49a71304dd8ac0","observation_id":"6db5f140-7ae6-43ac-82f8-3a1fb2385b63","resolution":{"observed_at":"2026-08-11T18:17:06.677764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.139711Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.139711Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:f82365fd616db8b22d161b3686208bb8b70ba5cc60f6d2c459849a804ccbbdca","observation_id":"b01563fd-f0cb-464d-b321-e18862bdf64a","resolution":{"observed_at":"2026-08-11T18:17:06.139711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T18:17:06.145369Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.145369Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:c8943e5c23ada0b134750cc84fa59d1a7df34349ee0ef7be9761edbd7ebc17d0","observation_id":"3acd0955-aa33-4cfa-9e04-a58d4f0aeef2","resolution":{"observed_at":"2026-08-11T18:17:06.145369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.654527Z","title":"K.; Patra, B.; et al","venue":null,"work_id":"387f8af1-43f4-4288-bcea-04baeb103d4d","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.150243Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:19a154b33a94b9dd55ba6f0b09fe4f8aa196ba48ba7a82de49e9b4e7d159a84e","observation_id":"44f34efa-2b26-4f89-a99e-e3b5ffa6ef34","resolution":{"observed_at":"2026-08-11T18:17:06.658612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.642038Z","title":"A.; and Manning, C","venue":null,"work_id":"2e35f449-05eb-4acc-8896-2c805a796d90","year":2019},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.154983Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:d29f5dcdeded21a5d557088fc32bcd1609880394c4c552424fb9a89aca2dc4aa","observation_id":"4f524a37-d721-4ca8-b33b-6fff89e7cf42","resolution":{"observed_at":"2026-08-11T18:17:06.646054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.631017Z","title":null,"venue":null,"work_id":"073245e6-3ff7-448d-8f91-7645d6d4a5ec","year":2020},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.159146Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:e84ee6e40736c3372a9e56768338a2e5817ec344a245988188da9d8ae8dd523d","observation_id":"85378678-594f-429f-a86f-d0c333cde960","resolution":{"observed_at":"2026-08-11T18:17:06.635225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.618463Z","title":"M.; and Partee, B","venue":null,"work_id":"c71a2d3c-b0a8-4210-97d3-a78a892afb80","year":1997},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.163853Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:5c3819f145a6d47fb3a94cca89a7a2a2b1b29283ad5251ff0bd288e1aee8bbbf","observation_id":"c7ef61d7-260c-4007-8ea1-6d5507b5a411","resolution":{"observed_at":"2026-08-11T18:17:06.622469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T18:17:06.168470Z","title":"Q.; Sablayrolles, A.; Roux, A.; Mensch, A.; Savary, B.; Bamford, C.; Chaplot, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.168470Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:7ecfe61e085d348263f5762a5ef2157b5cd0ed641ef7800c94fcbb7b16f78a49","observation_id":"15d342f5-9cc3-4e9c-8119-180a5e8db2af","resolution":{"observed_at":"2026-08-11T18:17:06.168470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.607649Z","title":null,"venue":null,"work_id":"c354b8f2-44f2-4bd5-97d0-2cae6f87f430","year":2014},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.172495Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:9ecee5f018a08a27f4248120b371302d0a51c1967f2e217267ee2f14f3e5c1fe","observation_id":"8a800034-f83a-4075-95e9-48e01275d09a","resolution":{"observed_at":"2026-08-11T18:17:06.610873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.596940Z","title":null,"venue":null,"work_id":"af17610e-0571-4261-be9e-ff844d17e241","year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.178237Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:76b098ce5cfa330ea4bdde955b1e137832fcbb6d77b22e43ef69206bc91f2b9c","observation_id":"ca415897-a9cd-4b64-8070-b2379d9416ba","resolution":{"observed_at":"2026-08-11T18:17:06.600755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.584274Z","title":null,"venue":null,"work_id":"df92bfe8-b645-4ac3-9450-f646ed3ef577","year":2019},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.181688Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:cc6b23ae5d6eaaf2eb0381c9f25e5d1b7e3887b1e97629ebbdfe8489347db644","observation_id":"30a11930-083b-44fd-b6c0-9a1f423f7f54","resolution":{"observed_at":"2026-08-11T18:17:06.588209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.572200Z","title":"A.; et al","venue":null,"work_id":"0548587a-53ef-4bfc-8ee5-f8796f049d3c","year":2017},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.185784Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:aef0e921fa622320172f44a2bcd731cd2576d838badcbf6bb29b101103711506","observation_id":"a07a0489-b3e4-4d72-bb5e-8390861370da","resolution":{"observed_at":"2026-08-11T18:17:06.575838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.560634Z","title":"M.; Le, V.; Venkatesh, S.; and Tran, T","venue":null,"work_id":"e69b9c85-a9c8-4807-92ce-d02b73e53c3a","year":2020},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.189130Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:bfaedb10ef174bbcee25d824fe267d09162d16ef4394724b306a6b21ba95136b","observation_id":"4e51bac2-83d4-4e96-9082-fbc0bb9aafe0","resolution":{"observed_at":"2026-08-11T18:17:06.564653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03354","last_updated":"2023-11-06T18:59:44Z","snapshot_observed_at":"2026-08-13T05:31:53.647406Z","submitted_at":"2023-11-06T18:59:44Z","title":"CoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03354","snapshot_observed_at":"2026-08-11T18:17:06.194020Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.194020Z"},"links":{"cited_paper":"/paper/2311.03354","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:019b39383d0aaddf81508a8734fd0e02a95cfd45c51b354ebf01d0dd1bf6157f","observation_id":"70171532-8b38-4b87-800a-21addb893a3e","resolution":{"observed_at":"2026-08-11T18:17:06.194020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.549735Z","title":null,"venue":null,"work_id":"a4ce66c5-3929-4eda-95f9-d4aceed87272","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.198575Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:75cd02b8814ca433b00acc70ee4e332a7c78478cf36e0a6d9006f23c31514fa1","observation_id":"f6e5c6d4-fc1c-48ef-8b65-4e1d4fb2a7c5","resolution":{"observed_at":"2026-08-11T18:17:06.553804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.539277Z","title":null,"venue":null,"work_id":"36888ec6-e1a1-446c-8b95-d6722c601f60","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.203704Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:36011bc919d6969fce3b4a0828fcbfe02917e210f42beef4730938d90c3fd5f2","observation_id":"4311eaea-ea22-4c6c-8fa8-81f5c6699623","resolution":{"observed_at":"2026-08-11T18:17:06.543315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.528424Z","title":null,"venue":null,"work_id":"a7729ca2-8964-4767-b983-cd60112ba55a","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.208478Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:93405a4de4a51d178af0b53d61beaf42c214b1c4d9ed4074db69518574f08b59","observation_id":"ea871e84-cb89-4c6f-ab81-b73d064ce780","resolution":{"observed_at":"2026-08-11T18:17:06.532324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-11T18:17:06.211796Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.211796Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:a6f191824f378948c07652ff911e18684be2c5a8bf887da0082749ec493db02a","observation_id":"a0c43349-e56a-41ad-b84d-47bc035bfe82","resolution":{"observed_at":"2026-08-11T18:17:06.211796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.519493Z","title":"O.; Gandhi, M.; Gao, I.; and Krishna, R","venue":null,"work_id":"cc849bd2-82a6-4948-8ec8-84d81249c8d0","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.215286Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:8f4bb87b6fa64742bd94b5052d6643f6c7234dbaa4516910f97522dc46111ae0","observation_id":"6ab68c9a-8519-4782-97d2-cab93de0a760","resolution":{"observed_at":"2026-08-11T18:17:06.522333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.507781Z","title":"L.; and Murphy, K","venue":null,"work_id":"83feefb4-d080-4ade-bf18-99417776549a","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.219372Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:f5ec4d4411591b3c1f1d590ca4b30e12d5c8cede1d48ebbc3e30f156680621ac","observation_id":"ef1c416e-6d11-4397-b506-b6f202817510","resolution":{"observed_at":"2026-08-11T18:17:06.512468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.495517Z","title":null,"venue":null,"work_id":"0bdd2f22-3c7a-4d44-928b-417ef35189c9","year":2008},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.224014Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:c590011080a9edb4b8115feedc2c33983147317c647956a2f92cad7ada2fc501","observation_id":"3a203d5e-7960-4749-b4b1-08871a28d578","resolution":{"observed_at":"2026-08-11T18:17:06.499596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.484281Z","title":null,"venue":null,"work_id":"d3fd2b57-afc9-4ae1-a13e-22b7d4d54368","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.228524Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:aeefdf5f2f7cfd6d4843ef4bdf078a50caf636bca91ca852a982f7522288637d","observation_id":"5824d950-62c4-4e62-a8b8-55523cedce6b","resolution":{"observed_at":"2026-08-11T18:17:06.487722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.470864Z","title":"A.; Wang, L.; Cervantes, C","venue":null,"work_id":"d9b275f8-f1f7-409d-b61f-d58dcdb4524a","year":2015},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.232348Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:820562332b6680436ab539a00512f41dafe29d0cae5f46cde925476bcc149c42","observation_id":"7929454f-37c9-48fb-8723-50ebb4892fc3","resolution":{"observed_at":"2026-08-11T18:17:06.474955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.459070Z","title":null,"venue":null,"work_id":"6a945470-db40-43d9-a4c1-7ea2de3a250b","year":2019},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.235920Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:87d6860e520fe0dd9224d6764df329543bdfd0a4cb5de61e3f6147de483530d0","observation_id":"46b9664e-ad61-49fe-92a8-6cf885c8f753","resolution":{"observed_at":"2026-08-11T18:17:06.463277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.445178Z","title":null,"venue":null,"work_id":"bc8ba2a6-8816-4826-a718-6b5367fc0d94","year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.239356Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:80195954e971e27aa9486ace75dafc7b6ccb2d7e4078ad52846c11e7e84a7748","observation_id":"3312f287-05ec-40f7-acff-7eab0c313639","resolution":{"observed_at":"2026-08-11T18:17:06.449165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.434292Z","title":null,"venue":null,"work_id":"7254c0f2-bf83-4f46-99a1-642760e290cd","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.243926Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:97fe64fdf6db1ce37789507600df378a5a19dc6b8d2a3d79886ba94774de3933","observation_id":"9729b605-a070-4143-9dc8-8e9558fb27eb","resolution":{"observed_at":"2026-08-11T18:17:06.437893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.422656Z","title":"C.; and Berg, T","venue":null,"work_id":"fecd68e8-c03c-4f29-996c-16bfe4f2650e","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.247642Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:654345ffb2503b19aeb900b6447f31f765c636b529d09271adb261b78ce7c416","observation_id":"17a75dcd-0225-4746-9d2d-d128e63b644a","resolution":{"observed_at":"2026-08-11T18:17:06.426335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.409824Z","title":null,"venue":null,"work_id":"90d36f5b-8e87-43ef-a566-4522f03c6559","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.251198Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:c0da59741b48264fc67a83458ac88355aa002796a7c9049502910bfd56242572","observation_id":"a4922ffa-f999-4e19-bf98-b842174c245f","resolution":{"observed_at":"2026-08-11T18:17:06.414370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08276","last_updated":"2022-06-01T16:45:09Z","snapshot_observed_at":"2026-08-09T00:48:25.798151Z","submitted_at":"2021-11-16T07:55:26Z","title":"Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08276","snapshot_observed_at":"2026-08-11T18:17:06.254943Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.254943Z"},"links":{"cited_paper":"/paper/2111.08276","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:0d4a3441a027941ef88b57d665039d14de2b5e01eb4a3d0edd93d69508b77780","observation_id":"550b026c-80d7-4699-87cc-d6019b2d24c2","resolution":{"observed_at":"2026-08-11T18:17:06.254943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00221","last_updated":"2023-06-22T16:55:44Z","snapshot_observed_at":"2026-08-10T11:59:13.699690Z","submitted_at":"2022-07-01T06:25:53Z","title":"VL-CheckList: Evaluating Pre-trained Vision-Language Models with Objects, Attributes and Relations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00221","snapshot_observed_at":"2026-08-11T18:17:06.258515Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.258515Z"},"links":{"cited_paper":"/paper/2207.00221","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:6df48cc4b00383610a1a916dd53e7d8de898c71398de528964a2fba09c6f2c87","observation_id":"06c6fe06-7548-4ce7-b2f1-1f808c4ebe90","resolution":{"observed_at":"2026-08-11T18:17:06.258515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.395565Z","title":null,"venue":null,"work_id":"619c79c8-832e-4575-89d3-55a7c3f47737","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.263351Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:128f27b2cb4f6c55dbb6bebab5edc1f4a446d6e15456a27f961d2a3768eafaf0","observation_id":"91c6b993-c5ea-4153-89f7-25634aebe423","resolution":{"observed_at":"2026-08-11T18:17:06.400597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T18:08:56.992999Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.08125."}