{"as_of":"2026-08-11T15:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:11438569cf093abc341a4debfa31b07972628fa33f7d440f83d412ca6d1085d1","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:27:33.497742Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:49:04.957341Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T22:30:50.190842Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"cited_work":{"arxiv_id":"2501.09041","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.09041","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative visual commonsense answering and explaining with generative scene graph constructing","venue":null,"work_id":"7f47f246-d8a7-4a78-943c-4b12150bbd37","year":2025},"citing_paper":{"arxiv_id":"2604.09695","last_updated":"2026-04-06T20:44:46Z","snapshot_observed_at":"2026-07-06T22:58:29.952947Z","submitted_at":"2026-04-06T20:44:46Z","title":"Assessing Privacy Preservation and Utility in Online Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T19:49:04.957341Z"},"links":{"cited_paper":"/paper/2501.09041","citing_paper":"/paper/2604.09695"},"observation_digest":"sha256:e1509854b96e75ec5bc07c81ba59f005587b63696c765c9a5d96cdf11a4dd9ac","observation_id":"c5ebc4e5-458a-41c5-8a21-a0bfcc854ac6","resolution":{"observed_at":"2026-05-10T22:30:50.196143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.09041/citation-record","integrity":"/paper/2501.09041/integrity","json":"/paper/2501.09041/citation-record.json","paper":"/paper/2501.09041"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.010610Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.010610Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:9a4245863c344cddeda40e166461488c38aa6e818661471f88d33c79cfb2bc58","observation_id":"cb2f60f2-06ce-40ca-8c45-cdb4d41ac9b1","resolution":{"observed_at":"2026-08-10T20:27:33.010610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.018974Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.018974Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:6b6f6e2e4ec344f2fa2f26cdd04f657e2673bc406526269274a9e063d3c8a056","observation_id":"fcbed731-84ce-4db9-a195-bc05e45788f7","resolution":{"observed_at":"2026-08-10T20:27:33.018974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.030680Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.030680Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:4650e391883cebf61fa8d413874ef845654a78e508d8766355f4aedf2e6af5b2","observation_id":"aa0de65a-0fd6-45fe-943c-d64f6f36882f","resolution":{"observed_at":"2026-08-10T20:27:33.030680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.05739","last_updated":"2020-02-14T02:52:27Z","snapshot_observed_at":"2026-08-10T23:00:55.235607Z","submitted_at":"2019-08-15T20:03:10Z","title":"Abductive Commonsense Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.05739","snapshot_observed_at":"2026-08-10T20:27:33.036271Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.036271Z"},"links":{"cited_paper":"/paper/1908.05739","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:38eddab60bcddb7a3313ec856b7f7b3e2b7d6cdbfd3062ab4383ab7b494272d8","observation_id":"eac59a3c-1cd6-4118-bba1-9f0d72942a3b","resolution":{"observed_at":"2026-08-10T20:27:33.036271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:35.105916Z","title":null,"venue":null,"work_id":"d4444d15-a4f8-4f7c-9018-4618fc9b7c6e","year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.059461Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:a23b69481f98e7a83a2173b33fc54f3901e2b8621fd1e5e353983f6a8ed339ca","observation_id":"fe32df4b-662d-4f46-a86c-a3b2bf87ace8","resolution":{"observed_at":"2026-08-10T20:27:35.123789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:35.046998Z","title":null,"venue":null,"work_id":"d86a107c-f52c-496e-9167-3e14ca6e7df7","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.074862Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:5e447a3c6db6ad29d0fad763a41d7c81b93f336612865b0bd1bfe94ecfd0a09a","observation_id":"2abca3a0-4de9-40f3-ab35-5ae7b31ebab9","resolution":{"observed_at":"2026-08-10T20:27:35.057813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10852","last_updated":"2022-03-27T14:44:00Z","snapshot_observed_at":"2026-08-10T12:15:26.330880Z","submitted_at":"2021-09-22T17:26:36Z","title":"Pix2seq: A Language Modeling Framework for Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.10852","snapshot_observed_at":"2026-08-10T20:27:33.082063Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.082063Z"},"links":{"cited_paper":"/paper/2109.10852","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:d895183ae9f795f56aca6c22d76cd99c51522e924cf873c0b101f74c82b812be","observation_id":"70715bb7-5693-4d66-b31d-dc44db28f634","resolution":{"observed_at":"2026-08-10T20:27:33.082063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:35.080902Z","title":"Advances in Neural Information Processing Systems 31 (2018)","venue":null,"work_id":"71d3efbf-f979-4325-8037-83226206f995","year":2018},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.067324Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:1dce42af0ee85f3edbee16460a89799be44d03b76029f7bc10afa8b5fb4ebeb0","observation_id":"ac2b377f-0e17-4e2a-aa74-c98e49d6644f","resolution":{"observed_at":"2026-08-10T20:27:35.089320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:35.007048Z","title":null,"venue":null,"work_id":"bc9a8c0b-c2ed-4713-a2f8-66878bf8dcce","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.093901Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:5b6b39501f499f1c528e38876d1cb10ab4f12c3210b40ae3a158958f2064dbde","observation_id":"539d03f9-5aca-474d-86e2-7ecbcdd4d97e","resolution":{"observed_at":"2026-08-10T20:27:35.013255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.981606Z","title":null,"venue":null,"work_id":"8d4261b0-f3b5-49b1-886c-0da49eb2c636","year":2017},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.099361Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:9608245d4c7e4f9428664dd6bac8d5c49c30fc70d4561ffaa077ad25900ee87c","observation_id":"638de633-f397-413d-9bde-b26765d7b2d8","resolution":{"observed_at":"2026-08-10T20:27:34.987970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:35.027179Z","title":null,"venue":null,"work_id":"282e2bfa-8c0f-45bc-b9b1-2651e397582e","year":2019},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.088469Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:69054c8adc4e5b428b581d36cbe858ce49e9967f2568a3e1bf182e744a0f050a","observation_id":"5762263c-5255-40ef-9c3d-d562260d2085","resolution":{"observed_at":"2026-08-10T20:27:35.033925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.935318Z","title":null,"venue":null,"work_id":"325b9162-5334-4b24-b883-5e125a0f701d","year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.123022Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:6502e7f20c21eb6c9822a1baf7f5b73970079c423d08db85103fab9a0e535178","observation_id":"c6df612a-3f64-405e-9464-639cc2612002","resolution":{"observed_at":"2026-08-10T20:27:34.943193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-10T20:27:33.153755Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.153755Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:cc0e10f707d8f863cbddf90b5ae3164098c1f025b280b2b2b4caffe9185c317f","observation_id":"76ca6d68-6e72-4354-973a-1c26ce940c3c","resolution":{"observed_at":"2026-08-10T20:27:33.153755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.958033Z","title":null,"venue":null,"work_id":"0d1ea100-3e8a-4262-bbd2-672117133f3f","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.114755Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:f7b078ab91aeaa41f7f22dd1730f536f9c28d3c2358f65a67bb6af78f2e6b98f","observation_id":"cd202432-7dd5-454c-a9a8-bec0297937ca","resolution":{"observed_at":"2026-08-10T20:27:34.964548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T20:27:33.177772Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.177772Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:69c4cf4b475a30cae4b8acf200d05e4e9b0370a40c4a514fa0908e1f2adfbe45","observation_id":"658cdc4a-8226-4f86-a158-8864565155ee","resolution":{"observed_at":"2026-08-10T20:27:33.177772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.892279Z","title":null,"venue":null,"work_id":"18dfdee1-5e26-4e6f-b835-f211986422d4","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.184233Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:e78eb99cacd8fe2299412dc82e565989dfe39dc08bd26e337beb33d514dbac8e","observation_id":"bee6320b-cb82-41c9-8070-e37f5797cc71","resolution":{"observed_at":"2026-08-10T20:27:34.898217Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.912673Z","title":null,"venue":null,"work_id":"239df800-70a6-4202-b4cb-cdb0694a1559","year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.160734Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:d2d6715a920a90b92dd345e2ab6dca9e478489dd41be87433812bfc059f69265","observation_id":"5bbbf62e-101c-4f4c-8804-907a9cecb066","resolution":{"observed_at":"2026-08-10T20:27:34.919231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.197603Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.197603Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:dac094a4e959ba2b29dcd4664d4443971653ec8170baff05fefaf04ad51eca6f","observation_id":"0a83cea5-2694-407e-ba5c-b42b23bff84f","resolution":{"observed_at":"2026-08-10T20:27:33.197603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.821186Z","title":null,"venue":null,"work_id":"9e82defe-d3fa-44ce-8dcc-b2b816ff1e91","year":2015},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.208584Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:763966611e99321d57b6b7b072a864cbd15055769b2a060efbe0b8c236c878dc","observation_id":"f93a2f05-bf15-4867-b3bd-e2493b30fe7a","resolution":{"observed_at":"2026-08-10T20:27:34.827857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.15010","last_updated":"2023-04-28T17:59:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-28T17:59:25Z","title":"LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.15010","snapshot_observed_at":"2026-08-10T20:27:33.190838Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.190838Z"},"links":{"cited_paper":"/paper/2304.15010","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:1c89a6d891ffd00f3d0ded7d9082b015be3b437357193e2b469c554ca9ba6b50","observation_id":"3cea5617-01eb-4417-baa1-941941287a1c","resolution":{"observed_at":"2026-08-10T20:27:33.190838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.218680Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.218680Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:0a9ceec179734d8f3e54dc716db2623e4a44b0263a31048d071f640635e98c27","observation_id":"acd508f6-f7ce-4442-a5ee-d78deafade10","resolution":{"observed_at":"2026-08-10T20:27:33.218680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.750514Z","title":null,"venue":null,"work_id":"c5572f75-2a5c-4c08-a1a1-b689003372d1","year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.235772Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:b663870efb4daf6743c896a729c1812604d5d55fde9e6dd7478b1378aa22fa01","observation_id":"c14c42e6-0ee4-480f-9d70-dd1ca078509c","resolution":{"observed_at":"2026-08-10T20:27:34.756201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.730150Z","title":null,"venue":null,"work_id":"4f00a6d7-d059-4b02-843b-817705c88017","year":2017},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.246013Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:d4469e3c4b1432e5dfaeabdba3c079364abb8cd1bf5dd073cbded6ab01823e57","observation_id":"bb04a637-a997-4507-b349-3803688cda32","resolution":{"observed_at":"2026-08-10T20:27:34.737154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.800202Z","title":null,"venue":null,"work_id":"46a55a74-d344-4a97-9ed2-087e920e9c72","year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.213771Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:3109d562af365c8c69b92bd22953be0a089057c6ff7ad2917f562e58fa361613","observation_id":"46533c28-4d4d-4aac-b463-6fe2336d506a","resolution":{"observed_at":"2026-08-10T20:27:34.806159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.689025Z","title":null,"venue":null,"work_id":"8db9896d-27a6-4b3a-a861-1f2d64a52145","year":2019},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.258320Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:7e57aa34283ec873f12aee30687618ae1d7f204b4bab24ab0eb86e3970583e8c","observation_id":"a237ad42-a9d1-4172-8155-7bb0e31549c6","resolution":{"observed_at":"2026-08-10T20:27:34.694795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.225648Z","title":"International journal of computer vision 123 (2017), 32–73","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.225648Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:4b9fc3aaf5df06c7763b974762c3e1d08617b347015a69ee1de1f27c51d27c08","observation_id":"92a31cdd-a431-4845-94b8-45f0157284bb","resolution":{"observed_at":"2026-08-10T20:27:33.225648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.272817Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.272817Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:b6d13cdbb77530ebfbbd8557ff20c2bb83c323e49680912271d7ba0e424a0506","observation_id":"9a5255fe-7058-40f9-a9f4-803e5282fcab","resolution":{"observed_at":"2026-08-10T20:27:33.272817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.638341Z","title":null,"venue":null,"work_id":"14fab66c-0839-4f3c-9775-c23506150f1a","year":2016},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.278614Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:5ebd8fbb1199b9e5a377bf5a35844f3902b0c8452427e6ae5c484063be539981","observation_id":"ea41abf3-6652-4f09-b9d5-2bad0295f0df","resolution":{"observed_at":"2026-08-10T20:27:34.644486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.708843Z","title":null,"venue":null,"work_id":"99685baa-e47c-4847-ba79-7e25cc244f54","year":2017},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.252339Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:f97f77ba58a6f3412dc37b25ff38635015745dad9972fac4da9282a39abb3bcc","observation_id":"30874c2f-635a-4522-8bcd-425858b6f6b4","resolution":{"observed_at":"2026-08-10T20:27:34.715671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.603685Z","title":null,"venue":null,"work_id":"a3081664-8854-4bac-9d15-dd960dc6a44f","year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.290525Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:8c87b88361c63cb71842a962a67eaa25c5b91895ef08897f5cd6fa9481114114","observation_id":"4b2fd0db-25de-4d3b-a694-1d4991b9cc16","resolution":{"observed_at":"2026-08-10T20:27:34.610867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.266714Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.266714Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:95185bd57679d4eec24cf1a55dcea8e4cc12f3ce008996e41fb96fc42232d74e","observation_id":"9a017599-de24-43d9-8e12-e432fbceb404","resolution":{"observed_at":"2026-08-10T20:27:33.266714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.559119Z","title":null,"venue":null,"work_id":"0ee6e1b0-b013-4bf4-85b3-af1cb611994c","year":2018},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.308938Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:dc59b5682d3154c6ba8fc8b3aaa6a582903f00a4b276692c5dda78ec976a1313","observation_id":"2ab2b72e-da61-4828-8b68-78a27bacc949","resolution":{"observed_at":"2026-08-10T20:27:34.567277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1612.04757","last_updated":"2017-07-25T09:33:03Z","snapshot_observed_at":"2026-07-06T05:22:43.741378Z","submitted_at":"2016-12-14T18:12:47Z","title":"Attentive Explanations: Justifying Decisions and Pointing to the Evidence","version":2},"cited_work":{"arxiv_id":"1612.04757","doi":null,"metadata_source":"pith","pith_arxiv_id":"1612.04757","snapshot_observed_at":"2026-08-10T20:27:34.027524Z","title":"Attentive Explanations: Justifying Decisions and Pointing to the Evidence","venue":"cs.CV","work_id":"c6ae637c-f103-40f0-b80c-0036829a2dc8","year":2016},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.314620Z"},"links":{"cited_paper":"/paper/1612.04757","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:a4ba1b4a5f63b61a0f5ca3f421b422367c8c8405684405de83e824c01f020dd9","observation_id":"76fb8b49-bd25-48a4-b9b9-b2647846ac71","resolution":{"observed_at":"2026-08-10T20:27:34.034539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.284808Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.284808Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:cddd2adbe77f99b843454273ebff902952393a70a3b53a9849d3be8e7d1489df","observation_id":"6797d7b8-9706-4ed8-b7a9-737aac491c7d","resolution":{"observed_at":"2026-08-10T20:27:33.284808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.513223Z","title":null,"venue":null,"work_id":"a01c02f9-2a68-4673-8326-175a408be37c","year":2023},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.330764Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:2360968e6a37b5f9923b7b46035b6c22ade9a0db17a8d3eb2c9aa45eea36b049","observation_id":"b53afe4d-e42a-4753-b455-8707afc8585f","resolution":{"observed_at":"2026-08-10T20:27:34.519225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.336497Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.336497Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:822b81202ba0f184d6abd21339d1798564bb6d041bf175ad3290fcf0965280bd","observation_id":"490e7317-b692-4898-ae68-2b4a1e7fa782","resolution":{"observed_at":"2026-08-10T20:27:33.336497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.302578Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.302578Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:b6a7576b32552c98efc051ecced5efb52b175f32b26a64e775ac37432ce5386b","observation_id":"9f0f9dac-d06a-4cfc-9954-bbbef083628a","resolution":{"observed_at":"2026-08-10T20:27:33.302578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.455303Z","title":null,"venue":null,"work_id":"c77f5764-211b-401d-90e5-97a4c8d8582e","year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.346920Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:d01f13e7439cceaae9c6d195f1d0745026d4f6879382af26a86f9d34be352b79","observation_id":"2f5fd938-5b92-490b-8cc5-f555a01dd287","resolution":{"observed_at":"2026-08-10T20:27:34.463144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08530","last_updated":"2020-02-18T02:59:17Z","snapshot_observed_at":"2026-08-08T09:19:20.381840Z","submitted_at":"2019-08-22T17:59:30Z","title":"VL-BERT: Pre-training of Generic Visual-Linguistic Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08530","snapshot_observed_at":"2026-08-10T20:27:33.352795Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.352795Z"},"links":{"cited_paper":"/paper/1908.08530","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:ad87d2ecbc8e0a8c7dfc42426c887da768b4607ad3f06094a976c55092915fe7","observation_id":"d60ae289-6b88-487b-a098-588669977d05","resolution":{"observed_at":"2026-08-10T20:27:33.352795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.535308Z","title":null,"venue":null,"work_id":"a767bf78-2ab8-4410-bcc2-29d87bc38d27","year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.320050Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:70dea2f6853dd98904c2fee2b2497a0fd7e687b9727fdc332f97aefcbc469146","observation_id":"3bbf6914-a881-4bef-9575-949442bce4a0","resolution":{"observed_at":"2026-08-10T20:27:34.541563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.410873Z","title":null,"venue":null,"work_id":"2234358e-80fa-4700-99ca-7643adf5bd99","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.364237Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:8fdbcb562e7ae602f923f47c0c47d7ce7f62e95c8836b0904cd884cda4ccb65b","observation_id":"0a18f426-aed0-49e8-b51a-7046c6f755f9","resolution":{"observed_at":"2026-08-10T20:27:34.416896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.370939Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.370939Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:782d83056c29419ca27acfeceb11f871a0f15b9f097ebb1c55aff8fec322322e","observation_id":"0015fa8f-8feb-4c26-b953-920e6991daee","resolution":{"observed_at":"2026-08-10T20:27:33.370939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.376612Z","title":null,"venue":null,"work_id":"8eae21f7-2aff-410b-97d5-8f05141fa4e0","year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.376471Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:3f21d2b64a68650ed10d9053d1abe6dbc59501c42e7473453f1cb2f668b847cd","observation_id":"e7c64a0a-f7fc-4ad1-88dc-4f6336c5e237","resolution":{"observed_at":"2026-08-10T20:27:34.384234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.341565Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.341565Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:db000ac0e8389a8485cb303bae694d5988568dbacd470d2a88721c67c8feca36","observation_id":"59413684-7f18-464c-aaff-e3ad8055426b","resolution":{"observed_at":"2026-08-10T20:27:33.341565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.10496","last_updated":"2022-04-28T17:43:36Z","snapshot_observed_at":"2026-07-06T13:02:42.093125Z","submitted_at":"2022-04-22T04:41:04Z","title":"Multimodal Adaptive Distillation for Leveraging Unimodal Encoders for Vision-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.10496","snapshot_observed_at":"2026-08-10T20:27:33.388583Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.388583Z"},"links":{"cited_paper":"/paper/2204.10496","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:f086163a95d493c730228febd6b7a81b16cec2757e98edf6766268f64e8b1f18","observation_id":"c6419447-93a5-4407-a641-95e9f0cce85b","resolution":{"observed_at":"2026-08-10T20:27:33.388583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.351047Z","title":null,"venue":null,"work_id":"e50c1301-7cdc-42f5-86ec-43c9168a617c","year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.395079Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:c362d61dd9da9fe1a2ec0750095003510273d38702687bdc7335be74fab21a2c","observation_id":"fae1ecc1-d61b-4df2-befd-9f1853fc09e5","resolution":{"observed_at":"2026-08-10T20:27:34.360347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.430861Z","title":null,"venue":null,"work_id":"ce23d3a9-70b2-47b8-b7e0-5d9d387caf34","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.358552Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:79801c952c2fc0f303851f3947128ceefae548e6051301e86bacfaee04171a33","observation_id":"cc582317-5560-448b-b3f8-14212c1f65e7","resolution":{"observed_at":"2026-08-10T20:27:34.437103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.324170Z","title":null,"venue":null,"work_id":"446559b1-b0c7-41ae-805e-f592a19be753","year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.406446Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:9260cd81010c3500c4c55474508963c1f8b20ee5cde8edca06793d0a947bfbca","observation_id":"21e4d127-169c-4270-bd06-be3e2b073415","resolution":{"observed_at":"2026-08-10T20:27:34.329394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.06706","last_updated":"2019-01-20T17:55:05Z","snapshot_observed_at":"2026-08-08T23:17:13.003005Z","submitted_at":"2019-01-20T17:55:05Z","title":"Visual Entailment: A Novel Task for Fine-Grained Image Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.06706","snapshot_observed_at":"2026-08-10T20:27:33.412196Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.412196Z"},"links":{"cited_paper":"/paper/1901.06706","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:7c160338adac3f8aa15a2680896538b749a613ec1acd449ba0b2045f06a5e896","observation_id":"b7a13976-b7c5-4cec-8c02-18dddf25778b","resolution":{"observed_at":"2026-08-10T20:27:33.412196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.306803Z","title":null,"venue":null,"work_id":"142e503d-5380-4cbf-9c61-84da821868fa","year":2017},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.417963Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:fa50d22d3b9266c075d0fbc18fdfb563ed0f2e019b400bc7f032462221b607cb","observation_id":"df5d2480-1fcb-4ad5-a18f-703706069eaa","resolution":{"observed_at":"2026-08-10T20:27:34.311561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.07832","last_updated":"2020-08-18T10:04:51Z","snapshot_observed_at":"2026-08-11T11:30:41.945396Z","submitted_at":"2020-08-18T10:04:51Z","title":"Tackling the Unannotated: Scene Graph Generation with Bias-Reduced Models","version":1},"cited_work":{"arxiv_id":"2008.07832","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.07832","snapshot_observed_at":"2026-08-10T20:27:33.949508Z","title":"Tackling the Unannotated: Scene Graph Generation with Bias-Reduced Models","venue":"cs.CV","work_id":"90112dfc-8138-4918-83b0-ea7018ee3d62","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.381878Z"},"links":{"cited_paper":"/paper/2008.07832","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:dbf513eb557e22caabf5b4cc500454de8f1a5579a62f179f673ac35e36ff4f0e","observation_id":"5b0eeab8-5e80-400d-ac62-7fee51ecc784","resolution":{"observed_at":"2026-08-10T20:27:33.959390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.430318Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.430318Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:c161cfc61edc03a893af3fd643d393b91eccc87a1214434b1251ad6f2e8fae04","observation_id":"208acdfb-53af-4491-8e79-9550df355e5a","resolution":{"observed_at":"2026-08-10T20:27:33.430318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.225542Z","title":null,"venue":null,"work_id":"054605c2-e83c-4005-ba01-b0c92b3717d6","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.443177Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:13295b7cc7cfeabdae218664e355a4df113f02984d435436cbf7b12c5db72706","observation_id":"0666551f-cc7f-406b-8f7a-f77b0057cc6a","resolution":{"observed_at":"2026-08-10T20:27:34.230896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10799","last_updated":"2023-02-13T14:02:12Z","snapshot_observed_at":"2026-08-10T18:19:30.964315Z","submitted_at":"2023-01-25T19:29:19Z","title":"Towards a Unified Model for Generating Answers and Explanations in Visual Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10799","snapshot_observed_at":"2026-08-10T20:27:33.400887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.400887Z"},"links":{"cited_paper":"/paper/2301.10799","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:e2d06335504f14dd242c3560c3c47d3c66d30e41a5c2d2e48376715b95c8e8a2","observation_id":"1efe30c9-920e-4e96-90df-95fd6dd4e105","resolution":{"observed_at":"2026-08-10T20:27:33.400887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:33.465355Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.465355Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:3c489eead106bbe911d87c7c9664b0f11515ca64f4e18ebe2f24d66a3364afae","observation_id":"51fddcdb-3a52-4533-b6e4-48e659513a49","resolution":{"observed_at":"2026-08-10T20:27:33.465355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.185437Z","title":null,"venue":null,"work_id":"8e16e312-5e5c-4d33-8b3b-1cd572d041fe","year":2021},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.472104Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:29ec494022e439e14e9f92c1806b69ee49dd45e6d4ccf07333ac2ad2cd8b7870","observation_id":"d1c7ab7a-c9cc-43aa-a809-63574315b054","resolution":{"observed_at":"2026-08-10T20:27:34.192493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.162218Z","title":null,"venue":null,"work_id":"932f2ee4-f07c-48b5-8c5c-86fb906e9068","year":2017},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.478080Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:a4a68f0262bd2cb8bf1361b61d8e782392047b275e7b28cd06e7f4992dcad874","observation_id":"abf49447-9bb1-41cf-8a75-ada427509c57","resolution":{"observed_at":"2026-08-10T20:27:34.169000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.286619Z","title":null,"venue":null,"work_id":"8dde1ade-9b5a-4b05-8ec8-b30450e9c7e3","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.423904Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:2f9788ba2d12486e52e31441a0dbebde0b2455dba0b5797cc5ae67f5e0e11594","observation_id":"500f5ffc-cc84-498b-89a9-1656d8cfe958","resolution":{"observed_at":"2026-08-10T20:27:34.293760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-10T20:27:33.490905Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.490905Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:0e81f9c891ee2d782b9bdd4ce114b9886a3b41ed708acaec38b71c46cb86fa44","observation_id":"cb18a3c9-1398-40e2-98dd-34ff5d97e81c","resolution":{"observed_at":"2026-08-10T20:27:33.490905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-08-11T00:52:12.225793Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-10T20:27:33.497742Z","title":"G2 w/o SG","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.497742Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:90dbefb70e99f7f3b27b199d5e6167e4b9061ef33aca4e600c1fc98fdf4415d0","observation_id":"129f1357-0385-4e8e-a2dd-7f7447e474d4","resolution":{"observed_at":"2026-08-10T20:27:33.497742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.206247Z","title":null,"venue":null,"work_id":"3a9af28f-4f2d-40b7-b30f-4bbb057d8d0c","year":2019},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.458384Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:81927f05381754d9cb4def59b009a3cc4863b0b312f73f251452fee29d5dff65","observation_id":"4aa55458-fec3-4b71-870c-42e0d6ab8f6f","resolution":{"observed_at":"2026-08-10T20:27:34.212502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16199","last_updated":"2024-09-18T23:54:36Z","snapshot_observed_at":"2026-08-06T06:36:02.994951Z","submitted_at":"2023-03-28T17:59:12Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16199","snapshot_observed_at":"2026-08-10T20:27:33.484046Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.484046Z"},"links":{"cited_paper":"/paper/2303.16199","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:6d46d785e0994c222f5564341297a69159fa76b8849e6b7662cc074a76374f2e","observation_id":"9bdd2701-373a-419b-9703-f69ba2801512","resolution":{"observed_at":"2026-08-10T20:27:33.484046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.845651Z","title":"In Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":"358dd20f-7fd1-4db2-8b68-f5333ba0ebfe","year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.202995Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:1d2e08706dc5aef4862d96db7b896b77ef9b1c135e8d4568a977a7202fb8bd2b","observation_id":"4d8ffc59-1f34-43a5-a73f-a1728d48f516","resolution":{"observed_at":"2026-08-10T20:27:34.855375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:35.168416Z","title":null,"venue":null,"work_id":"6899659f-bbef-4328-b07a-778067bc41c5","year":2020},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.024651Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:5a258317168be6e303b5b982559155f2ac69b0d220b58df659901188ca172025","observation_id":"e07a15fe-5576-498c-9592-dd362f743c94","resolution":{"observed_at":"2026-08-10T20:27:35.175718Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:27:34.245487Z","title":"In Proceedings of the AAAI Conference on Artificial Intelligence , Vol","venue":null,"work_id":"a587a345-3ad6-415f-bcd6-72dc90cc353e","year":null},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.437009Z"},"links":{"citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:372eb6e98419cf1255347ffaf4fff89d9e98650dbc1be8b0754f2c215e911870","observation_id":"13a4c318-fc10-4a7e-9e2d-5cb305d81c83","resolution":{"observed_at":"2026-08-10T20:27:34.251676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04231","last_updated":"2023-03-29T08:48:35Z","snapshot_observed_at":"2026-08-09T21:37:35.280163Z","submitted_at":"2022-12-08T12:28:23Z","title":"Harnessing the Power of Multi-Task Pretraining for Ground-Truth Level Natural Language Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04231","snapshot_observed_at":"2026-08-10T20:27:33.325150Z","title":"arXiv preprint arXiv:2212.04231 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.325150Z"},"links":{"cited_paper":"/paper/2212.04231","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:1d45b671b602ac9602433d37924fce3e5b330e33d2f782b45ba622dfd7066e6c","observation_id":"410bf8d6-05ae-4855-a71c-45e752232589","resolution":{"observed_at":"2026-08-10T20:27:33.325150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10944","last_updated":"2025-01-21T10:48:40Z","snapshot_observed_at":"2026-08-08T15:40:37.009420Z","submitted_at":"2023-03-20T08:57:45Z","title":"Location-Free Scene Graph Generation","version":3},"cited_work":{"arxiv_id":"2303.10944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.10944","snapshot_observed_at":"2026-08-10T20:27:34.056334Z","title":"Location-Free Scene Graph Generation","venue":"cs.CV","work_id":"5ffbfba7-dd10-44af-90e0-340085e4203e","year":2023},"citing_paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T20:27:33.296031Z"},"links":{"cited_paper":"/paper/2303.10944","citing_paper":"/paper/2501.09041"},"observation_digest":"sha256:653f86ce966b561d1dcdbbe222d2f27037f552b9bcf319f15c97f374d254dbfe","observation_id":"8d50bb7c-1807-457d-a5e0-e79b9156f9e9","resolution":{"observed_at":"2026-08-10T20:27:34.062396Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.09041","last_updated":"2025-01-15T04:00:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T11:30:38.240328Z","submitted_at":"2025-01-15T04:00:36Z","title":"Generative Visual Commonsense Answering and Explaining with Generative Scene Graph Constructing"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":60,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 1 inbound Pith citation observation for arXiv:2501.09041."}