{"as_of":"2026-08-08T04:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d36049cb3dccfaa15469e9f0aade95502ee40c7324fa21caf41d899c97431b77","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:22:39.581294Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:22:39.462293Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:22:39.638306Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"cited_work":{"arxiv_id":"2506.02708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02708","snapshot_observed_at":"2026-08-07T11:22:39.638306Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","venue":"cs.CV","work_id":"d02e2601-daa1-420c-a57e-2ed5b152d80d","year":2025},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.462293Z"},"links":{"cited_paper":"/paper/2506.02708","citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:c8de133af83a9900fd10fd140cb3bbdded2242b712919590d9e5805abb433fa4","observation_id":"2d14ec3e-2093-4db5-8a10-afb076786963","resolution":{"observed_at":"2026-08-07T11:22:39.644055Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02708/citation-record","integrity":"/paper/2506.02708/integrity","json":"/paper/2506.02708/citation-record.json","paper":"/paper/2506.02708"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"cited_work":{"arxiv_id":"2506.02708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02708","snapshot_observed_at":"2026-08-07T11:22:39.638306Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","venue":"cs.CV","work_id":"d02e2601-daa1-420c-a57e-2ed5b152d80d","year":2025},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.462293Z"},"links":{"cited_paper":"/paper/2506.02708","citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:c8de133af83a9900fd10fd140cb3bbdded2242b712919590d9e5805abb433fa4","observation_id":"2d14ec3e-2093-4db5-8a10-afb076786963","resolution":{"observed_at":"2026-08-07T11:22:39.644055Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.989981Z","title":"IAA datasets (e.g., A V A [3] and AADB [4]) consist of photographs scored by human annotators","venue":null,"work_id":"7997a939-45ec-43b4-b63a-41972c18a3d7","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.466279Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:469de6dc55f0a7550b5d2a9d691fbf09714ee910a55e22703585ab8d9e4fa665","observation_id":"2ed680fc-593e-4dd6-b113-e3cb9919d7a4","resolution":{"observed_at":"2026-08-07T11:22:39.993197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.981227Z","title":"chosen” and “rejected","venue":null,"work_id":"d36c29ca-bb0b-4a96-9dec-6e475d727b6b","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.470068Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:c768cff4c0821e3560fcb7ee3574873bd48e82af97ffd69fc4accf2d7aef3084","observation_id":"d0cefc2e-78b5-4ffc-81df-db73e2e4be8b","resolution":{"observed_at":"2026-08-07T11:22:39.984013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.972080Z","title":"Datasets As IAA datasets, we use A V A [3] and AADB [4]","venue":null,"work_id":"adabfbfe-fc36-4c4c-a758-fb5021ab2547","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.473651Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:5d9e1a161d0e937935bee15b71a8ede658a7aefe68e89d77646cae7a68070b5f","observation_id":"4f956278-0b1b-41a5-a61c-0cb590db9b00","resolution":{"observed_at":"2026-08-07T11:22:39.975082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.962093Z","title":"Main Results Table 1 presents the results of our method applied to the LLaV A-NeXT-7B model on the A V A dataset, a part of which is also plotted in Fig","venue":null,"work_id":"ce0d7a08-3315-4b8e-97f7-a3f7cf71bf98","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.477154Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:207cf1ee1721e4a190989e93d05ff6ca68084d95cc0c2558d0ae51d889bd2209","observation_id":"d154969d-a14e-4f9f-bc31-524d2980b052","resolution":{"observed_at":"2026-08-07T11:22:39.966050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.952348Z","title":null,"venue":null,"work_id":"63874961-c3dc-4267-97c3-524dbba9e60f","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.480624Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:38983523bdbda039ad6e8a947ee2866366863756e444d5ec243fe78cbf81b0f1","observation_id":"61266e04-615f-43eb-abd5-27118940a0e8","resolution":{"observed_at":"2026-08-07T11:22:39.955560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11371","last_updated":"2020-06-23T01:48:56Z","snapshot_observed_at":"2026-07-06T09:30:53.643102Z","submitted_at":"2020-06-16T02:58:10Z","title":"Opportunities and Challenges in Explainable Artificial Intelligence (XAI): A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11371","snapshot_observed_at":"2026-08-07T11:22:39.483907Z","title":"Opportunities and challenges in explainable artificial intelligence (xai): A survey,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.483907Z"},"links":{"cited_paper":"/paper/2006.11371","citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:fe52fc03cfa8c985f2a9de80a70f52d98149f6b0a65c2487c7906e07ad825737","observation_id":"1c806957-c1bc-4ce1-a21f-14b2cd3f5338","resolution":{"observed_at":"2026-08-07T11:22:39.483907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.943155Z","title":"Di- rect preference optimization: your language model is secretly a reward model,","venue":null,"work_id":"3dc075eb-ab7a-41f4-8188-b27197bc241a","year":2023},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.487350Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:096f0b348c80ba0f2e920ee523f22d51da258c2ac261a2c908a17c4c91e79e64","observation_id":"6f17033b-efbc-443f-b088-961e8e222ce9","resolution":{"observed_at":"2026-08-07T11:22:39.946167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.933869Z","title":"Ava: A large-scale database for aesthetic visual analy- sis,","venue":null,"work_id":"af6842b4-4b1f-44e6-98fb-626303d43d35","year":2012},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.490408Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:0779b447798a4c34b97e266e95ec6771d009fa2526e289bb6da5e5cb6766c1b6","observation_id":"82622785-d97b-4c65-b9a4-80d9c7d07411","resolution":{"observed_at":"2026-08-07T11:22:39.936942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.924639Z","title":"Photo aesthetics ranking network with attributes and content adaptation,","venue":null,"work_id":"bcf5cd0e-90d2-4d1b-bcb0-0d7523d675e9","year":2016},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.493391Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:c02575b4b4cdf532cfdb9a286fa50791bc08432e6ad2ed96e434a29a49246c2d","observation_id":"2b5a600b-eecc-42df-a7e5-e780e169823b","resolution":{"observed_at":"2026-08-07T11:22:39.927803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.915957Z","title":"Image aesthetic assessment: An experimental survey,","venue":null,"work_id":"4383bddd-2cbc-46f7-be04-57c8e374ec4e","year":2017},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.496724Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:fcfc9af38597ec809bfe27659124835cefec5ab70446c70ad7468096a157db74","observation_id":"db186e22-6a14-405b-93b7-a10073d233c0","resolution":{"observed_at":"2026-08-07T11:22:39.919018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.906524Z","title":"Vila: Learning image aes- thetics from user comments with vision-language pre- training,","venue":null,"work_id":"724c94cd-235f-4b4d-a70e-943143abbc30","year":2023},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.499831Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:f058658f4f566e2ccc9c1b6a6ec0df0ed6130ab5a032b2cae44ee149c31afe6b","observation_id":"d2e0ca25-5989-4e1e-ab28-8230dd6166ae","resolution":{"observed_at":"2026-08-07T11:22:39.909522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.897964Z","title":"Q-align: Teach- ing LMMs for visual scoring via discrete text-defined levels,","venue":null,"work_id":"72f74092-b8cc-4b54-bff5-2a78a4ca5b10","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.502993Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:c43802fba5ac5ae6a69045a37a80c1f2ce831c4667877b278fc3de5b2dffebfa","observation_id":"9c5efb31-a617-4d67-a0e8-a8ca548135cb","resolution":{"observed_at":"2026-08-07T11:22:39.900889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.888884Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"51deda1c-1f36-46bb-927c-539a838a9ea2","year":2022},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.506200Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:5d5ad9e8aeb3d056c18a85e2b2c58b4700e983501d017d1bde9084590f010509","observation_id":"8f456c4b-6661-45af-be63-7522482f3b63","resolution":{"observed_at":"2026-08-07T11:22:39.892057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.879902Z","title":"Multimodal explanations: Justifying de- cisions and pointing to the evidence,","venue":null,"work_id":"86bc9370-9760-49f9-ae0d-2e2851cb515c","year":2018},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.509131Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:07e31bc2c47bebb94b0b1ffe13754afdcf0471222b2548629fe9ece77132473d","observation_id":"2029f5e8-406e-46f5-a8c8-d1c05c741f62","resolution":{"observed_at":"2026-08-07T11:22:39.882817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14546","last_updated":"2020-04-30T02:20:14Z","snapshot_observed_at":"2026-07-06T09:16:26.306280Z","submitted_at":"2020-04-30T02:20:14Z","title":"WT5?! Training Text-to-Text Models to Explain their Predictions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14546","snapshot_observed_at":"2026-08-07T11:22:39.512099Z","title":"Wt5?! training text-to-text models to explain their predictions,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.512099Z"},"links":{"cited_paper":"/paper/2004.14546","citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:5fe7b847fdf2e41b165afe3f07eb3826ba3d6e2083fdcdb3c1daf6308b7776ad","observation_id":"5673ca2f-f78d-4879-9147-6e596ce96ab1","resolution":{"observed_at":"2026-08-07T11:22:39.512099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.870909Z","title":"Measuring association between labels and free-text ra- tionales,","venue":null,"work_id":"3e00569f-c681-410d-9f9c-a72cd773c287","year":2021},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.515418Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:2573fcdb27e68155bb0d3e8220c96080f2697fe1e20490b3182a848a16719f77","observation_id":"ad6da841-b9bd-4c49-95c0-ed565071435c","resolution":{"observed_at":"2026-08-07T11:22:39.874019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.860667Z","title":"Few-shot self-rationalization with natural language prompts,","venue":null,"work_id":"e88de83f-c052-4860-8524-2783f13befb0","year":2022},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.518373Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:d0eeecbd50f8c6b7cc964029907d678336ede7cfbb4caa45086090bc4e361777","observation_id":"3d03dce8-5ad1-4684-8103-5460ec01d802","resolution":{"observed_at":"2026-08-07T11:22:39.863981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.851976Z","title":"Reframing human- ai collaboration for generating free-text explanations,","venue":null,"work_id":"a29fff39-e18d-40be-94c3-b63836de8fdb","year":2022},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.521342Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:e32e5421f01a41724c313e65bd7396d7152703100051a46a26a4fc56183b6049","observation_id":"a44cd642-adf4-4651-92fc-d1a6ddababa9","resolution":{"observed_at":"2026-08-07T11:22:39.855095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.843307Z","title":"Large language models can self-improve,","venue":null,"work_id":"434bfbce-e188-48a6-a913-64359f75c7be","year":2023},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.524875Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:1ce2077b8654cce5e3584eb45e29900d7a55a5df339fe57bf3d0af9eaa2908cc","observation_id":"ad0369cc-d466-4107-a54e-ac317df08b42","resolution":{"observed_at":"2026-08-07T11:22:39.846348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.834265Z","title":"Self-refine: iterative refinement with self-feedback,","venue":null,"work_id":"ea982088-945a-4eab-b5fb-c44d8c7d2d39","year":2023},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.527683Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:e60aa42da328e5802670a15d6091d99c53def04bd3c6016dbc952ebb667f828d","observation_id":"07d8dcea-0925-4a37-b2bf-5716232228b3","resolution":{"observed_at":"2026-08-07T11:22:39.837216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.824318Z","title":"Self-rewarding language models,","venue":null,"work_id":"8deb43b7-bd26-4196-a534-f388321208a5","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.530544Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:55d4d658c7c1be9274b9f1ac37744ff92bdde9af928da3e70200eb471f24a65a","observation_id":"2829e04c-99cb-42c8-a077-7f354de3a44e","resolution":{"observed_at":"2026-08-07T11:22:39.828007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.814351Z","title":"Iterative reasoning preference optimization,","venue":null,"work_id":"93e0061b-4ecf-43d5-b13e-a0931fec2ad9","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.533483Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:776816f204c886e68b156ceaec01db71bcbf7bc5b281b7bcbd55de30bffa4e3b","observation_id":"bc1c3e5f-368c-4f23-89cd-462e691966c9","resolution":{"observed_at":"2026-08-07T11:22:39.817727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.804053Z","title":"Enhancing large vision language models with self-training on image comprehension,","venue":null,"work_id":"231d4342-e35a-453c-a769-04ff20f8dab5","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.536376Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:d5f19489994c8e1cd929b7f59b92f74de878343c0cfe021842d7f091d4a1afaf","observation_id":"299e03f4-a8c4-463d-bd06-8f77d8d84019","resolution":{"observed_at":"2026-08-07T11:22:39.807526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.793468Z","title":"Ties-merging: resolving in- terference when merging models,","venue":null,"work_id":"fdac057c-29c7-48b6-807b-f0bccf616c26","year":2023},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.539337Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:339e36c5348d8fa1492bd4c9cee82f5aa773205b29fe7d26bbce243bb6515895","observation_id":"1c97a69f-b9b5-4734-bb92-2f0283b2d956","resolution":{"observed_at":"2026-08-07T11:22:39.797117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.782490Z","title":"Nima: Neural image assessment,","venue":null,"work_id":"6a890518-4ccf-493b-97a5-7ab3d4724d41","year":2018},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.542387Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:5379de4f9e7c9dc66587d09214e33399f328951acf5f849e1b8c8d98097a619f","observation_id":"1488d0b1-0aac-4909-85c7-4f6544fdcbbf","resolution":{"observed_at":"2026-08-07T11:22:39.786075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.771663Z","title":"Llava- next-interleave: Tackling multi-image, video, and 3d in large multimodal models,","venue":null,"work_id":"e3ea9caa-e867-4c43-8cf7-65d3b5135bcf","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.545790Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:e80e047db113dddb028cb898d288736c4f3f77d06d9e8826883de74bb9186de7","observation_id":"e9b41c18-baa8-414e-9a52-7767347f148e","resolution":{"observed_at":"2026-08-07T11:22:39.775329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.760982Z","title":"Internvl: Scaling up vi- sion foundation models and aligning for generic visual- linguistic tasks,","venue":null,"work_id":"54db34ec-5af2-42df-ad0b-6a658ca02ed7","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.548993Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:29104f127065dfce6086269355933f6efa675561b5656701582fa224a7be449e","observation_id":"e8c2f30f-c856-4a62-8df6-cf265bfdc897","resolution":{"observed_at":"2026-08-07T11:22:39.764830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.749523Z","title":"Improved baselines with visual instruction tun- ing,","venue":null,"work_id":"64e86d65-9092-4e9b-a4a6-07f1e08617d9","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.552025Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:d267ac6036523f99ad38c3c616c2a671860732086f65f59fb0b9561de543cbdc","observation_id":"f998c6e0-e86f-4f45-b827-f04f267bfcac","resolution":{"observed_at":"2026-08-07T11:22:39.753499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.738159Z","title":"Llava- next: Improved reasoning, ocr, and world knowl- edge,","venue":null,"work_id":"14db29ce-28e3-4b20-a9b0-012934e144b7","year":2024},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.555089Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:cc131795381709853220d0e76d7577d6cccc7573868cc9295aa2ad6ec2dc3a96","observation_id":"c06aba25-5c77-4954-a84e-1d1cdd220dca","resolution":{"observed_at":"2026-08-07T11:22:39.741525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.727387Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"df4bd32a-170e-4d1f-84f2-6e3fa8857d37","year":2022},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.558258Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:3057a857a304e423ecd0b9d78239373aa8bd41274608077793202aa2720eb274","observation_id":"9af17de3-0583-4a8f-8e3d-1c9f7708f031","resolution":{"observed_at":"2026-08-07T11:22:39.731063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.716635Z","title":"Musiq: Multi-scale image quality transformer,","venue":null,"work_id":"041bb95f-bf1f-49a3-8ced-c7629a6f774e","year":2021},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.561156Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:a92bb2cfe8da8124d5a9ee0095b75901b25a01c53031b915968800ef0e64ab94","observation_id":"6a5de88f-dabe-45e2-ba61-986fdeda7801","resolution":{"observed_at":"2026-08-07T11:22:39.720158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.705790Z","title":"This could be achieved by using a higher megapixel camera or a camera with better low-light capabilities","venue":null,"work_id":"1738f822-c8f4-4ca3-90eb-d9deaa23aaad","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.564721Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:5b1800cd128a0deb2ff6ca64046169eee925b5963b5fb5ebf32491cee27200d4","observation_id":"afa70c55-5d1e-46c5-870e-caad3cb39951","resolution":{"observed_at":"2026-08-07T11:22:39.709989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.694898Z","title":"Natural light is often preferred for food photography, as it can create a more appealing and natural look","venue":null,"work_id":"77640c00-e34f-439f-a308-470e3e1e2a1e","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.568061Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:3d637290a112eab81eced0edd75043f6e854c62e3487ca1276eee75adf5d8dc4","observation_id":"85d6f7f8-b259-4e38-ada3-5c5160260a68","resolution":{"observed_at":"2026-08-07T11:22:39.698301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.684216Z","title":"Consider the rule of thirds and the use of negative space to create a more balanced and visually appealing image","venue":null,"work_id":"d6ece0ec-508b-414b-bad0-b091cb90b5dc","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.571989Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:40ac45b01a9f9c24b1328ae4c9bc288ffd92021db3b97384c02a376b1f91e938","observation_id":"1a86cca3-b04c-4bbc-b476-cc50d4e9ae10","resolution":{"observed_at":"2026-08-07T11:22:39.687945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.672659Z","title":"This can help draw attention to the main subject of the image","venue":null,"work_id":"994f018e-7cd1-40d3-afe0-2068e27ecff2","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.575232Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:8eb8cb80e6b4edc28f14b3212722e3b4051a78787a5182b83833ec5b72d5c0d7","observation_id":"9b7adff3-b65d-4a04-ae04-407561c8797e","resolution":{"observed_at":"2026-08-07T11:22:39.676315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.661347Z","title":"This can be done using photo editing software","venue":null,"work_id":"86aa2365-31d6-4152-bf29-6094b8b3af10","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.578134Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:f890254fc89f33b1df774db10c2e720d0b5583bfe873207e1f3af90e5aa6ee3e","observation_id":"7f568fa4-573f-43c6-901a-642a4da335f5","resolution":{"observed_at":"2026-08-07T11:22:39.664944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.651375Z","title":"This could include adjusting the exposure, contrast, and saturation to make the colors pop and the image more vibrant","venue":null,"work_id":"ad99c614-ff31-42d2-80d4-2c87a52a3d4e","year":null},"citing_paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:39.581294Z"},"links":{"citing_paper":"/paper/2506.02708"},"observation_digest":"sha256:0643de6bee72f539d743d127680eef59e4ce1dc760b48e99e2a15296948754e7","observation_id":"6d47d51f-f11b-4494-a38d-5880d631303e","resolution":{"observed_at":"2026-08-07T11:22:39.654556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02708","last_updated":"2025-06-03T10:04:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:15:25.307392Z","submitted_at":"2025-06-03T10:04:19Z","title":"Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2506.02708."}