{"as_of":"2026-08-22T08:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41af16c23cbbb421274b344759cc35d01d59357ca1fb474fde84df68426fd3e1","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:56:45.656815Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03733/citation-record","integrity":"/paper/2608.03733/integrity","json":"/paper/2608.03733/citation-record.json","paper":"/paper/2608.03733"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T13:56:42.499496Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:42.499496Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:217f467c25558f6d5dd9bf17578c09fd239aa635ffd9450fc5971dbfbaacc8fb","observation_id":"5f81f295-1d89-4a10-a1c2-f9939f962691","resolution":{"observed_at":"2026-08-05T13:56:42.499496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-20T14:44:18.211453Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-05T13:56:42.543509Z","title":"arXiv preprint arXiv:2412.08905 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:42.543509Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:bd4d41f6722ea688da6e8dc38adaa1ddcf0f51f44f9d8b7fa63675fad413c05c","observation_id":"c77a3c7a-63be-4931-8dd4-f30bde0d8f7d","resolution":{"observed_at":"2026-08-05T13:56:42.543509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-05T13:56:42.647435Z","title":"arXiv preprint arXiv:2507.01006 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:42.647435Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:34b1c5c4b9f8d7ee6f837c6a5e989dd1c239e65ec500d2a79e77d0900ba7b8bd","observation_id":"159c3f5a-8943-46d3-a629-74c883f543cd","resolution":{"observed_at":"2026-08-05T13:56:42.647435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16640","last_updated":"2024-07-18T09:01:52Z","snapshot_observed_at":"2026-08-17T21:16:50.202546Z","submitted_at":"2024-05-26T17:31:21Z","title":"A Survey of Multimodal Large Language Model from A Data-centric Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16640","snapshot_observed_at":"2026-08-05T13:56:42.716124Z","title":"arXiv preprint arXiv:2405.16640 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:42.716124Z"},"links":{"cited_paper":"/paper/2405.16640","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:e1094d920cd49fa8e0f3cbb142bd1b1104bacff7929b802898689bc377d8e8c7","observation_id":"4e57ee8b-a552-49f5-80f7-c95dac246af2","resolution":{"observed_at":"2026-08-05T13:56:42.716124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:52.421613Z","title":null,"venue":null,"work_id":"5e60ef2e-754a-42ae-9753-faf1de64b2a9","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:42.820710Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:059e867362624595b082aed3b20b887489e9f08de1056893495ef408de049803","observation_id":"b5fa1a5b-5d39-4a54-950b-9d7eff20a917","resolution":{"observed_at":"2026-08-05T13:56:52.483359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:52.237245Z","title":null,"venue":null,"work_id":"ebb2390b-2f96-4a14-a956-ecab6a2d8f17","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:42.910905Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:2bbbb8d68afdc38bdee356a3eb3a83d2492069b1d0ebe2ac0d77c79b076cfd96","observation_id":"e49c62df-bfc9-42cc-af4e-d432d26719f5","resolution":{"observed_at":"2026-08-05T13:56:52.351105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:51.982580Z","title":null,"venue":null,"work_id":"65056a89-495a-43c8-8614-e71362ea0c47","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:42.970364Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:b282d81722b0584d1d711f825276fae8625f7ecb65740383829def1fd5a329f8","observation_id":"19d9c943-da53-468a-982f-ac59720a6bbb","resolution":{"observed_at":"2026-08-05T13:56:52.126608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:51.658853Z","title":"Smith and Daniel Khashabi and Hannaneh Hajishirzi , title =","venue":null,"work_id":"ef1c8cb3-dd8b-44ee-bfcf-cf77cb579771","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.102803Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:c36b2b44e3c9753e70e660e915f286153360f8aaafee77ad900d74e9dd3980a0","observation_id":"e1d1fadb-5c2c-4c9f-b948-b552a8f313c1","resolution":{"observed_at":"2026-08-05T13:56:51.772534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:51.421492Z","title":null,"venue":null,"work_id":"cbf9a9f0-0e29-4f67-bd94-ca4ee9e7e8f9","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.173964Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:aa3d34e21571793e38b8b616f679972ce5c838fb659a71169e5caf94416277e2","observation_id":"03d93b0e-631e-44fa-957b-648c0bbfc4c0","resolution":{"observed_at":"2026-08-05T13:56:51.525488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:51.152360Z","title":"NeurIPS , volume=","venue":null,"work_id":"ab22e69f-372a-4256-a63c-b0d679b29ab6","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.249161Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:6e06a49731fc1333004ea62cebf99a9a4c4fc8e7f4d3c760b2bbe2d7dc917714","observation_id":"2cde5260-58ee-43da-89de-c4dd1d37fae0","resolution":{"observed_at":"2026-08-05T13:56:51.250880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:50.851447Z","title":null,"venue":null,"work_id":"e1d7d9f8-a3a9-40da-a183-ee72afaf0e9e","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.352265Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:2ac6499f020815bc8c0c4dc8529873f79ef634291104d1234d4b633d63f5383e","observation_id":"7a48faff-a0cd-4bdc-96c7-c6edc95efc38","resolution":{"observed_at":"2026-08-05T13:56:51.023125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:50.591885Z","title":null,"venue":null,"work_id":"d94bfcaa-e84c-4125-a572-c5afd4de9bce","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.405625Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:4379897b2f91372d9a1def0fa052c5ffac5002f261606a26b9e355c484633dc8","observation_id":"bb7e84c2-d6ae-4d46-a68c-ddff227f9946","resolution":{"observed_at":"2026-08-05T13:56:50.696059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:50.340278Z","title":"Zou and Kai","venue":null,"work_id":"49df11e7-8f01-4856-9f83-88383994df59","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.521472Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:25e4d01e030ae70c2f9daecd6b9ec17c669fd1d80857c4da0a2eb284ddb6ca87","observation_id":"ecd63525-c92e-4ce7-a99c-8a4b6a4317d9","resolution":{"observed_at":"2026-08-05T13:56:50.460039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:50.118092Z","title":"NeurIPS , volume=","venue":null,"work_id":"fb9281ff-9e9a-496d-8326-78eac0d68380","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.594367Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:f0a3fbf14d7e1bdffa5b467ad30083862ebb42ce2a99740ee52ebbc9f40447e8","observation_id":"6e8eecef-7a85-4736-9b24-43f1133bfb79","resolution":{"observed_at":"2026-08-05T13:56:50.226338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20705","last_updated":"2026-04-22T15:46:42Z","snapshot_observed_at":"2026-08-15T22:24:27.472726Z","submitted_at":"2026-04-22T15:46:42Z","title":"SSL-R1: Self-Supervised Visual Reinforcement Post-Training for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2604.20705","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20705","snapshot_observed_at":"2026-08-05T13:56:46.683829Z","title":"SSL-R1: Self-Supervised Visual Reinforcement Post-Training for Multimodal Large Language Models","venue":"cs.CV","work_id":"22221153-6729-48d7-b445-cf4a87d2e2cd","year":2026},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.645518Z"},"links":{"cited_paper":"/paper/2604.20705","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:abfde40bc22e61aa397547945c5bc1dce9c664143204a33412845c3109a9e600","observation_id":"fd97243f-5c04-4656-9560-48fe1ac9104e","resolution":{"observed_at":"2026-08-05T13:56:46.759454Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:43.697769Z","title":"arXiv preprint arXiv:2510.14958 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.697769Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:a428acdbb788aeaa945529b85b4a95d3022e3b4bc9d2902301584eded96a05fc","observation_id":"50e0c54e-71ea-4eda-b91d-bdc2a9f62d2e","resolution":{"observed_at":"2026-08-05T13:56:43.697769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:49.833985Z","title":null,"venue":null,"work_id":"823aea71-4673-4521-a521-17cb0ed3c2f5","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.797060Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:35e2a407808d73ff9ffb59606a91f3e6d5896a079506400c7b05824cb43511ff","observation_id":"28f7560c-2402-4377-b2e4-c8fde1fb4473","resolution":{"observed_at":"2026-08-05T13:56:49.965887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:49.526591Z","title":"CVPR , pages=","venue":null,"work_id":"340c0882-497a-486b-a166-3ad21ad0ec8b","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.908691Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:fd929bd80eb156c8874d9213b9386e282a3c435497cdae62bafb0f3b9413446a","observation_id":"3bef8768-b81e-4a4a-a840-82dc3900e2c2","resolution":{"observed_at":"2026-08-05T13:56:49.658150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:49.223228Z","title":"CVPR , pages=","venue":null,"work_id":"23ba2b91-ca13-43a4-bf02-63645fa3b2c7","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:43.954592Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:7214f295c28774be343c88e3f7108f0c2a6fd8fe66ecaf6b62ad71c3b94c4126","observation_id":"9afcbc4d-a3b5-4e1d-a4fd-56675a308313","resolution":{"observed_at":"2026-08-05T13:56:49.335268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03300","last_updated":"2026-06-15T19:28:32Z","snapshot_observed_at":"2026-08-16T18:19:41.283950Z","submitted_at":"2026-02-03T09:26:32Z","title":"R1-SyntheticVL: Is Synthetic Data from Generative Models Ready for Multimodal Large Language Model?","version":2},"cited_work":{"arxiv_id":"2602.03300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.03300","snapshot_observed_at":"2026-08-05T13:56:45.816309Z","title":"R1-SyntheticVL: Is Synthetic Data from Generative Models Ready for Multimodal Large Language Model?","venue":"cs.LG","work_id":"9fd55f14-4c40-43cf-9b97-26e87d34e057","year":2026},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.033301Z"},"links":{"cited_paper":"/paper/2602.03300","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:ed5af822cd2daac9e7ccd1e828c8b748359d473a24e74e18278ec321fd00299c","observation_id":"c3c1546c-e411-47a9-bb16-a3fd71806f16","resolution":{"observed_at":"2026-08-05T13:56:45.865689Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:49.053498Z","title":"NeurIPS , year =","venue":null,"work_id":"90c3e6fd-6373-4ea1-a8d1-88bb9a571d58","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.095774Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:45b21cca0c2a2931e1b47592900f4d5e2a6d81243cee81c32d524e7dd87be7d3","observation_id":"9ec4c60d-6207-46c1-b16b-149e64abaec5","resolution":{"observed_at":"2026-08-05T13:56:49.118786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25787","last_updated":"2026-06-11T06:39:23Z","snapshot_observed_at":"2026-08-18T10:11:01.168025Z","submitted_at":"2025-09-30T04:57:26Z","title":"Self-Evolving Vision-Language Models for Image Quality Assessment via Voting and Ranking","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25787","snapshot_observed_at":"2026-08-05T13:56:44.151913Z","title":"arXiv preprint arXiv:2509.25787 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.151913Z"},"links":{"cited_paper":"/paper/2509.25787","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:5b045a2b15f210c5db690c1b60ff4e88385e5f05e43813964adc9cbbf530008e","observation_id":"cb909bf1-ede6-492d-8688-094e24ca4903","resolution":{"observed_at":"2026-08-05T13:56:44.151913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:48.790210Z","title":null,"venue":null,"work_id":"78f4af92-e1b7-475c-ae75-2fb17b463588","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.278830Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:597623623260eba36d4a008ee631f5b2e6d6687fd896a7fe96c410c14c28ac9a","observation_id":"c7fddf86-7132-47a1-bb79-de7e513b07c2","resolution":{"observed_at":"2026-08-05T13:56:48.890522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-20T12:52:29.141935Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-05T13:56:44.345409Z","title":"arXiv preprint arXiv:2411.15594 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.345409Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:a07ee0c13735b5ca13521b2e1dcab1707d38203084d1177393bf373ed2a9b0ed","observation_id":"c7acdce0-05b1-42e2-b0f8-b025c39bf99a","resolution":{"observed_at":"2026-08-05T13:56:44.345409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:48.613014Z","title":null,"venue":null,"work_id":"aeca0b5f-512b-45cd-9871-157524070f12","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.441595Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:fc3c487d4fb447968a989569ae96263c45ad78a9f6fc377181e8b016c2cfe260","observation_id":"28667ed7-72cf-4824-a6ee-dff006c91f49","resolution":{"observed_at":"2026-08-05T13:56:48.705574Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:44.487778Z","title":"Le and Ed H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.487778Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:f9dd84acf4c4119c7a92144de5c9e06e8921a92263e3fc62f60db78904fcf89f","observation_id":"5c6b0285-e729-49a3-a6ab-f54984c3299d","resolution":{"observed_at":"2026-08-05T13:56:44.487778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:48.498285Z","title":"Pattern Recognit","venue":null,"work_id":"4ac1a617-684a-498a-87db-c7800a90c471","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.562495Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:18478e22ebbeebad4b7230e98cd4e3fdfe6f62f56dfce11d9e248e671a41aaf1","observation_id":"e21a99f4-b8f3-4f9f-bd0e-af97b3741c35","resolution":{"observed_at":"2026-08-05T13:56:48.566953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:48.320034Z","title":null,"venue":null,"work_id":"483cf771-aa33-4778-93c6-9e1f952cf271","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.619543Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:2a58b5e3e87a4fde125884fdde306925f8d8c3a983f39515aed7bffc79651221","observation_id":"f11d3859-7cb7-4f60-bcff-a2eed9e9f654","resolution":{"observed_at":"2026-08-05T13:56:48.424066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:48.169841Z","title":null,"venue":null,"work_id":"60d16d31-7464-4cf5-b0f6-413a0bdb2701","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.711071Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:f46559b7e78f88c14237d76c09d3a3398dbc7f0e23534204edaa717d7d873ac2","observation_id":"59378b28-970f-426b-9cb5-4cd5f1e4a0c4","resolution":{"observed_at":"2026-08-05T13:56:48.252454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-05T13:56:44.772546Z","title":"arXiv preprint arXiv:2307.16125 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.772546Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:78656e5ff851a2f418acf5613af8da2c20b32a7e246febc1918f1f1c31401960","observation_id":"29b30ac9-c555-4dea-8c62-98ee2bb8759d","resolution":{"observed_at":"2026-08-05T13:56:44.772546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:48.016127Z","title":null,"venue":null,"work_id":"3b32fb51-9dcf-44a7-85ef-0233de9a7e1e","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.843168Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:15bb7fda18649caf78522a2b972081daaecd379d8573d2598a64ae2eb5b19346","observation_id":"d177bf4b-3008-488c-8953-6c2293e7409d","resolution":{"observed_at":"2026-08-05T13:56:48.100367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:47.818656Z","title":null,"venue":null,"work_id":"a2ca38bf-7d75-4994-bdb7-14aaf4e56ab0","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:44.947527Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:580d076a66360ea14da07b2ca4870f5b4ad84e64958f16c4fa914ca45332607a","observation_id":"d082aada-45e5-411b-a847-7df99abfaeff","resolution":{"observed_at":"2026-08-05T13:56:47.886430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:47.674283Z","title":"NeurIPS , volume=","venue":null,"work_id":"5c44bc7e-a890-484c-b94b-7d1b38c0165b","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.018585Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:9d7d00a4a6ac8d1ec2f68097541b605ef78173b3c025b33ef9251c35140fc041","observation_id":"2667888f-532d-45e1-b7ca-c141699b6ae9","resolution":{"observed_at":"2026-08-05T13:56:47.733489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:47.505769Z","title":"NeurIPS , year =","venue":null,"work_id":"be29ccbd-12c9-489d-b4cb-4bf2702effbf","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.129319Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:1cacedf768877cb202845bf28c75b8953f73e172bda6b5faccabb986fde64f06","observation_id":"f55697eb-735a-4db3-9700-5b457651ad53","resolution":{"observed_at":"2026-08-05T13:56:47.613513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:47.337454Z","title":null,"venue":null,"work_id":"7c303800-a2b2-42d3-9c78-c5c05248e765","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.180731Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:c12ef65dacc63f7b3cb53fe23c81383fa0f45d7efa377819a4c81b1fea722e79","observation_id":"e2a8b00d-eb05-4a86-b40e-8a7357087bf0","resolution":{"observed_at":"2026-08-05T13:56:47.403828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:45.240968Z","title":"Gemma 3 , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.240968Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:2c4274a1dfe38efc86b5a8c200fe27e089f29f21102a98525721f1f42d8134f8","observation_id":"49697680-e7ff-4087-bb62-c2271c963707","resolution":{"observed_at":"2026-08-05T13:56:45.240968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:47.173581Z","title":null,"venue":null,"work_id":"80684342-5862-48ea-9022-74a1f4700361","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.330576Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:56197a054d1811480d1a01cb54d81f08d62c762518c952bd68d07286f3e6d5dc","observation_id":"7cb8ad77-7f97-4799-af28-d3bf679019b9","resolution":{"observed_at":"2026-08-05T13:56:47.231110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:46.990853Z","title":null,"venue":null,"work_id":"e8de8c8e-7b4d-4635-9a9e-fa140826caff","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.410205Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:8b781dc852bee31d34a96e46c5e2bf8c8cad265b24dc2c9e06fc1ff2bc221f37","observation_id":"0a5fd18a-3c12-49cc-b08b-2a07a0cf2486","resolution":{"observed_at":"2026-08-05T13:56:47.055967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:56:46.865619Z","title":null,"venue":null,"work_id":"0742deff-cc0e-40bc-af4b-306cab61a4e2","year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.471342Z"},"links":{"citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:80cb3daa84a6df3ff77053c82e773d20d011d253f7915e0afca042617a90bc25","observation_id":"35ac11fa-b33b-40ce-a84f-c4effa7cab14","resolution":{"observed_at":"2026-08-05T13:56:46.907015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-15T00:17:32.875866Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-05T13:56:45.584742Z","title":"arXiv preprint arXiv:2601.03267 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.584742Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:51abe1dc3d5a3ceaa10bc0b9f76102c9e88c106cd05c45d222e66ab31a0d9e2d","observation_id":"9e7c85aa-043c-41e5-8a70-af926f16de8a","resolution":{"observed_at":"2026-08-05T13:56:45.584742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-21T19:37:26.080420Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.22699","snapshot_observed_at":"2026-08-05T13:56:45.656815Z","title":"arXiv preprint arXiv:2511.22699 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T13:56:45.656815Z"},"links":{"cited_paper":"/paper/2511.22699","citing_paper":"/paper/2608.03733"},"observation_digest":"sha256:bf86874a5cb1da4a4aee33b23179b25035b35cfa418b7fbf54f88a7afee331df","observation_id":"e772f17b-ba30-4b9d-bd56-5d3efe4187a3","resolution":{"observed_at":"2026-08-05T13:56:45.656815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03733","last_updated":"2026-08-04T14:28:42Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T12:53:43.499091Z","submitted_at":"2026-08-04T14:28:42Z","title":"Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2608.03733."}