{"as_of":"2026-08-11T08:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa8251d30eb4508f9941d5f7d3b3615b002782061c99e1412e37b40a214850d4","coverage":[{"denominator":108,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T21:20:00.041277Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.02089/citation-record","integrity":"/paper/2607.02089/integrity","json":"/paper/2607.02089/citation-record.json","paper":"/paper/2607.02089"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":"2410.07073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-07-04T13:59:52.216141Z","title":"Pixtral 12B","venue":"cs.CV","work_id":"9ad2b071-82d8-4cfa-b994-b9975094b575","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:a651454ecb374c2371689966e6374906ef65ffc40a5afc4067da9f1af24c2605","observation_id":"d7bfd8c8-49bc-46e8-bc26-4a7818fdf141","resolution":{"observed_at":"2026-07-03T21:28:58.438954Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:817d4ed2d28433426fad91f3d864e140fdb2b69a7b729643ff3dbb4ce9cbfdb2","observation_id":"eccc6129-0bce-442c-98f6-47166313ea70","resolution":{"observed_at":"2026-07-03T21:28:58.436418Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:a592530d8f8190f5c6276003b47d32d585c39bd2053f5cfb2162790f18c79215","observation_id":"c128bc76-8b6b-4d31-b99a-895b8ba1a0b5","resolution":{"observed_at":"2026-07-03T21:28:58.378164Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.941765Z","title":"Personality and Social Psychology Review10(1), 20–46 (2006)","venue":null,"work_id":"b992843e-9e5d-46cb-8edb-fc20d1d741a3","year":2006},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:3bad24cf45d37470c2d52fdcf9e15c494ecd9b2a08cb5f0dae95f57274a96470","observation_id":"4c960e5e-d68b-408c-966f-866806805907","resolution":{"observed_at":"2026-07-05T01:10:30.942944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.915484Z","title":"Social Cognitive and Affective Neuroscience 12(1), 1–23 (2017)","venue":null,"work_id":"c9981229-250f-4cf2-9ce6-2eda4bcf206c","year":2017},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:05db2fe4c4038e6d4f0b2577f5cc9b0490268d441e7462e43de108f8132352ff","observation_id":"f0d30421-15a1-4d9d-8cc9-5a419e47198a","resolution":{"observed_at":"2026-07-05T01:10:30.916627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.938191Z","title":"Current Directions in Psychological Science8(1), 10–14 (1999)","venue":null,"work_id":"6c5c291b-3099-4785-9ec8-e640a7d9757c","year":1999},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:64d2755f04a5f20232aeda9c25959974ef04363fb450592cede0f82114e425af","observation_id":"da8eb97f-2ffc-4c7f-ab60-2506b82ed6ab","resolution":{"observed_at":"2026-07-05T01:10:30.939390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-10T20:12:25.614328Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2502.05660","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05660","snapshot_observed_at":"2026-07-03T21:28:58.443236Z","title":"Evaluating vision- language models for emotion recognition","venue":null,"work_id":"27251ab6-337c-468b-a738-855946fbab93","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2502.05660","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:e8d9cd310f9c8a5b8e28265f89288ce159d68933c7ea1f333d20d7635a2e1ded","observation_id":"84078a14-2714-4503-a13f-15bcdd1a0370","resolution":{"observed_at":"2026-07-03T21:28:58.444916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.979549Z","title":null,"venue":null,"work_id":"d33394fa-acc0-4056-98d3-b00166899f0d","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:1bb8abfca4daee159acea8fa02ef9d879dde36d7f070cdecf8ae6d3ccfa5ad22","observation_id":"155b840a-0677-4029-8d4b-a6cd9bd20031","resolution":{"observed_at":"2026-07-05T01:10:30.980652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:28:58.451401Z","title":"Sd-vlm: Spatial measuring and understanding with depth-encoded vision-language models.arXiv preprint arXiv:2509.17664, 2025","venue":null,"work_id":"d33b59d0-6898-438b-97c4-4a3f82a1709e","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:f830ac48f9e2ae80f76eff525ddbf706df020ae3a70b4f088faade4ed6762d2e","observation_id":"bee92638-da4c-4510-95ff-ddd20c2a7a6a","resolution":{"observed_at":"2026-07-03T21:28:58.453021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10081","last_updated":"2024-03-19T17:51:45Z","snapshot_observed_at":"2026-08-09T09:52:05.108481Z","submitted_at":"2023-11-16T18:37:29Z","title":"DRESS: Instructing Large Vision-Language Models to Align and Interact with Humans via Natural Language Feedback","version":2},"cited_work":{"arxiv_id":"2311.10081","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.10081","snapshot_observed_at":"2026-07-03T21:28:58.448685Z","title":"arXiv preprint arXiv:2311.10081 , year=","venue":null,"work_id":"f64c1d51-4637-4871-994d-6cd979097ba5","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2311.10081","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:fbbb6d7f585c23d085503d84bb52bbbef9275e65746507d9f0da7f618590d528","observation_id":"6175e463-06b8-41b2-9762-63edfed1d777","resolution":{"observed_at":"2026-07-03T21:28:58.450299Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":"2412.05271","doi":"10.48550/arxiv.2412.05271","metadata_source":"pith","pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":"cs.CV","work_id":"ee70bdc8-4656-4849-ada7-ce42a2278d70","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:cc7eb42a9bdc24dcdf93dd1d9ca73f16219ab9ad1e61de39219bd6908c892215","observation_id":"2bdcb78b-5b80-4afc-91e9-f8e125783444","resolution":{"observed_at":"2026-07-03T21:28:58.384923Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.012034Z","title":null,"venue":null,"work_id":"3a803846-dfd1-4ba1-b762-a5ed10851ea4","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:98bd01c3f2b747175e4b92d3c0b806da19344319c65afc1d3de0495f7b6b0039","observation_id":"d8e51f7f-231c-423b-b77b-bec69ce9fc5e","resolution":{"observed_at":"2026-07-05T01:10:31.013065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11161","last_updated":"2024-11-02T02:30:50Z","snapshot_observed_at":"2026-07-06T18:31:53.591578Z","submitted_at":"2024-06-17T03:01:22Z","title":"Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2406.11161","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11161","snapshot_observed_at":"2026-07-03T23:19:03.662529Z","title":"Emotion-LLaMA: Multimodal emotion recognition and reasoning with instruction tuning","venue":null,"work_id":"0fd6b32c-770b-4943-893d-364a06b55bd2","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2406.11161","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ad768e55b143dc6d2c2c64f8dc3caec9489dd4db9b9ea98b9533daf14d911e7e","observation_id":"d2774fdb-3e15-4740-936c-d51c16bd9fb2","resolution":{"observed_at":"2026-07-03T21:28:58.430833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12940","last_updated":"2024-12-17T14:18:50Z","snapshot_observed_at":"2026-08-10T07:34:59.522195Z","submitted_at":"2024-12-17T14:18:50Z","title":"Improving Fine-grained Visual Understanding in VLMs through Text-Only Training","version":1},"cited_work":{"arxiv_id":"2412.12940","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12940","snapshot_observed_at":"2026-07-03T21:28:58.415452Z","title":null,"venue":null,"work_id":"1d788b85-4ab5-45cf-9a25-f1f8cd904ef0","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2412.12940","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:6d2cb208bc438f16fa8c9568f5a23bee4b257086b58c761622c2d5619516493d","observation_id":"8786e51c-aef8-47c0-9dcb-f02a802a4832","resolution":{"observed_at":"2026-07-03T21:28:58.416837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.991454Z","title":"Proceedings of the National Academy of Sciences 114(38), E7900–E7909 (2017)","venue":null,"work_id":"ca9bed08-7ebf-4a6d-a38b-38c7738ee116","year":2017},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:f3e3b557034d5a348cb6ed08bf848eb28fcbe4ad4f6674406923e8fa6f2b353d","observation_id":"1047abde-7f5c-40b3-860f-2d97d3b0f936","resolution":{"observed_at":"2026-07-05T01:10:30.992629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.952224Z","title":null,"venue":null,"work_id":"04c71921-a01e-4f8b-b60c-3991d9580749","year":2026},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:5a1fe40b6ad097012d214a4cd9c4168bb7cfe49cce451a3b407f567497ea3a00","observation_id":"70432ab1-f83b-4676-8471-0818ac44db97","resolution":{"observed_at":"2026-07-05T01:10:30.953238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.963618Z","title":null,"venue":null,"work_id":"49e1504c-d093-4f9c-8941-efdfcc53d2a7","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:1e268786dd44a860cca76d24f424abd6f6ac7a52628c50a2abddce1ad9e063fa","observation_id":"08199d44-4ae8-4786-94ff-186b82f3b7f7","resolution":{"observed_at":"2026-07-05T01:10:30.964770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.988287Z","title":null,"venue":null,"work_id":"46cd1465-370e-42ee-913a-d9fa10e19944","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:56110257e697dbcf6bffb800aac4337ea619ea17b3b05c15cbd5b098c6ee23b3","observation_id":"a2adbcad-8698-41ca-9870-e6279a7efdc5","resolution":{"observed_at":"2026-07-05T01:10:30.989391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.958987Z","title":null,"venue":null,"work_id":"f5d2751b-4331-4597-a607-441f67af1f72","year":2026},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:f5154d183feec9ad6070f786c18e983dcc0a416f74b7620b65a193100856e215","observation_id":"e350f6eb-7807-4445-bd02-18b9561edbc8","resolution":{"observed_at":"2026-07-05T01:10:30.959999Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.957210Z","title":null,"venue":null,"work_id":"ae5b416b-d74d-4b2e-b8ee-5d3b604ab40c","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:9c4d5159a54feeaa30406a76a62c7435162987c6bd7e109cafaecb2119d09009","observation_id":"ea3875c0-800e-4400-867e-c450d4a47b76","resolution":{"observed_at":"2026-07-05T01:10:30.958361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.986461Z","title":null,"venue":null,"work_id":"1162d276-1b11-4736-aeeb-4ae4f4454d47","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:a790fa971eeb5e0aff4fa462e3ccadac81e4e9891c4d13bd31cc2d3d36e6516f","observation_id":"741641c3-689b-49d2-8863-e62b39dfd14a","resolution":{"observed_at":"2026-07-05T01:10:30.987733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.989913Z","title":"Cognition & Emotion6(3–4), 169– 200 (1992)","venue":null,"work_id":"e97b2088-14d3-4805-934f-a21aaed70590","year":1992},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:0342574e1fe7a21fc088216f4067a50211f3b5fee1ded7964c5cd2de746fa57e","observation_id":"cd1ed193-bcea-47ff-ac18-fd9cda032b55","resolution":{"observed_at":"2026-07-05T01:10:30.990934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.993167Z","title":null,"venue":null,"work_id":"167a8e26-1e6b-4fa8-8d8c-0d120c515405","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:f2e1a8aada96e32dfa1ec994e1ac76cdf142345790570649c11def76fc13a685","observation_id":"9ec33279-74fa-43a7-b55c-c4c4f70da494","resolution":{"observed_at":"2026-07-05T01:10:30.994404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12644","last_updated":"2025-07-16T21:30:05Z","snapshot_observed_at":"2026-08-07T14:06:21.459730Z","submitted_at":"2025-07-16T21:30:05Z","title":"VLMgineer: Vision Language Models as Robotic Toolsmiths","version":1},"cited_work":{"arxiv_id":"2507.12644","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12644","snapshot_observed_at":"2026-07-03T21:28:58.449574Z","title":null,"venue":null,"work_id":"9218fe86-20b6-44bb-b285-04a8bb08a397","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2507.12644","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ee14032249c33b2dbeba7ba35fc5a5da534631bb4f2e15d92a981c41d4d9d118","observation_id":"8f0d6bff-d428-4b5a-9c29-b87d5974fcf6","resolution":{"observed_at":"2026-07-03T21:28:58.450872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01284","last_updated":"2025-07-02T01:52:40Z","snapshot_observed_at":"2026-08-06T20:53:21.450877Z","submitted_at":"2025-07-02T01:52:40Z","title":"VLAD: A VLM-Augmented Autonomous Driving Framework with Hierarchical Planning and Interpretable Decision Process","version":1},"cited_work":{"arxiv_id":"2507.01284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01284","snapshot_observed_at":"2026-07-03T21:28:58.352897Z","title":null,"venue":null,"work_id":"1119d09d-56c5-4548-b76d-878fbec96c8e","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2507.01284","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:f4c933dda02b655108731206953a5503c3d0dfd6edefc82d2d1225b25007eda5","observation_id":"6f765c46-d637-40f4-ad05-ac88e0f1f0ca","resolution":{"observed_at":"2026-07-03T21:28:58.354420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:c40e07a3a811fa9c7e668b5623344603cda8c0fde7a031ef0c3561c92f65d7f2","observation_id":"927a9263-8c46-46e8-81f0-45c81f3b87e7","resolution":{"observed_at":"2026-07-03T21:28:58.447532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.996475Z","title":null,"venue":null,"work_id":"177b0063-d69d-474c-83aa-f1b95431f6b2","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:727b331f8304b880e3bfc65376d05737c96c79dbc7642a091fcd5b8b1fbe13e2","observation_id":"a97482f7-c127-4736-8b0f-071b3cf362fb","resolution":{"observed_at":"2026-07-05T01:10:30.997519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02330","last_updated":"2024-03-04T18:58:08Z","snapshot_observed_at":"2026-08-04T19:14:19.335752Z","submitted_at":"2024-03-04T18:58:08Z","title":"RegionGPT: Towards Region Understanding Vision Language Model","version":1},"cited_work":{"arxiv_id":"2403.02330","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02330","snapshot_observed_at":"2026-07-03T21:28:58.461251Z","title":"arXiv preprint arXiv:2403.02330 , year =","venue":null,"work_id":"bd99fbc5-3616-4660-9bef-ac43e411f9a1","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2403.02330","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:5a0785d857006da8257b8a3ed63c3f94422781cd1b0d3df4cd2b4e7b4100d24c","observation_id":"85ec625b-b834-48e1-af8e-1f660fa7b610","resolution":{"observed_at":"2026-07-03T21:28:58.463068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.999722Z","title":"In: Rambow, O., Wanner, L., Apidianaki, M., Al-Khalifa, H., Eugenio, B.D., Schockaert, S","venue":null,"work_id":"ba554520-cb45-49d7-9e91-b46cf1df3849","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:a1f0af16807e7b1858af7deff3a47045526b096153677db26e65a4b912cd4594","observation_id":"2e436a75-069c-48d8-b98f-41f32382019b","resolution":{"observed_at":"2026-07-05T01:10:31.000849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.983262Z","title":null,"venue":null,"work_id":"7b65982a-8c8b-4c63-a9e1-82309038ab28","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:9c8d394d43e9da9eca383dde5a451d7bb257c941da22c722b2315d5f7c282486","observation_id":"1d3b19b6-7dc1-431f-b5fb-ba1d6b7b8cac","resolution":{"observed_at":"2026-07-05T01:10:30.984301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04424","last_updated":"2026-04-27T06:21:20Z","snapshot_observed_at":"2026-07-31T22:21:13.872121Z","submitted_at":"2025-02-06T18:13:35Z","title":"EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.04424","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04424","snapshot_observed_at":"2026-07-03T21:28:58.454216Z","title":"EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models","venue":"cs.CL","work_id":"bb910c42-671a-497f-b02b-12fdd9af17b8","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2502.04424","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:fbab126fad39c6e4ea8845f6f5e991d31d2df8bb7c4009c5bde5de1b1ac98096","observation_id":"0c72d0be-191a-4783-840e-2a222262ed38","resolution":{"observed_at":"2026-07-03T21:28:58.455866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03656","last_updated":"2024-10-04T20:02:14Z","snapshot_observed_at":"2026-08-09T11:06:57.766463Z","submitted_at":"2023-08-07T15:18:30Z","title":"Emotionally Numb or Empathetic? Evaluating How LLMs Feel Using EmotionBench","version":6},"cited_work":{"arxiv_id":"2308.03656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.03656","snapshot_observed_at":"2026-07-03T21:28:58.408250Z","title":"Emotionally numb or empathetic? evaluating how llms feel using emotionbench","venue":null,"work_id":"674e03ae-f776-42c8-8942-c876db69d352","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2308.03656","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:e106236a79067432d80026cc19fe640ec6d81b52490a02108cb3006377d3d4af","observation_id":"432b09b2-73dc-4c9d-b727-44216ec8406a","resolution":{"observed_at":"2026-07-03T21:28:58.409892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.984879Z","title":null,"venue":null,"work_id":"3246061a-5612-4f50-9ac1-5251a3075111","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:5a43193bb8a478697140e215c36436f85140902823ad31c1df24d883ee974e25","observation_id":"d3c19e19-fa0d-4587-9e81-8b49643f0947","resolution":{"observed_at":"2026-07-05T01:10:30.985891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.010458Z","title":null,"venue":null,"work_id":"8e565b2d-1402-44b9-8325-d1ce5b531511","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:de41a3ec1bc3ae08b7142befcb97e5640f432bc633438a65e72b6a3f4ef4e831","observation_id":"8c9b9420-9455-4de1-b39d-4dcaac813d8f","resolution":{"observed_at":"2026-07-05T01:10:31.011532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.969970Z","title":"In: European Conference on Computer Vision (ECCV)","venue":null,"work_id":"7fe52b24-3823-4870-91d9-69ae8d22bee5","year":2016},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:f8fe37fc96023d86e428dab6a879a23c9a25b09c9360b60f37730ef7f21f824e","observation_id":"c250bb3e-64a0-4ad2-9f4c-5cf11c83dd3a","resolution":{"observed_at":"2026-07-05T01:10:30.971028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":"2205.11916","doi":"10.48550/arxiv.2205.11916","metadata_source":"pith","pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Models are Zero-Shot Reasoners","venue":"cs.CL","work_id":"d9b7eb1a-7165-46ff-9f06-d2f0b9d6f95d","year":2022},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:b605d61ce0d96ce1c1cb758d1139240a6bf3ed6428180574118816d74bf78e4e","observation_id":"1aee7bb6-1bea-44f5-8a7e-4ea0746fc004","resolution":{"observed_at":"2026-07-03T21:28:58.398862Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02246","last_updated":"2024-05-03T17:00:00Z","snapshot_observed_at":"2026-08-08T17:33:57.727194Z","submitted_at":"2024-05-03T17:00:00Z","title":"What matters when building vision-language models?","version":1},"cited_work":{"arxiv_id":"2405.02246","doi":"10.48550/arxiv.2405.02246","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.02246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What matters when building vision-language models?","venue":"arXiv (Cornell University)","work_id":"d774cb51-7f06-48c6-9dea-33285f55ce87","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2405.02246","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:364a0c4a403b45a75e2fc231053dd488abf14eb6630354b701406958ff4547aa","observation_id":"309c7b99-0f3b-40b0-9166-bd941c05bf26","resolution":{"observed_at":"2026-07-03T21:28:58.481477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09876","last_updated":"2025-04-17T01:42:05Z","snapshot_observed_at":"2026-08-07T16:06:01.829833Z","submitted_at":"2025-04-14T04:52:24Z","title":"HDC: Hierarchical Distillation for Multi-level Noisy Consistency in Semi-Supervised Fetal Ultrasound Segmentation","version":2},"cited_work":{"arxiv_id":"2504.09876","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09876","snapshot_observed_at":"2026-07-03T21:28:58.402745Z","title":null,"venue":null,"work_id":"212d495f-5190-403f-aa57-8d7b6232f40f","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2504.09876","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:e9f6c0f91c6611afc28e6e9d178d515e163e7ea961f9f98628c5900ccb83fb04","observation_id":"1bdd781f-a940-4e2d-814e-709a15d795bc","resolution":{"observed_at":"2026-07-03T21:28:58.404214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.971550Z","title":null,"venue":null,"work_id":"c0b9bc15-4d7f-4057-a185-0a3b9c51dfe1","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ed73ffbe67caf555e4dbb6aa76b1df4d91077785230f7f557170a857df2378b5","observation_id":"7d93099c-9fa2-483f-9591-462275498f0e","resolution":{"observed_at":"2026-07-05T01:10:30.972775Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.968447Z","title":"Annual Review of Psychology66, 799–823 (2015)","venue":null,"work_id":"35a53b0c-6cd5-47ad-bd75-66f2a96949d6","year":2015},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:8c938f8c1cb3885b65ec17b6b7dee04d8c300b480197303d8817ccde921cf6da","observation_id":"7354b7dd-b477-4d09-a024-b9a73fcc680d","resolution":{"observed_at":"2026-07-05T01:10:30.969448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04219","last_updated":"2023-11-07T18:59:58Z","snapshot_observed_at":"2026-08-10T22:16:46.022160Z","submitted_at":"2023-11-07T18:59:58Z","title":"OtterHD: A High-Resolution Multi-modality Model","version":1},"cited_work":{"arxiv_id":"2311.04219","doi":"10.48550/arxiv.2311.04219","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.04219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Otterhd: A high- resolution multi-modality model","venue":"arXiv (Cornell University)","work_id":"55746fc3-80c7-4185-bc84-6ec4c0095bc5","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2311.04219","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:2341a1f1cfca37331ccbad46cc8ae233fc1409ed4125a9b2a4bd9a165a598a69","observation_id":"c6ff5bf8-d435-467a-82d8-665b5d566cd5","resolution":{"observed_at":"2026-07-03T21:28:58.468287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.001418Z","title":null,"venue":null,"work_id":"6b890db8-56c3-490c-9a97-7470842331f8","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:e6873e3340af8eb5d536f1030da348249a97f414fe0a7c5e1bae8d7d192b4931","observation_id":"e8252d32-5c6c-4332-9452-bc82fb08e45c","resolution":{"observed_at":"2026-07-05T01:10:31.002446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.965285Z","title":null,"venue":null,"work_id":"3b1a446e-2655-45fc-8532-cf6028639e0c","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:d4baca7b153b4dccc86c061b33d23bcf15fae9f16161bf3cc1424fa07831186d","observation_id":"c4dfb50d-2f54-4dce-8c5c-8fe528b1d186","resolution":{"observed_at":"2026-07-05T01:10:30.966344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.966958Z","title":null,"venue":null,"work_id":"60a42a32-6df5-4435-b331-cb161ec884b3","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:a81d515c2aaf087d1855a7cf2d8f4b6801355f84f0345fed82e2580d50c31a6a","observation_id":"44e91a78-a811-432c-8e66-caa704cc2e61","resolution":{"observed_at":"2026-07-05T01:10:30.967954Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06607","last_updated":"2024-08-26T06:57:51Z","snapshot_observed_at":"2026-08-05T16:46:37.436149Z","submitted_at":"2023-11-11T16:37:41Z","title":"Monkey: Image Resolution and Text Label Are Important Things for Large Multi-modal Models","version":4},"cited_work":{"arxiv_id":"2311.06607","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.06607","snapshot_observed_at":"2026-07-04T06:39:37.479106Z","title":"Mon- key: Image resolution and text label are important things for large multi-modal models","venue":null,"work_id":"1b51b65b-5659-4d2a-b5b3-0a8ac7f88ed5","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2311.06607","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:1a7938524e36547a18dee5f7c653b13f42fa913305c019f0262a49af9061e8aa","observation_id":"a6cd8e01-3f80-4ee3-86ce-87e3715168a5","resolution":{"observed_at":"2026-07-03T21:28:58.426378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05138","last_updated":"2024-02-06T19:16:55Z","snapshot_observed_at":"2026-07-06T17:27:03.686119Z","submitted_at":"2024-02-06T19:16:55Z","title":"SceMQA: A Scientific College Entrance Level Multimodal Question Answering Benchmark","version":1},"cited_work":{"arxiv_id":"2402.05138","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05138","snapshot_observed_at":"2026-07-03T21:28:58.416782Z","title":"Scemqa: A scientific college entrance level multimodal question answering benchmark","venue":null,"work_id":"2ac5d449-2999-414b-8371-0bca13a3d357","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2402.05138","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ab594940178d5acf967bbe87427273a5ddf41bffc5e2ed8e1a1d6cf53c2ec3a2","observation_id":"eddba273-163d-4144-a3d7-c44943b8d092","resolution":{"observed_at":"2026-07-03T21:28:58.419001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.973310Z","title":null,"venue":null,"work_id":"dd5c8de7-a807-4b04-a4e6-f7047cc9f22c","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:303daa54d9d3c11db6196b1171d64c04155678ac14d7e48f7e6cd58188467596","observation_id":"cb67062a-f6ef-4748-8b10-f393aaa997a8","resolution":{"observed_at":"2026-07-05T01:10:30.974906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07533","last_updated":"2024-05-16T21:21:30Z","snapshot_observed_at":"2026-08-10T13:01:53.292743Z","submitted_at":"2023-12-12T18:58:18Z","title":"VILA: On Pre-training for Visual Language Models","version":4},"cited_work":{"arxiv_id":"2312.07533","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.07533","snapshot_observed_at":"2026-07-04T12:09:48.871684Z","title":"Vila: On pre-training for visual language models","venue":null,"work_id":"6cd946f1-89e0-4dc6-9718-bf5a7e8519fa","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2312.07533","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:cb8d5c343eae8c4fed39d94fb4f12b0d3438cfd7d84f58177e432e3385359ab9","observation_id":"d1a90f2f-7dbe-4c44-974c-2ec2accbd19b","resolution":{"observed_at":"2026-07-03T21:28:58.423966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2583.365810","doi":"10.1145/3652583.3658104","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Proceedings of the 2024 International Conference on Multimedia Retrieval","venue":null,"work_id":"c5848413-3490-4d05-a997-0cf2eb1fe600","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ad1c048f8bda21ed28673d6d70fbb4d34fc5a3a20cc4c32f799855a6e9f897b5","observation_id":"913d511e-1e98-4330-a394-127a40b58eb0","resolution":{"observed_at":"2026-07-03T21:28:58.011255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.975815Z","title":null,"venue":null,"work_id":"a3383527-1e60-4693-8d78-cd9ce97699b4","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:c93828eeb89dd227013e05404ad38ea1ad4f673c7d8257bd651f9e12902e59b1","observation_id":"327483bd-a00f-4496-be33-62f4184339eb","resolution":{"observed_at":"2026-07-05T01:10:30.977186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:34:31.742670Z","title":null,"venue":null,"work_id":"7d47ebfa-ae57-4b26-add7-810f9c25f0b0","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:68ee5335771404dab34e7d107acbb17b86f546e7737aef04614ad4bb96d233b9","observation_id":"4250d238-7c65-4da5-b71b-185675c8abeb","resolution":{"observed_at":"2026-07-05T01:10:30.982706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T18:56:27.968575Z","title":null,"venue":null,"work_id":"e2616913-2672-4b77-be0e-a8dddf92de6f","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:2dd851215f4422569d44c812affa5bb9279b5966634abeedd6c7b72e3e42dbca","observation_id":"156f1489-1b5a-409e-a9ab-1c823966fdf4","resolution":{"observed_at":"2026-07-05T01:10:30.978925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.013585Z","title":"In: European Conference on Computer Vision (ECCV) (2024)","venue":null,"work_id":"4e8b83e4-b09a-4528-8281-224e2106f90b","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ed114268b8e6b6202cb3f117beb606999616a177e62cdef872835b7ce3f57e8a","observation_id":"3deed759-f126-4295-a386-fef98d3f3431","resolution":{"observed_at":"2026-07-05T01:10:31.014666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":"2310.02255","doi":"10.1109/cvpr52734.2025.01245","metadata_source":"pith","pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","venue":"cs.CV","work_id":"e22c3789-9e71-4242-b6ea-3e60e06e2b66","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:d4f0f4867aab442819cbf85a8b57045f1a44b3e5f068e296308c4b7367c9e9d3","observation_id":"a13354d7-4480-493f-ba9a-ed04aa2ceeb9","resolution":{"observed_at":"2026-07-03T21:28:58.395684Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.006732Z","title":null,"venue":null,"work_id":"ca69c8fb-fa24-4511-ae31-6d4e998c42d0","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:03b80fe741f6589c46a1ae099bc1dfbffa93eb194502186d07333e02ac71026c","observation_id":"4cab95dc-2d03-43b3-9d43-272c987642bd","resolution":{"observed_at":"2026-07-05T01:10:31.007831Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.017264Z","title":"MIT Press (1974) 20 T.-H","venue":null,"work_id":"01814f80-0c6d-400b-816b-3457db00bcab","year":1974},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:354b036d6c4f4e0d3d7e804b99f20845af85d7e747d447542688ecbfeb849a40","observation_id":"e61e03f7-3187-4889-adec-5aa1f249e940","resolution":{"observed_at":"2026-07-05T01:10:31.018298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.003017Z","title":null,"venue":null,"work_id":"98491c4e-935c-48f2-8163-f2a4d56c214b","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:8b775d0b24ef32be4b8e70a54ad4de42406ea0ae81d0f7dfdf16b92fc1a78788","observation_id":"36b4df1f-eaaf-4d5d-8630-ccfc284ddd1c","resolution":{"observed_at":"2026-07-05T01:10:31.004159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.955449Z","title":"Ad- vances in Neural Information Processing Systems37, 53969–54002 (2024)","venue":null,"work_id":"2db52e3e-a68b-48bc-9b66-3fd2badc90d2","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:fe9a9321b10a5b163d4603ec541ecdc1b61779e9f6630f9353d32d01b4ffbee6","observation_id":"0fbd5eab-0904-4564-9995-d746e0f9d716","resolution":{"observed_at":"2026-07-05T01:10:30.956682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.01024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:28:58.470397Z","title":"Nguyen, H.-L","venue":null,"work_id":"803a391a-2b9f-4f96-8220-a0c37afc69a8","year":2026},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:d6a506c8ab3bfd95db0bb58fc34078e3b931ac31f3b8387eabe06ef5c7ee3ede","observation_id":"7b2caa27-ef0c-4b87-b7f0-1199a345d66e","resolution":{"observed_at":"2026-07-03T21:28:58.473450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.22470","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:28:58.474673Z","title":null,"venue":null,"work_id":"214161f5-5db5-45d6-b1bf-a25aaefe5359","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ba6b2494b2d4e8accb637504d4102bbe526b382002a7d072ca2896a6429212ce","observation_id":"7993bdd0-e669-414c-928d-cc36234b6000","resolution":{"observed_at":"2026-07-03T21:28:58.476601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20883","last_updated":"2024-11-01T12:42:49Z","snapshot_observed_at":"2026-07-06T19:40:39.348570Z","submitted_at":"2024-10-28T10:04:40Z","title":"Improving Generalization in Visual Reasoning via Self-Ensemble","version":2},"cited_work":{"arxiv_id":"2410.20883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20883","snapshot_observed_at":"2026-07-03T21:28:58.351335Z","title":null,"venue":null,"work_id":"2fde0c9b-02b4-44ed-bbe0-3e86460d7188","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2410.20883","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:864ffedd0e0cbc48b75c722d09e1d821d953abd55d83d37aa7430c3f0b730682","observation_id":"cee07154-639f-4eee-9ce0-afb7f5efefde","resolution":{"observed_at":"2026-07-03T21:28:58.352698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13470","last_updated":"2025-08-19T03:03:29Z","snapshot_observed_at":"2026-08-10T06:06:18.503386Z","submitted_at":"2025-08-19T03:03:29Z","title":"STER-VLM: Spatio-Temporal With Enhanced Reference Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2508.13470","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.13470","snapshot_observed_at":"2026-07-03T21:28:58.379714Z","title":null,"venue":null,"work_id":"43bf5bf4-ad30-46ed-b9a7-a7bfe57f652b","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2508.13470","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:6210616626ea764d232a7691c884889ac9120e5d53053504a9cb4b236042e2de","observation_id":"ca2de7d7-d1d7-4c89-9448-115a09479bea","resolution":{"observed_at":"2026-07-03T21:28:58.381307Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:13b99e445e9e0429b6c34077830d37c620bd1dfbd7cd76de615436ee157e28f9","observation_id":"631a2292-638a-45d8-9a4a-39af79134fd5","resolution":{"observed_at":"2026-07-03T21:28:58.414033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:39ba52a074a6c382e318355d09829edf33c1daf4a1a17bd545a9b34fdd247a65","observation_id":"45db66a0-a602-4252-8da8-7bec9c47647e","resolution":{"observed_at":"2026-07-03T21:28:58.334665Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00147","last_updated":"2024-08-30T07:37:38Z","snapshot_observed_at":"2026-08-09T14:33:03.506246Z","submitted_at":"2024-08-30T07:37:38Z","title":"MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2409.00147","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.00147","snapshot_observed_at":"2026-07-03T21:28:58.438612Z","title":"Multimath: Bridging visual and mathematical reasoning for large language models","venue":null,"work_id":"c82f0a48-7a00-4aa4-94dd-e64c35c6d5f2","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2409.00147","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:0fc74faa3609325ce95f661f4d4922e7ab88a882da454dc9e74062fa2947333f","observation_id":"35151b0c-3245-4ee5-9d12-002e9b025f3e","resolution":{"observed_at":"2026-07-03T21:28:58.439954Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:31.008389Z","title":"Harper & Row (1980)","venue":null,"work_id":"7f469284-8a4e-431c-8a33-22ad7203ac8e","year":1980},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:380c484e311ad8e3293f0eb39d310918786f68bcdfce610edbf84d8b9b07e723","observation_id":"617dfed2-2259-4865-a3c4-771767858c85","resolution":{"observed_at":"2026-07-05T01:10:31.009925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.953816Z","title":"Development and psychopathology17(3), 715–734 (2005)","venue":null,"work_id":"7557a4a0-262e-4666-95d4-535dcf7f1490","year":2005},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:5186e0beba52068408203f17dc86375058884ea1a83d73da7fc80aea9c2d3ae4","observation_id":"ebda1bbb-b492-4da0-9bf9-446ccad04b22","resolution":{"observed_at":"2026-07-05T01:10:30.954934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.01483","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:28:58.330559Z","title":"arXiv preprint arXiv:2601.01483 (2026)","venue":null,"work_id":"186345e6-dcd0-42e1-a523-dfdf25eea82e","year":2026},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:61724fa18d56d1f7469a5d467c80d5ede0a10297ef3cba2b5cb565ee8cec3c76","observation_id":"eee5cea4-a9c5-4a5c-b2b2-b67e34c4b7c0","resolution":{"observed_at":"2026-07-03T21:28:58.332013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.960478Z","title":"In: Pro- ceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"039b74bc-afed-49f3-af51-38af9b791d68","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:08bb9f05e72656a58174e83706b614eac69ebe149e07b529a2ec9e53ddc7cfc0","observation_id":"79468006-0de8-4e10-a1fa-84c552c00d5b","resolution":{"observed_at":"2026-07-05T01:10:30.961516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:46:18.457927Z","title":"In: International conference on machine learning","venue":null,"work_id":"72924f86-0330-4260-a415-a55b8692e69b","year":2021},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:73c2b388328c11e7d39b154737e884553bf65b744f71d500a879bb19325478d3","observation_id":"b387752c-d4b4-45ea-8d49-5c25cba74825","resolution":{"observed_at":"2026-07-05T01:10:31.016650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.948691Z","title":"Journal of personality and social psychology39(6), 1161 (1980)","venue":null,"work_id":"aa651f8c-8533-4215-a548-2e4d50ace39b","year":1980},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:74b03fa55b90434e59a7857d9e0e2ad8ec2b3c96defc3345ed853c5761736431","observation_id":"d8b3b3b6-4db0-4075-8c1f-2758fe4494ec","resolution":{"observed_at":"2026-07-05T01:10:30.949893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.947010Z","title":"Psychological Bulletin 110(3), 426–450 (1991)","venue":null,"work_id":"95e5bbe4-a96d-4f67-bc50-d73e0407fd9d","year":1991},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:a41b415430847006200f68a5bee9e1d154cfa92a750ce7e808abe5910048e0ae","observation_id":"a07c9233-c62b-40ba-a29c-29ad5913f7d3","resolution":{"observed_at":"2026-07-05T01:10:30.948192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.950435Z","title":"Psycho- logical Review110(1), 145–172 (2003) ESC23","venue":null,"work_id":"317327d2-5269-4a56-8011-73110e9c6f3a","year":2003},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:aacac52d8b1c49f6e9a442a9ed1a91a2efa259da39d034cd67c45b6f5a51395a","observation_id":"3759f2c2-7353-4c19-a8a9-7aa70b7140c0","resolution":{"observed_at":"2026-07-05T01:10:30.951514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12071","last_updated":"2024-07-17T05:30:58Z","snapshot_observed_at":"2026-08-09T01:06:10.212560Z","submitted_at":"2024-02-19T11:48:09Z","title":"EmoBench: Evaluating the Emotional Intelligence of Large Language Models","version":3},"cited_work":{"arxiv_id":"2402.12071","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12071","snapshot_observed_at":"2026-07-03T21:28:58.359245Z","title":"Liu, Jinfeng Zhou, Alvionna S","venue":null,"work_id":"42e8ce46-b0d6-4f47-ad92-a2cb8adda82b","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2402.12071","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:9eeee7f4b5f39d0955e0ca14086c226cdc9922e58c184c7645867c1630ca9231","observation_id":"5b3957af-80e9-4bfa-842e-178b9e24cf11","resolution":{"observed_at":"2026-07-03T21:28:58.360982Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.962046Z","title":"In:Scherer,K.R.,Schorr,A.,Johnstone,T.(eds.)AppraisalProcessesinEmotion: Theory, Methods, Research, pp","venue":null,"work_id":"36f21fa9-2281-41c0-b0ae-f649ebc30b8e","year":2001},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:41c7a57d1d8dbc69c83cb0711228c196a542a22565078ba9b927d5002f81ad33","observation_id":"09abc44b-4ee3-4e47-995e-59cbdae88177","resolution":{"observed_at":"2026-07-05T01:10:30.963114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.945112Z","title":null,"venue":null,"work_id":"7ef13d95-cc07-4511-9d1e-c7cfa07d39af","year":2005},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:89c3f71f7dd9fd350d31caf1d117e410ed3c089ea6525ffb0134006815335016","observation_id":"614e5d97-457a-4401-b0d1-f8317339a903","resolution":{"observed_at":"2026-07-05T01:10:30.946374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.917159Z","title":"Cognition and Emotion23(7), 1307–1351 (2009)","venue":null,"work_id":"11024f9d-2cef-4d3b-a29b-9d27ba14df7d","year":2009},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ab270f108fb1739222c8fea5e5d6b5f86bb5dce9cd2034b9d9d91abb7ccff2e3","observation_id":"f2ebf99b-6a7b-49d2-941d-eeeef4f8388f","resolution":{"observed_at":"2026-07-05T01:10:30.918225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.940136Z","title":"In: Handbook of Theories of Social Psychology, pp","venue":null,"work_id":"a7a9688f-3ad0-4282-b6c8-4ce831695203","year":2012},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:e723799466be15eae9ca77dc26d6d604e7848e6d8a97526eb67c71ebde5dea92","observation_id":"f640041b-edf9-47fd-b034-f86784aa8839","resolution":{"observed_at":"2026-07-05T01:10:30.941231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16999","last_updated":"2024-11-04T05:50:56Z","snapshot_observed_at":"2026-07-06T17:50:18.017647Z","submitted_at":"2024-03-25T17:59:23Z","title":"Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":"2403.16999","doi":"10.48550/arxiv.2403.16999","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.16999","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual cot: Advancing multi-modal language models with a comprehensive dataset and benchmark for chain-of-thought reasoning, 2024a","venue":"arXiv (Cornell University)","work_id":"da440264-f4bb-477b-b4a4-c14bab386f8f","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2403.16999","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:9986368e4a267d8654ee25819ce1e2dbdc71ac48798b5376575c153db2605fb8","observation_id":"debc71df-1a90-4982-9689-dcc4c0938864","resolution":{"observed_at":"2026-07-03T21:28:58.437462Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13073","last_updated":"2025-09-01T08:10:01Z","snapshot_observed_at":"2026-08-07T15:40:31.068428Z","submitted_at":"2025-08-18T16:45:48Z","title":"Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey","version":2},"cited_work":{"arxiv_id":"2508.13073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.13073","snapshot_observed_at":"2026-07-08T05:54:33.623543Z","title":"Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey","venue":"cs.RO","work_id":"bcbdae00-80a0-4488-a280-7eaf3c5336bb","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2508.13073","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:ef0871522323ad428fa0df8b6c59c7452b51207bc495a11fb6d4bb0fa03ac379","observation_id":"2506d977-4ae3-42aa-8812-686f50474834","resolution":{"observed_at":"2026-07-03T21:28:58.428016Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.943490Z","title":"In: Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":"d9924523-ac04-44b7-a4f1-5b422fb66fa1","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:c222ad763a840378236846ef3126652750d0a09657cbf5a8c9230edb606d5848","observation_id":"f3fe2a77-5841-45bd-a3e0-f551ce0a53f9","resolution":{"observed_at":"2026-07-05T01:10:30.944608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:3fe79f7e005c3e2d9cb916820251a3166fa4555e2287251c59637dea4aaeaa13","observation_id":"ee20b35c-62bf-4820-ac50-b13366464141","resolution":{"observed_at":"2026-07-03T21:28:58.484027Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16860","last_updated":"2024-12-04T17:57:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-24T17:59:42Z","title":"Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":"2406.16860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16860","snapshot_observed_at":"2026-07-03T23:49:02.295501Z","title":"Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs","venue":"cs.CV","work_id":"f305b8a2-d78e-4bf3-b9fd-41777382e536","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2406.16860","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:96ff6513edc1f07bf2ec25db299299bbde37a65a61898c1ebe531ea3ffaf790a","observation_id":"0b716028-08ce-4e1e-9b25-a3c56af27aab","resolution":{"observed_at":"2026-07-03T21:28:58.407042Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T18:21:23.288524Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"ff1643d8-7670-4d6f-bd92-41b87c2df284","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:139105f60dda930892a8954afaf55a26bf948ef6c7b7f80e7cc8f3e72044e610","observation_id":"8abfadb8-d8c3-4cd1-bbbc-a378ade442c0","resolution":{"observed_at":"2026-07-05T01:10:30.919953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02778","last_updated":"2026-08-02T21:08:33Z","snapshot_observed_at":"2026-08-08T09:35:34.594850Z","submitted_at":"2025-07-03T16:41:30Z","title":"Self-Correction Bench: Uncovering and Addressing the Self-Correction Blind Spot in Large Language Models","version":3},"cited_work":{"arxiv_id":"2507.02778","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02778","snapshot_observed_at":"2026-08-04T02:29:36.375484Z","title":"Self-correction bench: Uncovering and addressing the self-correction blind spot in large language models","venue":null,"work_id":"cdc79fb8-0919-4089-8a57-ab9adbd958d7","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2507.02778","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:bb1132851545a48f5ad87b5bdaadf4565e491a0b6aad25ba28e9d7dc82647be0","observation_id":"eaa9921f-da88-4f3c-9369-e2f5a7f177a6","resolution":{"observed_at":"2026-08-04T02:29:36.375484Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2504.08837","doi":"10.48550/arxiv.2504.08837","metadata_source":"pith","pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","venue":"cs.LG","work_id":"b13ff087-9614-48cc-8991-ad75b6543bbc","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:9d4e5d7758ed3b5801ab55ac3065050af3671d22d4ecefcc025e3a1d2bb9826e","observation_id":"2105c5b2-3e81-4e0b-bd7a-4967fd2603e8","resolution":{"observed_at":"2026-07-03T21:28:58.442819Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:7e058638115ffbba2468855a74e323777edc0b2fe888c4981f3803372ae02094","observation_id":"eab4bb07-6455-452e-bdf2-c8ddd591cab0","resolution":{"observed_at":"2026-07-03T21:28:58.412360Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.936392Z","title":"Psychological Bulletin98(2), 219–235 (1985)","venue":null,"work_id":"995fc29d-48ce-4921-b190-b5c628ccef83","year":1985},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:acea3deec973e309a4267496c9ee78e1403455833c24754c4f6c8ee88d7dd632","observation_id":"a5b364a4-3e06-4d84-8706-7f0bbedaa742","resolution":{"observed_at":"2026-07-05T01:10:30.937590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.13169","doi":"10.48550/arxiv.2504.13169","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2504.13169 , year=","venue":"ArXiv.org","work_id":"2edd3aa6-846e-40f7-8cf0-bf9ea693e345","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:a55907e4521bb0d78f9ae54d03baf19260292b541fa63d88f83b8c8cc978eff3","observation_id":"fa0c4856-9233-4ef3-a1d3-5973b6a4a3fc","resolution":{"observed_at":"2026-07-03T21:28:58.425238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.930686Z","title":null,"venue":null,"work_id":"dc14f619-515d-4c6d-bd37-534c74aa11ea","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:b09679bd240866c8c9ad230b38a83e9754fc4670601877347856fa98d103996a","observation_id":"7bd4693d-689e-471c-b7ec-dabf8550e311","resolution":{"observed_at":"2026-07-05T01:10:30.931886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14446","last_updated":"2025-08-29T20:50:08Z","snapshot_observed_at":"2026-08-09T16:03:18.730964Z","submitted_at":"2024-12-19T01:53:36Z","title":"VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision","version":2},"cited_work":{"arxiv_id":"2412.14446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.14446","snapshot_observed_at":"2026-07-04T08:49:42.140527Z","title":"Vlm-ad: End-to-end autonomous driving through vision-language model supervision","venue":null,"work_id":"27a2e683-9815-4627-9722-a252c7441cd9","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2412.14446","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:49ccac9944e46ba9ee9853f23d90b1a7b38175a82b3fe57758be506ce60e4264","observation_id":"d7171d21-f7c9-4091-8cc4-cee597b4073e","resolution":{"observed_at":"2026-07-03T21:28:58.459558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:70637c99869dc5bc35637760f9870bdd36c29438145f0f9bcac19186756b1230","observation_id":"c218b54c-449a-4a8e-828c-975d1a155ec5","resolution":{"observed_at":"2026-07-03T21:28:58.431638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1980.2024","doi":"10.1109/ainit61980.2024.10581513","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: 2024 5th International Seminar on Artificial Intelligence, Networking and Information Technology (AINIT)","venue":null,"work_id":"5dea89ea-6bd9-472d-9a26-74a22e42ddff","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:42ea8c2400db62a5505afa6d33a42ade0b364c9a3504adc507f712b059ad1b66","observation_id":"46737de7-8738-4455-bcd2-a747e82d9d13","resolution":{"observed_at":"2026-07-03T21:28:58.007371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.14881","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.14881","snapshot_observed_at":"2026-07-10T05:16:48.121722Z","title":"A survey of safety on large vision- language models: Attacks, defenses and evaluations","venue":"cs.CR","work_id":"926b36b9-f3d1-4fc7-ab4c-75a8ce58e4b7","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2502.14881","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:211be52ea8e01235cd0adec2aff3275acc840d5814dc12e5198d121aebdf3ac9","observation_id":"1804b0e1-9873-47ce-81aa-52ec62d6d8cf","resolution":{"observed_at":"2026-07-03T21:28:58.422556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:10:30.932725Z","title":"Journal of Personality and Social Psychology77(3), 600– 619 (1999) ESC25","venue":null,"work_id":"4c71d63f-49ee-4d93-9f07-0c9d9f2b7b51","year":1999},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:1e3b43831f8f9a78c06d5dbd4ea1998785f73bade9e1e70ed5b3fadf606be8ec","observation_id":"aad64524-c9ad-4afb-94fc-dd0b5cab4063","resolution":{"observed_at":"2026-07-05T01:10:30.933931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:22:58.946764Z","title":"Science China Information Sciences67(12), 220105 (2024)","venue":null,"work_id":"415b72a5-fb5d-4a9d-ac6f-c1e2e83a6def","year":2024},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:82072bce549d5103f7b9fe265052cfd464d6b0ab4552b5d08d3e237bec67b4f4","observation_id":"9acce9a9-2785-4f22-9c1c-170d732cb159","resolution":{"observed_at":"2026-07-05T01:10:30.921728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":"2308.02490","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-07-10T09:37:00.827227Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","venue":"cs.AI","work_id":"7f3bac41-a0a5-4a7a-bfd2-526b616db745","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:5d264142787bcf71951b009cb8fd04dba36bbf5abd636b4d778c4f313b860fe8","observation_id":"d8ba742e-a4b0-4065-9eb3-1c2a256d8478","resolution":{"observed_at":"2026-07-03T21:28:58.453206Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16502","last_updated":"2024-06-13T15:02:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-27T17:33:21Z","title":"MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","version":4},"cited_work":{"arxiv_id":"2311.16502","doi":"10.48550/arxiv.2311.16502","metadata_source":"pith","pith_arxiv_id":"2311.16502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","venue":"cs.CL","work_id":"da087b16-ea05-4064-980e-ce1d6e281d49","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2311.16502","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:2bee502d912d3eb9a8ce4ad4b0137c52b2dae256b5f1ea833c0cbd59e15a6b76","observation_id":"47733d8d-f82f-4bc1-afff-605a4d45aac4","resolution":{"observed_at":"2026-07-03T21:28:58.406082Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:12.261029+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:12.261029+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.18746","last_updated":"2026-06-16T03:12:38Z","snapshot_observed_at":"2026-08-02T21:56:22.978999Z","submitted_at":"2026-02-21T07:56:59Z","title":"Bridging Modality Disconnect in Self-Reflection via Closed-Loop Visually Grounded Verification","version":3},"cited_work":{"arxiv_id":"2602.18746","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.18746","snapshot_observed_at":"2026-07-09T13:56:19.198301Z","title":"Bridging Modality Disconnect in Self-Reflection via Closed-Loop Visually Grounded Verification","venue":"cs.CV","work_id":"beda5823-54de-49c3-a4b5-dd0108bcc97f","year":2026},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2602.18746","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:2a4a1d64572971dfea68f18503514b4b404765247c53acec00d08c4c6a640cbd","observation_id":"1c8a1008-c65c-4fef-958f-5680c55883fb","resolution":{"observed_at":"2026-07-03T21:28:58.390899Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:cfb04b987c5709fe8edc167cac9ebf6f27e407551c9fbda426ac61a9e69f3602","observation_id":"ec793c38-0c87-4d17-a638-1b73b43427d9","resolution":{"observed_at":"2026-07-03T21:28:58.401558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":9,"parse_uncertain":0,"unresolved":25,"verified_exact":40,"verified_fuzzy":26},"total_outbound_references":108},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 108 outbound references and 0 inbound Pith citation observations for arXiv:2607.02089."}