{"as_of":"2026-08-08T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f485af30d95bf2ae5efce5726ec414dfa64461caf471756b5109e0993efafeb","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:51:50.676043Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17467/citation-record","integrity":"/paper/2507.17467/integrity","json":"/paper/2507.17467/citation-record.json","paper":"/paper/2507.17467"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.240712Z","title":"Agrawal, D","venue":null,"work_id":"0e3e35d2-b0cc-46d7-b1ef-39c893cfad27","year":2018},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.530500Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:5331e7c10f0472bbf1d8460bc99df8755d6018d5a95c2be49eefac550d0aa2a1","observation_id":"61adf578-82b2-41ec-9d48-de2f09b9e7db","resolution":{"observed_at":"2026-08-06T14:51:51.243836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.231340Z","title":"Alper and H","venue":null,"work_id":"3a4171a6-a385-4201-8c61-6603c4d1f2f0","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.534239Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:4eed7e796f036b4b723e257b71e0a43a44c40157cb1d7f08287059b48ced3c18","observation_id":"aac17287-1032-401c-82ed-7501eba8fa44","resolution":{"observed_at":"2026-08-06T14:51:51.235269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.221988Z","title":"Baltrušaitis, C","venue":null,"work_id":"beb45899-9e6d-4ce9-8c50-c2468b087a42","year":2018},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.537762Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:1194c942dc90ab989a98a50ab86a6e04b82e0eacf29936cb48f251f7d3fed14f","observation_id":"66241f6d-718c-48b2-8819-9645c6864f7c","resolution":{"observed_at":"2026-08-06T14:51:51.225615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.212730Z","title":"Bowman, G","venue":null,"work_id":"13d2d86d-bad4-4344-a25f-68fc6d6c5d97","year":2015},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.541095Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:5aac8a1cca33c1c735bfb947ac064fbf23221380de77b93a082df326d9d3c758","observation_id":"1d380abc-9c7f-42cf-bdda-c2bc2578985e","resolution":{"observed_at":"2026-08-06T14:51:51.216423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.204061Z","title":null,"venue":null,"work_id":"aa77d560-c78a-48a3-a938-e8fdf36f541b","year":1901},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.544560Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:cb1f9d01ed10db105dcb96621a230247195e2c15bca154f252605b583e719827","observation_id":"ba84257a-fd28-4242-ad1a-92502925d058","resolution":{"observed_at":"2026-08-06T14:51:51.207438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.195157Z","title":"Conwell, J","venue":null,"work_id":"4f0b8d44-8910-4a6c-82e3-ad6669c0334a","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.547985Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:396319626fe454ac62011f1e7dc5d0a2380f900b02bfb6fa19e1f482c8f8318f","observation_id":"51fbb5c5-584e-4edc-b121-9f2efab44cd3","resolution":{"observed_at":"2026-08-06T14:51:51.198178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.186059Z","title":"Dagan, O","venue":null,"work_id":"33acd548-6789-44b7-a43e-4945ccf5f64f","year":2005},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.551441Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:19146b8bf9fb539174f0a55d7052b2090c7a6a35b4cde8da3a964b708a0401ca","observation_id":"83c74acf-e084-4ed2-b41c-1f261584818d","resolution":{"observed_at":"2026-08-06T14:51:51.189215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.176695Z","title":"Dettmers, A","venue":null,"work_id":"ad869da6-800b-41dd-aef5-38574d933d76","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.554628Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:8dd75fc8e33326755346b26658699987e14ba4fe9fd9d4d097b147fc3704992a","observation_id":"1fd248cc-454d-4fcc-97eb-4518746eeedd","resolution":{"observed_at":"2026-08-06T14:51:51.180308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.167845Z","title":"Diwan, L","venue":null,"work_id":"92192869-e22c-43cb-8abf-4833f4a76032","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.557890Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:18b8585fe5d79c93147e9f2ed7fcb3d011d5cedb7369678e545fd44c5202c265","observation_id":"9e6e62f1-0e20-4031-89f5-41ae27063327","resolution":{"observed_at":"2026-08-06T14:51:51.171291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.158206Z","title":"Do, O.-M","venue":null,"work_id":"d6896093-ba47-4ffc-ae48-678b84c965b8","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.560912Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:84cc1267ddb651159d3485c1c0c2288025e7d3a7f72f42601952dea90272efd0","observation_id":"470b264a-1ed7-4d7c-b893-a9f462d33fef","resolution":{"observed_at":"2026-08-06T14:51:51.161675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.149875Z","title":null,"venue":null,"work_id":"bafcbdeb-4803-46fb-a476-3403deb77265","year":2025},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.567512Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:1b10c9407519fcee112d7373bea009208b116032a1f39722c166fc7f79fabf41","observation_id":"470f1f3f-bef8-468c-86cd-eb91d75221f5","resolution":{"observed_at":"2026-08-06T14:51:51.153106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.141205Z","title":"Goyal, T","venue":null,"work_id":"57fcea7d-db7c-4fd9-98a6-b24ba0cab5ff","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.570897Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:a97f5001c6a8ba7957af65cbd8f901204e66243c6f4c84d6e017df468c12f5d0","observation_id":"1674a2f0-408d-4340-849b-30437acd6598","resolution":{"observed_at":"2026-08-06T14:51:51.144402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.132743Z","title":null,"venue":null,"work_id":"34ea456d-8446-4dee-9169-a7f457a846c1","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.576964Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:d506fc5ff24e2a5b1013d672d6749e921ff188091a3205f3a4d34dd2d190cac4","observation_id":"0ad876fa-645a-4831-b1a7-46a169fc9abd","resolution":{"observed_at":"2026-08-06T14:51:51.135805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.124092Z","title":"Hendrycks, C","venue":null,"work_id":"cb15ec45-44f7-4fd3-bcb1-1d660cace103","year":2021},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.580048Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:afed2da090dc1585f7c73a1a7e0d2c5ab8e8be7cb802735585ed567507b752c7","observation_id":"b99f9fd6-ce36-46e2-85b5-50fab5f50fe7","resolution":{"observed_at":"2026-08-06T14:51:51.127401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.114061Z","title":"Jabri, A","venue":null,"work_id":"735f4b3e-7818-4452-b09a-f7f578ce11a6","year":2016},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.582987Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:b0f0e18e939a32de483efb400d2dd729a54df70c4658f09b15db7915af6864f4","observation_id":"1225beb0-20d3-4f6e-9d90-6c9e96175f89","resolution":{"observed_at":"2026-08-06T14:51:51.117849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.585906Z","title":"Kamath, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.585906Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:1095559dd1104b19bbe6199516de7dd32ce344d426ada770717f9669c19e8ad9","observation_id":"a1f2a7ba-7347-4160-b798-f673b7b4fcd1","resolution":{"observed_at":"2026-08-06T14:51:50.585906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.105208Z","title":"Kayser, O.-M","venue":null,"work_id":"2e2b3fc2-9037-40a6-8a50-d8837989b384","year":2021},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.588988Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:378b8918ce9ad278fb31e98fe698e74c971df10159501d5910d67eca21d222de","observation_id":"0be34735-fcbd-44ba-9fcd-4c55cd0b9b4f","resolution":{"observed_at":"2026-08-06T14:51:51.108513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07955","last_updated":"2024-08-15T02:18:08Z","snapshot_observed_at":"2026-07-06T17:15:50.649358Z","submitted_at":"2024-01-15T20:42:16Z","title":"A Study on Large Language Models' Limitations in Multiple-Choice Question Answering","version":2},"cited_work":{"arxiv_id":"2401.07955","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07955","snapshot_observed_at":"2026-08-06T14:51:50.931551Z","title":"A Study on Large Language Models' Limitations in Multiple-Choice Question Answering","venue":"cs.CL","work_id":"1287730d-63b4-4f47-b6da-3deb3720e95e","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.591975Z"},"links":{"cited_paper":"/paper/2401.07955","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:effaf6973ddf99461ff9a91a0af7549e79294c5e5d1cd77a5d4f54a055ce240c","observation_id":"3c233bd1-64b2-4d1a-af04-dc89e7e17fbc","resolution":{"observed_at":"2026-08-06T14:51:50.935110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.095877Z","title":"Kouwenhoven, K","venue":null,"work_id":"01017ed6-a478-4e1e-9d70-3ba5e931cf00","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.595709Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:4ad17541f4ab83f8232c0491d6117d93532e184a7066803492eef1d4869a3fd1","observation_id":"a3e7a8cd-d157-40b7-8669-82f20315fc0c","resolution":{"observed_at":"2026-08-06T14:51:51.099418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.086457Z","title":"Lapuschkin, S","venue":null,"work_id":"ed83c15e-0d22-44de-83f0-e1c5fd65f622","year":2019},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.601707Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:9287575645ebdc5db429dbc1951fa378edf24b8fa5353a0ce376af104d73d3f5","observation_id":"67082a30-dcca-4f77-a2dc-b8f7ce85ed61","resolution":{"observed_at":"2026-08-06T14:51:51.089812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.077071Z","title":null,"venue":null,"work_id":"aecab9d4-61ce-4d85-ac5a-ecb07a50430f","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.604686Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:7f898165da76623a718005c7edea75db8b65305bbde05f8de4b93af99eb36935","observation_id":"03ca06ae-1dce-4d34-a581-c05c7217618e","resolution":{"observed_at":"2026-08-06T14:51:51.080285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.607638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.607638Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:7d0e2bb5f4d607e53c3242140570d4a6ad7036386ab7a9b43ac5f379250bd3cb","observation_id":"faebbbd4-82d5-41db-beb7-e381824cc4a1","resolution":{"observed_at":"2026-08-06T14:51:50.607638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.610565Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.610565Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:e58b65e910a109468d4578890a076762dadea4c6f785ada726f566db6fbfcfe2","observation_id":"ab69fc3d-2e51-4fe6-8cd6-95358c8debd8","resolution":{"observed_at":"2026-08-06T14:51:50.610565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.067867Z","title":"Millière and C","venue":null,"work_id":"08ed76c0-c08e-4d1d-9b52-e1b8be5a7bb1","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.613417Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:8358a80e51fcf8a69f52c7ee88b84db8baefb50ddbe8fa78bea5babec0a00687","observation_id":"22701fad-6767-41e6-92f2-ab5308341715","resolution":{"observed_at":"2026-08-06T14:51:51.071184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.048703Z","title":null,"venue":null,"work_id":"5f55644e-15ef-4d65-81d3-cbf9767e10e4","year":2025},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.619402Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:cc9b93a8199fc3cd4a32ab51518f545e0fd2dc84e0f6f062f0558344ddb422f5","observation_id":"4d4cc267-c833-4812-b9bb-a2e844eadac7","resolution":{"observed_at":"2026-08-06T14:51:51.052057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.037876Z","title":"Mitchell and D","venue":null,"work_id":"09726462-f0fc-48a3-9595-3c9a0cdbe735","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.622150Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:ed1b98944d59e2e1bc4ba2fb42b1505f11dec8b2141f7fea43787e4adf5611a8","observation_id":"f8cea98f-d6b8-410c-9586-0f675163474b","resolution":{"observed_at":"2026-08-06T14:51:51.042135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.027633Z","title":"Muttenthaler, J","venue":null,"work_id":"a4595547-5679-4b65-b683-f2bdae46cf38","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.624957Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:fb7330e4b6dd6414ea6cd045202448633a017fe3420df7bbf5c26764edf5e493","observation_id":"89d95f19-a1b0-4c32-8760-4c1f0bb0305e","resolution":{"observed_at":"2026-08-06T14:51:51.031359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04231","last_updated":"2023-03-29T08:48:35Z","snapshot_observed_at":"2026-07-06T14:28:17.748673Z","submitted_at":"2022-12-08T12:28:23Z","title":"Harnessing the Power of Multi-Task Pretraining for Ground-Truth Level Natural Language Explanations","version":2},"cited_work":{"arxiv_id":"2212.04231","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.04231","snapshot_observed_at":"2026-08-06T14:51:50.838500Z","title":"Harnessing the Power of Multi-Task Pretraining for Ground-Truth Level Natural Language Explanations","venue":"cs.CV","work_id":"1f5b9e76-5200-44f3-8052-f46ae5f96bc4","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.628101Z"},"links":{"cited_paper":"/paper/2212.04231","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:20c2ccfe182650989992aab94b217f3141b63e3b340c9499f6432f555a0418a4","observation_id":"5978a572-316c-4181-9e77-edbe33f93f06","resolution":{"observed_at":"2026-08-06T14:51:50.844270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.631222Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.631222Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:5a3cacc0a21ad248c9c3947e6ccc6b51c4c44a6ccd880f5c94f66bcb2e63a830","observation_id":"ed235610-6163-4f84-b16d-d0950dcfb4ce","resolution":{"observed_at":"2026-08-06T14:51:50.631222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.634020Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.634020Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:45dbb6b7eac29211a57f542dfef4a36a35ada861f7c5fa8ff464ec98d83b3785","observation_id":"eb6a3e63-5cd6-43d6-9380-f9511997d53e","resolution":{"observed_at":"2026-08-06T14:51:50.634020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.636974Z","title":"Shiri, X.-Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.636974Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:f260b85a50ed16de200a468a80da2b1cf9509c51dcf094a75662ae031d5c9bc3","observation_id":"247aed77-8d17-43ba-b623-93952b408f3f","resolution":{"observed_at":"2026-08-06T14:51:50.636974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.006927Z","title":"Thrush, R","venue":null,"work_id":"3a93cafd-b4c7-4828-9401-c716728c3cb1","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.642940Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:49c42ed5be5af1ffe3e3c7dac3bf1dc872017c9bf67677ca0b4b60d1139de1ab","observation_id":"4cb86626-ab72-406d-a853-6c6ca4f656bb","resolution":{"observed_at":"2026-08-06T14:51:51.011309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.645687Z","title":"Verhoef, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.645687Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:8c2a7ac95c0143eddb0001a8674473ff35c970a83e8d09a14d83b4af889a45d7","observation_id":"991d4357-8b0b-47f1-836f-024aac3c68a1","resolution":{"observed_at":"2026-08-06T14:51:50.645687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.996791Z","title":null,"venue":null,"work_id":"348e3c8d-4601-4df1-bc2e-841cb2e5cd0e","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.648623Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:48b3d80dfb760db68ad10e39900c56c2aedaeb96750d7cf39a92fac23a2ef051","observation_id":"db37623d-b3c1-42b2-94f3-79c4c248033c","resolution":{"observed_at":"2026-08-06T14:51:51.000457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.651506Z","title":"my answer is C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.651506Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:6314e2c726dfc3b263b6e4f5a8b771585885bea70163e188207c0f9498f87841","observation_id":"248c295d-a541-4f74-b303-f7d3d0022f88","resolution":{"observed_at":"2026-08-06T14:51:50.651506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.654451Z","title":"Weber, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.654451Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:1c0c74975b63dfc48aed9e292b81a02d983ebb54e016e5f40a0819a55c7f3a40","observation_id":"f98e0b0f-3cb8-4179-94e9-6401bccdc659","resolution":{"observed_at":"2026-08-06T14:51:50.654451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.987165Z","title":null,"venue":null,"work_id":"d9c30010-d9f9-43a8-9c27-2649399eaba8","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.657624Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:5af5616d69831d4b0413c6b54b3ae1f0c5df6dec42d14299cfcf3254e661bb38","observation_id":"58157d25-1cca-4766-9037-6d7de0be2081","resolution":{"observed_at":"2026-08-06T14:51:50.990292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.10582","last_updated":"2019-01-21T03:07:54Z","snapshot_observed_at":"2026-07-06T07:17:07.332183Z","submitted_at":"2018-11-26T18:37:25Z","title":"Visual Entailment Task for Visually-Grounded Language Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.10582","snapshot_observed_at":"2026-08-06T14:51:50.660432Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.660432Z"},"links":{"cited_paper":"/paper/1811.10582","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:db9eca04a66b8fc98cfc8c175030ee4518ebc40ea29844aca6b8f150a579a4f6","observation_id":"539712ab-8c3d-424b-aa00-648877d7836f","resolution":{"observed_at":"2026-08-06T14:51:50.660432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.977980Z","title":"Zhang, V","venue":null,"work_id":"255d6416-8605-4e15-a1d4-6aa6f3db3f38","year":2020},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.663945Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:35cd46cfc3e2bdf6fc6f7e39ac725927c0401a37757845303e5b31c3c48ca85e","observation_id":"9bc8f9cd-5eae-4623-a635-38860ab99ed2","resolution":{"observed_at":"2026-08-06T14:51:50.981230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.958719Z","title":null,"venue":null,"work_id":"2e0cb5ac-66b3-4694-b374-a958675e051a","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.670254Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:78db20c8a16b5ca860e689e7ea23bebb14f5fa3e0933213d07b9118508c5e5b8","observation_id":"63cb6713-0dc5-49fd-a88f-879d10198ba1","resolution":{"observed_at":"2026-08-06T14:51:50.961867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.968775Z","title":null,"venue":null,"work_id":"4aec01a8-8321-4c27-b9f7-727146608d56","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.673125Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:02ecf2bd3d497c5453c4aee50048296f5e589b416d7b1af72a5d0cf7249d6f45","observation_id":"bedc76e7-7512-480f-bfdc-031d0633b442","resolution":{"observed_at":"2026-08-06T14:51:50.972099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.949483Z","title":null,"venue":null,"work_id":"8422698d-07c5-452d-b782-3c6cc395a733","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.676043Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:807d0faf66050c723e75cae315aa3af88502f86e38cbaa0b663157240bc6ab16","observation_id":"26d15cd2-9656-4eb1-9e83-daa8e40cf9a8","resolution":{"observed_at":"2026-08-06T14:51:50.952632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.017878Z","title":null,"venue":null,"work_id":"d9847db3-a1ad-4456-bd9e-96f3200327c4","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":1195,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.639926Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:a30cd0a6a5616f1d063741462b62ce11792e9fda3b8ad32fb8d6c14b8c807b96","observation_id":"d9109c39-35ff-40b4-ba91-1e86d992d6d4","resolution":{"observed_at":"2026-08-06T14:51:51.021076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.574067Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.574067Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:f1e379f8cb884ff996047c0bc8283763ec7ef6207bccc40cae5904c3fa9d3ebd","observation_id":"7bf8dee9-d1ff-4d1d-b7f9-61a2c4e8a293","resolution":{"observed_at":"2026-08-06T14:51:50.574067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03744","last_updated":"2021-08-19T09:26:21Z","snapshot_observed_at":"2026-08-06T01:09:18.652428Z","submitted_at":"2020-04-07T23:12:51Z","title":"e-SNLI-VE: Corrected Visual-Textual Entailment with Natural Language Explanations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03744","snapshot_observed_at":"2026-08-06T14:51:50.564041Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.564041Z"},"links":{"cited_paper":"/paper/2004.03744","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:c9334293a8f35855614f0adeceaa42ac1d356ded483a63b5b2316054fa9ca212","observation_id":"047f491e-9d67-4e66-8c4c-ab48ac450641","resolution":{"observed_at":"2026-08-06T14:51:50.564041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.057979Z","title":null,"venue":null,"work_id":"c27d809e-9a21-40cd-93af-8f1346e48a55","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.616166Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:f5ed1dbf5c258e1f853b48a36ec548b7f812737f7b8fd34bcaa938dfbf54111a","observation_id":"c5a606e3-b6b8-4be2-8444-8776ec5c2976","resolution":{"observed_at":"2026-08-06T14:51:51.061515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.10013","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.918388Z","title":null,"venue":null,"work_id":"e1e5c039-8436-46b1-8610-fd6bfd5f7f73","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.598794Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:c8b7318a7e50e7412c9ea1078e6fb1d455bd28f4b2af0daa5145acbaa689b40a","observation_id":"b1b499f7-9bf9-44e0-a5a2-49bcde5cbf6b","resolution":{"observed_at":"2026-08-06T14:51:50.923240Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:18:56.362380Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":3,"verified_fuzzy":20},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2507.17467."}