{"as_of":"2026-08-14T08:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:775f0c477122f92a1ad1e7aa6ee0df40d774b54ffa9c2d708e9c028079790a44","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:09:39.172139Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2511.16527/citation-record","integrity":"/paper/2511.16527/integrity","json":"/paper/2511.16527/citation-record.json","paper":"/paper/2511.16527"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.14610","last_updated":"2023-06-26T11:35:22Z","snapshot_observed_at":"2026-08-13T11:09:24.121685Z","submitted_at":"2023-06-26T11:35:22Z","title":"SugarCrepe: Fixing Hackable Benchmarks for Vision-Language Compositionality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14610","snapshot_observed_at":"2026-08-03T21:09:38.144310Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.144310Z"},"links":{"cited_paper":"/paper/2306.14610","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:98e95ff35d877385633aa286d7fc8cd447e190e7fcf9bf93dd30a7d4b3b89c97","observation_id":"522cd0ae-39d2-4586-b492-f40362367fd8","resolution":{"observed_at":"2026-08-03T21:09:38.144310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00740","last_updated":"2025-03-29T12:57:07Z","snapshot_observed_at":"2026-08-13T19:09:38.694941Z","submitted_at":"2024-04-30T01:19:18Z","title":"Modeling Caption Diversity in Contrastive Vision-Language Pretraining","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00740","snapshot_observed_at":"2026-08-03T21:09:38.539074Z","title":"Steven J Leon, Åke Björck, and Walter Gander","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.539074Z"},"links":{"cited_paper":"/paper/2405.00740","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:fdbc5b6e08461361a650d80959ab39f216620ae6c78189c134b4af909d3fedd7","observation_id":"a6624439-ad1d-4a76-a568-75808baedd31","resolution":{"observed_at":"2026-08-03T21:09:38.539074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20312","last_updated":"2024-03-29T17:33:42Z","snapshot_observed_at":"2026-08-13T00:41:53.538899Z","submitted_at":"2024-03-29T17:33:42Z","title":"Learn \"No\" to Say \"Yes\" Better: Improving Vision-Language Models via Negations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20312","snapshot_observed_at":"2026-08-03T21:09:38.806868Z","title":"Aarohi Srivastava, Abhinav Rastogi, and Abhishek Rao et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.806868Z"},"links":{"cited_paper":"/paper/2403.20312","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:e427893cd4ba07cb78af2b34280dc957c3f9db1c5a7a2b8ce79bc89373ef9453","observation_id":"beff9099-4641-4635-be9e-6cb34a6ed9b1","resolution":{"observed_at":"2026-08-03T21:09:38.806868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-03T21:09:38.915404Z","title":"Norbert Vanek and Haoruo Zhang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.915404Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:5c02c81099eb42d6deab09d4468335a8cc2d773583837ea2b5ed18beb5b04c54","observation_id":"d7849b73-2840-4e4a-a39d-98d78d63ae77","resolution":{"observed_at":"2026-08-03T21:09:38.915404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:09:38.980711Z","title":"doi: 10.3389/fpsyg.2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.980711Z"},"links":{"citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:8fc328f8a230954832a174ecee04695853f6588d508ac3672eb8290d088c9f05","observation_id":"0d63db69-504d-4b73-8607-876920c5a93b","resolution":{"observed_at":"2026-08-03T21:09:38.980711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01936","last_updated":"2023-03-23T23:21:38Z","snapshot_observed_at":"2026-08-13T14:13:01.385510Z","submitted_at":"2022-10-04T22:13:25Z","title":"When and why vision-language models behave like bags-of-words, and what to do about it?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01936","snapshot_observed_at":"2026-08-03T21:09:38.983791Z","title":"Kecheng Zheng, Yifei Zhang, Wei Wu, Fan Lu, Shuailei Ma, Xin Jin, Wei Chen, and Yujun Shen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.983791Z"},"links":{"cited_paper":"/paper/2210.01936","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:6a7ae000ce4a22eec73dbfe4b1dca9e10ddf0c9703aca00638c13849c736bfca","observation_id":"bac79f28-4979-4612-8ae4-10343a704e77","resolution":{"observed_at":"2026-08-03T21:09:38.983791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17007","last_updated":"2024-03-25T17:59:42Z","snapshot_observed_at":"2026-08-13T00:45:25.540457Z","submitted_at":"2024-03-25T17:59:42Z","title":"DreamLIP: Language-Image Pre-training with Long Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17007","snapshot_observed_at":"2026-08-03T21:09:39.055252Z","title":"{original}","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:39.055252Z"},"links":{"cited_paper":"/paper/2403.17007","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:6e84611351f1ae1ab9ac8310a9286f0286e0a79bacc408e55a878e6d4de4d0aa","observation_id":"a00aee8d-dc54-48d6-8689-15e0bfb3a155","resolution":{"observed_at":"2026-08-03T21:09:39.055252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:09:39.172139Z","title":"(b) Effect of setting the number of projection vectors on Top-1 accuracy using paraphrased caption for image matching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:39.172139Z"},"links":{"citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:c78aac9671be2a8f9fdd8ca966adc43f5e72809440d07ef836bccb1b461d4916","observation_id":"9fc52de7-abc4-4b31-9597-e1e1d6d5d266","resolution":{"observed_at":"2026-08-03T21:09:39.172139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:09:38.447128Z","title":"Technical Report, CIFAR-10 and CIFAR-100 datasets","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.447128Z"},"links":{"citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:6c2c485eba49d880d5dd05978688c14f73d565ea46d30875552382c5023b3458","observation_id":"d8a739a6-a7d3-4a38-a1ff-4c85af4ecd55","resolution":{"observed_at":"2026-08-03T21:09:38.447128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02230","last_updated":"2018-12-05T21:21:09Z","snapshot_observed_at":"2026-07-06T07:19:25.218264Z","submitted_at":"2018-12-05T21:21:09Z","title":"Towards a Definition of Disentangled Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02230","snapshot_observed_at":"2026-08-03T21:09:37.980521Z","title":"Cheng-Yu Hsieh, Jieyu Zhang, Zixian Ma, Aniruddha Kembhavi, and Ranjay Krishna","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:37.980521Z"},"links":{"cited_paper":"/paper/1812.02230","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:b6ba0b2df3d6ad536690221b06e5d0ea895e469ed6157c64713d9a493bcc91d8","observation_id":"b518c03e-8ebb-4cd7-adc7-fcd484e5c484","resolution":{"observed_at":"2026-08-03T21:09:37.980521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:09:38.303578Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.303578Z"},"links":{"citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:0835509984877102012b9c0b335273eeac97cf19b1fd950a009f0b353cae924a","observation_id":"a7217013-f6fc-40c6-8f65-02bf0c19fabb","resolution":{"observed_at":"2026-08-03T21:09:38.303578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-03T21:09:38.691533Z","title":"Fixing weight decay regularization in adam.CoRR, abs/1711.05101, 2017a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.691533Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:abd95edd1e7b51b4b302131be285f7cc997c2957c280dc2d5bbd49c93ce3f751","observation_id":"4ba2cce1-44b2-472e-aaeb-52a86ab39ada","resolution":{"observed_at":"2026-08-03T21:09:38.691533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20088","last_updated":"2023-10-28T08:46:13Z","snapshot_observed_at":"2026-08-13T11:28:03.339274Z","submitted_at":"2023-05-31T17:59:04Z","title":"Improving CLIP Training with Language Rewrites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20088","snapshot_observed_at":"2026-08-03T21:09:37.868345Z","title":"Irina Higgins, David Amos, David Pfau, Sebastien Racaniere, Loic Matthey, Danilo Rezende, and Alexander Lerchner","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:37.868345Z"},"links":{"cited_paper":"/paper/2305.20088","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:531c435a00af22723b084080619a71a086b8aa5a34c971851f986cdf47cd7080","observation_id":"ee264ae8-0f3d-47e4-96bb-2c3e12725e34","resolution":{"observed_at":"2026-08-03T21:09:37.868345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15120","last_updated":"2024-02-23T06:11:50Z","snapshot_observed_at":"2026-08-13T04:12:22.058603Z","submitted_at":"2024-02-23T06:11:50Z","title":"Fine-tuning CLIP Text Encoders with Two-step Paraphrasing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15120","snapshot_observed_at":"2026-08-03T21:09:38.394630Z","title":"Alex Krizhevsky","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:38.394630Z"},"links":{"cited_paper":"/paper/2402.15120","citing_paper":"/paper/2511.16527"},"observation_digest":"sha256:04c39a8c813f3ddc8aaae314861d922dcbf26797925a476fef2ed068683246c8","observation_id":"23c81c33-2776-44a5-8864-3eb9e92e8363","resolution":{"observed_at":"2026-08-03T21:09:38.394630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.16527","last_updated":"2026-06-29T08:31:48Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T10:30:13.415903Z","submitted_at":"2025-11-20T16:41:36Z","title":"Contrastive vision-language learning with paraphrasing and negation"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2511.16527."}