{"as_of":"2026-08-12T12:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5aafe0077822bfa476f3003740f7ad28c16efaa79c8fc28796ff1726da0a8d0a","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:43:08.140446Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.10817/citation-record","integrity":"/paper/2412.10817/integrity","json":"/paper/2412.10817/citation-record.json","paper":"/paper/2412.10817"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.869533Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.869533Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:acac44da1fcbb52c8eba4085dd56f64376198c4418fde1e32d97b54ac60ae3dd","observation_id":"6537e4d3-74a6-40c2-b7c2-86a6c26775e8","resolution":{"observed_at":"2026-08-11T15:43:07.869533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.877609Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.877609Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:c21b0e0b58ca57ddcb58517562c6bacf6b32ed4b08ce6caa9067073df5e96240","observation_id":"8a0afe93-54b5-4c72-8df2-af6196e5d87f","resolution":{"observed_at":"2026-08-11T15:43:07.877609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.885605Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.885605Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:14ceb70f7d64fe345d7d5442e3e252135bdcf180780ac9aa97ce8005af0cbabd","observation_id":"e429ddf2-98a0-4a65-89c5-674459acc72c","resolution":{"observed_at":"2026-08-11T15:43:07.885605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.894767Z","title":"M.; Kucukelbir, A.; and McAuliffe, J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.894767Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:7484fa18a42026d1b32adf13330f5d0fbcfb68a567692d4f557fe182e7a812d8","observation_id":"0dab6955-524e-4d92-a762-d8c6cace46e7","resolution":{"observed_at":"2026-08-11T15:43:07.894767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.901330Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.901330Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:3a4bd3eb5c87ec4c986d1e45fa6545f4b015b7927a14b9e0a353ab48930f715d","observation_id":"ee4891be-333c-41d4-8cea-19b04721a49c","resolution":{"observed_at":"2026-08-11T15:43:07.901330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.908216Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.908216Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:da5e7a3ab4b0396dcf25f7a9ae53a2c41e36fe55ae259983987a6ee8274e2705","observation_id":"0c824282-6f9b-429e-b7fa-f097e9e8f8d7","resolution":{"observed_at":"2026-08-11T15:43:07.908216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.822639Z","title":null,"venue":null,"work_id":"7038b978-691e-40b4-8f21-dc38ccd591ff","year":2019},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.913959Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:e6f05b93631a04310c4c7d8a05a5d1b3e43a22a795e5ff7d7ae64aa0e16b9e3f","observation_id":"000cb9ef-665e-41f3-805b-00f3b12e801c","resolution":{"observed_at":"2026-08-11T15:43:08.828146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.919289Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.919289Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:ad444c53edf98bafe62cb1e89e8575be187636562685b61fa6b29e982b84de10","observation_id":"0268b373-ab0a-4412-b703-f2c3ad92e7f4","resolution":{"observed_at":"2026-08-11T15:43:07.919289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.925281Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.925281Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:5a1d3f8830aa40e903edde26b5f5d22735b036d5357e2df4ec94f30e9725883f","observation_id":"95956bd8-23af-476c-9888-dc5b659b87fb","resolution":{"observed_at":"2026-08-11T15:43:07.925281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.775783Z","title":null,"venue":null,"work_id":"2e84305e-a00e-47cb-9612-c18d79d68965","year":2024},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.931056Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:6dfc39e07a374d5bd1abf0fed15e2be27a068f809d69740c6737bcc7f86eaff3","observation_id":"a2b1ea47-7c33-4097-ac20-9595fddce491","resolution":{"observed_at":"2026-08-11T15:43:08.782301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.754893Z","title":null,"venue":null,"work_id":"c331e0f4-90e1-4ad2-afc6-e6d4fae69f71","year":2024},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.937469Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:83bf729513be102afdf0f78811301c3bd4c26b79679801e254bf670fec08e46c","observation_id":"8486f910-71ed-4fe6-a138-5c6267234027","resolution":{"observed_at":"2026-08-11T15:43:08.760558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.943996Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.943996Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:e7c9e384d9ce8dbddbf6cdd8f1117fb981485a99fe0bdbe579be9a6c478856bb","observation_id":"850bea96-1375-4574-97ce-186f93afda30","resolution":{"observed_at":"2026-08-11T15:43:07.943996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.951642Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.951642Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:fde14db0a0f9d8261e039a3dea28fa9d359e9b5f81d447fc8a44b4b6a700cc6d","observation_id":"48539f7e-d9cb-46fe-a39b-f476fc3977a8","resolution":{"observed_at":"2026-08-11T15:43:07.951642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.957764Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.957764Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:3f3493abb5652d84b7d1b70580863d480f51ad26e9d50a51a0084e1ad411e628","observation_id":"9676d49e-77eb-4451-af72-514673c17164","resolution":{"observed_at":"2026-08-11T15:43:07.957764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.963749Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.963749Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:921966b412d5b824475f9bc55ce3e1d4f63156d3e50bd9947bbabbca08e665c6","observation_id":"5ac10cb4-74db-4ef1-bf1b-8325c981d11a","resolution":{"observed_at":"2026-08-11T15:43:07.963749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.691102Z","title":null,"venue":null,"work_id":"7b13eec6-9644-4269-a577-85ed9a81d943","year":2019},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.969637Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:147d70efdfb06d8a1c3e01d0c91a3deced9c573b4378b0df5c2f07f7d5807e57","observation_id":"b2fe814d-1957-4008-812e-6822c2584fa3","resolution":{"observed_at":"2026-08-11T15:43:08.696878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.974882Z","title":"J.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; Chen, W.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.974882Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:d032f78e6748d7ed003b39a7173d14e63f0431bac476e5af0e4d5e9fe9d24096","observation_id":"b6a6f37a-702a-482b-b430-9e37a62bb37f","resolution":{"observed_at":"2026-08-11T15:43:07.974882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.980383Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.980383Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:571204fd72179c439eff03076d66ba492a41d856bb2ec987bdfd6205a16002b6","observation_id":"f551e398-3680-41c8-96e4-da0e41dc37cf","resolution":{"observed_at":"2026-08-11T15:43:07.980383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.646485Z","title":"U.; Rasheed, H.; Maaz, M.; Khan, S.; and Khan, F","venue":null,"work_id":"7c6c1560-6406-4556-b17e-7973f6a8582d","year":2023},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.985804Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:352bc8fa6b34fde0d14c85238d29727503d14f01b01a1b76503dfc79cc134c08","observation_id":"da6ed8d8-e988-48e6-9685-f15779b9b46f","resolution":{"observed_at":"2026-08-11T15:43:08.654039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.625576Z","title":"P.; and Welling, M","venue":null,"work_id":"066d1e68-b025-4a8b-80c7-e7c91cf50d69","year":2014},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.991332Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:beb6dae5d903ed32e4963b21fbfcbfe3466d5bb722377bbad7714e3805c68b71","observation_id":"b2abfaee-8da4-4a81-b761-bcefa23d8800","resolution":{"observed_at":"2026-08-11T15:43:08.631862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:07.996790Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:07.996790Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:9f99992692ff7410dd7b6e62728616f51c48c26d5e6cb43061f7a6b26483b21c","observation_id":"1e19a158-e5ef-4725-a896-c9d42e61db61","resolution":{"observed_at":"2026-08-11T15:43:07.996790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.009023Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.009023Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:b2691ce0fd4f614971a70aecb846cc095bce04546bfa00a0a91d28a947432d39","observation_id":"fdd11495-7aa9-449c-a4ab-57d93c90a319","resolution":{"observed_at":"2026-08-11T15:43:08.009023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.580106Z","title":null,"venue":null,"work_id":"22800ac4-bce6-4287-bbc1-c281c0312fe5","year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.014402Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:197b1845f359fe0ade0f7297593c1680281850b534651dcf84691c938e057d10","observation_id":"bcd0c0d5-1eb1-4e6e-8c11-f8058d056c3b","resolution":{"observed_at":"2026-08-11T15:43:08.585985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03958","last_updated":"2022-04-22T03:10:41Z","snapshot_observed_at":"2026-07-31T18:02:16.558987Z","submitted_at":"2022-02-08T16:09:12Z","title":"Uncertainty Modeling for Out-of-Distribution Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03958","snapshot_observed_at":"2026-08-11T15:43:08.019836Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.019836Z"},"links":{"cited_paper":"/paper/2202.03958","citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:1bae67b7539891fd556604347d3554febde96486c0011849c0aec646f14a5a4e","observation_id":"558a84ba-a1ce-40bc-ae8e-7eb151f11d3c","resolution":{"observed_at":"2026-08-11T15:43:08.019836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.025546Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.025546Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:6d0cf799badb81507fa3cc5d998a3b7cf9c2e6576410005a4c3615915ad81735","observation_id":"24928ecb-33af-455e-b72e-1368f5f62f90","resolution":{"observed_at":"2026-08-11T15:43:08.025546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.031298Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.031298Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:319d11ba93fdb4833677c581d0f9e10a520ca3939350de507334287ad5925d07","observation_id":"bdade583-65c0-431c-a97f-3671208d44a6","resolution":{"observed_at":"2026-08-11T15:43:08.031298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08632","last_updated":"2025-03-03T12:01:27Z","snapshot_observed_at":"2026-07-06T17:44:00.848335Z","submitted_at":"2024-03-13T15:46:37Z","title":"A Decade's Battle on Dataset Bias: Are We There Yet?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08632","snapshot_observed_at":"2026-08-11T15:43:08.036929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.036929Z"},"links":{"cited_paper":"/paper/2403.08632","citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:1c02227964449238b45f178fde043fbc97e30ffd3ba04e9c4e072667cadb0df9","observation_id":"cfc68f3d-4c9e-4bd9-8630-efad9805cd94","resolution":{"observed_at":"2026-08-11T15:43:08.036929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-11T15:43:08.042720Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.042720Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:1e96f4482277f2ef9805653833ed2d6597cd4b086b662c174a0fe97146a37de8","observation_id":"5320cc0b-c8c0-4797-9582-90cca420e934","resolution":{"observed_at":"2026-08-11T15:43:08.042720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.049782Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.049782Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:e8072b14fea38c0480f7105b12bc3c610825a811446fb5cdc9c0f305665fdb2a","observation_id":"a5ef668c-c0e8-4642-8c08-c9c0e8f24b0e","resolution":{"observed_at":"2026-08-11T15:43:08.049782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.056291Z","title":"M.; Vedaldi, A.; Zisserman, A.; and Jawahar, C","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.056291Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:e39c685459d6bd46961f44db93ba540e0a72036fbed14b8b94a1ec1cf0ea038c","observation_id":"9d9609e1-3b00-4dc1-9ed3-5e8c3675335e","resolution":{"observed_at":"2026-08-11T15:43:08.056291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.061406Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.061406Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:361ad015cc061724d7cb54c6264ed6c1d6d34e53f7a4443084b16cd9eed1e277","observation_id":"ab49b7f9-4b8a-433b-a46b-7d7661150df3","resolution":{"observed_at":"2026-08-11T15:43:08.061406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.067548Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.067548Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:d862e20c76951da1fc7f6703288f90db0c7be2cbc30c3d9048b2ec059daf948c","observation_id":"f7466d8b-333a-4325-8ee3-7babdcdfa327","resolution":{"observed_at":"2026-08-11T15:43:08.067548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-11T15:43:08.073436Z","title":"R.; and Shah, M","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.073436Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:0fdf160aa5f6dff9e96978f5e703c8409b75f6775fae5e0bb20769463ba7db23","observation_id":"8c22c14c-de99-481d-880d-42ba21a7db58","resolution":{"observed_at":"2026-08-11T15:43:08.073436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.079599Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.079599Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:b73cb175f3a89714fed1d540e2a3ec2117682ab8b5bc159e16674e8017ad6043","observation_id":"5db0e79b-8941-43ea-8666-12f0c20cb2f0","resolution":{"observed_at":"2026-08-11T15:43:08.079599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.084790Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.084790Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:4fb4ec6a6cdfc956ed985548e72912b50b38b8d521f75a530af2a9bfac91dad0","observation_id":"a110728c-8422-4617-bfb8-38435ae30d14","resolution":{"observed_at":"2026-08-11T15:43:08.084790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.090385Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.090385Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:ce6c92252cd3e88e87f83c564c812b6a82552e9af8213cd7aa9c54f0f7566d23","observation_id":"50ed3298-747a-4d6d-af9b-a26675e50304","resolution":{"observed_at":"2026-08-11T15:43:08.090385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.423019Z","title":"A.; Oliva, A.; and Torralba, A","venue":null,"work_id":"725833a1-e09f-49c5-ae84-37d559c03e05","year":2010},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.097003Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:75187402063159f7e693fb0e4ab3bcde4b720907c3cf2bc1ca4f057ffd305c65","observation_id":"5d34ea5c-154a-48bc-9643-72ea83631ff1","resolution":{"observed_at":"2026-08-11T15:43:08.428976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.102650Z","title":"B.; Goldberg, Y.; and Ravfogel, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.102650Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:72697b186e134a17a6bd5a43ffb273277f7f4c87de815539e896110204afafe8","observation_id":"f7bc7a8b-b522-4b25-9799-0f44f698dc41","resolution":{"observed_at":"2026-08-11T15:43:08.102650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07651","last_updated":"2025-05-28T15:07:08Z","snapshot_observed_at":"2026-08-11T18:36:49.602726Z","submitted_at":"2023-06-13T09:43:32Z","title":"Variational Positive-incentive Noise: How Noise Benefits Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07651","snapshot_observed_at":"2026-08-11T15:43:08.108208Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.108208Z"},"links":{"cited_paper":"/paper/2306.07651","citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:7c4f07e340dee1d2b05c84c8808aaab5d3131c5d1b7c9995f788c4c0dfe49152","observation_id":"5d2cebbc-16f7-4424-865f-7334e6621ab4","resolution":{"observed_at":"2026-08-11T15:43:08.108208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09929","last_updated":"2026-05-08T06:19:21Z","snapshot_observed_at":"2026-08-02T14:52:34.680562Z","submitted_at":"2024-08-19T12:07:42Z","title":"Data Augmentation of Contrastive Learning is Estimating Positive-incentive Noise","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09929","snapshot_observed_at":"2026-08-11T15:43:08.114080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.114080Z"},"links":{"cited_paper":"/paper/2408.09929","citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:edbc10d48bea46006fc3988c4dca26fd93f1cbad0caf7d255f43c7d8cad33d6e","observation_id":"ce943cb5-6c4b-4eb3-9e40-ed8fd01f55d0","resolution":{"observed_at":"2026-08-11T15:43:08.114080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.119727Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.119727Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:568fcbb1071653dc5fb8831059467eefd8b91c7cb7eb69ba3443bb3cd6107c23","observation_id":"b61bfef2-6d1e-438e-8d3e-64f725f5ebb7","resolution":{"observed_at":"2026-08-11T15:43:08.119727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12643","last_updated":"2023-01-30T03:52:16Z","snapshot_observed_at":"2026-08-07T16:10:56.846388Z","submitted_at":"2023-01-30T03:52:16Z","title":"Adversarial Style Augmentation for Domain Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12643","snapshot_observed_at":"2026-08-11T15:43:08.124676Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.124676Z"},"links":{"cited_paper":"/paper/2301.12643","citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:7271ef03af632f4ab26bd573313cc3ddf29c76acd20b0793f2d99270798e8b76","observation_id":"223ecb94-75ca-4c53-8a29-b13eb0a1233f","resolution":{"observed_at":"2026-08-11T15:43:08.124676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.362519Z","title":"H.; and Sebe, N","venue":null,"work_id":"b2f301ee-cfb2-4c73-9116-0ed3f9951eda","year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.130089Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:6cb0cd4b8978d739585be9f03757116b3fc893ee7bd99e74442d843ba6c99a08","observation_id":"7e3f7548-16fe-455d-8a9c-4949aa6411c5","resolution":{"observed_at":"2026-08-11T15:43:08.370905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.135485Z","title":"C.; and Liu, Z","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.135485Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:edfaef15650adb9c1f43c0bd7f21fad0fc6cbbd21920ecc89a317d68bf5f2e51","observation_id":"c62a6925-5c62-44bc-9065-73787b7c83c2","resolution":{"observed_at":"2026-08-11T15:43:08.135485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:43:08.140446Z","title":"C.; and Liu, Z","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T15:43:08.140446Z"},"links":{"citing_paper":"/paper/2412.10817"},"observation_digest":"sha256:cbe3acd5320dfc085b655fefda9ba071b3c680bfb15f46329bf64d8765c3d5e3","observation_id":"efb0491d-7aa0-4e51-a77b-7c44c83bc48c","resolution":{"observed_at":"2026-08-11T15:43:08.140446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.10817","last_updated":"2024-12-17T02:35:10Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T18:37:10.008263Z","submitted_at":"2024-12-14T12:58:15Z","title":"Enhance Vision-Language Alignment with Noise"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2412.10817."}