{"as_of":"2026-08-19T09:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:322e468e3d88bbf01abd1633488a4e1dc2083894ea8e6aca1b1dbc412e26f85f","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:42:50.425283Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19659/citation-record","integrity":"/paper/2508.19659/integrity","json":"/paper/2508.19659/citation-record.json","paper":"/paper/2508.19659"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T15:42:50.343100Z","title":"L., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.343100Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:74fb6cd4cb6c7e1ed45500fcdf9973b6030c3e6a62b9ab843f214dbb3f0b7b9e","observation_id":"6e150b46-e433-4d87-8c79-d618b27ce973","resolution":{"observed_at":"2026-08-05T15:42:50.343100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-05T15:42:50.347026Z","title":"A., Adeli, E., Altman, R., Arora, S., von Arx, S., Bernstein, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.347026Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:814731f843e5167795ea38115bc463ea2fb931d6f7590414d07db10301c905ab","observation_id":"6ad299e0-4a7c-488a-b2de-08850ae59686","resolution":{"observed_at":"2026-08-05T15:42:50.347026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.726352Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"f8ee2a5a-3b31-48a7-aade-ac32eec852f2","year":2021},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.350608Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:309644427d9a28e1cd01db013923c06a90f84d1fb9f03e07507376d467fa45e0","observation_id":"e33ba18d-5f09-45e9-b0e2-e4f433b2c67d","resolution":{"observed_at":"2026-08-05T15:42:50.729190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.717801Z","title":"Learning with instance- dependent label noise: A sample sieve approach","venue":null,"work_id":"bfe782be-b175-4486-8710-127361a60684","year":2021},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.353649Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:f6dac5d0ce3dafcfb729b7f8f00587e44d5dd01d62512529f9041f527696d45d","observation_id":"df9f1ea2-8884-4247-b967-44203d98ccea","resolution":{"observed_at":"2026-08-05T15:42:50.720829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.708728Z","title":"Pengi: An audio language model for audio tasks","venue":null,"work_id":"a33baed2-2449-4f8e-80c5-84505d675528","year":2023},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.356739Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:935513b8d3a6382a629df6dc28b6734e6f2c8e4c24ad64d75d9bbbcdbe153c65","observation_id":"f0988f99-25dc-4e89-822a-2934de55aa50","resolution":{"observed_at":"2026-08-05T15:42:50.711943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.699964Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"3a2b6d17-47c8-455c-9e92-88674f0e442a","year":2019},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.359725Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:c9ab93a9959b8d3649815c5fcc0b193f3632b362655a45c3ce31aa08453892a8","observation_id":"f0e41465-8eaa-4955-a1a2-3ed69647c83b","resolution":{"observed_at":"2026-08-05T15:42:50.703051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.690983Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"4b36f3f0-7d07-4503-9342-d6abee071d33","year":2021},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.362976Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:f951cd72ff8bc564085ac2b94bc66bb8756c0798aa77944fcc781d2cbd9b59e0","observation_id":"a93f859d-5092-4547-8a86-324d7514b881","resolution":{"observed_at":"2026-08-05T15:42:50.694139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.681909Z","title":null,"venue":null,"work_id":"1679e960-d0e4-46b1-b3f3-211ca3520d03","year":2024},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.365748Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:f0fc6dd0edc73ab99dca6b2ee6738f5731e0f307c7828958dcee8f744d12dec2","observation_id":"0e1c202f-6e0d-41fe-9a19-b999d7f5b57f","resolution":{"observed_at":"2026-08-05T15:42:50.684728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.672410Z","title":"Deep residual learning for image recog- nition","venue":null,"work_id":"d0af90e7-1f89-4678-8063-2791c127110e","year":2016},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.368481Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:0c0e0f9332e277edfacaec9015335b2169831ef3afaacf5168d54c65cb78f191","observation_id":"4bff7725-0115-4a18-99cd-f599c1525810","resolution":{"observed_at":"2026-08-05T15:42:50.675520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.662996Z","title":"An in- formation fusion approach to learning with instance-dependent label noise","venue":null,"work_id":"6b2f9770-109e-41ba-9846-dad85c5afae0","year":2021},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.371184Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:ed6aa3c75a9310252d469de747add1a1d9946a7502655b73945334abac0d9057","observation_id":"0f52fcc1-a113-4e4c-a72f-534260049a1d","resolution":{"observed_at":"2026-08-05T15:42:50.666374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.653297Z","title":"Mind the data gap: Bridging large language models (llms) to enterprise data integration","venue":null,"work_id":"bedfb776-dc1c-4d15-a4a3-b3f43e9cdfb1","year":2024},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.373863Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:9638af93944131aa2158112012b75e27d8ca52dba757ae704de1301fced05e04","observation_id":"bea2978a-b724-4aa7-986f-009c0e213384","resolution":{"observed_at":"2026-08-05T15:42:50.656552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-05T15:42:50.376713Z","title":"Roberta: A robustly optimized BERT pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.376713Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:46caa947cb16e4b6279fb39e8446bf5ae21dd52c6562f696fe7c727d9eaf2123","observation_id":"11125bfb-c95f-4391-a441-450155ba2917","resolution":{"observed_at":"2026-08-05T15:42:50.376713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.643964Z","title":"X-clip: End-to-end multi- grained contrastive learning for video-text retrieval","venue":null,"work_id":"b34f8511-7215-4601-a079-16db7763b174","year":2022},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.379737Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:9c81cb213b1970a506843a26031162664cfba4096d13e5e2c242546b45fe7741","observation_id":"6abb9c81-59bc-4362-961f-6940684935ea","resolution":{"observed_at":"2026-08-05T15:42:50.647009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.634262Z","title":"Databases unbound: Querying all of the world’s bytes with ai","venue":null,"work_id":"b2409e07-5b1a-4acc-b905-eb04a23a2a0c","year":2024},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.382476Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:0ed7ec4b760442c45fe67b13c5079208131d0d4497c4d27f8d8e1f9f9bbe096a","observation_id":"aeecad60-7780-42d8-bf3a-eb601f7d3181","resolution":{"observed_at":"2026-08-05T15:42:50.637787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.625155Z","title":"Z.Uniform convergence may be unable to explain generalization in deep learning","venue":null,"work_id":"1e105a91-b3b8-41d2-8f6f-06a0fd0d522d","year":2019},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.385218Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:75213f298ddc8afb067a44b5c80dc1ac9a1db34494234e5368a5792bf6e3ac1b","observation_id":"df8cacab-1fca-44a1-8eb0-6ef8c40bb1d7","resolution":{"observed_at":"2026-08-05T15:42:50.628232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.615888Z","title":null,"venue":null,"work_id":"71fa8fa8-2df8-4d55-a0d5-e88879a50119","year":2021},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.387903Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:9644cffe56bc14b0a26698efc20ecd8d2bfe8dc8c8848ef2161a208ffdb7f690","observation_id":"e8a9c34a-1239-4aa9-a0a7-bcf3d10b7718","resolution":{"observed_at":"2026-08-05T15:42:50.618912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.605925Z","title":"J., Goel, K., and Ré, C","venue":null,"work_id":"9910761a-bb6d-4161-9ff2-31f50c06e835","year":2022},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.390888Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:5cc3b03c9da8173889e408d98abc70be95ce8dc5571bbeac40ca7d1573d61188","observation_id":"542e86c5-e105-4fe8-ae86-e0629ea602ce","resolution":{"observed_at":"2026-08-05T15:42:50.609028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.596935Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., et al","venue":null,"work_id":"fa68ec0b-6d73-4696-a624-f4ca8d9860df","year":2021},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.393681Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:64235a248d09e17872f3883eb82ff5045cb38a9797a6dbdb712cb2c728e009ee","observation_id":"11dfb474-ba75-41da-b289-7ba527a8716e","resolution":{"observed_at":"2026-08-05T15:42:50.600025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.587502Z","title":null,"venue":null,"work_id":"40f519a2-016d-4bee-9875-54821569b44e","year":2025},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.396280Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:bd357627288c35fd33febe32380561e8318524de7198ff8070219507213d80e1","observation_id":"9871c83e-75cb-4a0a-9318-3f1e1a3702b8","resolution":{"observed_at":"2026-08-05T15:42:50.590659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.577130Z","title":"Videoclip-xl: Advancing long description understanding for video clip models, 2024","venue":null,"work_id":"ac0fa814-fed0-4392-a529-d7eb4694e35f","year":2024},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.399095Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:1ea3cd8d833f2772ebeadcfa21d338b16c4f383ad2844cd606852f765d473ee8","observation_id":"12052898-43bc-42fc-a8b0-3203b561db9d","resolution":{"observed_at":"2026-08-05T15:42:50.580632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.10959","last_updated":"2020-02-24T23:25:50Z","snapshot_observed_at":"2026-08-18T06:11:01.992422Z","submitted_at":"2018-11-27T13:17:45Z","title":"Dataset Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.10959","snapshot_observed_at":"2026-08-05T15:42:50.401881Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.401881Z"},"links":{"cited_paper":"/paper/1811.10959","citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:745ed95464f3f08c7ddbde128e6ae6bb054618b59c9c345070515dca1cf5ce6f","observation_id":"b8dacc0c-1c84-4600-b188-cb68c256fca7","resolution":{"observed_at":"2026-08-05T15:42:50.401881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.567393Z","title":"Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation","venue":null,"work_id":"8136bf05-b261-4e9e-8182-37c3f725393d","year":2023},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.405041Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:5fdc5914716c065b863b20f896cd02fff86ac3dfffc09a7903a1120476f7c8f5","observation_id":"0fd3548a-52ec-4cac-93be-d1fc5a15dbd8","resolution":{"observed_at":"2026-08-05T15:42:50.570673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.557613Z","title":"TMLR 2022 (2022)","venue":null,"work_id":"99dd6e36-b1d1-470c-bc70-0605d94674d8","year":2022},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.407849Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:3111357b3b885a88c534411b082ae281f28947bbcb21b4edd9fb4e86674f86a0","observation_id":"edf06c12-5d12-4fab-9b21-46b194482981","resolution":{"observed_at":"2026-08-05T15:42:50.560870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.546878Z","title":"P., Lai, K.-H., Y ang, F., and Hu, X.Data-centric ai: Perspectives and challenges","venue":null,"work_id":"909cbb48-0198-4471-a2a0-fba3a6868d2c","year":2023},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.410712Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:983d10874113cf9065d5fdc0692008c58541f88c49f9c2a015c0b9b7e953be23","observation_id":"084265c0-e48e-4629-8b85-3c6d731ddee7","resolution":{"observed_at":"2026-08-05T15:42:50.550446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.536116Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"c3846ed6-8859-4c22-91f0-0d83f0b8adb9","year":2023},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.413542Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:421e2a9f7f48b4be112d86ac7cda68755bcfc45ca06930aef2cadc13ade0eecc","observation_id":"7cafe26d-3719-4bf4-9a44-1dbe199695c2","resolution":{"observed_at":"2026-08-05T15:42:50.539496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.526132Z","title":"Understanding deep learning requires rethinking generalization","venue":null,"work_id":"e1557584-2c67-405f-bbdd-42948fe5ee90","year":2017},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.416434Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:dac30e3d93d9366ae0f988b234d71774bc5e296662f3ae892c6fe28be3ca4bd0","observation_id":"35d3fdef-9390-47f2-927d-02bcfa848445","resolution":{"observed_at":"2026-08-05T15:42:50.529412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.515309Z","title":"Mathematical analysis of machine learning algorithms","venue":null,"work_id":"750b86c4-53bd-419f-b4cd-9cdb1f4d7fb9","year":2023},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.419383Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:8ae44b7adec9434b34b6bed2bf3ce2739c6b474a36a1c35a0256c834f3d45615","observation_id":"83f59d2b-0717-4913-a035-202b5a6f0b18","resolution":{"observed_at":"2026-08-05T15:42:50.519344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.504633Z","title":"In ECCV (2024), Springer, pp","venue":null,"work_id":"2062ef4d-8d43-4466-b35e-7d913663a410","year":2024},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.422332Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:bdcccd6a25c4e309fc5971e538663caf531fe89f9c848b4679e5211ca0296392","observation_id":"ba28311d-71c6-48ba-a448-322201f10cb0","resolution":{"observed_at":"2026-08-05T15:42:50.508128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:42:50.492179Z","title":null,"venue":null,"work_id":"b62a003d-a1ca-4217-b6f6-9e5fd74e01ce","year":2023},"citing_paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T15:42:50.425283Z"},"links":{"citing_paper":"/paper/2508.19659"},"observation_digest":"sha256:819326b7f38131f6ecea3d5392eb69047f542a0f063215eb24906a858f8429f9","observation_id":"09f4aab5-8008-41f9-ade6-1fdebb1ab7a8","resolution":{"observed_at":"2026-08-05T15:42:50.496301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.19659","last_updated":"2025-08-27T08:16:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T07:57:23.987662Z","submitted_at":"2025-08-27T08:16:59Z","title":"SCAR: A Characterization Scheme for Multi-Modal Dataset"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2508.19659."}