{"as_of":"2026-08-15T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d53f3a65096c13174241feb388abed7dcb7605fc9de54352988e8fc4330b2acc","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T12:44:13.432914Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28269/citation-record","integrity":"/paper/2607.28269/integrity","json":"/paper/2607.28269/citation-record.json","paper":"/paper/2607.28269"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2102.05918","last_updated":"2021-06-11T07:51:39Z","snapshot_observed_at":"2026-08-13T20:15:51.556270Z","submitted_at":"2021-02-11T10:08:12Z","title":"Scaling Up Visual and Vision-Language Representation Learning With Noisy Text Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05918","snapshot_observed_at":"2026-07-31T12:44:13.340533Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.340533Z"},"links":{"cited_paper":"/paper/2102.05918","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:8fb174da5eacdc00ca9f79c6751ea01fa4c2786975ecf6a295ea4b6d8ebed794","observation_id":"d4b3338b-8b46-4a9c-a9ae-6a354c1cdbcc","resolution":{"observed_at":"2026-07-31T12:44:13.340533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.344449Z","title":"Mensch, K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.344449Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:4493027f366b461bb543233cc0687219a562704e2c90feb7b7d73ed2ae5d3e36","observation_id":"2d7b7f3d-5071-4dce-86bb-b48bb41ef366","resolution":{"observed_at":"2026-07-31T12:44:13.344449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.347533Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.347533Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:97062d4d15f4891f7d9caa1e4134949c5e3dfd5bc469747c9c53fdad28f2346d","observation_id":"476bc87d-2c28-4e3d-bb8f-ce97f0016f58","resolution":{"observed_at":"2026-07-31T12:44:13.347533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.350386Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.350386Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:84271f479310d5e0c548fa075870f2768071588dc41a606add935045cb35d035","observation_id":"6d2fbe57-3bc9-45df-8cab-f9dcaac8dd40","resolution":{"observed_at":"2026-07-31T12:44:13.350386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.353308Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.353308Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:73391277dee1fb81b944c5773c544fe1a0b6aaed44dceef4a5e10c8b7be29872","observation_id":"b386d1f1-d9ca-478f-847a-9ba9c59fde56","resolution":{"observed_at":"2026-07-31T12:44:13.353308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-07-31T12:44:13.356194Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.356194Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:61b6df027d7c1bae7cc04918de7e187eb914852128e475fe0e5bbd6d99cf169a","observation_id":"0eb79e6f-f2bf-4493-8488-decf8173308a","resolution":{"observed_at":"2026-07-31T12:44:13.356194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.359452Z","title":"Zitkovich, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.359452Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:de76f5b1b920bf7539ba3561d782c5ebde778ee9be63ecd792fd142db28cbe43","observation_id":"cf663ae0-c6cf-45fa-9803-4a98c7aa76d3","resolution":{"observed_at":"2026-07-31T12:44:13.359452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.362058Z","title":"Driess, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.362058Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:12c4e15321a1a4eb03f98e56e6cbb74620907caa041ad838e27ab53526ddcc0f","observation_id":"75298650-287e-4ac6-9112-181eb910bdd6","resolution":{"observed_at":"2026-07-31T12:44:13.362058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.364501Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.364501Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:377140fb2b5f4af84baee386d346d71cbf5e2770943313782d9419d9cca4bf35","observation_id":"69ead41b-cc72-4a2e-ba47-8befd5253c69","resolution":{"observed_at":"2026-07-31T12:44:13.364501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.366968Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.366968Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:8d0ff098eae4b43ce02c4fe99baff87020b20b464ca3fef8db284a5ed06194e7","observation_id":"33b68069-4439-44d8-a3de-64751fcf3d55","resolution":{"observed_at":"2026-07-31T12:44:13.366968Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.08218","last_updated":"2018-05-09T17:26:40Z","snapshot_observed_at":"2026-08-14T19:43:11.278539Z","submitted_at":"2018-02-22T18:16:53Z","title":"VizWiz Grand Challenge: Answering Visual Questions from Blind People","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.08218","snapshot_observed_at":"2026-07-31T12:44:13.369623Z","title":"Gurari, Q","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.369623Z"},"links":{"cited_paper":"/paper/1802.08218","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:ced9879d9ec96d600e893e0fd60a0c2f5bdb7f41bc1e5598c49adb394a1c8308","observation_id":"f5a080d7-18c1-4d75-80dd-7284160e6944","resolution":{"observed_at":"2026-07-31T12:44:13.369623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.372726Z","title":"Gurari, Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.372726Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:3357ce7dccca75e6e008792668e6a8a1ba746d80bc6ec5dfd9b1453eda620db3","observation_id":"cfeab2dd-780a-420e-90b4-019941d554ed","resolution":{"observed_at":"2026-07-31T12:44:13.372726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.375382Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.375382Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:dcff0f13614e79dc647c5a1a241c80db0ae60c3db65cc4eca6a389dcf67db7fa","observation_id":"66bb1b65-8d3e-4b5a-83f3-f35f2731842a","resolution":{"observed_at":"2026-07-31T12:44:13.375382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.377890Z","title":"Weber, N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.377890Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:4c7da7b57644128f3d849c7bab65db3cbef48240f25233f5429bf10b1a86ba38","observation_id":"19e269b6-bc3a-4bbb-afb2-bb43d1101602","resolution":{"observed_at":"2026-07-31T12:44:13.377890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/icwsm.v12i1.14983","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the International AAAI Conference on Web and Social Media","work_id":"603b631e-223e-4044-8b08-2b2da08fe52b","year":2018},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.380383Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:dd023b1c5e8f0f0f462d7874b766f4c6d593cb32bc93b41e5af9a2d033c12546","observation_id":"fbf9a549-c6bb-468a-8593-12671ffc67f9","resolution":{"observed_at":"2026-07-31T12:45:50.758641Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-09T00:38:15.567138+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-09T00:38:15.567138+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.382960Z","title":"Weber, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.382960Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:29fdc6352bf550f2175f16a6dd08ea3b996238c3af04a8f50bf06b512652ab75","observation_id":"480f697f-a800-4234-b3c8-f899a89bdaf4","resolution":{"observed_at":"2026-07-31T12:44:13.382960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-07-31T12:44:13.385462Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.385462Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:049e2d8cb197bc02a33bb75d43eec4f84e81330565714ad5a8779a50c6838893","observation_id":"65704830-bb04-4d55-bfa0-d23e77d49b09","resolution":{"observed_at":"2026-07-31T12:44:13.385462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-31T12:44:13.388355Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.388355Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:432a2db9554680c68e1d5faeaa818a9aceda1524d8b949efc79bd5d4246fef83","observation_id":"de1c19e8-f8b5-4576-9572-cb261c88af3d","resolution":{"observed_at":"2026-07-31T12:44:13.388355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-14T22:57:08.956233Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-07-31T12:44:13.391227Z","title":"Hinton, O","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.391227Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:14f5019fc9273f102e30251b37843d4dfcc11b02334b2787509482a795c3a54b","observation_id":"34fba734-b420-42c5-8831-baf09b6b0767","resolution":{"observed_at":"2026-07-31T12:44:13.391227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05525","last_updated":"2021-05-20T13:45:55Z","snapshot_observed_at":"2026-08-10T22:39:55.357269Z","submitted_at":"2020-06-09T21:47:17Z","title":"Knowledge Distillation: A Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05525","snapshot_observed_at":"2026-07-31T12:44:13.394605Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.394605Z"},"links":{"cited_paper":"/paper/2006.05525","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:7639d9178ff69a919c081bb0329d718fcfc9bbe4c3cb16afa49f3f5191f961ab","observation_id":"c1d0012f-6efb-43d1-a473-e81174abf68e","resolution":{"observed_at":"2026-07-31T12:44:13.394605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.397877Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.397877Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:98c40902e86801f66c4e7142cc861bf2dc50c0a51ceafb3cdf867da1e97f2a65","observation_id":"8292bf43-841f-45df-a8f2-c838fa04f23b","resolution":{"observed_at":"2026-07-31T12:44:13.397877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.403439Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.403439Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:c9f870e9941b4fdf69eb8925668128fa7a4a6478ee0a29fd288e4aeb9d711a8e","observation_id":"39892797-6f70-4218-b577-14997f80bb52","resolution":{"observed_at":"2026-07-31T12:44:13.403439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v36i6.20613","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"3502dcc9-a92f-43ee-afab-dc8624cc7bff","year":2022},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.406170Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:c998ab02ef7bde3e19eb4b3c678a9011535aa4074868fe27ba4ee12291f4747e","observation_id":"4040767e-7ce5-4e2d-8a22-d38e43328064","resolution":{"observed_at":"2026-07-31T12:45:50.747008Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-09T00:38:15.660206+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-09T00:38:15.660206+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-07-31T12:44:13.411945Z","title":"Shazeer, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.411945Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:cf91665b58a3c6022f584ed812ec396e846e9f4188b26a83b22f9fa5d67e1a1b","observation_id":"4eef1510-0e7d-43a3-889f-4b4e0fa9cdea","resolution":{"observed_at":"2026-07-31T12:44:13.411945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-07-31T12:44:13.414912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.414912Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:b33f8eb7328871b3da7af690b285128701aa20bb7364e24a4da0a10e944dc2c1","observation_id":"c671b387-fe58-4413-aa55-b69423cc82db","resolution":{"observed_at":"2026-07-31T12:44:13.414912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.418061Z","title":"Zheng, W.-L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.418061Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:134b6c9e630f8d51eac8ed2fe8d6cbcfda6be532a079a4ffa25536d0f92d5cb0","observation_id":"5f2ef272-a04b-4f99-a004-f8c3edc8599f","resolution":{"observed_at":"2026-07-31T12:44:13.418061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.421017Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.421017Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:d1a4cb6daa0602c7126c59af20c99cef8c887eaabc61969b1c68c47d1953efc3","observation_id":"24586492-4fea-412b-8896-6f166d1e2196","resolution":{"observed_at":"2026-07-31T12:44:13.421017Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.423895Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.423895Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:82e36be945482f7d5d5a40ccc19878c85146d71ae8337bc95e70410718e19c44","observation_id":"6cca5c75-226c-424d-8d3f-f0c9b5983d5d","resolution":{"observed_at":"2026-07-31T12:44:13.423895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.427121Z","title":"Papineni, S","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.427121Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:d6c5a15074d148f1f005e0810ef63fe5e1785f0d22616229120ce685d2bf6145","observation_id":"b8c23ffc-3f30-4dc3-a86a-21adcfa4e24b","resolution":{"observed_at":"2026-07-31T12:44:13.427121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.429990Z","title":"Lin, ROUGE: A package for automatic evaluation of summaries, in: Text Summarization Branches Out, Association for Computational Linguistics, Barcelona, Spain, 2004, pp","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.429990Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:5dc771317eeeccf81c7c5bb736b071e77ed0b6240bec6cc7c798beb0106b5936","observation_id":"dfee6a3f-6966-45aa-b9b4-3dcf2fbf7131","resolution":{"observed_at":"2026-07-31T12:44:13.429990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.432914Z","title":"Lavie, A","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.432914Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:434425438aac0707c1abb6f05be47e42218785d88fac1375a1b373d113aaa2ae","observation_id":"8eb71c9f-902d-42a4-9dcf-fabdb36cb909","resolution":{"observed_at":"2026-07-31T12:44:13.432914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:44:13.400787Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation","version":1},"reference_index":3521,"source":"pdf_text","source_observed_at":"2026-07-31T12:44:13.400787Z"},"links":{"citing_paper":"/paper/2607.28269"},"observation_digest":"sha256:b01b1eefdac4d6966b81ab70d10110cd58ee7369d87508d1dd7f7e74ee3a3d11","observation_id":"e84dcc18-249e-4819-bc70-739db8eab697","resolution":{"observed_at":"2026-07-31T12:44:13.400787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28269","last_updated":"2026-07-30T14:23:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T04:58:52.190436Z","submitted_at":"2026-07-30T14:23:01Z","title":"Theia: Large-Scale Multimodal Captioning and Automated Validation of the Incidents1M Dataset for Data-Free Distillation"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2607.28269."}