{"as_of":"2026-08-13T20:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5ac8780e9d3746f54c56f057d45f3232e63b7c9decd016a66e2afb3abab081c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:41:28.462937Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":9,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.04856","last_updated":"2023-01-12T07:42:36Z","snapshot_observed_at":"2026-08-13T13:05:32.812002Z","submitted_at":"2023-01-12T07:42:36Z","title":"Multimodal Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04856","snapshot_observed_at":"2026-08-11T20:06:53.263889Z","title":"Akkus et al., ”Multimodal Deep Learning,” p","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06044","last_updated":"2024-12-08T19:49:07Z","snapshot_observed_at":"2026-08-12T20:31:20.182719Z","submitted_at":"2024-12-08T19:49:07Z","title":"Cloud Platforms for Developing Generative AI Solutions: A Scoping Review of Tools and Services","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:06:53.263889Z"},"links":{"cited_paper":"/paper/2301.04856","citing_paper":"/paper/2412.06044"},"observation_digest":"sha256:f6c2a56dbebb9518d1405cbb7258b28381d81cf06e871b155714dc42c301c811","observation_id":"10f072bb-9a43-4c40-a0c9-ca3056f7feb9","resolution":{"observed_at":"2026-08-11T20:06:53.263889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04856","last_updated":"2023-01-12T07:42:36Z","snapshot_observed_at":"2026-08-13T13:05:32.812002Z","submitted_at":"2023-01-12T07:42:36Z","title":"Multimodal Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04856","snapshot_observed_at":"2026-08-08T13:35:05.039509Z","title":"Multimodal deep learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07838","last_updated":"2025-02-13T11:13:14Z","snapshot_observed_at":"2026-08-10T05:59:21.497164Z","submitted_at":"2025-02-11T02:31:45Z","title":"NanoVLMs: How small can we go and still make coherent Vision Language Models?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T13:35:05.039509Z"},"links":{"cited_paper":"/paper/2301.04856","citing_paper":"/paper/2502.07838"},"observation_digest":"sha256:004b984301758c23ad172b1bf71cc903ec91f714f614bee207216bdd28a93ead","observation_id":"0867f3ca-0589-4565-8da8-7dfd6f62c1f0","resolution":{"observed_at":"2026-08-08T13:35:05.039509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04856","last_updated":"2023-01-12T07:42:36Z","snapshot_observed_at":"2026-08-13T13:05:32.812002Z","submitted_at":"2023-01-12T07:42:36Z","title":"Multimodal Deep Learning","version":1},"cited_work":{"arxiv_id":"2301.04856","doi":"10.48550/arxiv.2301.04856","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.04856","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal deep learning","venue":"arXiv (Cornell University)","work_id":"8b18ac57-ef85-4d0b-abeb-177bc50e5499","year":2023},"citing_paper":{"arxiv_id":"2509.22123","last_updated":"2026-05-13T12:28:55Z","snapshot_observed_at":"2026-08-08T13:18:54.000166Z","submitted_at":"2025-09-26T09:46:13Z","title":"Multilingual Vision-Language Models, A Survey","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T13:02:08.000814Z"},"links":{"cited_paper":"/paper/2301.04856","citing_paper":"/paper/2509.22123"},"observation_digest":"sha256:91b6905a62d9e4b0d9069e6e8f64fd6db33e2154c13ff7c82dac9236a17c8ad0","observation_id":"b39cd44b-0db2-4b61-a67d-2cf7d9d43855","resolution":{"observed_at":"2026-05-18T13:02:37.329801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04856","last_updated":"2023-01-12T07:42:36Z","snapshot_observed_at":"2026-08-13T13:05:32.812002Z","submitted_at":"2023-01-12T07:42:36Z","title":"Multimodal Deep Learning","version":1},"cited_work":{"arxiv_id":"2301.04856","doi":"10.48550/arxiv.2301.04856","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.04856","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal deep learning","venue":"arXiv (Cornell University)","work_id":"8b18ac57-ef85-4d0b-abeb-177bc50e5499","year":2023},"citing_paper":{"arxiv_id":"2604.16264","last_updated":"2026-04-17T17:20:42Z","snapshot_observed_at":"2026-07-06T23:03:39.351412Z","submitted_at":"2026-04-17T17:20:42Z","title":"Information Router for Mitigating Modality Dominance in Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T08:41:54.503158Z"},"links":{"cited_paper":"/paper/2301.04856","citing_paper":"/paper/2604.16264"},"observation_digest":"sha256:c953215bf83f33b0c8ce21bfe88c0a596419cf7129b70fb032c84f51197437d6","observation_id":"a11ee470-c5d9-4beb-87c5-224c99a5d9e5","resolution":{"observed_at":"2026-05-10T08:43:01.143127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04856","last_updated":"2023-01-12T07:42:36Z","snapshot_observed_at":"2026-08-13T13:05:32.812002Z","submitted_at":"2023-01-12T07:42:36Z","title":"Multimodal Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04856","snapshot_observed_at":"2026-08-12T15:41:28.462937Z","title":"Multimodal","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10857","last_updated":"2026-08-11T12:30:19Z","snapshot_observed_at":"2026-08-13T19:45:55.250133Z","submitted_at":"2026-08-11T12:30:19Z","title":"FiGuRO: Intrinsic Dimension Estimation for Multi-Modal Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T15:41:28.462937Z"},"links":{"cited_paper":"/paper/2301.04856","citing_paper":"/paper/2608.10857"},"observation_digest":"sha256:45a74582afea8f5cfe2acd3b31eb91144dff8c5ed868fb700a4602f01a97dd89","observation_id":"f2d1802b-d78c-40e6-8b33-08f265c50c47","resolution":{"observed_at":"2026-08-12T15:41:28.462937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2301.04856/citation-record","integrity":"/paper/2301.04856/integrity","json":"/paper/2301.04856/citation-record.json","paper":"/paper/2301.04856"},"outbound":[],"paper":{"arxiv_id":"2301.04856","last_updated":"2023-01-12T07:42:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T13:05:32.812002Z","submitted_at":"2023-01-12T07:42:36Z","title":"Multimodal Deep Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2301.04856."}