{"as_of":"2026-08-08T20:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a2552242e3dbada0fc20fb90c309a3147eafee173a64292a43e5640037ba0f5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:34:08.695045Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T16:07:53.138866Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2009.04107","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-modal attention for speech emotion recognition","venue":null,"work_id":"b862d839-df53-4a21-8150-e48256038d29","year":2009},"citing_paper":{"arxiv_id":"2504.20690","last_updated":"2025-09-23T02:34:36Z","snapshot_observed_at":"2026-08-05T06:11:45.068217Z","submitted_at":"2025-04-29T12:14:47Z","title":"In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T16:07:53.054355Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2504.20690"},"observation_digest":"sha256:4cf7281ac331aaf542058660508d23dcc573002d04069bc12de10ad7fe8080f7","observation_id":"ddc34ba7-9a96-4450-a29a-63af3615c266","resolution":{"observed_at":"2026-05-16T16:07:53.140578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-07T14:34:08.695045Z","title":"Multi-modal attention for speech emotion recognition","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.18445","last_updated":"2025-05-24T01:00:20Z","snapshot_observed_at":"2026-08-07T14:29:02.939579Z","submitted_at":"2025-05-24T01:00:20Z","title":"OmniConsistency: Learning Style-Agnostic Consistency from Paired Stylization Data","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:08.695045Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2505.18445"},"observation_digest":"sha256:961dc1972143cfe0245a748dbce64c6c59fe2f1171a58a13707c4e4575335e53","observation_id":"de3e0fe3-0290-4195-b903-e405c77dad86","resolution":{"observed_at":"2026-08-07T14:34:08.695045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-07T13:43:00.880411Z","title":"Multi-modal attention for speech emotion recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.880411Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:a70ba917cc1f2d43bcbb9258c574533bdf283f7bab808f51073e8be7d6d604c4","observation_id":"d99b507b-246d-4ca3-ba17-1fc6b982fe04","resolution":{"observed_at":"2026-08-07T13:43:00.880411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-07T11:26:28.052890Z","title":"Multi-modal attention for speech emotion recognition","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.052890Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:11c30f9b170e38d8e04fa72bac9101156c337ea52b9b0e0cff39a700b503ee88","observation_id":"70218a74-fba3-4563-817a-34557ad3eb31","resolution":{"observed_at":"2026-08-07T11:26:28.052890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-07T10:51:38.472327Z","title":"Multi-modal attention for speech emotion recognition","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.04158","last_updated":"2025-06-04T16:57:24Z","snapshot_observed_at":"2026-08-08T10:26:28.640432Z","submitted_at":"2025-06-04T16:57:24Z","title":"Image Editing As Programs with Diffusion Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:51:38.472327Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2506.04158"},"observation_digest":"sha256:05e8edd2b7eef9ae8400f7cbaf97d7533eb34efe60a13d17ac8a2583a4ea06b8","observation_id":"9ced870f-7f9a-4704-bda6-22122cf3619b","resolution":{"observed_at":"2026-08-07T10:51:38.472327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-06T17:57:32.728477Z","title":"Multi- modal attention for speech emotion recognition.arXiv preprint arXiv:2009.04107, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.09573","last_updated":"2025-07-13T10:49:09Z","snapshot_observed_at":"2026-08-06T17:50:01.775188Z","submitted_at":"2025-07-13T10:49:09Z","title":"WordCraft: Interactive Artistic Typography with Attention Awareness and Noise Blending","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:32.728477Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2507.09573"},"observation_digest":"sha256:cd6cb7742c01dd9280ad992ad62a19d4a291e1a760e45eb22b5bdcd4b0fe271b","observation_id":"e91dbf3d-efc3-490d-bece-3e8589f93713","resolution":{"observed_at":"2026-08-06T17:57:32.728477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2009.04107/citation-record","integrity":"/paper/2009.04107/integrity","json":"/paper/2009.04107/citation-record.json","paper":"/paper/2009.04107"},"outbound":[],"paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2009.04107."}