{"as_of":"2026-08-09T08:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb68df91d526f89baa7214108316abdead717ee69700b790276244257af2c398","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:27:24.864589Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:20:06.390789Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-08-07T12:27:35.121940Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24423","last_updated":"2025-05-30T10:02:15Z","snapshot_observed_at":"2026-08-07T12:20:03.288235Z","submitted_at":"2025-05-30T10:02:15Z","title":"MMAFFBen: A Multilingual and Multimodal Affective Analysis Benchmark for Evaluating LLMs and VLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:27:35.121940Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2505.24423"},"observation_digest":"sha256:c7e5b3021284aa1508226124f23f65257697497bec755e54a65670d613230358","observation_id":"0a6ccba9-d443-45f5-ad23-cb391ac15ece","resolution":{"observed_at":"2026-08-07T12:27:35.121940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-08-07T00:33:19.420806Z","title":"Omni-emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13642","last_updated":"2025-06-22T07:56:58Z","snapshot_observed_at":"2026-08-09T02:59:40.714095Z","submitted_at":"2025-06-16T16:06:45Z","title":"Stream-Omni: Simultaneous Multimodal Interactions with Large Language-Vision-Speech Model","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:33:19.420806Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2506.13642"},"observation_digest":"sha256:fe985408375b05b4e0d527fbe4856d8d13e41f965808826cc3e4dddd29cc115e","observation_id":"5f8eeb56-c015-44ca-b3ee-76677e515931","resolution":{"observed_at":"2026-08-07T00:33:19.420806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-08-06T05:49:55.479002Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01178","last_updated":"2025-08-02T03:33:47Z","snapshot_observed_at":"2026-08-07T21:57:57.399342Z","submitted_at":"2025-08-02T03:33:47Z","title":"Advancing the Foundation Model for Music Understanding","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T05:49:55.479002Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2508.01178"},"observation_digest":"sha256:6998d4625bb02bf76a492e8df4e87a78f132689dbf1b8c01bc94dcfdb294ab16","observation_id":"7e02fb8b-d5c0-4a60-bf40-0905f3a981b8","resolution":{"observed_at":"2026-08-06T05:49:55.479002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-08-06T05:02:24.481438Z","title":"Omni-emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02429","last_updated":"2025-08-04T13:49:03Z","snapshot_observed_at":"2026-08-08T01:53:05.709859Z","submitted_at":"2025-08-04T13:49:03Z","title":"Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:02:24.481438Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2508.02429"},"observation_digest":"sha256:5749028e468057e2348ea36b0ec6f07cb31bafdfffba187e80f61e7efc223727","observation_id":"b284676b-38d0-44fd-978f-2acca5ce5b4a","resolution":{"observed_at":"2026-08-06T05:02:24.481438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":"2501.09502","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-07-04T19:20:06.390789Z","title":"Omni- emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis","venue":null,"work_id":"481b7991-70a5-4c46-9b42-647a3c423005","year":2025},"citing_paper":{"arxiv_id":"2603.02123","last_updated":"2026-04-11T07:33:14Z","snapshot_observed_at":"2026-08-07T23:06:22.566905Z","submitted_at":"2026-03-02T17:42:33Z","title":"Nano-EmoX: Unifying Multimodal Emotional Intelligence from Perception to Empathy","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-15T17:43:32.593075Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2603.02123"},"observation_digest":"sha256:3e20da77dd25e12c74dc30b886a4c24bd056556d3280dd23a83c7d1c10f4f301","observation_id":"76c85212-56be-4cc2-94a0-a73c8c645c13","resolution":{"observed_at":"2026-05-15T17:46:23.797958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":"2501.09502","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-07-04T19:20:06.390789Z","title":"Omni- emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis","venue":null,"work_id":"481b7991-70a5-4c46-9b42-647a3c423005","year":2025},"citing_paper":{"arxiv_id":"2604.08209","last_updated":"2026-04-09T13:09:40Z","snapshot_observed_at":"2026-07-06T22:57:22.475588Z","submitted_at":"2026-04-09T13:09:40Z","title":"OmniJigsaw: Enhancing Omni-Modal Reasoning via Modality-Orchestrated Reordering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T17:45:51.528645Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2604.08209"},"observation_digest":"sha256:281dfba0c8ce785c4d068d5621c12d9ffb3de52bd666930eb76151f8cf7befb4","observation_id":"eb2b66fd-abaf-4746-8756-22670cd6d650","resolution":{"observed_at":"2026-05-11T06:11:01.841793Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":"2501.09502","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-07-04T19:20:06.390789Z","title":"Omni- emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis","venue":null,"work_id":"481b7991-70a5-4c46-9b42-647a3c423005","year":2025},"citing_paper":{"arxiv_id":"2604.15823","last_updated":"2026-04-17T08:22:14Z","snapshot_observed_at":"2026-07-06T23:03:16.345488Z","submitted_at":"2026-04-17T08:22:14Z","title":"Watching Movies Like a Human: Egocentric Emotion Understanding for Embodied Companions","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T08:49:33.107658Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2604.15823"},"observation_digest":"sha256:68ee1de42f21237085bf211e761dcea9ff1cf7daa7ef39a9b8d4ca03366662f6","observation_id":"ec58ea26-ab16-4e70-ba94-f45dbefe006d","resolution":{"observed_at":"2026-05-10T08:53:04.280664Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":"2501.09502","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-07-04T19:20:06.390789Z","title":"Omni- emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis","venue":null,"work_id":"481b7991-70a5-4c46-9b42-647a3c423005","year":2025},"citing_paper":{"arxiv_id":"2606.07585","last_updated":"2026-05-27T16:36:58Z","snapshot_observed_at":"2026-08-06T20:44:24.646882Z","submitted_at":"2026-05-27T16:36:58Z","title":"Multimodal Group Emotion Recognition In-the-Wild Towards a Privacy-Safe Non-Individual Approach","version":1},"reference_index":242,"source":"pdf_text","source_observed_at":"2026-06-29T13:01:00.924735Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2606.07585"},"observation_digest":"sha256:27c74a6fc9354a6c58b2b2019b404af6f8465e0e3b3c52007fa202c78c62620f","observation_id":"417d020f-adfb-46a5-826e-17f543ae6c13","resolution":{"observed_at":"2026-06-29T13:03:26.072029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":"2501.09502","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-07-04T19:20:06.390789Z","title":"Omni- emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis","venue":null,"work_id":"481b7991-70a5-4c46-9b42-647a3c423005","year":2025},"citing_paper":{"arxiv_id":"2606.25325","last_updated":"2026-07-20T13:20:39Z","snapshot_observed_at":"2026-08-02T10:17:41.360200Z","submitted_at":"2026-06-24T02:43:26Z","title":"Omni-Perception Policy Optimization for Multimodal Emotion Reasoning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-25T21:31:38.450382Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2606.25325"},"observation_digest":"sha256:d68fa559b4a64ced00b18ee439e826a7980ec044e633b238501ab74272e06557","observation_id":"f1ab91e4-52a8-4146-8570-e7558e070d20","resolution":{"observed_at":"2026-07-04T19:20:06.393957Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-08-07T19:27:24.864589Z","title":"Omni-emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-09T08:13:11.830072Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.864589Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:f0ee6f76c42abb2555fbdf3acb6fb96fa844df4cc25117ecdcee0a90ecbc95ed","observation_id":"40f34a35-0f09-42cf-87c2-002b6151b5ff","resolution":{"observed_at":"2026-08-07T19:27:24.864589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.09502/citation-record","integrity":"/paper/2501.09502/integrity","json":"/paper/2501.09502/citation-record.json","paper":"/paper/2501.09502"},"outbound":[],"paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2501.09502."}