{"as_of":"2026-08-11T14:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f9a53772dd8156cae4f6a3d04ef48129f54c74890a644f770604cbc68f0b7ad","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:41:47.761955Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.17295/citation-record","integrity":"/paper/2412.17295/integrity","json":"/paper/2412.17295/citation-record.json","paper":"/paper/2412.17295"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.413662Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.413662Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:e2b4b7915e74483ecba9145673c51d59089f1cd24e13fc391e0da5eeafc2d7a1","observation_id":"f1acbea2-0520-4ddb-820a-4bcc7fae1433","resolution":{"observed_at":"2026-08-11T05:41:47.413662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.425367Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.425367Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:1ec4cfb6dce2d5ef02e580fdf42ab3bd97f22ea1f1fd99f41b4eebb28a9ef52a","observation_id":"767e761b-6ff8-4097-aa7c-5849be5a8ad0","resolution":{"observed_at":"2026-08-11T05:41:47.425367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.872162Z","title":"K.; and Hori, C","venue":null,"work_id":"b5669410-4623-40bb-8c2d-58cb7a368887","year":2019},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.435013Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:587dc576d6da71526f84de75e7d98af657ecca0c5a37f9b2e79282ac40b1cb31","observation_id":"a9762f84-a9a0-4fe7-a3e4-e2d9c0d5f829","resolution":{"observed_at":"2026-08-11T05:41:48.880153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.849991Z","title":"M.; and Zisserman, A","venue":null,"work_id":"fae84c7d-a6ed-4486-b96c-5695e16a3142","year":2017},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.445288Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:5f138fca454f8684a07dda303f554f3165548cfae952d35cfb7523c3c6a2b079","observation_id":"4091deac-cf3f-4983-a914-7adb5a9cb993","resolution":{"observed_at":"2026-08-11T05:41:48.855827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.823950Z","title":null,"venue":null,"work_id":"1cfb494b-413e-49a4-889a-a3d317f4146d","year":2016},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.451482Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:cc0af7b40fe6d8042d28783181c39663f4fd606649af8ed83766d340630f11ae","observation_id":"940a4941-3cc1-49fb-8e86-47bad5a1281b","resolution":{"observed_at":"2026-08-11T05:41:48.833981Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.459887Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.459887Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:e33c7ab55c8546d2417fad71254c0978fa4a8639f993a37b919977d3fd374e39","observation_id":"5ede7a9f-d090-41c2-948e-39a582ffd0a8","resolution":{"observed_at":"2026-08-11T05:41:47.459887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.776452Z","title":null,"venue":null,"work_id":"2ea09b10-0c16-4bd1-9ada-68179aeef07b","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.467532Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:a0c85d99f18364342a1e5578900839d7c7bcdb01c60abcd82d78b0f0da9515b5","observation_id":"b4ea5344-3897-4ff2-a22d-175eab859613","resolution":{"observed_at":"2026-08-11T05:41:48.784345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12681","last_updated":"2022-04-16T04:21:26Z","snapshot_observed_at":"2026-08-04T04:22:15.975890Z","submitted_at":"2021-11-24T18:31:20Z","title":"VIOLET : End-to-End Video-Language Transformers with Masked Visual-token Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12681","snapshot_observed_at":"2026-08-11T05:41:47.477395Z","title":"Y.; Wang, L.; and Liu, Z","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.477395Z"},"links":{"cited_paper":"/paper/2111.12681","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:a5aa48517d315b170e0e423da5776aab9459068f1e7925399014af82343f4604","observation_id":"1bd85624-c249-4b27-8427-e28e210e2719","resolution":{"observed_at":"2026-08-11T05:41:47.477395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.751752Z","title":null,"venue":null,"work_id":"94c61904-a66b-45a7-932e-0f0c5afa8d0d","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.489121Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:df7d7d29aef38c57dfe0fb7c846dd085d57a18cfbe53b87c71306f6a6ffed32f","observation_id":"c035db82-97db-4c63-b402-373139947a4e","resolution":{"observed_at":"2026-08-11T05:41:48.758564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.729616Z","title":null,"venue":null,"work_id":"1078e138-78f5-4bf5-a45e-a947c4a8f2a2","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.496010Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:67b7573f02a72457d1562da0ecabb121abfd4989ff542b1ddcd67eba0e4467f7","observation_id":"ae10006e-de55-4993-973f-e24bf4a86164","resolution":{"observed_at":"2026-08-11T05:41:48.736156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.684204Z","title":null,"venue":null,"work_id":"b116efc7-9b38-4739-afad-1059c04324ed","year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.502549Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:5519e2602ea34f1049617b83d4e4a7e1bbaa128b649efb770948075a67591d9d","observation_id":"c113fac9-17f2-49bb-8637-148a123c2b42","resolution":{"observed_at":"2026-08-11T05:41:48.695540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.656716Z","title":null,"venue":null,"work_id":"56d41ba3-47b7-42b3-af7d-d3f2f8a421e5","year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.510979Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:9073fe592cf85448d5fdeb1125156b3c60067792336a5d72419ecd00ce218ddf","observation_id":"59f4dc76-6657-4c52-a88f-463d93c91a9c","resolution":{"observed_at":"2026-08-11T05:41:48.663725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.516856Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.516856Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:e4d6c8a44cf755a674fdc753ad9f1312e17f0273ebbd6f3c05ab96a291b0607b","observation_id":"6d0ce594-d9a5-4600-b5ee-271a0471be35","resolution":{"observed_at":"2026-08-11T05:41:47.516856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-11T05:41:47.522646Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.522646Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:90cf94cffaff54d0ea9ee6eaa1eb0ea053458ba670d36e1f698a0609f4b3c304","observation_id":"66bbeca8-1d10-4059-9cdd-fa3ee608e42c","resolution":{"observed_at":"2026-08-11T05:41:47.522646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:47.528485Z","title":"J.; Shen, Y.; Wallis, P.; Allen - Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.528485Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:d31fb5d5887a5173850bb4a06e11eadd659fb7b4767c8f198a51a95fdf755d00","observation_id":"b147973a-2e47-468a-bc6d-ccb9884314ba","resolution":{"observed_at":"2026-08-11T05:41:47.528485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.602009Z","title":null,"venue":null,"work_id":"7a6e9eaf-00d2-430c-b361-92f55d8b033b","year":2019},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.535256Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:7e0a0e04f15d9a3345319d994bebfcee525aee4e644ba8b7cd84b3df4b040ef2","observation_id":"89c55b27-c0bf-47c0-81e6-e9e2af4016d4","resolution":{"observed_at":"2026-08-11T05:41:48.608935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.581236Z","title":"S.; and Zisserman, A","venue":null,"work_id":"f27aa173-fbae-4b56-8c0a-4d5cd0edcff0","year":2020},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.541905Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:23f771f780a13b69634e00339279e4ee6391ac83f375d646717533b87d4b5dc2","observation_id":"3a5e1dfe-9742-4c61-b3ce-a4f50fe9f002","resolution":{"observed_at":"2026-08-11T05:41:48.587514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-11T05:41:47.548723Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.548723Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:189968f37fa7bdb5d95fe3626eec0dc29fbfb1030e15a82d482b58f4face8c60","observation_id":"729ca95e-ca18-4b1a-b029-2b6b82e69251","resolution":{"observed_at":"2026-08-11T05:41:47.548723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17005","last_updated":"2024-05-23T14:49:29Z","snapshot_observed_at":"2026-07-06T16:53:55.269172Z","submitted_at":"2023-11-28T17:59:04Z","title":"MVBench: A Comprehensive Multi-modal Video Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17005","snapshot_observed_at":"2026-08-11T05:41:47.557078Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.557078Z"},"links":{"cited_paper":"/paper/2311.17005","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:efbcbb33d14ea5048bd113b6b6e23c09f58d3f22fdbee349b086c003acdfee85","observation_id":"05de5a87-1bcb-4955-bec0-463ccbc8413c","resolution":{"observed_at":"2026-08-11T05:41:47.557078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-11T05:41:47.568018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.568018Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:7aca0fb4b1247c55783a0171c4cac0a0089461169b854cfe1352526eeac8b28f","observation_id":"b47e595c-042a-492a-a9a6-4b8722a1de94","resolution":{"observed_at":"2026-08-11T05:41:47.568018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.551909Z","title":null,"venue":null,"work_id":"5142b8f2-3e59-4e07-af22-6c3b73a65642","year":2015},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.574224Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:501dbef9525b22db28a1923f82c407b4697bba86fe0031ccf4704b746cbf5e11","observation_id":"f71373ab-c9f5-4604-8a63-a7f75437d800","resolution":{"observed_at":"2026-08-11T05:41:48.558090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-11T05:41:47.581309Z","title":"A.; Khan, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.581309Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:3e6b8679d25905c4914076e291f03dc6ab491b5e69fbd2777752cc8e7a9a2aeb","observation_id":"43f865cc-af2f-46b9-8d66-5ea8db82878d","resolution":{"observed_at":"2026-08-11T05:41:47.581309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15015","last_updated":"2021-05-29T13:15:07Z","snapshot_observed_at":"2026-07-06T10:28:41.157385Z","submitted_at":"2020-12-30T03:02:50Z","title":"OpenViDial: A Large-Scale, Open-Domain Dialogue Dataset with Visual Contexts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15015","snapshot_observed_at":"2026-08-11T05:41:47.591948Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.591948Z"},"links":{"cited_paper":"/paper/2012.15015","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:bc8b2c0ca4fb6d22582ac3a31e5a9686822dd45488b52ffa6f4af797a9a0328c","observation_id":"288f1716-9dfe-45a8-a127-ff47275b0dbc","resolution":{"observed_at":"2026-08-11T05:41:47.591948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.527674Z","title":null,"venue":null,"work_id":"969f222b-145d-4c17-8ef9-3a4b84309665","year":2018},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.598006Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:432c26ce0e4b10deafaa4d42ffb10a361ec6679a35f8a11edf0bbb962d27885d","observation_id":"56d5cbfe-a166-426e-a98a-8cb7ee5122ca","resolution":{"observed_at":"2026-08-11T05:41:48.534108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.08251","last_updated":"2017-04-20T00:36:35Z","snapshot_observed_at":"2026-07-06T05:27:54.149181Z","submitted_at":"2017-01-28T05:06:11Z","title":"Image-Grounded Conversations: Multimodal Context for Natural Question and Response Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.08251","snapshot_observed_at":"2026-08-11T05:41:47.603359Z","title":"B.; Galley, M.; Gao, J.; Spithourakis, G","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.603359Z"},"links":{"cited_paper":"/paper/1701.08251","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:13f53515104bb9e203b7ed41b16e865bb7ee43d2c050e1f03efd0f89a2388752","observation_id":"73a0ec7f-05d0-4c2c-bc07-f931eb3fb1e3","resolution":{"observed_at":"2026-08-11T05:41:47.603359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.505698Z","title":null,"venue":null,"work_id":"ebe07af0-73ee-4d0f-a6c5-6995bf1f8c72","year":2024},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.610782Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:325d1cf097c08effe2b69d686a18dbc12d853666013378a22e7eb283e0a5ab3d","observation_id":"01bbe700-5dd2-4fde-a904-6189f3a64528","resolution":{"observed_at":"2026-08-11T05:41:48.515044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.479364Z","title":null,"venue":null,"work_id":"53273e89-0df1-45f8-8458-784738bbe113","year":2016},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.622847Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:cfb113fbf35e64c07d46ce530b536a55beee9e8fd9fdb9833c3286db73ffa541","observation_id":"901b5fb8-c347-401b-a785-a36977211aa2","resolution":{"observed_at":"2026-08-11T05:41:48.486157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-09T15:41:11.041317Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T05:41:47.636044Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.636044Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:9183fed20e92a2a831d30cb36b6a3834fd8c7b135caf1d313fb422749d643ae2","observation_id":"d1902ffc-96f6-4347-9c70-b11f8d60bded","resolution":{"observed_at":"2026-08-11T05:41:47.636044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.452060Z","title":null,"venue":null,"work_id":"9b443a1c-b76a-4722-8427-4f4b720c0e53","year":2015},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.641719Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ec770d2e4f6e6715f9aeb71d812059b234fe16d5c8c5fce34790c43b2241109d","observation_id":"4a9ae869-502e-4277-853a-9c7d58401766","resolution":{"observed_at":"2026-08-11T05:41:48.458877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.427740Z","title":null,"venue":null,"work_id":"9b700dc2-466f-4419-8df3-af4c332b5730","year":2020},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.651234Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:a2713974de900faeb635c0ba5638393a8c8353f65e45d7736d1dde9f9f9626e1","observation_id":"60425850-0b2d-41f2-8717-5ab6779e053d","resolution":{"observed_at":"2026-08-11T05:41:48.433951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.401837Z","title":null,"venue":null,"work_id":"b14005f5-1a15-4598-8c20-f1b086cb88c4","year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.659011Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:3b9ad6d984441b2d2be9b085c7392584575273df3fd2ec9d7cd8f22fe069547e","observation_id":"018c623c-699d-4ca9-8583-a5a949594ce8","resolution":{"observed_at":"2026-08-11T05:41:48.409368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05222","last_updated":"2024-05-08T02:46:43Z","snapshot_observed_at":"2026-08-06T07:46:37.713769Z","submitted_at":"2023-07-11T12:45:39Z","title":"Emu: Generative Pretraining in Multimodality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05222","snapshot_observed_at":"2026-08-11T05:41:47.666258Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.666258Z"},"links":{"cited_paper":"/paper/2307.05222","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:c5744be58d5e49084504b0e713b4f07e3a9f1d2b567e3bcc54c32b596d9100ea","observation_id":"3a00f7af-da35-480d-88c6-51e21842a2d9","resolution":{"observed_at":"2026-08-11T05:41:47.666258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.377856Z","title":"E.; Anguelov, D.; Erhan, D.; Vanhoucke, V.; and Rabinovich, A","venue":null,"work_id":"ee6f765e-5ab4-4586-ad95-ed8fc6000fc5","year":2014},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.673830Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:71244971cce5cd14a7ad633226d355ce52ad7f023c8d3839ddbe2a969dc9fd5f","observation_id":"64a8ff6f-3ec2-442b-8560-9b787e7e5e9c","resolution":{"observed_at":"2026-08-11T05:41:48.386006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.355856Z","title":"K.; Qian, X.; Shou, M","venue":null,"work_id":"fa7a0149-4c3b-4963-b764-9ce8704734df","year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.685256Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:c6e1affca7a9df839e2a23f45db3697b27cdd1561b3e712594d40fd5074cf270","observation_id":"d6351b54-6715-44b8-9825-be9aa67e29e9","resolution":{"observed_at":"2026-08-11T05:41:48.362739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12761","last_updated":"2021-09-28T15:15:57Z","snapshot_observed_at":"2026-07-06T11:51:32.965715Z","submitted_at":"2021-09-27T02:10:29Z","title":"OpenViDial 2.0: A Larger-Scale, Open-Domain Dialogue Generation Dataset with Visual Contexts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.12761","snapshot_observed_at":"2026-08-11T05:41:47.694800Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.694800Z"},"links":{"cited_paper":"/paper/2109.12761","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:554205cc32e8f38a5d3368b2cef5a6d53ed1a67865461155f1e0e84d322f4f61","observation_id":"a886c044-e071-41fa-a401-beb2664b14e1","resolution":{"observed_at":"2026-08-11T05:41:47.694800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.315733Z","title":null,"venue":null,"work_id":"56ddf4c9-184c-44da-ae94-3dacb11c4e14","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.705866Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:620bcc2e52f9566f335b72ef712db0e2ab6f7be03025010ee37df54b563d30c1","observation_id":"16e0dd4b-b052-4971-b6dc-27ff87ee78ee","resolution":{"observed_at":"2026-08-11T05:41:48.323878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.282960Z","title":null,"venue":null,"work_id":"26be4383-e4c3-4ec2-9436-f2467a3514ea","year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.712699Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:c1898b1825b3f96ea34b58cd34bf2d436a4502fe0f8eeccec25b8f2d82399f6a","observation_id":"1e06c222-beac-46b3-b126-1f4399e90b1f","resolution":{"observed_at":"2026-08-11T05:41:48.292185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04658","last_updated":"2024-05-11T07:08:16Z","snapshot_observed_at":"2026-08-10T14:05:21.041873Z","submitted_at":"2023-09-09T01:56:40Z","title":"Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04658","snapshot_observed_at":"2026-08-11T05:41:47.718599Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.718599Z"},"links":{"cited_paper":"/paper/2309.04658","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:61e15af069d06b0e4bf32fb8b4c499edbf7bec9806e755d325e6f6483dffaec5","observation_id":"6c96e174-e4f6-4a10-a0d7-94f824dc7c88","resolution":{"observed_at":"2026-08-11T05:41:47.718599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01453","last_updated":"2021-07-06T14:03:04Z","snapshot_observed_at":"2026-08-10T01:45:45.266953Z","submitted_at":"2021-07-06T14:03:04Z","title":"PhotoChat: A Human-Human Dialogue Dataset with Photo Sharing Behavior for Joint Image-Text Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01453","snapshot_observed_at":"2026-08-11T05:41:47.725770Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.725770Z"},"links":{"cited_paper":"/paper/2108.01453","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:098bb49b530005dcbbee937dc17022e13b27cb3d2a55ac823843328a0c92f0b2","observation_id":"a2db3e8b-3e81-4b11-ada2-78d6aed53f2e","resolution":{"observed_at":"2026-08-11T05:41:47.725770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02485","last_updated":"2024-02-17T05:27:56Z","snapshot_observed_at":"2026-08-02T22:53:12.613357Z","submitted_at":"2023-07-05T17:59:27Z","title":"Building Cooperative Embodied Agents Modularly with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02485","snapshot_observed_at":"2026-08-11T05:41:47.732821Z","title":"B.; Shu, T.; and Gan, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.732821Z"},"links":{"cited_paper":"/paper/2307.02485","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:4911299ac406b367456957cbea634020ebf93e9a041989dc4c2ca979060552a4","observation_id":"7dcee085-fc3c-4dca-be90-08353bab027d","resolution":{"observed_at":"2026-08-11T05:41:47.732821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:41:48.254975Z","title":null,"venue":null,"work_id":"f9982502-3e61-436a-88e6-d1c28bfaa3ba","year":2017},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.740055Z"},"links":{"citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:6719a5938d85827b67e6c3cb2e81b2605a6af403100b3574231ee7f7e56b6987","observation_id":"1dcaf3b4-a0d9-4cd9-826a-12eb63e456da","resolution":{"observed_at":"2026-08-11T05:41:48.263912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07154","last_updated":"2022-05-01T09:51:17Z","snapshot_observed_at":"2026-08-09T12:12:23.706628Z","submitted_at":"2021-08-16T15:27:49Z","title":"MMChat: Multi-Modal Chat Dataset on Social Media","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07154","snapshot_observed_at":"2026-08-11T05:41:47.746531Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.746531Z"},"links":{"cited_paper":"/paper/2108.07154","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:ab2c8355a0d854fff05abd16c8d8d4ba66f54411828a224eaeb5305742ba1568","observation_id":"96f74744-ce67-4072-922b-00e49210bda5","resolution":{"observed_at":"2026-08-11T05:41:47.746531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03051","last_updated":"2023-10-04T06:47:58Z","snapshot_observed_at":"2026-08-10T19:42:41.078290Z","submitted_at":"2023-10-04T06:47:58Z","title":"How FaR Are Large Language Models From Agents with Theory-of-Mind?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03051","snapshot_observed_at":"2026-08-11T05:41:47.755625Z","title":"P.; Gupta, A.; McKee, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.755625Z"},"links":{"cited_paper":"/paper/2310.03051","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:17d38e3b13056a007c710bb3216c37b34f157e3859f35e30ae6a63784c75fdd5","observation_id":"2f6e8187-87b8-45ae-b822-ac35d278b408","resolution":{"observed_at":"2026-08-11T05:41:47.755625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-11T05:41:47.761955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.761955Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:b529aabcb1bc1ddca568bcf72d5425c796580836ee646da763ffe31075b02490","observation_id":"0e02625f-031a-4bdf-998f-29947d16de37","resolution":{"observed_at":"2026-08-11T05:41:47.761955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T05:34:54.756252Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2412.17295."}