{"as_of":"2026-08-08T04:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a4eb02645f827a1129ef5701d289b0417f95d203cfe316c5318a6ce7313d31f","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:49:21.249314Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T21:49:38.075702Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T21:50:19.513353Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"cited_work":{"arxiv_id":"2508.06564","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.06564","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding emotion recognition with visual prototypes: Vega–revisiting clip in merc","venue":null,"work_id":"404345aa-02c5-4b28-b384-31e65258f812","year":2025},"citing_paper":{"arxiv_id":"2511.12554","last_updated":"2026-04-20T07:01:19Z","snapshot_observed_at":"2026-08-03T09:35:27.876906Z","submitted_at":"2025-11-16T11:16:50Z","title":"EmoVerse: A MLLMs-Driven Emotion Representation Dataset for Interpretable Visual Emotion Analysis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T21:49:38.075702Z"},"links":{"cited_paper":"/paper/2508.06564","citing_paper":"/paper/2511.12554"},"observation_digest":"sha256:31bc843e831806341f617895cf518538bac341d9d7291a92be7226d2cfb5c242","observation_id":"05c66fe1-f916-45d0-83ad-fb28ae3d4a4a","resolution":{"observed_at":"2026-05-17T21:50:19.515155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.06564/citation-record","integrity":"/paper/2508.06564/integrity","json":"/paper/2508.06564/citation-record.json","paper":"/paper/2508.06564"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:31.049422Z","title":"Barsalou","venue":null,"work_id":"4639db02-9f82-43ae-9e0a-a4616974fd21","year":2008},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:10.754662Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:012442d8bc7afab20f5f8be800e7011c4376a4c7bfda3862a364d0c331c79c3e","observation_id":"99fb2700-8a09-4494-8763-63aeb3553d0b","resolution":{"observed_at":"2026-08-05T23:49:31.114063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:10.933806Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:10.933806Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:8e73fc228bb4d779a6414fdf097bc3b80f38b600d9f78a45aea726de6575462c","observation_id":"0335ae1b-e280-4040-b4e0-31152bdbc733","resolution":{"observed_at":"2026-08-05T23:49:10.933806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:31.025374Z","title":null,"venue":null,"work_id":"f2386acd-1da4-4de3-991e-2de8e61e942b","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:11.111835Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:3f860ae870223e3c811dc674debbc95e31012cd1c9cb8d7b15e369a12470ada6","observation_id":"e7cc09a7-2f8a-48fc-869d-b0bff91685b3","resolution":{"observed_at":"2026-08-05T23:49:31.029651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:30.900807Z","title":null,"venue":null,"work_id":"61e3f72c-71cf-458b-958a-7584a9f528a3","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:11.269360Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:ee3411b12ceee171caaf013161864ddabfa8378e995ee31b4b3ded2c74a72d29","observation_id":"73672bce-03fe-4573-a193-79935cf0fc1e","resolution":{"observed_at":"2026-08-05T23:49:30.953933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:30.703995Z","title":null,"venue":null,"work_id":"700133c0-c7b9-4ac8-97af-29ac2512c357","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:11.461442Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:c3b911b7a2bdba26435ca3be367c1de7a8fe9f90762a934b40c72a5e9031a8c2","observation_id":"fbd80ea9-a431-4df8-8ffe-b37a3084eaa9","resolution":{"observed_at":"2026-08-05T23:49:30.790048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:30.536857Z","title":null,"venue":null,"work_id":"6c7acb14-4ec4-4f1b-a493-1f84f861c9ad","year":2000},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:11.655784Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:1b1f407ac2251b9d3be49e4454ec2091f4e7dd93902c707b559b0c8930955943","observation_id":"508d3d69-c930-4423-babd-d07067a767aa","resolution":{"observed_at":"2026-08-05T23:49:30.634675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:30.334620Z","title":null,"venue":null,"work_id":"2821b939-f583-4769-9a8e-6016d90040ac","year":1992},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:11.870799Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:4aa80d884bc382bd8944d942134a783bd8300463b77bf62f7d9c141c3bd31f42","observation_id":"920ab5af-8cdf-4915-b0e8-6381baf94eb5","resolution":{"observed_at":"2026-08-05T23:49:30.420758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:30.182233Z","title":null,"venue":null,"work_id":"2dab04df-3822-4232-8562-d111d6a5b7f8","year":1994},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:12.120083Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:826a315469cf9573b89852deadf20fe48f9bdb0f83b0b24717b7fa40b6227cca","observation_id":"409dbf73-65c9-4d48-9e2c-ccc182ed7deb","resolution":{"observed_at":"2026-08-05T23:49:30.238001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:30.021675Z","title":null,"venue":null,"work_id":"4cb28ec1-dab7-45d8-b607-24e6465e06cb","year":2001},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:12.361521Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:fc9a75b7a14ec95ea157b2376674bbc7a154cca02e821b396e403f6dd4bfa33a","observation_id":"8878915c-f3a8-41fe-a4ec-b0e6c1eb100a","resolution":{"observed_at":"2026-08-05T23:49:30.116195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:29.841423Z","title":null,"venue":null,"work_id":"2b182fa6-8875-4f0c-a9ca-35734144844a","year":1984},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:12.523649Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:22f45797b238d765bff093828da77c334a36a853be2e09c4d670da7532e12294","observation_id":"71e7dba9-1484-443d-96ec-9cbe3eb43859","resolution":{"observed_at":"2026-08-05T23:49:29.928291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:29.735542Z","title":null,"venue":null,"work_id":"086941d9-5d53-422d-98b9-f02af0f73d16","year":2018},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:12.737238Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:e9e331454f29ede150a26ec57eff3157fa1a51d5d8d2201f17f26e5442f338c5","observation_id":"88011010-99fb-4335-8e05-d6df44dae08c","resolution":{"observed_at":"2026-08-05T23:49:29.786025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:29.595027Z","title":null,"venue":null,"work_id":"43018f8f-37f0-4673-a781-3243d38caa85","year":2021},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:12.894326Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:27cdd0bef386a363ff6b0b184ae5f162207f6007e56496b71383b32a5210019e","observation_id":"68f33ad9-9b6e-4697-8a60-8380d934e352","resolution":{"observed_at":"2026-08-05T23:49:29.668629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:29.446246Z","title":null,"venue":null,"work_id":"203a9e60-9077-4b2e-bb2f-a7762512fac1","year":2022},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:13.076053Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:8bb76ff2684812c06dc3ec49d41bdadd158e68180efd8f7883d1e8dca3f6515e","observation_id":"e014d6c3-9e1d-4eec-81b2-0273f6a9b045","resolution":{"observed_at":"2026-08-05T23:49:29.520827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:29.278561Z","title":null,"venue":null,"work_id":"b4ffe8c0-ef58-4984-8793-98d24c6a6c03","year":2025},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:13.243954Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:9aff624ba88722b6bf5f15e88cce21dee5f73d3a8ea61d5c2f0f60ceb23f6b53","observation_id":"0a9036fc-8ca5-4906-b9ac-8884cc397c1d","resolution":{"observed_at":"2026-08-05T23:49:29.364328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:29.110114Z","title":null,"venue":null,"work_id":"c105e5d8-5060-4cda-a772-ed3645a01641","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:13.441977Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:dcedbf6249e22ddce70450a04cf373c5cb72fac305ff997b9fec8a0d56c35da2","observation_id":"dc7b8cd4-6c3f-481a-97c7-6688e53465f1","resolution":{"observed_at":"2026-08-05T23:49:29.185658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:28.950238Z","title":null,"venue":null,"work_id":"4a772e65-465d-47d1-afe7-ad465c66e88f","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:13.627383Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:0c598b0356b8507c1d71014ae0156c2bcf637065f0138405aecb3e85efc8c582","observation_id":"e4c9efed-081e-41e6-a28b-ad4f238647e4","resolution":{"observed_at":"2026-08-05T23:49:29.016806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06779","last_updated":"2021-07-14T15:37:02Z","snapshot_observed_at":"2026-07-06T11:29:07.489964Z","submitted_at":"2021-07-14T15:37:02Z","title":"MMGCN: Multimodal Fusion via Deep Graph Convolution Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06779","snapshot_observed_at":"2026-08-05T23:49:13.768740Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:13.768740Z"},"links":{"cited_paper":"/paper/2107.06779","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:6e3574bf1674d4966a8caa3f834589e3b60722cbd23097ceca2ff66258621aec","observation_id":"1a7157c1-0b89-4852-895f-892bb6700124","resolution":{"observed_at":"2026-08-05T23:49:13.768740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:28.775572Z","title":null,"venue":null,"work_id":"5867defd-907d-4e90-92d1-cd632644ea25","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:13.934614Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:44252cc5caec0034d0dca5e22aef38510ef657feb3f4837a2929ee3830db3870","observation_id":"04e0f457-f80f-4f20-ae88-d243b4c944dd","resolution":{"observed_at":"2026-08-05T23:49:28.861505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:28.607537Z","title":null,"venue":null,"work_id":"b8d14bdd-71ab-44ce-bccd-b2df2c01fb6d","year":null},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:14.175448Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:25bd717399147362c8af7476d46b1381bf0306fe9ae68f00a798718616141b68","observation_id":"6fe32888-abfa-42ef-8cf0-c7ecb02dedbe","resolution":{"observed_at":"2026-08-05T23:49:28.684417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:28.450244Z","title":null,"venue":null,"work_id":"93358b2b-1dcc-4e81-8711-69eddf827c0d","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:14.582573Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:d9a6d697bbd1e2eb840a8eb9cf523863ea7afaa0018565910980b9ed364e010c","observation_id":"3aecee8e-e354-4653-b713-03620b5d4e7e","resolution":{"observed_at":"2026-08-05T23:49:28.534477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:28.270022Z","title":null,"venue":null,"work_id":"d664aed9-2268-4058-a6a7-638e0f53fa91","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:14.827397Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:c76d4f85f0544188af507451acd4f5e537584547d58da042edd0207d2b4075a4","observation_id":"1ecb9619-3cbf-49c3-90e3-146d3ef57cb8","resolution":{"observed_at":"2026-08-05T23:49:28.354100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:28.030739Z","title":null,"venue":null,"work_id":"e86159de-f1d9-4df3-90d9-e37a78be224a","year":2025},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:14.989655Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:66fdb6f79d53739236a6035cfb31278ed365052a8a2c8c71721c9dcfa2701912","observation_id":"7d8abc58-cbf1-4f53-a705-8886f5a82f76","resolution":{"observed_at":"2026-08-05T23:49:28.140360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:27.842438Z","title":null,"venue":null,"work_id":"b8418282-6cd8-47e5-b6eb-3f28e345ceac","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:15.145597Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:f216c79e78e150972f70bdf914a09c118b36678ffd61fa5d8ded568f92fb1ee5","observation_id":"4140b7a0-b389-447a-921b-0d5b39c01eb6","resolution":{"observed_at":"2026-08-05T23:49:27.917377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:27.639731Z","title":null,"venue":null,"work_id":"ac1e7243-6bfc-455c-8615-83faff786754","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:15.312789Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:c2ac6f0f9e994bc9e39d39d0f2fd5ff2dad9298f27660c41df5839534dade0fd","observation_id":"080b8602-3363-4c01-a2bc-18b7cd5aac3e","resolution":{"observed_at":"2026-08-05T23:49:27.769609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21536","last_updated":"2025-06-29T16:49:43Z","snapshot_observed_at":"2026-08-02T21:53:22.784750Z","submitted_at":"2024-07-31T11:47:36Z","title":"Tracing Intricate Cues in Dialogue: Joint Graph Structure and Sentiment Dynamics for Multimodal Emotion Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21536","snapshot_observed_at":"2026-08-05T23:49:15.565601Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:15.565601Z"},"links":{"cited_paper":"/paper/2407.21536","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:4a09ca424d12aafd010bba334b7e70f183f0d77a30a1cb651d07f3da8238e7a5","observation_id":"94c4faab-61ae-41f7-8c77-1a501f6515ab","resolution":{"observed_at":"2026-08-05T23:49:15.565601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:27.428442Z","title":null,"venue":null,"work_id":"16faf110-fe60-47d1-bb91-9f3f67819871","year":2021},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:15.748392Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:7d2665354e2d69aea79bc4b87bcc3544820b8620099fc9c0a285823ac29ad3d2","observation_id":"642785df-0091-403f-9587-894fe1415f1b","resolution":{"observed_at":"2026-08-05T23:49:27.531815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07078","last_updated":"2024-09-11T08:06:47Z","snapshot_observed_at":"2026-07-31T19:09:07.857845Z","submitted_at":"2024-09-11T08:06:47Z","title":"Multimodal Emotion Recognition with Vision-language Prompting and Modality Dropout","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07078","snapshot_observed_at":"2026-08-05T23:49:15.920870Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:15.920870Z"},"links":{"cited_paper":"/paper/2409.07078","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:ffd22b31bb5fe53495dca72ad268f7d90093b061caa438095da5053a742b1a14","observation_id":"78856022-c072-49ab-8672-cac47cc3a441","resolution":{"observed_at":"2026-08-05T23:49:15.920870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:27.250390Z","title":null,"venue":null,"work_id":"e653b728-c430-4b60-8195-118a8e50d958","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:16.306357Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:caf42004978b63813672ce342afd190e97f4376057e07051b1f98f2896f690ab","observation_id":"5477d0ff-6e02-448d-b09c-749f34b57495","resolution":{"observed_at":"2026-08-05T23:49:27.327550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:27.074634Z","title":null,"venue":null,"work_id":"899ea6bc-c14d-4023-823a-c509c8a6078b","year":null},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:16.558526Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:282a32a12279071c18be09d74685e04ee01d58ba25a079306b69c9058c446861","observation_id":"5670e702-bfb9-4823-ab39-b72c29a417f7","resolution":{"observed_at":"2026-08-05T23:49:27.149949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.07637","last_updated":"2020-10-15T10:10:41Z","snapshot_observed_at":"2026-07-06T10:04:42.268483Z","submitted_at":"2020-10-15T10:10:41Z","title":"DialogueTRM: Exploring the Intra- and Inter-Modal Emotional Behaviors in the Conversation","version":1},"cited_work":{"arxiv_id":"2010.07637","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.07637","snapshot_observed_at":"2026-08-05T23:49:21.711382Z","title":"DialogueTRM: Exploring the Intra- and Inter-Modal Emotional Behaviors in the Conversation","venue":"cs.CL","work_id":"f0f1ed26-b2bb-445b-9be9-b9a8a4f913c6","year":2020},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:16.980533Z"},"links":{"cited_paper":"/paper/2010.07637","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:5422c1445b5e77422a5c0fb4f392f0915ca8324eb2f407555c12646db2954a81","observation_id":"e080c786-e2c9-4e23-9834-58dfd56962ab","resolution":{"observed_at":"2026-08-05T23:49:21.768270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:26.650988Z","title":null,"venue":null,"work_id":"6668384e-1b41-4de3-a4cc-b0f22069a6ea","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:17.136503Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:308b9e36d764913295e41b6b237f70b623adf52aa893ddf36c1181784ab25a80","observation_id":"3325813c-aeb9-4c62-8c5f-91ccb70d4553","resolution":{"observed_at":"2026-08-05T23:49:26.727995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09172","last_updated":"2024-10-19T16:20:53Z","snapshot_observed_at":"2026-08-03T04:15:31.807605Z","submitted_at":"2022-11-16T19:42:31Z","title":"Deep Emotion Recognition in Textual Conversations: A Survey","version":4},"cited_work":{"arxiv_id":"2211.09172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.09172","snapshot_observed_at":"2026-08-05T23:49:21.493517Z","title":"Deep Emotion Recognition in Textual Conversations: A Survey","venue":"cs.CL","work_id":"549baf48-7d23-4c2d-bfdc-178ab666c1a1","year":2022},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:17.296187Z"},"links":{"cited_paper":"/paper/2211.09172","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:8fc9ab2d14185a8293616c7ec8088b936dfe2d966ae92e4b609efa446f42db6a","observation_id":"3015eb11-0fc9-41c7-8f3f-f3ce22345652","resolution":{"observed_at":"2026-08-05T23:49:21.600670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-07-06T07:06:12.726165Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-05T23:49:17.456516Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:17.456516Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:c1af037c943f3b1fc1b77415ec07671ed06e020b515b368117fa1a8cd581858f","observation_id":"9a878111-3e64-45c5-be7f-f3070c80186d","resolution":{"observed_at":"2026-08-05T23:49:17.456516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:26.440857Z","title":null,"venue":null,"work_id":"817a9558-e28a-442a-9192-37d0c0301b75","year":2019},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:17.618933Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:761426d752ac6103a9fb5f24d0e156630820409143b1baca172dc688be9b0132","observation_id":"84b440cd-3c54-443e-9e97-e175de5e93d8","resolution":{"observed_at":"2026-08-05T23:49:26.550216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:26.238760Z","title":null,"venue":null,"work_id":"5c13deb5-9c30-4af7-8c25-88573bbcee70","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:17.818038Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:f4f43a575278cdd95b00e8081338bfe4445894bfc87e2d440434aa15aac93fb4","observation_id":"aeff7072-3cf7-4d98-a62e-7f1573a42a47","resolution":{"observed_at":"2026-08-05T23:49:26.336749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:26.017170Z","title":null,"venue":null,"work_id":"12559e54-6bfa-4bb8-8f21-1770b06d5d92","year":null},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:17.975774Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:5bc5360ffebcc0e6acc170884aefff651fe69b8fa7fd3333fcc19ad846ef82c1","observation_id":"23ff4e56-ab4f-4a26-bd5e-2da0a7399053","resolution":{"observed_at":"2026-08-05T23:49:26.144221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:25.615653Z","title":null,"venue":null,"work_id":"b6be38ef-c47d-45d3-970d-70ed54e06f62","year":1987},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:18.349009Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:6b445a9b55df0423f819fcfce407d71297c49f4cf54beca95573ff8b04b96731","observation_id":"527d30f2-4870-4933-b229-e9c15221353b","resolution":{"observed_at":"2026-08-05T23:49:25.705835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:25.366851Z","title":null,"venue":null,"work_id":"21d5d8fa-48f4-4a33-9734-c17a6cb8c80f","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:18.572346Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:1c4019a30333221593ea8f16fb9943be3548ee11a0dab6d431e0133328715166","observation_id":"2d161707-192f-4a42-ae0b-531aab95e281","resolution":{"observed_at":"2026-08-05T23:49:25.494103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:25.169803Z","title":null,"venue":null,"work_id":"279ad9de-27c0-46f1-85ee-aa828c1c9086","year":2025},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:18.713562Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:951abfec67749b874925ec5eecda4d6c242ab1d142d9dba8c92727c9b5971bec","observation_id":"fc01f011-3c94-4ced-befc-22d289aa9024","resolution":{"observed_at":"2026-08-05T23:49:25.262715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:24.953339Z","title":null,"venue":null,"work_id":"a53a8008-49c5-47e7-9467-e65cb2a4bf25","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:18.811328Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:3d3970f9c4283fedb967090f5c4a0e25d4124e9983caaaa6eb6f510f12ade7ef","observation_id":"a47146b6-ca57-40fe-93e4-b3adc165e519","resolution":{"observed_at":"2026-08-05T23:49:25.040326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:24.773985Z","title":null,"venue":null,"work_id":"5744fa4d-1a6e-4a13-855f-bdec29544f76","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:18.959004Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:e3ad575fb93343ccf518cda77e2a7b08e061bd2561d1980923e12245c90a9a1e","observation_id":"4ce63658-0d8e-49d5-b4a7-a87db9f68ede","resolution":{"observed_at":"2026-08-05T23:49:24.856836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:24.598340Z","title":null,"venue":null,"work_id":"944b9ea0-7960-4e87-8644-f01dfb01a699","year":2022},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:19.114394Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:9216badfc66a8f461696c9d694fd663c6f12c053c21c7fc96224b9896bd4c6a9","observation_id":"52cb7ef5-6752-4041-9b51-13f7a93fb3be","resolution":{"observed_at":"2026-08-05T23:49:24.675788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:24.433028Z","title":null,"venue":null,"work_id":"efb07342-4c6f-48b1-ad52-246eba04d645","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:19.259782Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:b8142f8600a1715e22d184992aa025883e64f34b8d2c44186f80bb2947d10541","observation_id":"e3bc819f-e656-4de7-99bd-bba1bc64f1fa","resolution":{"observed_at":"2026-08-05T23:49:24.513564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:24.221336Z","title":null,"venue":null,"work_id":"d7b0cdca-67ae-438b-990e-c38d6276d5bf","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:19.410641Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:a91b0085ae190da8f52715648eb0e7928d297c3a597b1a9beede81dbdb341771","observation_id":"ca1c0d83-2380-45ca-bac9-c0682e1a0088","resolution":{"observed_at":"2026-08-05T23:49:24.314233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:24.033565Z","title":null,"venue":null,"work_id":"15120d06-9813-4006-a621-33dc9af3a2f2","year":2022},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:19.554810Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:ac92510ea82a53d5e8adc573268e701b2138a6a0fcf35c8a5016c1b7a5fe7c3b","observation_id":"efe7e6c3-6856-402e-8891-5d6a9e7b6376","resolution":{"observed_at":"2026-08-05T23:49:24.147182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:23.811367Z","title":null,"venue":null,"work_id":"6755791f-434c-4fb1-8af6-86e532028009","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:19.762204Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:e151756fd7d0e4f1dc4fe6abc0f0cb2822596a2537a4fe76840a759d58972a52","observation_id":"a9571e82-3f51-430b-abcf-1c6a2da5a645","resolution":{"observed_at":"2026-08-05T23:49:23.907748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:23.583757Z","title":null,"venue":null,"work_id":"076ea0c7-aeff-43e6-9c46-584a632fd1b1","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:19.917326Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:c1f620732a5ec8413dcb314aed24af85fe425427ccefd5b44a82287d0ec26123","observation_id":"b7c78820-3769-4b2e-baff-49f54ba41a65","resolution":{"observed_at":"2026-08-05T23:49:23.721731Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:23.319652Z","title":null,"venue":null,"work_id":"44d8d2f6-8256-4cf3-afa6-b0f28ddfdb43","year":2018},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:20.074129Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:34e03949238458b80126fe29303a7097a27c5e1d4e3cf03ef365cf394c0d7e64","observation_id":"89907919-cb49-4d85-a3da-84ff2d2cc104","resolution":{"observed_at":"2026-08-05T23:49:23.447846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:23.116887Z","title":null,"venue":null,"work_id":"fb7e1148-5d78-4d87-bef0-5ff8f7f02973","year":2018},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:20.240336Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:f5abf2c7ac35a97719489fd74d120d8f0a38c8d86b09b91f18e83efc0aaa3d42","observation_id":"64f94fe1-674b-41e2-bce6-e2370df5c2fa","resolution":{"observed_at":"2026-08-05T23:49:23.200773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:22.922121Z","title":null,"venue":null,"work_id":"598008e7-4e86-4883-8100-8ef97248697c","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:20.362512Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:8f8dc4e38aff5fa224a7d7cee9ccc72ba65885f894a300383f2f638ed4d109e5","observation_id":"0b9fa139-3781-408d-a605-9398528027fd","resolution":{"observed_at":"2026-08-05T23:49:22.998084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:22.751225Z","title":null,"venue":null,"work_id":"e6d57e53-886d-4cbc-a5b1-eb4e164bcb7b","year":2024},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:20.483910Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:4d80428bcf4cba52f919642c603f1d4139c7df46e68cf95805d76fbf406a46ae","observation_id":"5ebbae30-5fa8-4e4e-8f41-a17d2e4b4bd2","resolution":{"observed_at":"2026-08-05T23:49:22.831622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:22.522219Z","title":null,"venue":null,"work_id":"4de06c58-4954-410f-823a-e9db14f25927","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:20.583799Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:445a0746ef3f465b2593f3721a24ccfb78186516127323136fef7688d265ece8","observation_id":"e5542257-8edf-4468-8b1b-fb73d24d7b4d","resolution":{"observed_at":"2026-08-05T23:49:22.665342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:20.704224Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:20.704224Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:a1d761a8ba76005e73f2d77977d9bb2ed68aa771f7eef0bf72298781f6d7bcb6","observation_id":"88becd55-8a98-4d89-b5dd-da7e745bf139","resolution":{"observed_at":"2026-08-05T23:49:20.704224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:22.368411Z","title":null,"venue":null,"work_id":"729d6323-8957-4f6e-9df2-a6579e8dba7e","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:20.868354Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:c558d8338fbff192243a69b29e30a07320b8e51bc4dfbcd6a79992ba544dc2ad","observation_id":"4a51ac2d-f747-4761-94e9-06e03986a9b1","resolution":{"observed_at":"2026-08-05T23:49:22.441874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13382","last_updated":"2024-11-26T16:37:36Z","snapshot_observed_at":"2026-08-04T05:25:47.547926Z","submitted_at":"2023-08-25T13:52:05Z","title":"Prompting Visual-Language Models for Dynamic Facial Expression Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13382","snapshot_observed_at":"2026-08-05T23:49:21.013487Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:21.013487Z"},"links":{"cited_paper":"/paper/2308.13382","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:eebb72e347ecb99eaeaf9b1ca88a86054165f1348834de01d4bfb5ed628050f3","observation_id":"324ea9f0-0661-4602-b9a0-308fc3716c49","resolution":{"observed_at":"2026-08-05T23:49:21.013487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:22.198761Z","title":null,"venue":null,"work_id":"a5ef2588-354e-424c-841c-f51361757b76","year":2023},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:21.123536Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:e035504e922e40cd8f07b16946eb8d387eb70c2a40028a21bb072e04c716d89e","observation_id":"621d8409-3577-49c9-8a1e-84d4d4e2533d","resolution":{"observed_at":"2026-08-05T23:49:22.265104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:21.967743Z","title":null,"venue":null,"work_id":"448c787e-8e7c-4933-88af-fbeb8acc3a9b","year":2022},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:21.249314Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:77d1344dd82e47446dd316afff8699661d6ea6677b845037c95677249348e3ba","observation_id":"951a894f-8e5e-4239-8461-8cb56214f91e","resolution":{"observed_at":"2026-08-05T23:49:22.058994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:26.827061Z","title":"In Proceedings of the AAAI Conference on Artificial Intelligence , Vol","venue":null,"work_id":"08c47c0e-358d-4643-ac07-aeedd992108c","year":null},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:16.817901Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:a68d92a3ca397a8b8fced8c2fcd687643722a7c984264e5ae808ecdba05ca4e8","observation_id":"dfd356cb-636a-4467-8e4a-a604bd63230e","resolution":{"observed_at":"2026-08-05T23:49:26.953969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:49:25.825612Z","title":"In International Conference on Machine Learning","venue":null,"work_id":"f10e9845-76a3-4481-b549-c36a832d5deb","year":null},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:18.148334Z"},"links":{"citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:759baf910d7333360c401a18d4fff4027f7ac717465fa1959f9baddb06583942","observation_id":"ac3d5fb7-64ee-4476-974b-8618ca200b59","resolution":{"observed_at":"2026-08-05T23:49:25.927174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.02455","last_updated":"2022-05-05T05:54:24Z","snapshot_observed_at":"2026-08-02T03:57:59.438119Z","submitted_at":"2022-05-05T05:54:24Z","title":"COGMEN: COntextualized GNN based Multimodal Emotion recognitioN","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.02455","snapshot_observed_at":"2026-08-05T23:49:14.368091Z","title":"arXiv preprint arXiv:2205.02455 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:14.368091Z"},"links":{"cited_paper":"/paper/2205.02455","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:232c15249021c4da15f16ae2b3b450bf6332c29e214e2a9d96db3fa98af4ea8c","observation_id":"71107452-4ff8-4f9e-9f19-fabd9d5f17b7","resolution":{"observed_at":"2026-08-05T23:49:14.368091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T23:49:06.316248Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":55,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 1 inbound Pith citation observation for arXiv:2508.06564."}