{"as_of":"2026-08-09T04:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:895db00b520b71269fde6ab872ca3344e6136921ff2ef04346edca0d2781c1e0","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T18:32:29.286029Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T21:20:00.041277Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T21:28:58.443236Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2502.05660","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05660","snapshot_observed_at":"2026-07-03T21:28:58.443236Z","title":"Evaluating vision- language models for emotion recognition","venue":null,"work_id":"27251ab6-337c-468b-a738-855946fbab93","year":2025},"citing_paper":{"arxiv_id":"2511.12554","last_updated":"2026-04-20T07:01:19Z","snapshot_observed_at":"2026-08-03T09:35:27.876906Z","submitted_at":"2025-11-16T11:16:50Z","title":"EmoVerse: A MLLMs-Driven Emotion Representation Dataset for Interpretable Visual Emotion Analysis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T21:49:38.075702Z"},"links":{"cited_paper":"/paper/2502.05660","citing_paper":"/paper/2511.12554"},"observation_digest":"sha256:69f2457989f38733a9df7d741a7b3553efbc0ff4aeff2dfa04dbf2529feeaebe","observation_id":"ff9bf63b-e841-40b0-b190-2b750a9d6614","resolution":{"observed_at":"2026-05-17T21:50:19.508576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2502.05660","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05660","snapshot_observed_at":"2026-07-03T21:28:58.443236Z","title":"Evaluating vision- language models for emotion recognition","venue":null,"work_id":"27251ab6-337c-468b-a738-855946fbab93","year":2025},"citing_paper":{"arxiv_id":"2607.02089","last_updated":"2026-07-01T14:25:43Z","snapshot_observed_at":"2026-08-02T16:57:02.105465Z","submitted_at":"2026-07-01T14:25:43Z","title":"ESC: Emotional Self-Correction for Reliable Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T21:20:00.041277Z"},"links":{"cited_paper":"/paper/2502.05660","citing_paper":"/paper/2607.02089"},"observation_digest":"sha256:40ef2267dd6ebb5a661421fb0a2de386afbe6749a198c32ebdeb39ec48c9a722","observation_id":"84078a14-2714-4503-a13f-15bcdd1a0370","resolution":{"observed_at":"2026-07-03T21:28:58.444916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05660/citation-record","integrity":"/paper/2502.05660/integrity","json":"/paper/2502.05660/citation-record.json","paper":"/paper/2502.05660"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T18:32:29.135177Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.135177Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:faecf44ec0dcbcd22679cb21d0aba9f3f67f17af0f922ebf2e0de4d1b68f1c9e","observation_id":"20a27732-a493-489c-8e91-d041c12898be","resolution":{"observed_at":"2026-08-08T18:32:29.135177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.312627Z","title":null,"venue":null,"work_id":"d9f4e505-3076-4ceb-be9f-bb00996823a5","year":2021},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.139147Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:04568faba4a12ecc8c4d4f5725ac2b8ceb6ff0d1f341a184aaddc02c440fee7e","observation_id":"deff3c8e-0f19-48f9-8864-2fddab3864f7","resolution":{"observed_at":"2026-08-08T18:33:09.315812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-08T18:32:29.142757Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.142757Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:02522e96543e2fdebf2d296b4a28cfd20e36df7782fc7fd4dc20492a9df377ea","observation_id":"110aebc2-a2a2-4a78-8874-365c38f986a5","resolution":{"observed_at":"2026-08-08T18:32:29.142757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16741","last_updated":"2023-11-02T17:37:53Z","snapshot_observed_at":"2026-07-06T16:12:46.676413Z","submitted_at":"2023-08-31T13:59:35Z","title":"Socratis: Are large multimodal models emotionally aware?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16741","snapshot_observed_at":"2026-08-08T18:32:29.146436Z","title":"Plummer, and Kate Saenko","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.146436Z"},"links":{"cited_paper":"/paper/2308.16741","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:6c35f02a9749543c6ad672cc6464c4f1ec7926701dca6796f2ae44cc4b2d944d","observation_id":"0e03952c-09a8-44e4-b9fa-727a194e2ee8","resolution":{"observed_at":"2026-08-08T18:32:29.146436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.304161Z","title":null,"venue":null,"work_id":"f367002e-5889-44af-b797-dc9cf7a701f3","year":2020},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.150054Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:56c23a9e3fcf44f7bbca02457974238cca92816f1d8f46ea70577e1f750f0f07","observation_id":"115a9083-ab2b-4bf4-8ac4-03ea54083192","resolution":{"observed_at":"2026-08-08T18:33:09.307247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08992","last_updated":"2025-01-31T18:53:30Z","snapshot_observed_at":"2026-07-06T18:14:29.262608Z","submitted_at":"2024-05-14T23:24:12Z","title":"Contextual Emotion Recognition using Large Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08992","snapshot_observed_at":"2026-08-08T18:32:29.153457Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.153457Z"},"links":{"cited_paper":"/paper/2405.08992","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:8a2855cae7bcf69741d73f63f913c3ae154b0c213e6476c80f5d9080445d0b89","observation_id":"ed3fbeb9-8a5a-428e-999b-2249ff765c03","resolution":{"observed_at":"2026-08-08T18:32:29.153457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09369","last_updated":"2024-02-14T18:16:54Z","snapshot_observed_at":"2026-08-01T18:25:19.560373Z","submitted_at":"2024-02-14T18:16:54Z","title":"Massively Multi-Cultural Knowledge Acquisition & LM Benchmarking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09369","snapshot_observed_at":"2026-08-08T18:32:29.157328Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.157328Z"},"links":{"cited_paper":"/paper/2402.09369","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:b4869acc7b73d3b2939523742c3da1404590563d8583aefd15f44939ff08efac","observation_id":"677a43c3-0bf5-4b8a-991e-c7fd81cf32e9","resolution":{"observed_at":"2026-08-08T18:32:29.157328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.294726Z","title":null,"venue":null,"work_id":"e964ac89-8486-41e8-9cbc-a14925a1509f","year":2021},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.160776Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:2eb94df7d3ffa34829a90f678b7826124f585d84060fdbadc3c0f04bc12369e8","observation_id":"8203bea5-cd90-4e8a-a19d-ae135e67bde7","resolution":{"observed_at":"2026-08-08T18:33:09.298009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.037202Z","title":null,"venue":null,"work_id":"14d028b0-d24a-43d0-9cf5-3529627df15f","year":2021},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.163613Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:9a7013919541b4994586e4b5c3b0dcee5a4c222aaa8a094a67cd59d06169fb69","observation_id":"d623efe8-bee3-4573-acd8-cc8f860321bc","resolution":{"observed_at":"2026-08-08T18:33:09.040968Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:02.113849Z","title":null,"venue":null,"work_id":"d41cc443-6a9b-4951-8726-eab4f19dc12f","year":2016},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.166719Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:79b753a16e554ebf28dfee41a0cf97084a3e4647141e776b06206a0a7e1b558c","observation_id":"b908595d-d567-4dd3-ac9c-38c18b041b60","resolution":{"observed_at":"2026-08-08T18:33:02.118511Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02135","last_updated":"2024-02-03T12:52:36Z","snapshot_observed_at":"2026-07-06T17:24:49.522453Z","submitted_at":"2024-02-03T12:52:36Z","title":"Do Moral Judgment and Reasoning Capability of LLMs Change with Language? A Study using the Multilingual Defining Issues Test","version":1},"cited_work":{"arxiv_id":"2402.02135","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.02135","snapshot_observed_at":"2026-08-08T18:32:54.204307Z","title":"Do Moral Judgment and Reasoning Capability of LLMs Change with Language? A Study using the Multilingual Defining Issues Test","venue":"cs.CL","work_id":"8dbfdcc9-4226-472c-ac2b-73cfd3036ad1","year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.173192Z"},"links":{"cited_paper":"/paper/2402.02135","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:1a1adb141ce96d07d98c3ed720a62e8eb362107dd440cb48f0086c2a85769429","observation_id":"0df9bbfd-1174-410c-ae77-6df4ef10393e","resolution":{"observed_at":"2026-08-08T18:32:54.208012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.285290Z","title":null,"venue":null,"work_id":"859727cb-d9dc-4420-94d4-50f7a4c757ec","year":2018},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.177090Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:5d13f049c6d139c89a46eeb3238bbead70161b512797c8624e5bbb707e7e4226","observation_id":"9518b195-56e7-4df7-8891-ae42646889fe","resolution":{"observed_at":"2026-08-08T18:33:09.288626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.277063Z","title":null,"venue":null,"work_id":"85efd6fd-11e0-4eb8-b597-282b968821f3","year":2014},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.180249Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:64ca08f27b23bbc8edcbbc2e1dd7b7dae70e1f8c279a97c88f396f221497f342","observation_id":"392d4e5a-c0cc-474d-9987-9ca051e98364","resolution":{"observed_at":"2026-08-08T18:33:09.280160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.268291Z","title":null,"venue":null,"work_id":"68b490e4-986d-4694-b89c-13574640deda","year":2019},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.183170Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:3e17584abe5d84c049d1dcc0df35c04c1dc346cf8590a495b133da70f793c70e","observation_id":"e42f1f78-e850-4e87-ad34-9d2f316829de","resolution":{"observed_at":"2026-08-08T18:33:09.271626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11760","last_updated":"2023-11-12T12:35:41Z","snapshot_observed_at":"2026-08-06T12:21:48.928479Z","submitted_at":"2023-07-14T00:57:12Z","title":"Large Language Models Understand and Can be Enhanced by Emotional Stimuli","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.11760","snapshot_observed_at":"2026-08-08T18:32:29.186155Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.186155Z"},"links":{"cited_paper":"/paper/2307.11760","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:48e2f325f690b4849ce70981b0445760a524924315548881126fdee738ca9bdf","observation_id":"044b282f-9edd-448a-91f3-36f28bb701a5","resolution":{"observed_at":"2026-08-08T18:32:29.186155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.260078Z","title":null,"venue":null,"work_id":"7d175948-a700-40fc-9c74-b78c2ad7b34c","year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.189446Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:7fb4cc34e8a6516f62acb81f4638b59c78f6ce1dbca296b87d8c2d9f182e30e0","observation_id":"28aaf7d7-34c7-49b7-b818-8b7e52aae21a","resolution":{"observed_at":"2026-08-08T18:33:09.263101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06836","last_updated":"2024-08-07T08:09:53Z","snapshot_observed_at":"2026-08-05T03:31:28.874008Z","submitted_at":"2024-01-12T16:42:10Z","title":"Enhancing Emotional Generation Capability of Large Language Models via Emotional Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06836","snapshot_observed_at":"2026-08-08T18:32:29.192221Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.192221Z"},"links":{"cited_paper":"/paper/2401.06836","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:aab1822e0221cf46b483dd5c78f8a312c0279d54947571dd67f26891ea4ba527","observation_id":"05b81987-a887-4005-ac02-ea65afe0b202","resolution":{"observed_at":"2026-08-08T18:32:29.192221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.251696Z","title":null,"venue":null,"work_id":"9f623496-f1db-46dd-b2a7-ce65d5f40435","year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.195305Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:a82c0bcf95404d78bd4a30e3f7fae3d44a1aa902d10e9dbb7ce0f908b21b2711","observation_id":"e8aba687-fe67-453c-b40f-227f1245dd7f","resolution":{"observed_at":"2026-08-08T18:33:09.254811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.242894Z","title":null,"venue":null,"work_id":"f7a76393-f56b-482d-82f9-7a343acc9260","year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.198596Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:62bafe558672615b56a96fed9ed74bfd1e002eeaebc913eef4684e9444d18c74","observation_id":"307c5a7d-c2b7-47ab-9046-4e1758247600","resolution":{"observed_at":"2026-08-08T18:33:09.246084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08508","last_updated":"2024-06-18T02:24:03Z","snapshot_observed_at":"2026-08-04T18:44:55.708751Z","submitted_at":"2024-01-16T17:11:11Z","title":"EmoLLMs: A Series of Emotional Large Language Models and Annotation Tools for Comprehensive Affective Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08508","snapshot_observed_at":"2026-08-08T18:32:29.201439Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.201439Z"},"links":{"cited_paper":"/paper/2401.08508","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:784f43635e9a88b95f450a9f00a687781f4fc28cc41f50f7eb326c72b2c22a14","observation_id":"4869a6dd-6ce8-4109-a237-cdf4f2c69d04","resolution":{"observed_at":"2026-08-08T18:32:29.201439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.233904Z","title":null,"venue":null,"work_id":"09fbf604-73fa-4372-954a-c612e71f1e09","year":2022},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.204742Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:7d4e009e9b4a0f72af0beac14c2ad228af144d58456edcf9809a341daeb2b456","observation_id":"499a1a53-e015-4352-9c4b-7d986333e94d","resolution":{"observed_at":"2026-08-08T18:33:09.237186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.225173Z","title":null,"venue":null,"work_id":"46581783-5378-4240-9326-dffc7089da65","year":2017},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.207701Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:9aa286239e6e89da7de1af6efe10ef6cd53fcb3b9f2bab561ba856fc3cc842f2","observation_id":"668bbe54-0ae4-4e9a-8f4b-1062e54ee611","resolution":{"observed_at":"2026-08-08T18:33:09.228337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.216067Z","title":null,"venue":null,"work_id":"ad14522d-3a7a-4880-8597-6b74e89eb18c","year":2010},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.210727Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:0ca6ccc516ced630fa833307fe24d2cc4947b6013fcef2989169b4e16a256cf2","observation_id":"b3dfa58c-1422-4803-b87a-d33bc566488b","resolution":{"observed_at":"2026-08-08T18:33:09.219154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.207316Z","title":null,"venue":null,"work_id":"8d2380d1-b0b8-43b6-9cbb-e0b4d1b52429","year":2005},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.213762Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:4be929e760d043ed559ca418a2dae6750e2865256f942966b5e1aaab78334297","observation_id":"df70bcbd-b9db-4e90-ae56-4c60adb48611","resolution":{"observed_at":"2026-08-08T18:33:09.210505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.198347Z","title":null,"venue":null,"work_id":"20dad923-c312-4fff-8612-1e3ab0a3a4c8","year":2020},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.216749Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:9beddb71608470e941e87358e48b8204b8209d44ddf971a31a7465bc81720fa4","observation_id":"cebbc544-00c4-43e2-9c10-4f43463eaad5","resolution":{"observed_at":"2026-08-08T18:33:09.201753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.188805Z","title":null,"venue":null,"work_id":"b8ec0d2a-0f6a-43e8-89ba-7fc247a92d9e","year":2010},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.219662Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:4dbfd0f36adc0b7213ce30904f89972c07ee4c28aaf2ff9d5fd4522f2ea1c682","observation_id":"ac391e98-fd9f-48f7-8e47-d678a1b37ac1","resolution":{"observed_at":"2026-08-08T18:33:09.192425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:32:54.166384Z","title":null,"venue":null,"work_id":"58960db0-16fa-469c-8a31-6123a1efd49e","year":2015},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.222672Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:afa063422169025180748f356b90d965ec8c97a2cb556dae08ae612be8890e5d","observation_id":"270f7656-e155-42b4-a127-7db152ae04f6","resolution":{"observed_at":"2026-08-08T18:32:54.169620Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04232","last_updated":"2024-02-07T17:27:09Z","snapshot_observed_at":"2026-08-04T01:54:16.971823Z","submitted_at":"2024-02-06T18:39:43Z","title":"Can Generative Agents Predict Emotion?","version":2},"cited_work":{"arxiv_id":"2402.04232","doi":"10.48550/arxiv.2402.04232","metadata_source":"pith","pith_arxiv_id":"2402.04232","snapshot_observed_at":"2026-08-09T00:16:22.132183Z","title":"Can Generative Agents Predict Emotion?","venue":"cs.AI","work_id":"6663f01b-d891-4974-945a-452c7dc98f83","year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.225575Z"},"links":{"cited_paper":"/paper/2402.04232","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:6d6047351a3a50ac2cda2984327598d27ecd25ec4a103668b5def012646be336","observation_id":"06680f8d-2592-4fbd-a5ee-bdffeff0fd02","resolution":{"observed_at":"2026-08-08T18:32:29.325239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-08T18:32:29.228960Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.228960Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:2be8b273afd737fd6e97943ac136310d0e5eebd565cad78aa7a68697a0e48f86","observation_id":"8a285c7e-623e-41cb-baa3-bdb46aac22ae","resolution":{"observed_at":"2026-08-08T18:32:29.228960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.178337Z","title":null,"venue":null,"work_id":"70a64719-e688-4c6c-aeb5-410e8b31fab4","year":2021},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.232210Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:3770d1437271ad04dccad267e66800962f39503110d6122e5881841a031ba3a2","observation_id":"e308623f-a037-4a4a-a316-27674b305c98","resolution":{"observed_at":"2026-08-08T18:33:09.182245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.167516Z","title":null,"venue":null,"work_id":"dbbb2fcb-44c8-418d-b9cc-c6250e821799","year":2015},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.234980Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:ae44f8c6424adeedf70bb4093acf72e4c5ab66a3737cee11a8af2abc38a1dcde","observation_id":"b97ed427-5de5-4f3f-a382-f724016e0b14","resolution":{"observed_at":"2026-08-08T18:33:09.171364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:32:46.655806Z","title":"Cobo, Carlos De Las Heras-Pedrosa, José Ignacio Peláez, and Enrique Herrera-Viedma","venue":null,"work_id":"7b302f7b-092b-4283-921e-0b98ad54a2ab","year":2020},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.237903Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:a2556e3e3ae7ce2e1c0f88aeecb20e39872330d8c935ca68d3beff394576fccb","observation_id":"de7655e2-9786-4f53-b538-d7151095f106","resolution":{"observed_at":"2026-08-08T18:32:46.659494Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-08T18:32:29.240796Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.240796Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:def7bfa73cfe7e9279df40f7ea79220a381ffd891316a3899affd401d88b18d4","observation_id":"75f4719e-4632-4108-8ef5-2bc8c0958748","resolution":{"observed_at":"2026-08-08T18:32:29.240796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:32:29.243811Z","title":"Wang, Sicheng Zhao, Chenyan Wu, Reginald B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.243811Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:170a0c03c1debaa0c542dde777f9386ab8df9ead11a562b6f09c136739881bbf","observation_id":"3503fa25-c75f-43ab-ac4e-8a80709a5c09","resolution":{"observed_at":"2026-08-08T18:32:29.243811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.157652Z","title":null,"venue":null,"work_id":"1c2bcbec-4491-4706-b255-22e43db40541","year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.246882Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:4c9b73009d40463481258b544e672981a5cf71f10ec2cc97771de9456ff727d3","observation_id":"1b82e3e4-4251-4a97-9c7e-f0c5a00d66cb","resolution":{"observed_at":"2026-08-08T18:33:09.161224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.147493Z","title":null,"venue":null,"work_id":"ca26df5a-4b2b-49bc-88a8-d64b6d07e7f8","year":2022},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.249837Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:de09ee9b36f43ccb1083fc0168822ee18e31346fbf266f4b28ef0fa1e3558c61","observation_id":"069b3555-247c-40f9-b3b4-c0cc48470ae7","resolution":{"observed_at":"2026-08-08T18:33:09.151111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.137432Z","title":null,"venue":null,"work_id":"a6cf80e7-b19a-4481-a8f8-c8eac5bd3d9d","year":2012},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.252587Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:0b63ec2e9ce11e4ca4a11918db9d659c954ad4dc3b5d8eb7d85bb0169a2c8945","observation_id":"d4772aad-856f-4706-9e5c-1436871f078e","resolution":{"observed_at":"2026-08-08T18:33:09.140933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-08T18:32:29.255526Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.255526Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:f12f1355ec42e13d65ea35f2dcea29c1c24ccd2ed4f11440e1cd6510f1c643c2","observation_id":"e8b01b73-2928-4e73-ac20-e70e8c8be1a1","resolution":{"observed_at":"2026-08-08T18:32:29.255526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07078","last_updated":"2025-07-15T11:18:24Z","snapshot_observed_at":"2026-07-06T17:58:21.138881Z","submitted_at":"2024-04-10T15:09:15Z","title":"VLLMs Provide Better Context for Emotion Understanding Through Common Sense Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07078","snapshot_observed_at":"2026-08-08T18:32:29.258653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.258653Z"},"links":{"cited_paper":"/paper/2404.07078","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:07477857c06b4786b0681bc8e68cdc122b99c608a257214f1fc344031d280ace","observation_id":"e787cc0f-cb83-45d0-a39a-6f123e03b4de","resolution":{"observed_at":"2026-08-08T18:32:29.258653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16670","last_updated":"2024-04-25T15:15:36Z","snapshot_observed_at":"2026-07-06T18:05:34.109470Z","submitted_at":"2024-04-25T15:15:36Z","title":"EmoVIT: Revolutionizing Emotion Insights with Visual Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16670","snapshot_observed_at":"2026-08-08T18:32:29.261710Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.261710Z"},"links":{"cited_paper":"/paper/2404.16670","citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:c77cefda557eb7829fc0a11a3e3685866ce8d93e3c9de712a9c4d737fe3f8192","observation_id":"724d50ea-479d-4ab7-9713-0f735e415806","resolution":{"observed_at":"2026-08-08T18:32:29.261710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.127755Z","title":null,"venue":null,"work_id":"9a905503-a565-46a2-b664-048e4bb3e22c","year":2022},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.264909Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:df1b72df4d2c2a08a047f4ef8c1ef8c41a9413823279d7050effc1f9a9fbdec3","observation_id":"996e7d58-ed5e-4bd8-ac8d-5381cfb3d481","resolution":{"observed_at":"2026-08-08T18:33:09.131139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.118135Z","title":null,"venue":null,"work_id":"f4ee8858-2976-47a5-b152-a356f438e1ea","year":2023},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.267704Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:78864f0df995ede3c0499480626295d1a65173213249ccfb215fd23666781d04","observation_id":"3126b744-fdbb-45fa-850f-9ed320f7750b","resolution":{"observed_at":"2026-08-08T18:33:09.121741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.108871Z","title":null,"venue":null,"work_id":"9f06dbc0-21e1-4fcb-b3cf-6f4d4374b03d","year":2021},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.270784Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:979dfc81593f80a7f7544fe70f569459f9675f7d1b9b54bf0f57c40f8772bb48","observation_id":"4e887569-f3f5-4693-8ed3-b5c493bc7a13","resolution":{"observed_at":"2026-08-08T18:33:09.112206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:33:09.099467Z","title":null,"venue":null,"work_id":"17a1b793-ca47-4846-bce7-5cf600028e78","year":2016},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.273737Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:b8d56b98ee46d2ebe4448e678a82c097979b0e935bf5dc678bcc69d955665d74","observation_id":"bc6883bb-1dbe-4547-b387-a3f3997950b1","resolution":{"observed_at":"2026-08-08T18:33:09.102783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:32:31.031566Z","title":null,"venue":null,"work_id":"d294c559-fb4b-47d3-9482-5af173600842","year":2018},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.276617Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:11848c43b4627196d79a035570e319bba52775924dff6fa86b7e8678b93f823b","observation_id":"270e580c-c387-499b-8193-2de008d8b6a8","resolution":{"observed_at":"2026-08-08T18:32:31.035136Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:32:29.279489Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.279489Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:e59cd0da02c3590c8802ff42694dc4e677427af3f5034cdf3ee89c07959b9da6","observation_id":"769b78ef-e446-4355-8e21-c6863ba9bb2e","resolution":{"observed_at":"2026-08-08T18:32:29.279489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:32:29.282418Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.282418Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:f058b1d17c40063ce64a639955171ba84f76510da8131b01bf2eb814875d708a","observation_id":"93b40af6-957f-4422-9f22-5d01b3ed12b6","resolution":{"observed_at":"2026-08-08T18:32:29.282418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:32:29.286029Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T18:32:29.286029Z"},"links":{"citing_paper":"/paper/2502.05660"},"observation_digest":"sha256:b70804543164bdd707e465b4783143b0d5e38082a21250deb0840f9de61acfe4","observation_id":"8bd9e189-1c8b-4633-8335-0901512d0bf5","resolution":{"observed_at":"2026-08-08T18:32:29.286029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05660","last_updated":"2025-02-08T18:25:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T18:25:20.194040Z","submitted_at":"2025-02-08T18:25:31Z","title":"Evaluating Vision-Language Models for Emotion Recognition"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":7,"verified_fuzzy":0},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 2 inbound Pith citation observations for arXiv:2502.05660."}