{"as_of":"2026-08-20T19:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:20513fcb1e75532c5f4315fa51c71cc9741075a82f4081232367959bf4087669","coverage":[{"denominator":86,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":86,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:37:44.462596Z","state":"measured"},{"denominator":86,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":86,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.21061/citation-record","integrity":"/paper/2607.21061/integrity","json":"/paper/2607.21061/citation-record.json","paper":"/paper/2607.21061"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:37.515490Z","title":"Emotional intelligence and interpersonal relations,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.515490Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:eb0d97763506322d6332554743d0015b675d4af7baa750cf4132c540cc91c938","observation_id":"924657f6-f887-4079-9889-903c6c15c14d","resolution":{"observed_at":"2026-08-01T08:37:37.515490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:37.584521Z","title":"Affective image content analysis: Two decades review and new perspectives,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.584521Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:57ec58a60e08e0e9bbc4a9688b7869c4c64c0364954d77f71ff56be029b69963","observation_id":"876d1042-b585-4e86-aa18-b99039e8b871","resolution":{"observed_at":"2026-08-01T08:37:37.584521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21239","last_updated":"2026-05-20T14:29:07Z","snapshot_observed_at":"2026-08-14T19:34:25.548691Z","submitted_at":"2026-05-20T14:29:07Z","title":"Multimodal Emotion Recognition with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21239","snapshot_observed_at":"2026-08-01T08:37:37.645785Z","title":"Multimodal emotion recognition with large language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.645785Z"},"links":{"cited_paper":"/paper/2605.21239","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:7185fbc6c5c583f8b7cc6a732ec4757cfb437b3771e3aad8be292f794d2a5424","observation_id":"9ac78547-6d39-4886-a3a2-fdedcbb53c69","resolution":{"observed_at":"2026-08-01T08:37:37.645785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:37.707141Z","title":"Instructblip: Towards general-purpose vision-language models with instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.707141Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:9c2bc7a77839d8de3a39792550369771d2ca56245713c420ef2994e219bbd862","observation_id":"25df5998-f8d5-4b2e-8693-ee46b68110e1","resolution":{"observed_at":"2026-08-01T08:37:37.707141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:37.749846Z","title":"Minsky,Society of Mind","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.749846Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:78e7c12fd1a236f2f6d6813759a5ba9a39875c37abb8c8aef60498a45411293a","observation_id":"c45e611d-ab49-4b21-9e59-d100e89ddda8","resolution":{"observed_at":"2026-08-01T08:37:37.749846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-15T00:17:32.875866Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-01T08:37:37.800783Z","title":"Openai gpt-5 system card,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.800783Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:762d4470a4fee59f6e5b68efd360e00c8c02bf24feaad6e3bd27ab5f59aa4967","observation_id":"5f6ab6d2-6c1e-4641-bbb1-5167c0543e49","resolution":{"observed_at":"2026-08-01T08:37:37.800783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:37.885043Z","title":"Qwen3.5: Towards native multimodal agents,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.885043Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:8e41f1aedd95e85bdc61f117ce6839c31326d8f75580ae2406dcfb7a07fa05ec","observation_id":"3e73225b-49ac-477c-92c9-bda1b01bc3df","resolution":{"observed_at":"2026-08-01T08:37:37.885043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:37.937497Z","title":"Seed 2.0 official launch,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.937497Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:c84112a8b9ebffaf54c2873d74c93847f8452c254073e88cdabe1af68d8ea2b5","observation_id":"49b3a047-573f-46d5-8652-4231750a3f47","resolution":{"observed_at":"2026-08-01T08:37:37.937497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:37.991696Z","title":"Building a large scale dataset for image emotion recognition: The fine print and the benchmark,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:37.991696Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:99c5ae76102cd1f7c18ab7c67fe1ca72d932f489379b92e36f28a5c24ea1f4a1","observation_id":"061ea8ab-fcf0-4adb-bf84-eee925080103","resolution":{"observed_at":"2026-08-01T08:37:37.991696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.048521Z","title":"EMOTIC: emotions in context dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.048521Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:d279b3bf8831988c1ec8e9b053b9d5fa25304351dfdd22c2f54b16c7c1fbd3d8","observation_id":"b8688e87-2069-46a4-b321-dab5732f9628","resolution":{"observed_at":"2026-08-01T08:37:38.048521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.120385Z","title":"Learning visual emotion representations from web data,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.120385Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:ac2da3120cf0179fd37c2b90141fb01eeb0a416492b90cdc4fe9892c5857fcef","observation_id":"cd3ac59f-7368-442c-9c23-e7b002a26531","resolution":{"observed_at":"2026-08-01T08:37:38.120385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.238816Z","title":"Emoset: A large-scale visual emotion dataset with rich attributes,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.238816Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:3d3f2d4c3ecc63e48df4a19b51985b760aec4ef24d5abb319098d949e87f325d","observation_id":"4a0c53a4-11b1-4d5e-9eb4-832ff8b7c3e0","resolution":{"observed_at":"2026-08-01T08:37:38.238816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.303805Z","title":"Artemis: Affective language for visual art,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.303805Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:397e493e2d3cb554d85412b13eeac24e972fa19b2a99ea064f4a3caec8b07760","observation_id":"a84035df-dd7a-4061-82e0-52eae9fdc5cd","resolution":{"observed_at":"2026-08-01T08:37:38.303805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.350320Z","title":"Affection: Learning affective explanations for real-world visual data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.350320Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:f91b885369d3f5396a72a233b5245ee4375a4b8077ddcbf7b43e6f8bf2bbe1b7","observation_id":"e279190f-9dd4-4ee0-b0f1-4a7b4fd90d3a","resolution":{"observed_at":"2026-08-01T08:37:38.350320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.436674Z","title":"Why we feel: Breaking boundaries in emotional reasoning with multimodal large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.436674Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:57b606af634cfb85dc44fff326a097c8e253bb0f974f21b5db3b9df5e8067352","observation_id":"95966f5d-164e-477a-a8b8-7678fbe07bb0","resolution":{"observed_at":"2026-08-01T08:37:38.436674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.520534Z","title":"Predicting personalized emotion perceptions of social images,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.520534Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:518f7d0a65fbb97a2bd04ccb0ce6de96165de6f2d9c5190d1b07bf14fa8d42e5","observation_id":"8f5ccf29-78e2-4799-89b4-6313e8b54243","resolution":{"observed_at":"2026-08-01T08:37:38.520534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-01T08:37:38.605572Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.605572Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:8e55c7743df892c4d4a20878a1af15f5accf6864f454061d43c7d9021feabd8d","observation_id":"cc339a07-6f1f-43f9-8530-9e6e66d1ae20","resolution":{"observed_at":"2026-08-01T08:37:38.605572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.687460Z","title":"Context in emotion perception,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.687460Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:2582eba17448355291e685cead4ce47eb245bd1ccf74a87ba40b71e5d0f5543d","observation_id":"e0b559f3-bb9c-4b05-a752-c440fa9d039e","resolution":{"observed_at":"2026-08-01T08:37:38.687460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.769191Z","title":"Faces in context: A review and systemati- zation of contextual influences on affective face processing,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.769191Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:e0e6fcfbc87fbed5d641e1eb260f5970342b8c0ba1df7febc8a8a6efc343fd40","observation_id":"55d97070-11f7-4bbe-b050-b69960af86ac","resolution":{"observed_at":"2026-08-01T08:37:38.769191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.829555Z","title":"Individual differences in emotion processing,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.829555Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:cdc374ec1ffee4f46563d690f09b8434b6a5816408f45ba43254355a800a327b","observation_id":"94fb49f8-5d9b-418a-9c43-35830ee118e6","resolution":{"observed_at":"2026-08-01T08:37:38.829555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.876010Z","title":"Reliable crowdsourcing and deep locality- preserving learning for expression recognition in the wild,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.876010Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:9dcc7d318b8f7569ebc13264ddd0780272a089ed1813ac54bb850e12d6ac07ce","observation_id":"eb80f917-128b-499c-9b0b-741eadb6ab68","resolution":{"observed_at":"2026-08-01T08:37:38.876010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.932173Z","title":"A circumplex model of affect,","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.932173Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:7377b68d9173df2723de25a19b979b0e7078776ff39e5067785101006057f11c","observation_id":"d339890b-ffe7-4af6-9f23-a6c3b0afa4cd","resolution":{"observed_at":"2026-08-01T08:37:38.932173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:38.983804Z","title":"Constants across cultures in the face and emotion,","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:38.983804Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:7b44df8ad03a54ea4d23ff613572e0aa6c656eb3cc787a7402f97031596a9167","observation_id":"6e540371-8ca8-4c6b-b890-36eeaf9167e4","resolution":{"observed_at":"2026-08-01T08:37:38.983804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-01T08:37:39.034171Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.034171Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:1cb0c8fe06dafc308e304d2657c88830c7520adb42b8c76caa4a4aa1dbe5f3ba","observation_id":"092e23ed-5c6b-408b-b763-2a2331240d99","resolution":{"observed_at":"2026-08-01T08:37:39.034171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-13T14:47:47.249767Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-08-01T08:37:39.108303Z","title":"Self-distilled reasoner: On-policy self-distillation for large language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.108303Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:0b47e6652d93f0556ce293a2c6872788c827fa4caf12f56b76e44a1eac888ec7","observation_id":"6b3533c6-7c45-4bc0-b478-f65f22b1b5b4","resolution":{"observed_at":"2026-08-01T08:37:39.108303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.165779Z","title":"Eemo-bench: A benchmark for multi-modal large language models on image evoked emotion assessment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.165779Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:b33962557137c223cf2856cafe2bee2effcf80d8956d04f27008cd7a2dda7982","observation_id":"96d0e448-e310-41eb-aa26-8ddddc9843e1","resolution":{"observed_at":"2026-08-01T08:37:39.165779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.240407Z","title":"Emocaliber: Advancing reliable visual emotion comprehension via confidence verbalization and calibration,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.240407Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:83821361b3e005f76bd21a18e5d9b821da89c7e2f6687c02d16bc52fa0f93aa3","observation_id":"e7d3b4f8-21e2-43ae-8bf4-2ec0a1f57300","resolution":{"observed_at":"2026-08-01T08:37:39.240407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.325316Z","title":"Customizing visual emotion evaluation for mllms: An open-vocabulary, multifaceted, and scalable approach,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.325316Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:10bf917531cc4934ce684a6fe79c03b763566a33e09baf783a9f5888edcb595d","observation_id":"0bb8fd32-0cef-4192-a79c-d8541a4c5e15","resolution":{"observed_at":"2026-08-01T08:37:39.325316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.382866Z","title":"The conditions of artificial general intelligence: Logic, autonomy, resilience, integrity, morality, emotion, embodiment, and embeddedness,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.382866Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:92c1db2c6d45b99d41a1cfeb5a1aa9c250e9c26250c0122bfa3c322aef648edb","observation_id":"b6529244-88ef-46e0-bb46-4c28940c0d16","resolution":{"observed_at":"2026-08-01T08:37:39.382866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.435596Z","title":"Emotional category data on images from the international affective picture system,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.435596Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:f0fa60cc74c5d0f763ecad78d938b2bd1e3112a60965cd454e115fbeb29daa91","observation_id":"77f27251-fad0-4228-8007-205962f69d6a","resolution":{"observed_at":"2026-08-01T08:37:39.435596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.501218Z","title":"Affective image classification using features inspired by psychology and art theory,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.501218Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:d0f5e52e3a4c51a61bd1af4a77ea959cdb0eaeda4dfc044c7ddb8e26a0bc7bc3","observation_id":"6536726c-9ad0-42be-9238-d8e2b313cda3","resolution":{"observed_at":"2026-08-01T08:37:39.501218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.554183Z","title":"LUCFER: A large-scale context-sensitive image dataset for deep learning of visual emotions,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.554183Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:37a4dfc40486d3040db14adb70c4309c891d9daa30da77f4caca290aca1eb282","observation_id":"62abdbc1-a400-464c-814f-252566b3287c","resolution":{"observed_at":"2026-08-01T08:37:39.554183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.629770Z","title":"Weakly supervised coupled networks for visual sentiment analysis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.629770Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:7ab0ee442801484938abacd57d808d93c07fcb366000cc9c268d0b535e6a20da","observation_id":"62a3f056-665a-4cb9-b02b-0c717d299831","resolution":{"observed_at":"2026-08-01T08:37:39.629770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.679046Z","title":"S2-ver: Semi-supervised visual emotion recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.679046Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:794faf335c493c644ebf939f8a99465cec567578f0fda46b8e81186f6956749f","observation_id":"3659bbbc-d6fd-4b03-b38e-336afb9c6dd3","resolution":{"observed_at":"2026-08-01T08:37:39.679046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.731904Z","title":"MDAN: multi-level dependent attention network for visual emotion analysis,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.731904Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:225d7c2d069d678e2ebe8fd8b9715508946f2e2ae876dee3baf58461d024f784","observation_id":"45f9af73-ef39-4395-9b41-d050f46b577d","resolution":{"observed_at":"2026-08-01T08:37:39.731904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.784798Z","title":"Pdanet: Polarity-consistent deep attention network for fine-grained visual emotion regression,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.784798Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:67ff35432f858090729c9d5d0e7dec4aad71d044969e3c6f76aedeacc8f750bc","observation_id":"23d20872-173f-4cc8-80d5-46bc05d3e017","resolution":{"observed_at":"2026-08-01T08:37:39.784798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:39.877233Z","title":"It is okay to not be okay: Overcoming emotional bias in affective image captioning by contrastive data collection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:39.877233Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:dbff4ab65b40c4136667828c3234188b41c57c91c221bebc281d92b028ec7f12","observation_id":"7635f20f-651d-4bab-92d3-495cb8775baa","resolution":{"observed_at":"2026-08-01T08:37:39.877233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.006914Z","title":"Probing sentiment-oriented pretraining inspired by human sentiment perception mechanism,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.006914Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:2f181bb56c1545a20c9d9469fc5bc50ad6a9499479b97be875803a652ea9f2b4","observation_id":"747744e8-7062-432a-ac09-fea1f5bf3577","resolution":{"observed_at":"2026-08-01T08:37:40.006914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.133485Z","title":"Bridging visual affective gap: Borrowing textual knowledge by learning from noisy image-text pairs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.133485Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:95bbc3079abeb865245896817aa3b1cb07973989dacefcdf760a0a15d8794c59","observation_id":"c6626622-e4a0-41ea-bad6-f9d97eeb2019","resolution":{"observed_at":"2026-08-01T08:37:40.133485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.214748Z","title":"Zero-shot emotion recognition via affective structural embedding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.214748Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:c1abd4ff4b54d5793bfe493e650de7d65d21550685d186cbfd1044d8659dd742","observation_id":"07572543-27fe-475e-b6cc-6592678f121b","resolution":{"observed_at":"2026-08-01T08:37:40.214748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.288276Z","title":"Affective embedding framework with semantic representations from tweets for zero-shot visual sentiment prediction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.288276Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:4ee3b34c0d4b16fed8af4e71e8c75f972182983fec79289afd3beef1f787d54d","observation_id":"69e05c98-d626-4970-b3c4-a8ee09af1924","resolution":{"observed_at":"2026-08-01T08:37:40.288276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.364762Z","title":"An empirical study on configuring in-context learning demonstrations for unleashing mllms’ sentimental perception capability,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.364762Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:cdbb40da8d0b424218ea25b41dcdf7e292eaf19512095692a7b06f5e1a994f0a","observation_id":"10b456e2-2b0b-4415-a8f4-802790728d76","resolution":{"observed_at":"2026-08-01T08:37:40.364762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.411515Z","title":"Mm-bigbench: Evaluating multimodal models on multimodal content comprehension tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.411515Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:3583fd4ca45a5eaa5cdf12e2eaee8e4579973546e9264e6ce51823328971f49f","observation_id":"ab268955-5315-4454-8303-0b5fdbe57fe2","resolution":{"observed_at":"2026-08-01T08:37:40.411515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.491272Z","title":"Facial affective behavior analysis with instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.491272Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:b4d577243bf1983b1edea05c0546209055cb912dabaaa6e5ba9d10fa7ec37d15","observation_id":"7dd5d731-c64b-4b5b-ad7f-9fb392961d48","resolution":{"observed_at":"2026-08-01T08:37:40.491272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04424","last_updated":"2026-04-27T06:21:20Z","snapshot_observed_at":"2026-07-31T22:21:13.872121Z","submitted_at":"2025-02-06T18:13:35Z","title":"EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04424","snapshot_observed_at":"2026-08-01T08:37:40.572636Z","title":"Emobench-m: Benchmarking emotional intelligence for multimodal large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.572636Z"},"links":{"cited_paper":"/paper/2502.04424","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:d23ae3d4d827239ab7a858cb2fbf3c00e2b211a7dc77a7eb01851b8294898e3a","observation_id":"afb2c2f2-d3aa-4417-9bb4-53fd490c70d7","resolution":{"observed_at":"2026-08-01T08:37:40.572636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.658438Z","title":"Emovit: Revolutionizing emotion insights with visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.658438Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:c1e7d4df39126e951bffb93a31bc679b9aefc5a2c4672ecb0816812d0258f840","observation_id":"3db65a36-ce5f-4380-af8a-1b38c5bd67da","resolution":{"observed_at":"2026-08-01T08:37:40.658438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06685","last_updated":"2025-08-13T07:28:43Z","snapshot_observed_at":"2026-08-20T08:13:18.679971Z","submitted_at":"2025-05-10T16:15:26Z","title":"Emotion-Qwen: A Unified Framework for Emotion and Vision Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06685","snapshot_observed_at":"2026-08-01T08:37:40.713175Z","title":"Emotion-qwen: A unified framework for emotion and vision understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.713175Z"},"links":{"cited_paper":"/paper/2505.06685","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:da8a546491b8e0431c1baa13c805bc46de2c03e8e17bd42d7665e11e1c86a817","observation_id":"fe362b4d-5186-4db9-a16b-cfacf28a8b6f","resolution":{"observed_at":"2026-08-01T08:37:40.713175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01173","last_updated":"2026-06-28T10:10:46Z","snapshot_observed_at":"2026-08-13T16:46:35.522461Z","submitted_at":"2026-02-01T11:49:26Z","title":"EEmo-Logic: A Unified Dataset and Multi-Stage Framework for Comprehensive Image-Evoked Emotion Assessment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01173","snapshot_observed_at":"2026-08-01T08:37:40.795075Z","title":"Eemo- logic: A unified dataset and multi-stage framework for comprehensive image-evoked emotion assessment,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.795075Z"},"links":{"cited_paper":"/paper/2602.01173","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:ea7729d263c70549eee82f1377124cf84c35f6f6ea04c882c0cc6924f389911f","observation_id":"a5a8199b-a40a-479b-93bc-d01a4498a431","resolution":{"observed_at":"2026-08-01T08:37:40.795075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.849413Z","title":"Emotion perception from a componential perspective,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.849413Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:536b765a57e544f4f2a4d3701de2378e3ac585bab0ff1347f8a223b952bbd9f6","observation_id":"a14066a9-0116-4961-aa6e-3bd944be79dc","resolution":{"observed_at":"2026-08-01T08:37:40.849413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.899581Z","title":"Toward label-efficient emotion and sentiment analysis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.899581Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:e6be39b3210944d5d430f693ac2b977442549c4f3920befdde2b6d63f1a2c061","observation_id":"aab431a3-7807-4bab-8654-4acb0892bf4c","resolution":{"observed_at":"2026-08-01T08:37:40.899581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:40.974301Z","title":"Emotion-llama: Multimodal emotion recognition and reasoning with instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:40.974301Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:1f28e2ef30dd045baf37ff4a299cbfed0c2f48f1592f3b5940c105296c1a9eb5","observation_id":"f10de8fd-218f-4307-81da-c232abd65745","resolution":{"observed_at":"2026-08-01T08:37:40.974301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-01T08:37:41.052772Z","title":"Hallucination of multimodal large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.052772Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:a7da8467cee731e143264381cc9343a1a291d3a581bd521e0c74ff5736d49c6b","observation_id":"cc48adbd-64c2-4d2d-89d7-692ed02e94c8","resolution":{"observed_at":"2026-08-01T08:37:41.052772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:41.178597Z","title":"Mm-safetybench: A benchmark for safety evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.178597Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:7eac1f1ba77827762442288b01432c25023576925f0d58938fb89f0d2f2a30f0","observation_id":"c9107052-5c28-45a6-8afa-08e8fa5f3a4f","resolution":{"observed_at":"2026-08-01T08:37:41.178597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-01T08:37:41.285996Z","title":"GPT-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.285996Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:337fd2c4e49e89f34fc99f51f28959095895698a049c44d9dd8e8e5acc801adb","observation_id":"bbed5a35-6205-478f-a120-310050860235","resolution":{"observed_at":"2026-08-01T08:37:41.285996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:41.403967Z","title":"Emobench: Evaluating the emotional intelligence of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.403967Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:c2345fc91b9d9d86a0e6555bb5fe0ebad21f72c9e5a08a8f4ac1f00518dd2307","observation_id":"18832989-a893-4dac-8396-ac27252748b0","resolution":{"observed_at":"2026-08-01T08:37:41.403967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:41.460452Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.460452Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:825785f812e419792fb7534ef3abc625cf6120dd8bf4b6ff445ff8ae88614ad2","observation_id":"a526cafb-e8f7-40df-b8ac-03800fd8ebe8","resolution":{"observed_at":"2026-08-01T08:37:41.460452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:41.500722Z","title":"Extracting moods from pictures and sounds: Towards truly personalized tv,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.500722Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:092aec451c81d9ba732cb5714c06f4b37f989936e3a27486f8786125e2864496","observation_id":"fb0fcc21-d295-4f5d-a936-16fed46242eb","resolution":{"observed_at":"2026-08-01T08:37:41.500722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:41.556177Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.556177Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:443d63936cb56ef7762cad0c0d59b0883d504f44a481398811550f8b136a2d73","observation_id":"9292849e-fc87-4847-abd9-6f5e8aa813c4","resolution":{"observed_at":"2026-08-01T08:37:41.556177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:41.644840Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.644840Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:fe139f06ab4b687e98c24137d55e8aea9228a2e0e0604c73dd38039d38e6eb85","observation_id":"cf0341ac-dda9-4070-8aaa-c278882987a7","resolution":{"observed_at":"2026-08-01T08:37:41.644840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01483","last_updated":"2024-11-15T06:31:44Z","snapshot_observed_at":"2026-08-19T00:16:42.047230Z","submitted_at":"2024-05-02T17:14:57Z","title":"MANTIS: Interleaved Multi-Image Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01483","snapshot_observed_at":"2026-08-01T08:37:41.734233Z","title":"MANTIS: interleaved multi-image instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.734233Z"},"links":{"cited_paper":"/paper/2405.01483","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:172c81dde2e2080c149279eebe66e80ce323de684ad857c9ce3bd4e5aaac6da0","observation_id":"5b147077-e396-49e5-b98c-eefccb23b204","resolution":{"observed_at":"2026-08-01T08:37:41.734233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04840","last_updated":"2024-08-13T08:10:32Z","snapshot_observed_at":"2026-08-16T23:01:47.789827Z","submitted_at":"2024-08-09T03:25:42Z","title":"mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04840","snapshot_observed_at":"2026-08-01T08:37:41.845892Z","title":"mplug-owl3: Towards long image-sequence understanding in multi-modal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:41.845892Z"},"links":{"cited_paper":"/paper/2408.04840","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:bda5fbc1615ae69e0e1581f2e071e0c8aa7feba19e6acb1028d3ae585b64f197","observation_id":"23b177a1-d927-4d62-913f-afada9d78050","resolution":{"observed_at":"2026-08-01T08:37:41.845892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12637","last_updated":"2024-08-22T17:47:24Z","snapshot_observed_at":"2026-08-18T01:32:03.254930Z","submitted_at":"2024-08-22T17:47:24Z","title":"Building and better understanding vision-language models: insights and future directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12637","snapshot_observed_at":"2026-08-01T08:37:42.020482Z","title":"Building and better understanding vision-language models: Insights and future directions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.020482Z"},"links":{"cited_paper":"/paper/2408.12637","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:728df29c84256d0ee409fa64aece956b9ca300be7422f915badb2c624d0add19","observation_id":"c636bb41-f0a3-415f-b6c6-15f95f16eeb9","resolution":{"observed_at":"2026-08-01T08:37:42.020482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-01T08:37:42.215833Z","title":"Phi-3 technical report: A highly capable language model locally on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.215833Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:139a294150b8eddb985359af32fa231e59d4c4e103e0c5d605eac711922daffd","observation_id":"96ded6bb-ebc5-4b1d-8b3d-a14efc2e7442","resolution":{"observed_at":"2026-08-01T08:37:42.215833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-01T08:37:42.330328Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.330328Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:16e61a0b93cd88eb98ab54580380edc7f394d7ec7401e1a8aa132db970ca28b8","observation_id":"577a5b85-5725-4e79-a24c-b8c17f85288b","resolution":{"observed_at":"2026-08-01T08:37:42.330328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-01T08:37:42.402559Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.402559Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:04a69d210f18b13839492197b2e78efaa5ef55deeefe6bdcdcfc3cb16d978327","observation_id":"77df96d4-d078-4c5a-b650-17c12f20363c","resolution":{"observed_at":"2026-08-01T08:37:42.402559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17146","last_updated":"2024-12-05T14:28:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-25T17:59:51Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17146","snapshot_observed_at":"2026-08-01T08:37:42.483019Z","title":"Molmo and pixmo: Open weights and open data for state-of-the-art multimodal models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.483019Z"},"links":{"cited_paper":"/paper/2409.17146","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:ef88939cca79edd27b53d241f59202fe06a1e95eb201c312bbcb6033bdd420db","observation_id":"ef0405c2-9e41-413c-b7e9-71406a9ff105","resolution":{"observed_at":"2026-08-01T08:37:42.483019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-01T08:37:42.558704Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.558704Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:be212ca37c8bb972b9f0800d7cb50894b0fbd0e8c29788c6d38966bf95c05408","observation_id":"b601f800-9c31-4b69-936f-fb789207a7b8","resolution":{"observed_at":"2026-08-01T08:37:42.558704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:42.633684Z","title":"Opencompass: A universal evaluation platform for foun- dation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.633684Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:00bd9ad16679240f8cd071ef65128f029992534b3a96e807511d11c869fcdcd8","observation_id":"80e648b0-f4d1-4531-a0d5-bd32c66c58b9","resolution":{"observed_at":"2026-08-01T08:37:42.633684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T08:37:42.712706Z","title":"Qwen3-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.712706Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:e3e9fca54c77043be4674f3ebff277e700f15bbd34201f8068251a75610557c9","observation_id":"9dd40f82-2304-4f37-8c94-b9b5c68241ba","resolution":{"observed_at":"2026-08-01T08:37:42.712706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:42.805176Z","title":"Emotionreasoner: Emotion-explanation-oriented reinforcement learning for explainable multimodal emotion recognition,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.805176Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:cebbd94b1c0267b93f898253f30aa759920d4c8048d89d0adb68fd9b011c6944","observation_id":"fd9c667b-8a4b-46d9-b7a7-6dd692fc1a04","resolution":{"observed_at":"2026-08-01T08:37:42.805176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T08:37:42.938066Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:42.938066Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:78db63196011651581508306360f733847e0a204a7023083bf1ffdc01b17181c","observation_id":"4696959d-604e-4d2a-b2dc-5345d5f9aba0","resolution":{"observed_at":"2026-08-01T08:37:42.938066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:43.108022Z","title":"Does reinforcement learning really incentivize reasoning capacity in llms beyond the base model?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.108022Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:9ccdf616301d1626598bb2a4e0e1fb14a473f148c287cf7142172e4bce68d0a0","observation_id":"6a8066ff-f41e-42d8-b4bd-6b3b034620c9","resolution":{"observed_at":"2026-08-01T08:37:43.108022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-19T16:22:29.898436Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-01T08:37:43.277598Z","title":"Deepseek-vl: Towards real-world vision-language understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.277598Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:7d62d52acf9cc88cf1b45950854da084bbc17a2f893cca455b8eba43a77a4024","observation_id":"0a6164ca-882e-4cb7-ad63-0db7b71f1f43","resolution":{"observed_at":"2026-08-01T08:37:43.277598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:43.373558Z","title":"Gemma 4: Byte for byte, the most capable open models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.373558Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:ec6600e50eb2f986e630c50d76ba484d2eaa6c766a3704f70a9274b28b5d01ef","observation_id":"254a4cb1-2498-4f6e-adf0-aee7592dae99","resolution":{"observed_at":"2026-08-01T08:37:43.373558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-01T08:37:43.456857Z","title":"Minicpm-v: A GPT-4V level MLLM on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.456857Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:c8ac7144c114f839060b9c7c52c4399fbaf8501d77cce5f2183edb65409bcf80","observation_id":"632858f7-64c5-47fc-8ac2-01ab8fb35f79","resolution":{"observed_at":"2026-08-01T08:37:43.456857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:43.619727Z","title":"Qwen3.6-27B: Flagship-level coding in a 27B dense model,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.619727Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:60f3dbab2b088237bb3fda6e0416c545d69b8654e0d47d0c2b6683fe783a73a0","observation_id":"f69b1674-2c8a-47f0-b883-0a324ca4d4f0","resolution":{"observed_at":"2026-08-01T08:37:43.619727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:43.698035Z","title":"Qwen2.5-vl,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.698035Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:72de4a09b1afc14de9550d210e6379960c34f4bf1196d90982400517addf1acc","observation_id":"858d0d0b-44f9-4411-83fa-4017f25f226d","resolution":{"observed_at":"2026-08-01T08:37:43.698035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-01T08:37:43.813433Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.813433Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:ff298ff74b847d55591bf63340d3139b71a16501c31a652f648f42a7e2446463","observation_id":"05ea3c08-6a94-4380-9f23-c523d9b32e34","resolution":{"observed_at":"2026-08-01T08:37:43.813433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-01T08:37:43.898948Z","title":"Glm-4.1 v-thinking: Towards versatile multimodal reasoning with scalable reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.898948Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:bd52ff31b627912b508a00534fcca82b8e6069ec69bf5c2491f9362d664a194f","observation_id":"6b6174af-2b43-457b-952a-5af006caf61b","resolution":{"observed_at":"2026-08-01T08:37:43.898948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03569","last_updated":"2025-06-04T04:32:54Z","snapshot_observed_at":"2026-08-19T14:19:04.114322Z","submitted_at":"2025-06-04T04:32:54Z","title":"MiMo-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03569","snapshot_observed_at":"2026-08-01T08:37:43.966698Z","title":"Mimo-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:43.966698Z"},"links":{"cited_paper":"/paper/2506.03569","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:2c6901e5f5e4d29685fb07afd4b9eb06f9a660bc3078e0d6ff2834f89c512a3d","observation_id":"bc403541-2b97-4b33-9b74-c58a6aa4d875","resolution":{"observed_at":"2026-08-01T08:37:43.966698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-01T08:37:44.050618Z","title":"Internvl3. 5: Advancing open-source multimodal models in versatility, reasoning, and efficiency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:44.050618Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:0257ac1856f94f3d77d86dfdbbb85e511cdf8df1e3aa16a787a3d067f2e15c1f","observation_id":"4b5d8498-8540-4788-8157-32fee6135f07","resolution":{"observed_at":"2026-08-01T08:37:44.050618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-08-12T00:25:39.214406Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-08-01T08:37:44.159549Z","title":"Kimi k2.5: Visual agentic intelligence,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:44.159549Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:4ed925e6c4aafab5308a21229b9e4edb77e70efeb688cd5ef48a134031781dd8","observation_id":"85603fbc-be75-4a2b-a13e-aacd896f35f4","resolution":{"observed_at":"2026-08-01T08:37:44.159549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:44.246430Z","title":"Minicpm-v 4.5: Cooking efficient mllms via architecture, data, and training recipe,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:44.246430Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:f8004f5c518d10b6575a4da26d4852e753681ed0b3d6c8f3909d3e8c212118d7","observation_id":"96d10c62-334a-47dd-9ac2-10c5f4e83e5f","resolution":{"observed_at":"2026-08-01T08:37:44.246430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:37:44.308241Z","title":"Qwen3.6-plus: Towards real world agents,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:44.308241Z"},"links":{"citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:2bcc5ce66d0eecddb224be7a4a4f27032af6223f80f4cd4d9773e0055530a2f7","observation_id":"5027bcaf-d7b4-4a88-bb89-a1844023b266","resolution":{"observed_at":"2026-08-01T08:37:44.308241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25979","last_updated":"2026-05-25T15:54:04Z","snapshot_observed_at":"2026-08-20T03:23:18.251450Z","submitted_at":"2026-05-25T15:54:04Z","title":"LLaVA-OneVision-2: Towards Next-Generation Perceptual Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25979","snapshot_observed_at":"2026-08-01T08:37:44.391888Z","title":"Llava-onevision-2: Towards next-generation perceptual intelligence,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:44.391888Z"},"links":{"cited_paper":"/paper/2605.25979","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:a79834fa6757a7b14412fefdfe669ab5053010f0c7eb5b47af13bca9f78b086f","observation_id":"a1c55d83-6932-4859-8cb1-43d89de6ded3","resolution":{"observed_at":"2026-08-01T08:37:44.391888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-01T08:37:44.462596Z","title":"Gemma 3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:44.462596Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.21061"},"observation_digest":"sha256:69fb0ae357dad5e001a6d429ba5230bd5f80bc282d6ea7c2e7f0c94949e91088","observation_id":"276c7f29-bbe0-4e45-a9d5-51bd9693e403","resolution":{"observed_at":"2026-08-01T08:37:44.462596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.21061","last_updated":"2026-07-23T08:52:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T09:54:49.355937Z","submitted_at":"2026-07-23T08:52:11Z","title":"MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement Judgement"},"reference_resolution":{"displayed":86,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":86,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":86},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 86 of 86 outbound references and 0 inbound Pith citation observations for arXiv:2607.21061."}