{"as_of":"2026-08-12T05:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c6ab428c73e77b2061cd53458b9fbc3997055cbf6e09a5c1e298214881951d36","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T08:14:28.540629Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:05:40.089637Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T00:07:28.429968Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-08-05T23:05:40.089637Z","title":"Uniemo: Unifying emotional understanding and generation with learnable expert queries,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06063","last_updated":"2025-08-08T06:52:54Z","snapshot_observed_at":"2026-08-11T19:02:13.731514Z","submitted_at":"2025-08-08T06:52:54Z","title":"Distribution-Specific Learning for Joint Salient and Camouflaged Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T23:05:40.089637Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2508.06063"},"observation_digest":"sha256:2f056291a0c06a9391dbded28c4106123a6cc8bc6ba286bdf0a07b943e3a3d9b","observation_id":"46eb64f4-f18f-4a7c-a46f-ed42b9c73369","resolution":{"observed_at":"2026-08-05T23:05:40.089637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-15T12:40:55.565397Z","title":"Uniemo: Unifying emotional understanding and generation with learnable expert queries,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-05T23:30:45.811710Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-15T12:40:55.565397Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2603.08387"},"observation_digest":"sha256:9aeb34daa5324b833775c220419eb71d9e50b759b45522a0692eca10750a4b23","observation_id":"6b4c9a17-4a4e-4222-84c6-41415419ad08","resolution":{"observed_at":"2026-07-15T12:40:55.565397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":"2507.23372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-03T00:07:28.429968Z","title":"Uniemo: Unifying emotional understand- ing and generation with learnable expert queries","venue":"cs.CV","work_id":"a8f47ee9-42f3-491f-86bc-d3fc5e6669fc","year":2025},"citing_paper":{"arxiv_id":"2604.12735","last_updated":"2026-08-05T08:52:46Z","snapshot_observed_at":"2026-08-09T03:20:26.673676Z","submitted_at":"2026-04-14T13:49:19Z","title":"AffectAgent: Collaborative Multi-Agent Reasoning for Retrieval-Augmented Multimodal Emotion Recognition","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T15:21:42.285340Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2604.12735"},"observation_digest":"sha256:00ba2d0c8707fbe24a5895bf74132b6d8472da6d6eed03cf7274d41301ae1093","observation_id":"82c12f65-ba25-46cc-b36c-e18ed8851e0e","resolution":{"observed_at":"2026-05-25T03:01:05.604397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":"2507.23372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-03T00:07:28.429968Z","title":"Uniemo: Unifying emotional understand- ing and generation with learnable expert queries","venue":"cs.CV","work_id":"a8f47ee9-42f3-491f-86bc-d3fc5e6669fc","year":2025},"citing_paper":{"arxiv_id":"2605.05126","last_updated":"2026-05-06T16:55:44Z","snapshot_observed_at":"2026-07-06T23:17:48.161262Z","submitted_at":"2026-05-06T16:55:44Z","title":"ConsisVLA-4D: Advancing Spatiotemporal Consistency in Efficient 3D-Perception and 4D-Reasoning for Robotic Manipulation","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-08T16:40:19.057979Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2605.05126"},"observation_digest":"sha256:0a661b23fc6403ce7452c59b87f853a43595ce86afa8f17d37b9ec4e5994f1ef","observation_id":"938aef85-3764-4a39-a0e5-96f2d9d3e00b","resolution":{"observed_at":"2026-05-25T03:01:05.604397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":"2507.23372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-03T00:07:28.429968Z","title":"Uniemo: Unifying emotional understand- ing and generation with learnable expert queries","venue":"cs.CV","work_id":"a8f47ee9-42f3-491f-86bc-d3fc5e6669fc","year":2025},"citing_paper":{"arxiv_id":"2605.18884","last_updated":"2026-05-16T10:04:48Z","snapshot_observed_at":"2026-08-01T06:16:30.439623Z","submitted_at":"2026-05-16T10:04:48Z","title":"Navigating the Emotion Tree: Hierarchical Hyperbolic RAG for Multimodal Emotion Recognition","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-20T15:55:57.330888Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2605.18884"},"observation_digest":"sha256:d4af3d456d4e829501de8e8266407a8d16387b198bd95a5064b3f3cee41565a8","observation_id":"9f3e024b-052e-4b4b-8f2e-4244a81e65ae","resolution":{"observed_at":"2026-05-25T03:01:05.604397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":"2507.23372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-03T00:07:28.429968Z","title":"Uniemo: Unifying emotional understand- ing and generation with learnable expert queries","venue":"cs.CV","work_id":"a8f47ee9-42f3-491f-86bc-d3fc5e6669fc","year":2025},"citing_paper":{"arxiv_id":"2605.26421","last_updated":"2026-05-26T01:20:18Z","snapshot_observed_at":"2026-08-05T18:52:32.523775Z","submitted_at":"2026-05-26T01:20:18Z","title":"HydraPrompt: An Adaptive and Asymmetric Framework of Vision-Language Models for Synthetic Image Detection","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-29T18:51:53.451225Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2605.26421"},"observation_digest":"sha256:dfcd0bf06362a32ca4ea70c1503893e3f8f1cde28dd3146cd45a1217a13b581a","observation_id":"04bd2cd2-272c-4f72-ab28-a690df6004a6","resolution":{"observed_at":"2026-06-29T18:53:51.136964Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":"2507.23372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-03T00:07:28.429968Z","title":"Uniemo: Unifying emotional understand- ing and generation with learnable expert queries","venue":"cs.CV","work_id":"a8f47ee9-42f3-491f-86bc-d3fc5e6669fc","year":2025},"citing_paper":{"arxiv_id":"2606.09641","last_updated":"2026-06-08T15:36:15Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:36:15Z","title":"MAVIS: Multi-Agent Video Retrieval via Structured Video Understanding","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-27T17:27:32.615336Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2606.09641"},"observation_digest":"sha256:d58c8a3f4993a252c9008b12a6980fb271167b20854e9654a4af643d4f1c1897","observation_id":"e2b2265e-4c7a-4363-9afc-0c031d03ce62","resolution":{"observed_at":"2026-07-03T00:07:28.431227Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":"2507.23372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-07-03T00:07:28.429968Z","title":"Uniemo: Unifying emotional understand- ing and generation with learnable expert queries","venue":"cs.CV","work_id":"a8f47ee9-42f3-491f-86bc-d3fc5e6669fc","year":2025},"citing_paper":{"arxiv_id":"2606.28266","last_updated":"2026-06-26T16:57:40Z","snapshot_observed_at":"2026-08-08T11:04:24.327657Z","submitted_at":"2026-06-26T16:57:40Z","title":"RSICCLLM: A Multimodal Large Language Model for Remote Sensing Image Change Captioning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-29T04:09:32.397341Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2606.28266"},"observation_digest":"sha256:1b7ce10fbc82df8789c6d1b48460cfe91d3de72b1d570135f8130aed68f77145","observation_id":"62c64097-752f-491f-9776-6c38c06f7746","resolution":{"observed_at":"2026-07-01T17:05:51.415036Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-08-02T04:39:27.176697Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-09T21:37:18.308785Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:27.176697Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:63cc09171d6986c97fefb14046f0dbed090c0c06a0aa2538c15025615820d370","observation_id":"423c5ced-3169-4a71-8d84-f3d355418a2c","resolution":{"observed_at":"2026-08-02T04:39:27.176697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23372/citation-record","integrity":"/paper/2507.23372/integrity","json":"/paper/2507.23372/citation-record.json","paper":"/paper/2507.23372"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video ecommerce++: Toward large scale online video advertising","venue":null,"work_id":"e8b82a69-0953-40ae-84b5-c9dc35d27ca5","year":2017},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:f038c6f9f3b873b060b133e743f0c1e4c0ac01afe6d2f5a57dd63e777db10d8f","observation_id":"12a9940a-7bc3-4ab9-a0b5-9e9adb36fef3","resolution":{"observed_at":"2026-05-25T08:15:34.654165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video2shop: Exact matching clothes in videos to online shopping images","venue":null,"work_id":"b1ed8f93-e925-4f80-b522-7363f27750a7","year":2017},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:fd55c3abc21db25b9ca8786098871875f00c1b51c00c1f648583e47f579e62f7","observation_id":"17b3f935-b127-4ea5-9229-87fbdb06cd43","resolution":{"observed_at":"2026-05-25T08:15:34.665075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Detecting and grounding multi-modal media manipulation and beyond","venue":null,"work_id":"01016928-ecec-47ab-8287-45c3d18a670b","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:89dd01c97137650563bd0bbf267422a5b443f2508a7c24c6bbbc495acf65f8b2","observation_id":"348a013d-c6b4-45b0-a4f8-89b7b4bfcc58","resolution":{"observed_at":"2026-05-25T08:15:34.678831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Detecting and grounding multi-modal media manipulation","venue":null,"work_id":"2cdaeb5f-773a-41cd-bc66-39499409ba5c","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:052388f05da8173e0ce28e66e68069bd36e61350c2c507a78f50d55c286245f0","observation_id":"3187bffa-b7f0-4dab-a8cb-602ba2489e0d","resolution":{"observed_at":"2026-05-25T08:15:34.643429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-adversarial discriminative deep domain generalization for face presentation attack detection","venue":null,"work_id":"55a7405f-ccfa-43da-bdac-71178a0c3345","year":2019},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:4380c1e730b5f02edad84b279ee87bea51f6eb91ada64d96b482f8b1e9b81cf0","observation_id":"e4d5a794-02d8-4984-8d43-59a09e6253e2","resolution":{"observed_at":"2026-05-25T08:15:34.647645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotion recognition, emotion expres- sion, and cultural display rules: Implications for counseling","venue":null,"work_id":"83b93b2c-5b9b-4c4a-9aa9-eb32d8cc6077","year":2017},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:a6c9c21dd9479d62ca6ea0ed3e07d5c878a9e9221c251f79a8a43b6c406da124","observation_id":"5e68040f-2a1f-4bd4-81fa-d7060b7d643f","resolution":{"observed_at":"2026-05-25T08:15:34.698768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stimuli-aware visual emotion analysis","venue":null,"work_id":"9b0ddbe9-4897-40ce-beb5-21320e1af73b","year":2021},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:c826444588a82b3a42df9e6bf9ce8a4d83da75898969e68c88a32214dbfe7980","observation_id":"dae332ce-0c5c-405c-a519-a0661953488f","resolution":{"observed_at":"2026-05-25T08:15:34.702796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Puma: Layer-pruned language model for efficient unified multimodal retrieval with modality-adaptive learning","venue":null,"work_id":"682a40dc-7757-4a62-829f-e649911e5cd1","year":2025},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:49ed0a0a2629f1b956bf162d21ffbd9d49d652407638f1c229f44d1cc86c55b3","observation_id":"cd85ff1a-d871-4e69-9ed6-a66910c5a1a1","resolution":{"observed_at":"2026-05-25T08:15:34.661326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Analyzing emotional semantics of abstract art using low-level image features","venue":null,"work_id":"f9f6ec99-7d2c-4ebd-8b2b-b1126dc0e444","year":2011},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:07ca0a574ed2d1ddeedb15c86bc4bb6a447756e552b79fa0e856fb851926cf0e","observation_id":"1757a2a3-d453-49ca-ad17-56d287944610","resolution":{"observed_at":"2026-05-25T08:15:34.685165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning deep features for image emotion classification","venue":null,"work_id":"bfb58cbb-62b0-4cdb-b4ed-9487d4beb28b","year":2015},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:60572a0b14d4e4805fdc7128b1070a435f3da34770bf5dd6811175de4a29730a","observation_id":"2049ea16-991d-465e-94d0-89b8c8448878","resolution":{"observed_at":"2026-05-25T08:15:34.682077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dependency exploitation: A unified cnn-rnn approach for visual emotion recognition","venue":null,"work_id":"1198ce80-dec4-4cb2-8b36-f40af171b710","year":2017},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:c28375753298cd9d97f8de7cdc5c40e35a2b47b73e3a2b7566d6fff31d89ac01","observation_id":"1f513863-471f-471a-b37c-7e93e2237df8","resolution":{"observed_at":"2026-05-25T08:15:34.626137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring discriminative representations for image emotion recognition with cnns","venue":null,"work_id":"33ff3179-348d-435e-b0aa-38e4e83c3601","year":2020},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:e999ba95c53e06ff272db7cc52255cc15fea9a00e2fc000d7a236d64735f2cf1","observation_id":"7486d13a-780f-44cb-86ec-ee6174f57905","resolution":{"observed_at":"2026-05-25T08:15:34.636705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotion recognition based on con- volutional neural network (cnn)","venue":null,"work_id":"a77a92cb-50a9-456b-b2b2-5c1d2e238ad6","year":2021},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:de8c9b3374a3ada3a674c82ce36cbbf004e3029f44cfa19d78d77d8a0797b332","observation_id":"38415777-558e-4fac-8e93-be330cdf5e5c","resolution":{"observed_at":"2026-05-25T08:15:34.616586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solver: Scene-object interrelated visual emotion reasoning network","venue":null,"work_id":"97826cb0-4983-4c8b-b8c9-cc503952e6d6","year":2021},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:a30722d47277bd600df25cff3f02a2a42effbe5ae934432807fb2dfe178235b0","observation_id":"7e4e5621-13f4-4741-8758-dbdbf817130c","resolution":{"observed_at":"2026-05-25T08:15:34.619642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13419","last_updated":"2025-05-19T17:52:15Z","snapshot_observed_at":"2026-08-07T15:42:59.550991Z","submitted_at":"2025-05-19T17:52:15Z","title":"FEALLM: Advancing Facial Emotion Analysis in Multimodal Large Language Models with Emotional Synergy and Reasoning","version":1},"cited_work":{"arxiv_id":"2505.13419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.13419","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feallm: Advancing facial emotion analysis in multimodal large lan- guage models with emotional synergy and reasoning","venue":null,"work_id":"c9b98cef-bd83-4ff2-b33d-3a1834ca9ce0","year":2025},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2505.13419","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:5d21ddb171c2901084baeddfb89dd3e27f12cd6109cc6e14d6b1691b3d40d46b","observation_id":"6cf53597-60b2-4fcc-9220-84b9074dd751","resolution":{"observed_at":"2026-05-25T08:15:33.733202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:a99f148527680d9fdc1ef455d6583422bdf690edff02349dbf6bf0fe9c283887","observation_id":"fba297d8-0284-4eb3-b08e-0420b3fcaf41","resolution":{"observed_at":"2026-05-25T08:15:33.728143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Current state of text sentiment analysis from opinion to emotion mining","venue":null,"work_id":"3804c6be-c602-4b40-a014-530fc21dc186","year":2017},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:7450b8da63a1ad7ce00b59ee24410da59c8d1daf66d8436fa1004a3fe9456d52","observation_id":"aaf95344-e06f-4925-827d-d7631e85184e","resolution":{"observed_at":"2026-05-25T08:15:34.611753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conceptualizing emotion in healthcare interpreting: A normative approach to interpreters’ emotion work","venue":null,"work_id":"2d38f8a7-e3c2-41b8-8db2-109fa865705e","year":2015},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:5c311afaf7171b1b31be1241fe63404866d24a8bf41898fe6b0ca4dc1bb9543f","observation_id":"d7b15c0d-632f-4829-9caa-0c68f7ceb246","resolution":{"observed_at":"2026-05-25T08:15:34.622896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to prompt for vision-language emotion recognition","venue":null,"work_id":"1440f0a2-4044-43a5-9a55-fc35d8098c74","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:d50362f09bba3c3873e635010299261804538fc99a29fe34f58b45a100bd5ab2","observation_id":"6825fcb2-3dba-4a2b-960c-ad28b048feb1","resolution":{"observed_at":"2026-05-25T08:15:34.629740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"08fdfea8-820f-4129-96cf-f76cdbaf2d16","year":2020},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:2a2d37f9f475012450f0d9681d5c1bf73f5e546bc813fec50d4e1d11851f8fba","observation_id":"864340f7-19e7-4eeb-87f1-83ea13d07725","resolution":{"observed_at":"2026-05-25T08:15:34.590482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":"0a567407-9d09-4093-b6c9-6f2e6a6cccb0","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:4274dcba8e99cf5c61c843c830889e093383b68f8c779f4c5fb6a8054ac82d55","observation_id":"c4c1b2d0-569b-4e98-a706-380101b7a904","resolution":{"observed_at":"2026-05-25T08:15:34.605423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"4ee96690-0f6a-4543-95ad-24885b259245","year":2021},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:64abe69dd34493e7224e48cacc1c237d30d90b6612cf7f9c53a9bfd52d6ac074","observation_id":"8caeec0c-9dd9-4d75-b1d3-11b3937ff35d","resolution":{"observed_at":"2026-05-25T08:15:34.583193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"a38e213a-d055-4dc9-b015-6094b277326e","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:2046193b60240bc1b3f4c5b7270eb95573a48aa9da894dd8377471f5325d3fa6","observation_id":"8904197c-d75a-4c4d-9809-30bd9b7f07d6","resolution":{"observed_at":"2026-05-25T08:15:34.651117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject- driven generation","venue":null,"work_id":"d18c693f-b0b7-47fa-a6f3-d4f4c7023d67","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:2d711acf008cfe678febf3d21ba7269ee969d872268f08dfdccf7fb582232b7b","observation_id":"a95d3a25-a5d3-4d83-86b9-d330ca4c59e8","resolution":{"observed_at":"2026-05-25T08:15:34.598295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":"2408.12528","doi":"10.48550/arxiv.2408.12528","metadata_source":"pith","pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","venue":"cs.CV","work_id":"1393dc24-a6b2-44e1-b5d7-7009d1fa4811","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:d111efc02e2427c4658dacf94886a2e375752be517be3d90d9a8be78cef66b77","observation_id":"2e157aee-46b1-43c9-9921-3b2691182f03","resolution":{"observed_at":"2026-05-25T08:15:33.820444Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-11T01:34:46.484513Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":"2408.11039","doi":"10.48550/arxiv.2408.11039","metadata_source":"pith","pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","venue":"cs.AI","work_id":"c2bb4d2d-29de-4bf2-9150-3d6373ff358f","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:d2720d6fb66125d1eac34ea18951cac914b2fa1b929d5ae76e446b27dfdc505e","observation_id":"d63cd886-ceeb-4a76-a5c6-06a928e9f5dc","resolution":{"observed_at":"2026-05-25T08:15:33.779246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":"2409.04429","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-07-04T13:39:51.496167Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","venue":"cs.CV","work_id":"7039c3ef-6ce4-4c98-96ed-9eef3d669045","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:8e4d0521bebca842e5657b62644304a192e4020dea9cc0b72bd8c3601527dab8","observation_id":"39f5d095-9ecc-4143-a787-63ec09fbc0fb","resolution":{"observed_at":"2026-05-25T08:15:33.755199Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:ce8b0cddcd9f1d661f7b64e418c604d8c826421914085a5d428ac07730cfbefe","observation_id":"73501d3b-35e9-4268-a1ef-19ed8faefc6b","resolution":{"observed_at":"2026-05-25T08:15:33.784216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17576","last_updated":"2024-10-24T01:41:35Z","snapshot_observed_at":"2026-08-03T22:23:33.394349Z","submitted_at":"2024-09-26T06:46:40Z","title":"ID$^3$: Identity-Preserving-yet-Diversified Diffusion Models for Synthetic Face Recognition","version":2},"cited_work":{"arxiv_id":"2409.17576","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17576","snapshot_observed_at":"2026-07-01T19:16:01.214037Z","title":"ID3: Identity-Preserving-yet-Diversified Diffusion Models for Synthetic Face Recognition","venue":null,"work_id":"37fb71bd-5fdd-459e-aad2-212c9c564546","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2409.17576","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:a365ec9d750027d75d35296d82743667df3a11e5e8f10ff185d2f43ca9f528c1","observation_id":"0182876c-4d3a-421f-8f4f-ab1cac12fcc7","resolution":{"observed_at":"2026-05-25T08:15:33.816084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20171","last_updated":"2024-08-24T03:55:36Z","snapshot_observed_at":"2026-08-10T09:18:56.212969Z","submitted_at":"2024-07-29T17:00:09Z","title":"Diffusion Feedback Helps CLIP See Better","version":4},"cited_work":{"arxiv_id":"2407.20171","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20171","snapshot_observed_at":"2026-06-30T18:35:00.333248Z","title":"Diffusion feedback helps clip see better","venue":null,"work_id":"701de9c9-ca15-407e-b2e2-1911f7c02361","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2407.20171","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:4a2f37f67c646d4236a86e6056057f83bc60171d329a717f3bde6ee93ecb5cc9","observation_id":"3e5152e5-be19-46c1-8865-c4cae63d06f4","resolution":{"observed_at":"2026-05-25T08:15:33.749874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual objects in context","venue":null,"work_id":"94c966e0-a51b-420b-989c-2beb15bbff12","year":2004},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:09ad855f8c72bece0cd3e98b7a77cea22c1887ba7f44c3b6d729d5d106705d4a","observation_id":"82e5ac2d-e5d6-484d-8714-16ce139fa071","resolution":{"observed_at":"2026-05-25T08:15:34.675360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotion experience and its varieties","venue":null,"work_id":"cfa473e8-9c75-4cf2-9548-6061ab1556cc","year":2009},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:d6f67241c6afd4ad332e23e2d521bba0cfbbb93c37ceb9143a332493f543322b","observation_id":"a6d39248-f38b-47fe-95fa-92955f203250","resolution":{"observed_at":"2026-05-25T08:15:34.727752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affective image content analysis: Two decades review and new perspectives","venue":null,"work_id":"18c7b814-c2af-4f01-9e69-1fb5cbc0372b","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:89def29c3d8f4ee3d84967051d256c61c81923d3a01f7876ecfafad21c6813b9","observation_id":"0285bb33-20f4-4190-aaf1-ac5d2f29ab44","resolution":{"observed_at":"2026-05-25T08:15:34.734998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fuzzy similarity-based emotional classification of color images","venue":null,"work_id":"3f490e96-27a2-49ec-bcf1-f464c44e7ba9","year":2011},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:e576478d7d4c603b284a616c5c96fb3ae0a00455e7163e244e05c45f6a53ac48","observation_id":"1ca84303-5089-4bf1-b2b7-0161f9026c85","resolution":{"observed_at":"2026-05-25T08:15:34.710842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large-scale visual sentiment ontology and detectors using adjective noun pairs","venue":null,"work_id":"73449fd5-3f20-439a-b291-3112eb16718b","year":2013},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:96ce2ee44e9c1bb6d673eafecb3a7bfe2ac57f7256291085e67831576e5b745f","observation_id":"4c6e23b8-a323-42ba-a319-17e6c6c8a44f","resolution":{"observed_at":"2026-05-25T08:15:34.714172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3951.187396","doi":"10.1145/1873951.1873965","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Affective image classification using features inspired by psychology and art theory","venue":null,"work_id":"db51afc5-1f39-4033-bbf2-e4c895701f93","year":2010},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:230b0c38454698b03ac7f42fd1f56f91de9591306147fd7238edff40851c6068","observation_id":"4ebe6cd8-029c-4024-8fcd-44411f273b34","resolution":{"observed_at":"2026-05-25T08:15:33.214456Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mdan: Multi-level dependent attention network for visual emotion analysis","venue":null,"work_id":"8970532b-2ab9-4666-aa57-8388db967694","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:d2443e10accb4a63ad156de7d8b71db58c403c1ffd6a43518500ec88647d0f39","observation_id":"47d24f12-4fb5-4c6f-b342-01ae1991b38b","resolution":{"observed_at":"2026-05-25T08:15:34.691886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning multi-level deep representations for image emotion classification","venue":null,"work_id":"2982f227-651e-4ca8-a654-096e458a9265","year":2043},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:1a8caa4eca516a380c30fdba7f03bf18299db493bb160f1028da559f5e90add1","observation_id":"cee8f6e3-e1ee-437f-8032-fcded0469aec","resolution":{"observed_at":"2026-05-25T08:15:34.707303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.105245","doi":"10.1016/j.knosys.2019.105245","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Object semantics sentiment correlation analysis enhanced image sentiment classification","venue":"Knowledge-Based Systems","work_id":"0a1aefee-18c2-4b47-98c0-5b9b216b6f09","year":2020},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:cdc56b69861d033af36e404683817c737a6b0ccca2750dbb71679e7499c87602","observation_id":"95763c53-fdd0-414f-b336-013701bd7931","resolution":{"observed_at":"2026-05-25T08:15:33.195751Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sentibank: large-scale ontology and classifiers for detecting sentiment and emotions in visual content","venue":null,"work_id":"c9ffb8bc-2539-4458-a8b6-8241e5224d17","year":2013},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:5346a1b75150fc8beb5ee259880678eca78c0b2940f88d7edf2636783c221b09","observation_id":"1787336f-b303-4d65-a09c-c4273d744934","resolution":{"observed_at":"2026-05-25T08:15:34.688618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1783.361218","doi":"10.1145/3581783.3612186","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Progressive visual content understanding network for image emotion classification","venue":null,"work_id":"a25b06f8-bb5f-4a82-adc4-d19c84951f3a","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:a823539df41b2b8eddb7800f6e5f38cf511e8a9cc0cad0c72f4afbc6846071e6","observation_id":"875800a4-59fb-4abd-b6c6-79697728b068","resolution":{"observed_at":"2026-05-25T08:15:33.221581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":"2112.10741","doi":"10.48550/arxiv.2112.10741","metadata_source":"pith","pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","venue":"cs.CV","work_id":"34430d19-7919-48ce-88a5-17b3bfe2192e","year":2021},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:f3d6957f9209a45a189ae13ef417e5aa53c91f903fcbd531919ee917c94ebdb9","observation_id":"b9c86b73-0fa9-46f3-a39c-8159a4e8c789","resolution":{"observed_at":"2026-05-25T08:15:33.810760Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-21T20:52:26.23702+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T20:52:26.23702+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:38ea4a785cd3dec41742d8ba5800dc66067a7380a1143fbdb7f204524abc2b28","observation_id":"1c73d9bd-d5d4-4506-a771-281d1f9a8406","resolution":{"observed_at":"2026-05-25T08:15:33.805270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:40b4173b16af9d1b51fb217b7e42c02ac8314c96196df15223d599ed5bb8f4dc","observation_id":"b494398e-e282-4e35-87d9-2f46d17112af","resolution":{"observed_at":"2026-05-25T08:15:33.760443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"21c2d0d5-84be-485a-bf24-e70cd06b54b2","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:1e5e2dd5f997cef0a95d4b4f332edb35fd32c2b3c7bace92ce6f050d65da9478","observation_id":"d207cf68-cab3-4343-9598-d1d997e41862","resolution":{"observed_at":"2026-05-25T08:15:34.657832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Text to image generation with semantic-spatial aware gan","venue":null,"work_id":"a09d5b80-7dd3-4588-bfb4-f8cc5e88f139","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:951ce743d7df35252aafdb8ee38d4ef0e602c6b8f82ef34d5e65c04c9c6aa501","observation_id":"284b6e6b-8113-4d34-8a83-36f7e2b1bbf3","resolution":{"observed_at":"2026-05-25T08:15:34.633244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":"2208.01618","doi":"10.48550/arxiv.2208.01618","metadata_source":"pith","pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","venue":"cs.CV","work_id":"ca618c21-3ba6-448e-bd86-bcecff3cdeb5","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:0f8cc981fc7829efbf25c1ee3d7c5911bcf74d56434a54542bd4c94270b14c9b","observation_id":"6f2be06e-99a8-4d63-b675-9b0dca0dbd9b","resolution":{"observed_at":"2026-05-25T08:15:33.800377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi- concept customization of text-to-image diffusion","venue":null,"work_id":"444b219b-3e90-4931-b724-830d6a568f55","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:e8b06e037c82c5359f1718adeca13054c5367472c8adb66a4d64957676892185","observation_id":"c5a39c19-d956-4e01-b84b-d7ad537db79d","resolution":{"observed_at":"2026-05-25T08:15:34.602088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"dd9c4bb7-4f32-4ce9-88bb-ef658a138450","year":2021},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:89fe5a2c4305d3ddc67edfb5ce7207be7abb50b3bb884335cd8c9f553fefdfba","observation_id":"1b8396b8-a648-4c16-a223-022d432ee2e8","resolution":{"observed_at":"2026-05-25T08:15:34.586674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13848","last_updated":"2023-08-18T17:12:13Z","snapshot_observed_at":"2026-08-04T02:07:54.822320Z","submitted_at":"2023-02-27T14:49:53Z","title":"ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2302.13848","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.13848","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elite: Encoding visual concepts into textual embeddings for customized text-to-image generation","venue":null,"work_id":"0f52104e-2d64-4f37-a7f8-e9a44c02d75f","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2302.13848","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:4f14744bfe131da2de103a0a156c5f3551d9e16b0223a38cf0ca3e3bf2533bc6","observation_id":"b423358a-2ed6-4ab7-b5d2-9d8f889729f1","resolution":{"observed_at":"2026-05-25T08:15:33.744173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12661","last_updated":"2025-06-18T08:17:51Z","snapshot_observed_at":"2026-07-06T18:17:12.404441Z","submitted_at":"2024-05-21T10:18:45Z","title":"EmoEdit: Evoking Emotions through Image Manipulation","version":3},"cited_work":{"arxiv_id":"2405.12661","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.12661","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emoedit: Evoking emotions through image manipulation","venue":null,"work_id":"fe82d448-de9d-444d-80fe-8924105da773","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2405.12661","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:33232238f36a9b7bea790d740b313909fde91fe4c8dd5dedd0467c6f0ffa61d7","observation_id":"c24d1ae9-840d-4823-b163-60222d1f2117","resolution":{"observed_at":"2026-05-25T08:15:33.795713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotionprompt: Leveraging psychology for large language models enhancement via emotional stimulus (nd). retrieved 1 august 2023","venue":null,"work_id":"32c8cb33-d768-4e5a-af9f-bbb839e31668","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:08b8a68bedaaed5c188f9b4d0194fc12ad613a7560911f288a0e02a27705e088","observation_id":"84ff5ca4-5dfb-4308-87ee-5b935f295505","resolution":{"observed_at":"2026-05-25T08:15:34.575591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.05710","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emoticrafter: Text-to-emotional-image generation based on valence-arousal model","venue":null,"work_id":"00136ac9-3924-4315-924c-4a780b09a1a0","year":2025},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:469aeb58dde95a52d2237f0fd89825d2f9872ffff892ccb3c231857fd4fd2ab3","observation_id":"50666677-6d49-495f-90aa-7088ddf6a6eb","resolution":{"observed_at":"2026-05-25T08:15:33.766329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16297","last_updated":"2025-06-30T12:24:33Z","snapshot_observed_at":"2026-08-10T13:32:23.382061Z","submitted_at":"2025-01-27T18:36:10Z","title":"FALCON: Resolving Visual Redundancy and Fragmentation in High-resolution Multimodal Large Language Models via Visual Registers","version":2},"cited_work":{"arxiv_id":"2501.16297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16297","snapshot_observed_at":"2026-06-29T23:14:01.665133Z","title":"Fal- con: Resolving visual redundancy and fragmentation in high-resolution multimodal large language models via visual registers","venue":null,"work_id":"5bf9f96f-4554-4d68-9347-6ea2a87a3960","year":2025},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2501.16297","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:90ec37d6fb8d89bdb98a85f2db8026c21dd705664807ccb1f24331138122ce9d","observation_id":"1e720cc7-46b5-45e6-8500-60bd9775742e","resolution":{"observed_at":"2026-05-25T08:15:33.790283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"mplug-owl2: Revolutionizing multi-modal large language model with modality collaboration","venue":null,"work_id":"f113cc37-192b-4845-b5e5-5299cfaaf89c","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:3c5c890dac32929c42db7bba30866f5edcd2bfe55cfaaf01660571422b640fd7","observation_id":"c2011c6f-ae48-4a11-88f0-22e0dd338e45","resolution":{"observed_at":"2026-05-25T08:15:34.579223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:4177e1ca9261d19e4a3db740d122a61e00bf8452005c480a2971e3f24711c6e1","observation_id":"1887d7fa-7ad9-4caf-ae3d-d0691fd863b7","resolution":{"observed_at":"2026-05-25T08:15:33.717337Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lion-fs: Fast & slow video-language thinker as online video assistant","venue":null,"work_id":"72534628-92f2-43b8-8a7d-1da5480b7a58","year":2025},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:9af4a7dbb8d93c1c084220852c57c5ebce2400283c1c9eed684d1ef65a3cdeb3","observation_id":"be82cdf8-bfb0-4155-a5d7-8f86f0856ca0","resolution":{"observed_at":"2026-05-25T08:15:34.594358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lion: Empowering multimodal large language model with dual-level visual knowledge","venue":null,"work_id":"abc2c224-720d-4125-8c0e-f44aa79e1eaa","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:fde7ebb726597ba1a3debfae8d5213cab9435fb8447b064b2a2404d388cd27e3","observation_id":"599a39fa-df38-4820-be7a-cabc9994cef7","resolution":{"observed_at":"2026-05-25T08:15:34.639903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"End-to-end object detection with transformers","venue":null,"work_id":"eec89c82-bcc9-423a-b18d-6655b9a4296a","year":2020},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:506d7821c750339bf5e0de70e0e12dcd0a9f31ebdb9c6e1b030e87bb721ef429","observation_id":"7d80368c-f643-4514-acc5-0a6dc3c1a7da","resolution":{"observed_at":"2026-05-25T08:15:34.563700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object-centric learning with slot attention, 2020","venue":null,"work_id":"cc22cd97-104e-46c8-b8bd-47d4d2216d78","year":2020},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:2cfdabb6780fe71dba3138f1cd35e1ee0433d0a4ac0de7c85072a4b86c3bd652","observation_id":"d820df18-f0b9-4731-8065-833e5098f307","resolution":{"observed_at":"2026-05-25T08:15:34.556205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring plain vision transformer backbones for object detection","venue":null,"work_id":"1d571338-5ba7-49b7-b055-7185f5c2766d","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:21ea68a97336dae2d2ac9b6a0c17751f4684c2eab0cad7d2a8efa9b9951d1f8d","observation_id":"b33b65c7-47a7-45b6-9db0-805b72bbba0f","resolution":{"observed_at":"2026-05-25T08:15:34.608808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dino: Detr with improved denoising anchor boxes for end-to-end object detection","venue":null,"work_id":"a10ed13b-3aec-4263-bc4a-fcb53d4d59a0","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:2b3a08e7b59a0e5a6dcdd6a2f88bce857465eb0fc5a3e143d881ca0b135656b4","observation_id":"80572bd9-9e63-4d08-96c0-ba6a4f96fac1","resolution":{"observed_at":"2026-05-25T08:15:34.552377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extract free dense labels from clip","venue":null,"work_id":"b07c141a-a2fe-4e29-815c-8a9121a37027","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:6423e35ea543d805cf8008bce3f93172afb8323c43c35f580d2db48554800dde","observation_id":"e80ea814-3077-4995-8ab0-a1bd2c53ca74","resolution":{"observed_at":"2026-05-25T08:15:34.559863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denseclip: Language-guided dense prediction with context-aware prompting","venue":null,"work_id":"0022c30a-92b7-41f2-bea1-f53fec2c0ecf","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:a4071f4fe339002590a5b5ef41f2363cf182dbb2aad4518730778b96048d1854","observation_id":"bdad9e8c-afcd-4488-8d70-b6b2734763e6","resolution":{"observed_at":"2026-05-25T08:15:34.568603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":"2010.11929","doi":"10.1175/jcli-d-22-0357.1","metadata_source":"pith","pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":"cs.CV","work_id":"e96730e3-129b-4db6-b981-15ab7932e297","year":2020},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:0003de65c48c33c17c176214647e60adf4635798e862ff5569b94d5ecc972356","observation_id":"40482a87-6ec6-4525-a7e5-b953df100b20","resolution":{"observed_at":"2026-05-25T08:15:33.738451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emoset: A large-scale visual emotion dataset with rich attributes","venue":null,"work_id":"ed208c38-8148-4698-9773-a3f32184a210","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:f68c17ae047abfed5d47c81d29ef52a276cac7e84e869ca5be73d7bac055e10d","observation_id":"090e7454-c6c1-4b06-b138-427d7a20fc42","resolution":{"observed_at":"2026-05-25T08:15:34.548908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building a large scale dataset for image emotion recognition: The fine print and the benchmark","venue":null,"work_id":"e08d19b4-4191-4de2-a3d2-e41c60bed0ac","year":2016},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:ee6ae69e592728d3f6716051ed1f33a4e89cdf015a3b0213dc3af6fb99478bef","observation_id":"f4a0ef5c-fff3-4f37-9dc8-ff4c6ec64424","resolution":{"observed_at":"2026-05-25T08:15:34.572189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where do emotions come from? predicting the emotion stimuli map","venue":null,"work_id":"7bae395d-362e-439c-80e6-dd35af083143","year":2016},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:51be35a9f714722ea6e537442964ca70b7d6a14e664f13c123cb4a9ceea1e880","observation_id":"e845810f-5cfb-4ab6-b882-b42d5241e624","resolution":{"observed_at":"2026-05-25T08:15:34.531748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust image sentiment analysis using progressively trained and domain transferred deep networks","venue":null,"work_id":"c71144c8-3aef-4760-85d8-b43c7fb841f4","year":2015},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:55e4d258881c10408c3346df973ad261331f03928efbb819e7270cb737a87be8","observation_id":"aa133e9e-a10b-448b-baf1-df3a67a71298","resolution":{"observed_at":"2026-05-25T08:15:34.535033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emovit: Revolutionizing emotion insights with visual instruction tuning","venue":null,"work_id":"3b28a74b-c1a2-43a8-8154-325a1844d05b","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:24c2050979d1df90a1ba7d1c0e04b212452d0468c8f81a4e126093e11d08d842","observation_id":"2a31fbbc-d027-4cf3-8609-b07448b1888b","resolution":{"observed_at":"2026-05-25T08:15:34.538543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"a28181a7-ff26-4ac3-843f-6608aeaa63fd","year":2017},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:7d58a344311052bf5f9b491208da3d9e666eec0791bc3ec841a374d804534935","observation_id":"77c4b1d9-feb6-40f7-9bc3-25a8e1b78261","resolution":{"observed_at":"2026-05-25T08:15:34.668458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning emotional prompt features with multiple views for visual emotion analysis","venue":null,"work_id":"9c8ed954-198a-452a-9115-57b5555a671c","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:4d1121f079d73bfe0d25143d0beb89aaa077bd67d15d52c6449b7cf7fdc9a212","observation_id":"9102f48a-18a8-4a98-bd76-f31969297e4e","resolution":{"observed_at":"2026-05-25T08:15:34.521545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models","venue":null,"work_id":"6a35da2e-8450-4b96-9256-af1c1ffd3382","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:6b47cdacb43df5f684aa806c76ca627fd108f3bd1ae0fa6bf7902ced026905dc","observation_id":"7159aac0-3be1-4a05-b47c-a518a67a9ad7","resolution":{"observed_at":"2026-05-25T08:15:34.517674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructblip: towards general-purpose vision-language models with instruction tuning. arxiv","venue":null,"work_id":"3a87395b-9b06-4d2b-9186-bb684ebb5460","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:63e7c64efd5dbade3dba8080d3c10505961027b8ec6fa14d6498f02e96e49a68","observation_id":"dff7476c-0230-497f-bf87-751aded1e5ca","resolution":{"observed_at":"2026-05-25T08:15:34.525131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"5bc3f891-15fa-4034-9bad-a4612fb102ca","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:a9d90fe9dd01b8f162b27df4031ce4ce92d95c6a10aa9f998b14891b35d67d7d","observation_id":"c98fd2ee-7d89-483b-bca5-c7156dccb290","resolution":{"observed_at":"2026-05-25T08:15:34.541932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual instruction tuning","venue":null,"work_id":"7da38ee4-af50-4c63-810d-4a6a7c09b2b5","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:46c91163e8b85199d1986a65a0084bcdbb91d57bf3139a8045c95b51de64f0b8","observation_id":"6476a9aa-2e5d-4738-909d-8a870dccc4bc","resolution":{"observed_at":"2026-05-25T08:15:34.545132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to prompt for vision- language models","venue":null,"work_id":"0eb3d8db-037b-4c3d-9d53-147f40e106a5","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:ed0f6736790d981ed963f07fca11b2535dd22b3bcdf12f0d07acd50c2b5e0b53","observation_id":"1d970713-d98b-4184-b986-5ee380744505","resolution":{"observed_at":"2026-05-25T08:15:34.528486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conditional prompt learning for vision-language models","venue":null,"work_id":"66736e9a-18fb-45c0-8d29-dadef05988b7","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:e75631252c459373dd22ba9130e14d193a4906079a750d90c7f1adb924d930de","observation_id":"39ba42b2-9a09-4888-9fcc-26c60e8fb193","resolution":{"observed_at":"2026-05-25T08:15:34.731310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simemotion: A simple knowledgeable prompt tuning method for im- age emotion classification","venue":null,"work_id":"0d730caa-44af-4c9b-96e1-7013644cbc8f","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:8c6d778a10af9bd83a08b9ec041120a53bafa39a1933f2428ee3b7e1abaaefbd","observation_id":"e938b402-f3a4-429b-bbb9-57cb81628b55","resolution":{"observed_at":"2026-05-25T08:15:34.717561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to compose diversified prompts for image emotion classifica- tion","venue":null,"work_id":"b8063299-6171-4b77-8137-dddc7d9c8b6c","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:363bd93e003bbd0e7306d1a8840dd95d256acfea863fda6acc2cad0108f2f92e","observation_id":"daa63054-8b66-4886-82c2-4f43470879f4","resolution":{"observed_at":"2026-05-25T08:15:34.721257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masanet: Multi-aspect semantic auxiliary network for visual sentiment analysis","venue":null,"work_id":"953d9532-2a62-457f-9b9a-7812f60826a9","year":2024},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:3824a678eaef22f698defa461c2293b9245fabcbd935e38401d7f71a9dddabd9","observation_id":"d8d589be-c8fd-4f9b-8a55-1161e2d54bbd","resolution":{"observed_at":"2026-05-25T08:15:34.724523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:b68037e85474c4f444921268555dc8a9372fc9e70bf15695955773e659056ec1","observation_id":"9fd326f1-ac44-43cf-9337-65a02067550e","resolution":{"observed_at":"2026-05-25T08:15:33.774271Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":22,"verified_fuzzy":60},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 9 inbound Pith citation observations for arXiv:2507.23372."}