{"as_of":"2026-08-09T02:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7762c2d522fb1bdda6899830a0c73c2b90d373e3555d6bde1a8e799306a4a6db","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:49:15.654400Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.21013/citation-record","integrity":"/paper/2607.21013/integrity","json":"/paper/2607.21013/citation-record.json","paper":"/paper/2607.21013"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:10.905017Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:10.905017Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:d206d414d80ee413d3a1333330c2242340b1425668034353c3367ac699f1781b","observation_id":"1661cd3e-af1c-46ee-832a-d9c56fc36dc1","resolution":{"observed_at":"2026-08-01T08:49:10.905017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-01T08:49:11.056916Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:11.056916Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:a7e52a3506a286c2adb370764e9fd4926ebcc389702ab6e24176497321d2d570","observation_id":"e0b33a40-24e4-4633-94c1-2150cdc69009","resolution":{"observed_at":"2026-08-01T08:49:11.056916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:11.192718Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:11.192718Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:f8e31b5d955b2a1af999c644b1eed11d523ea826a83399718557118f642be3e1","observation_id":"7aeb22c6-2965-4bbe-8344-74c0ca236186","resolution":{"observed_at":"2026-08-01T08:49:11.192718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-08-01T08:49:11.461440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:11.461440Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:2af9d5cb25c18d9c1ab1cd268a5f7de5d7d8fae7e4ac871928fb7d97e9dbd07a","observation_id":"335d2f84-3d0d-46fa-9f68-f024efc74114","resolution":{"observed_at":"2026-08-01T08:49:11.461440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:11.653079Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:11.653079Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:86c56b2e92ab2e8e41d3e124917b4c6d872a1aec17e21e6e859e8c02a8bdb284","observation_id":"7d452bcd-efad-4280-824a-702d95f9e228","resolution":{"observed_at":"2026-08-01T08:49:11.653079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10978","last_updated":"2025-10-28T15:11:36Z","snapshot_observed_at":"2026-07-29T19:20:21.974239Z","submitted_at":"2025-05-16T08:26:59Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10978","snapshot_observed_at":"2026-08-01T08:49:11.775928Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:11.775928Z"},"links":{"cited_paper":"/paper/2505.10978","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:dfbf676e8f50ecb06d2561528d5245ac45f1b172a008ac54d02162f88e83d84a","observation_id":"ea150781-ebcc-4eee-99a7-274586254c88","resolution":{"observed_at":"2026-08-01T08:49:11.775928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:11.950233Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:11.950233Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:5a11ea9e1f89b1cd3b03a354bb5b8cf1deab51a46060cd9021a34774eb8fc06d","observation_id":"a8c95a60-3a93-406d-876a-f1ed7ed1c895","resolution":{"observed_at":"2026-08-01T08:49:11.950233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-01T08:49:12.094840Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.094840Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:5f8b4924fbf4fe0dbbf600df221a9122dd3c22ce9b1d26dc74af2bddc90c7b51","observation_id":"c522ffed-93d0-43b5-aa1f-5055ba40cb71","resolution":{"observed_at":"2026-08-01T08:49:12.094840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-01T08:49:12.196185Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.196185Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:e8583663d14d2a29ddb7d7b684bcb17f1aef34539f9bcc8655eea9d3fd72f06a","observation_id":"478eb93b-b4ad-447e-b4e6-104c02692f80","resolution":{"observed_at":"2026-08-01T08:49:12.196185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08046","last_updated":"2024-04-05T15:21:09Z","snapshot_observed_at":"2026-07-06T16:47:17.136168Z","submitted_at":"2023-11-14T10:11:36Z","title":"Chat-UniVi: Unified Visual Representation Empowers Large Language Models with Image and Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08046","snapshot_observed_at":"2026-08-01T08:49:12.288025Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.288025Z"},"links":{"cited_paper":"/paper/2311.08046","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:4fa5a16ad1237bfc03f36d856baf5548613a86595f82fd38cadac5f7003fdbf6","observation_id":"69cdeff9-09ab-42f3-bffa-e48e65f9cd89","resolution":{"observed_at":"2026-08-01T08:49:12.288025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:12.455823Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.455823Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:c5843ce5daebed8eeb15c7672744a22ef0f8aa73e500dfa16d32c2ef05ed000c","observation_id":"1180ac3c-e377-428e-98dd-06f587128004","resolution":{"observed_at":"2026-08-01T08:49:12.455823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:12.622638Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.622638Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:b6814454e6f10a00500486d9275834148bad900ceb20a21e98c494d3beb8b00a","observation_id":"5803d5fc-fdba-4b75-ad09-86a07bd66300","resolution":{"observed_at":"2026-08-01T08:49:12.622638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:12.645734Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.645734Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:ec0da6da6cea9e055cfbb41055fb1bb16d0a89ea9b31c91b9c54153cc7612481","observation_id":"34b55b1d-1333-4b2e-8e95-15d225fb4991","resolution":{"observed_at":"2026-08-01T08:49:12.645734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-01T08:49:12.701187Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.701187Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:3f8535deb27f34ff9117607e90ebe788f0101b2b8ecc934b04dc84f9005237ca","observation_id":"343db43f-eb21-412f-93f4-6c31e372719d","resolution":{"observed_at":"2026-08-01T08:49:12.701187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:12.759870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.759870Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:4eb914b423be2368e0c047c1daac1d442a3bd74a6fda8b0826abe542d5ce54e1","observation_id":"a4360587-34b2-483b-97b3-d9b58cc3037a","resolution":{"observed_at":"2026-08-01T08:49:12.759870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:12.819835Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.819835Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:71bc856b0d216c51b37e76b7236cc86fb105deec2a23e039ce96a3b13ad0e511","observation_id":"f28593ff-06a0-4d7a-ad1e-44573bf37327","resolution":{"observed_at":"2026-08-01T08:49:12.819835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:12.868090Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.868090Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:18a6307e4602b66296b68c7d436175ce7ebc9bae99966f9ac89c610ca765d935","observation_id":"bf4ab915-b1e2-4dcd-a955-129529fa61e8","resolution":{"observed_at":"2026-08-01T08:49:12.868090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18438","last_updated":"2023-07-03T13:08:46Z","snapshot_observed_at":"2026-07-06T15:34:59.457879Z","submitted_at":"2023-05-29T01:18:39Z","title":"Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18438","snapshot_observed_at":"2026-08-01T08:49:12.905158Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.905158Z"},"links":{"cited_paper":"/paper/2305.18438","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:77d14cbb8c27c2d9da37ac6f16876c5a579898f62326a30a1783649c0c875165","observation_id":"b95f051c-6a8e-40bc-9447-5dec8e7c6fe0","resolution":{"observed_at":"2026-08-01T08:49:12.905158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:12.981493Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:12.981493Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:71cc18d8ea06867580834a7520b1d07621a626da017c6d226bdd97bc7ac814bb","observation_id":"e44c447f-7630-45a0-aadb-25b0a5f29312","resolution":{"observed_at":"2026-08-01T08:49:12.981493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:13.059450Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.059450Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:ea28d8202bcfb632e2eedb3f57c9194876d11915a25ca9f130f9770c70b6f3f0","observation_id":"f3cb63eb-c373-4318-9751-a90a9ec61747","resolution":{"observed_at":"2026-08-01T08:49:13.059450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:13.118861Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.118861Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:9449f09e668b3616bb01fa7bf41a295af626d724ae160be12f6a1ca98afc7c69","observation_id":"f4c8b822-a571-478e-b80d-8ef8a4c96c95","resolution":{"observed_at":"2026-08-01T08:49:13.118861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:13.172348Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.172348Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:0f1854a11e94e0e8f2ebef609b0dafa4c8111b7664907a31110569a68dec0fb7","observation_id":"cf89f11a-50be-4838-a89a-4ad0dc242d1e","resolution":{"observed_at":"2026-08-01T08:49:13.172348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15542","last_updated":"2024-08-28T05:34:14Z","snapshot_observed_at":"2026-07-06T19:06:54.428910Z","submitted_at":"2024-08-28T05:34:14Z","title":"Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15542","snapshot_observed_at":"2026-08-01T08:49:13.271024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.271024Z"},"links":{"cited_paper":"/paper/2408.15542","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:b5e1eca2fea7791c53273da47cabb2d537060ef9daf195d00a5faa42d7bc304a","observation_id":"30cccac3-b3ac-40f9-adef-3c640cb6616b","resolution":{"observed_at":"2026-08-01T08:49:13.271024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-01T08:49:13.305673Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.305673Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:46f3b41152d06575054b70dc5638dc210fc0dcbb66b32916294e929382aef97c","observation_id":"4f7fdaff-54c2-4ced-86a3-c44683c7d1a1","resolution":{"observed_at":"2026-08-01T08:49:13.305673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04468","last_updated":"2026-04-25T07:16:42Z","snapshot_observed_at":"2026-08-03T08:48:57.969106Z","submitted_at":"2024-12-05T18:59:55Z","title":"NVILA: Efficient Frontier Visual Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04468","snapshot_observed_at":"2026-08-01T08:49:13.405920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.405920Z"},"links":{"cited_paper":"/paper/2412.04468","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:403719791790184e16e3477b1725730a7e81d23376e8238f76c8db85fc5918bb","observation_id":"ea0d2259-c377-4a65-9e2d-3c4fe634035e","resolution":{"observed_at":"2026-08-01T08:49:13.405920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:13.555335Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.555335Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:2100eceb238afb608e7e253b81dc8b6a5c3a982052adc584d0a0b91f3574d7ed","observation_id":"3511927c-87c6-4ba6-9db0-aa9c91452939","resolution":{"observed_at":"2026-08-01T08:49:13.555335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:13.824748Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.824748Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:515f30595d0f9876ef3ff1e6a9c3478f7ac575528226399b2e9912ad792f1766","observation_id":"1a79d68a-28fc-49c1-8641-dcaf9a8de9eb","resolution":{"observed_at":"2026-08-01T08:49:13.824748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:13.917158Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.917158Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:54459f5ae8929cbb809f022eac4ce4e06d7a79d5c0dd31f06e97358271641406","observation_id":"50835670-d971-41ff-92f2-cce2ea2abf70","resolution":{"observed_at":"2026-08-01T08:49:13.917158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-01T08:49:14.170675Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.170675Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:940f42d3d286d8c70422ecd7a727e92087eff6e2cd8195459ca852588194e951","observation_id":"1e295c08-f524-4353-a496-faa56dd0255f","resolution":{"observed_at":"2026-08-01T08:49:14.170675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:14.267566Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.267566Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:007149adf852d772ed55fa4b2cefcf46317c021df9e3524f7c58c7bb28e1f48b","observation_id":"6413a720-1198-4e21-830a-5b55ce3edb06","resolution":{"observed_at":"2026-08-01T08:49:14.267566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:14.453039Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.453039Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:79a8665fc42284340809c2d499811882acd0e2a44432db9776fdfca646c40516","observation_id":"d5caed64-a3a3-43bf-b885-557b0a537f46","resolution":{"observed_at":"2026-08-01T08:49:14.453039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:14.656578Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.656578Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:60c0d0d952016ad976c9f745ca065fc68ed0c24affdf72cec494574ff919b156","observation_id":"5065bb85-e243-4c09-b939-9f53b73111d5","resolution":{"observed_at":"2026-08-01T08:49:14.656578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:14.802798Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.802798Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:479c9711baa9365911f277623bfc93e7f6a4b8ff539b4db25982655f3434dc3a","observation_id":"0ac87f3e-eca8-4641-a7dc-9660ea53e82b","resolution":{"observed_at":"2026-08-01T08:49:14.802798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:14.957087Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.957087Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:120dc023752cbbcc5a749eb3a9ab48d7e5f864c1a899e798a3ce001b81149ba9","observation_id":"49d0c8dc-fa16-4a70-aeda-7526f855f2a9","resolution":{"observed_at":"2026-08-01T08:49:14.957087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:14.996022Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.996022Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:281adec51af51baaaf752e9af1a415986f6a1721c393d3f0beb7a538cc1b2a26","observation_id":"6c6b6216-194e-4b2f-a270-221153bb85ff","resolution":{"observed_at":"2026-08-01T08:49:14.996022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:15.240895Z","title":"Tenenbaum","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:15.240895Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:299a629a71331a34b1b9234248555d39bca45f5dcb3e2ad441434708d1661cb0","observation_id":"bd880192-12b8-4a7f-a8af-2cc0e0ec0aac","resolution":{"observed_at":"2026-08-01T08:49:15.240895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:15.287043Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:15.287043Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:c706677259e9e79a5c3182583d1ecdf14de5e44d597ae8d3d2ae47ef64c1a86a","observation_id":"538d335a-3c40-4909-82df-03c8d59afc1e","resolution":{"observed_at":"2026-08-01T08:49:15.287043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-01T08:49:15.330140Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:15.330140Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:a742c8029382f3578b568f2314a4ff49c83e974f2148386174c1ca1a4a631ad6","observation_id":"3d56b3ea-a767-4efa-bdd1-fa8df4fdda76","resolution":{"observed_at":"2026-08-01T08:49:15.330140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-01T08:49:15.164333Z","title":"arXiv:2304.14178 [cs.CL] https://arxiv.org/abs/2304.14178","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:15.164333Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:25de2fc17457b6c0c157ed1e6d62056f22be462d2259ea1ba0c76ac23a7464e7","observation_id":"8ab6c6d3-98bc-4ecf-ab85-5e0e5fcb5f30","resolution":{"observed_at":"2026-08-01T08:49:15.164333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-01T08:49:15.545006Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:15.545006Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:72ba63f630aeb02e6adde99af7586ee5031accac6529759e5b32096ea3a72fe7","observation_id":"d55d1f61-ca41-40d9-9a28-f01b0f5480f2","resolution":{"observed_at":"2026-08-01T08:49:15.545006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05379","last_updated":"2025-03-10T07:11:14Z","snapshot_observed_at":"2026-08-07T21:57:26.595540Z","submitted_at":"2025-03-07T12:46:42Z","title":"R1-Omni: Explainable Omni-Multimodal Emotion Recognition with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05379","snapshot_observed_at":"2026-08-01T08:49:15.654400Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:15.654400Z"},"links":{"cited_paper":"/paper/2503.05379","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:918c064d0f4bab7fad581646fb4992205473d8cb722e8a91d328a2fdc442a884","observation_id":"18ecc8a2-ebe1-4678-b989-9c8b88244285","resolution":{"observed_at":"2026-08-01T08:49:15.654400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-01T08:49:15.410966Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:15.410966Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:ef36acbfb9fa41ce118af11eb92e65261235723539a8cc0af097f61e9ca8a8ce","observation_id":"c7448407-9300-44d5-adb3-44abdaae46bb","resolution":{"observed_at":"2026-08-01T08:49:15.410966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T08:49:14.035514Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.035514Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:71d470a07201ff33a12e850a56b42db31f3c0503456299a8453cb59a67f1f2f2","observation_id":"deee8af2-e613-4ac8-a72e-f6794952ee86","resolution":{"observed_at":"2026-08-01T08:49:14.035514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:14.507829Z","title":"In Annual Conference on Neural Information Processing Systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:14.507829Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:19f55cddafbd409f701eae29a8f88abda691b2c1e34ffe6600d770970d966af5","observation_id":"dd740b84-c8fd-4c35-8b50-0d3282ed7e84","resolution":{"observed_at":"2026-08-01T08:49:14.507829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:13.697518Z","title":"InProceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (ACL 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:13.697518Z"},"links":{"citing_paper":"/paper/2607.21013"},"observation_digest":"sha256:27a439ee0298cd2160d35973604af4ae3b4155d3f2611d2a06bb477585f37537","observation_id":"e2962c2d-3365-4286-b8b9-a231651f0401","resolution":{"observed_at":"2026-08-01T08:49:13.697518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.21013","last_updated":"2026-07-25T07:42:56Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T08:24:32.757054Z","submitted_at":"2026-07-23T07:52:40Z","title":"EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2607.21013."}