{"as_of":"2026-08-22T07:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6dd2865a7488b5c5e31709ba8e9fdcd9a204d6ae01982c487a6865ca9cce164f","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T04:39:27.176697Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16322/citation-record","integrity":"/paper/2607.16322/integrity","json":"/paper/2607.16322/citation-record.json","paper":"/paper/2607.16322"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:19.364017Z","title":"Axtell and Mike Fornwald","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:19.364017Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:ddb9c00f6f2c00c1790bf3b7e2306adbd243710f36c823db19410e061f430cc3","observation_id":"45d6326d-f0f1-42ab-bb27-39ceb1629e9e","resolution":{"observed_at":"2026-08-02T04:39:19.364017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-02T04:39:19.499314Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:19.499314Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:cf649d259e8e7c30db3b145d59d2fb8201cd13ca56f865e5f9ca7a31425db75b","observation_id":"1f3ec4ac-1142-4b78-911b-40dad60f13eb","resolution":{"observed_at":"2026-08-02T04:39:19.499314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-02T04:39:19.616858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:19.616858Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:6c3dde4079d6606a6e8736a9e3ddd52fe65d9b7beeccbf58e1986cb27b2ccb93","observation_id":"efad377d-d847-4f30-a8bd-dad7e01985ad","resolution":{"observed_at":"2026-08-02T04:39:19.616858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T04:39:19.748913Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:19.748913Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:884a8d41e5a16f9f3f395e9f90990c5a1e868410e13722c66151003b9e745a2a","observation_id":"bcfe7a06-1955-47e9-9693-2c4b8c7a7462","resolution":{"observed_at":"2026-08-02T04:39:19.748913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05095","last_updated":"2021-06-09T14:48:13Z","snapshot_observed_at":"2026-08-16T18:46:40.012139Z","submitted_at":"2021-02-09T19:49:33Z","title":"Is Space-Time Attention All You Need for Video Understanding?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05095","snapshot_observed_at":"2026-08-02T04:39:19.873848Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:19.873848Z"},"links":{"cited_paper":"/paper/2102.05095","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:29f0e62dd6e3dd212402000c7ff7a32696cf1b12cef0bf532ab0778db228d3fe","observation_id":"ba800377-3a00-4419-9e01-e6dda56e0606","resolution":{"observed_at":"2026-08-02T04:39:19.873848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:19.970051Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:19.970051Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:e842075218165f54f4edd2b52b635dc25faf81f6017d5cdf82fd919d851901b3","observation_id":"c6ac8e08-0f8f-46c1-86b4-a96b40f6e04c","resolution":{"observed_at":"2026-08-02T04:39:19.970051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:20.125369Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:20.125369Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:7f0248706073a6af1252125cb754b2ed7d8f480bc93296b28459b00eff947396","observation_id":"97371f0c-920f-4410-965b-a6222bacd419","resolution":{"observed_at":"2026-08-02T04:39:20.125369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:20.242704Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:20.242704Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:f8a566d9da6f4b4497f28cb7333cdf48d4c573c8a92c06514659bc99ea7c9b2b","observation_id":"37095922-9da0-467e-90ec-d3f907ce71ed","resolution":{"observed_at":"2026-08-02T04:39:20.242704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13292","last_updated":"2023-05-23T07:48:15Z","snapshot_observed_at":"2026-08-19T17:23:30.606512Z","submitted_at":"2023-05-22T17:51:22Z","title":"VideoLLM: Modeling Video Sequence with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13292","snapshot_observed_at":"2026-08-02T04:39:20.337796Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:20.337796Z"},"links":{"cited_paper":"/paper/2305.13292","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:2389d154b97c55ee2f4b05e923886a753bbe293196ee464cc01f4d3b6c7b4f25","observation_id":"204689fb-d777-4c79-b01f-1969c1657c9f","resolution":{"observed_at":"2026-08-02T04:39:20.337796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:20.411507Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:20.411507Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:470eaac4865415950426dfac90dd4fae32538f42e68c37ad44f3c084bdd40584","observation_id":"78b80e0a-45a5-49e5-af9d-4a63e7a48e28","resolution":{"observed_at":"2026-08-02T04:39:20.411507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:20.457148Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:20.457148Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:8ba2d94aa0a265b4ed73f1a94e5922fd4ada125fdc8dcd5228fe0edeef8cee13","observation_id":"6eb13608-3caf-425e-863c-00ff9e1da19f","resolution":{"observed_at":"2026-08-02T04:39:20.457148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.27922","last_updated":"2026-06-30T06:57:21Z","snapshot_observed_at":"2026-08-16T16:30:37.593534Z","submitted_at":"2026-06-26T10:15:36Z","title":"Reflect-R1: Evidence-Driven Reflection for Self-Correction in Long Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.27922","snapshot_observed_at":"2026-08-02T04:39:20.564971Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:20.564971Z"},"links":{"cited_paper":"/paper/2606.27922","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:88a5142dfe1ef0088c0c8bda2d1eb60dd1542bd1900ebfcb3a42e55b8e2d381a","observation_id":"a44fdbf1-6450-45b3-9eaa-14296f8be951","resolution":{"observed_at":"2026-08-02T04:39:20.564971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-02T04:39:20.783867Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:20.783867Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:69f62e1ff7d6a59627569abdf2abceba64e2d061c90920fb3beb1ea3b719a520","observation_id":"0510a58f-0003-4a6b-8f2a-60b3caaec444","resolution":{"observed_at":"2026-08-02T04:39:20.783867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.15920","last_updated":"2026-07-09T17:53:09Z","snapshot_observed_at":"2026-08-12T23:04:28.488200Z","submitted_at":"2026-06-14T16:51:22Z","title":"OmniOPSD: Rationale-Privileged On-Policy Self-Distillation for Affective Computing","version":2},"cited_work":{"arxiv_id":"2606.15920","doi":"10.48550/arxiv.2606.15920","metadata_source":"pith","pith_arxiv_id":"2606.15920","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OmniOPSD: Rationale-Privileged On-Policy Self-Distillation for Affective Computing","venue":"cs.CV","work_id":"37b362c4-9afa-4362-a9c4-c2a9e7d888e0","year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.018036Z"},"links":{"cited_paper":"/paper/2606.15920","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:e09dc956dbe463258e0176b2de8d41c04511425cbf7af0c81ec9cc07bcc53a0d","observation_id":"3957d440-27e1-46d3-ad1c-e00119a4fe88","resolution":{"observed_at":"2026-08-02T04:43:29.970222Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-02T04:39:21.237763Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.237763Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:46168549c912acc2a1b9c538d3e5b78bf72865787615a23a6980445a913a33dc","observation_id":"c1628a9d-bfd0-4848-8d3b-5871a4a54e7f","resolution":{"observed_at":"2026-08-02T04:39:21.237763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21776","last_updated":"2025-10-22T16:42:24Z","snapshot_observed_at":"2026-08-05T07:15:29.998948Z","submitted_at":"2025-03-27T17:59:51Z","title":"Video-R1: Reinforcing Video Reasoning in MLLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21776","snapshot_observed_at":"2026-08-02T04:39:21.394032Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.394032Z"},"links":{"cited_paper":"/paper/2503.21776","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:b984c9e6ba42e672a6c3202158a585f4a71dec3d18bbf0b6f6e920a8d11110d7","observation_id":"0b561957-da7e-4793-b037-905a3bc39134","resolution":{"observed_at":"2026-08-02T04:39:21.394032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:21.524098Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.524098Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:0cd4719ae68cfb548253a89e2bdb8e863552bbf8f94b291162ba7e250e96b2b5","observation_id":"8a88525f-2db6-4888-a224-5dd81a5ad175","resolution":{"observed_at":"2026-08-02T04:39:21.524098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:21.645393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.645393Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:f39aa9af0b0fa16a8b781d2651d56cdeda993eda0c8b8365e4497a4d6005ba9b","observation_id":"b1d044fa-fc07-42ee-9a58-ff715eb646c1","resolution":{"observed_at":"2026-08-02T04:39:21.645393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-02T04:39:21.727955Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.727955Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:bdea6e1fd0bb682e93f47536d5ad8732a311970c9e7a25ee8c9a828dd1fd6c80","observation_id":"493df00c-2811-4f6c-a61d-8ac28b8127bd","resolution":{"observed_at":"2026-08-02T04:39:21.727955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:21.788869Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.788869Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:aa93c8d6fdb52ddc982cb8b3a5aff2a65c307aa1d3b4a1d70b540931dcf13e90","observation_id":"dc01b632-417d-41da-ba43-f33cdc654467","resolution":{"observed_at":"2026-08-02T04:39:21.788869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:21.848031Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.848031Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:d02cb6091bca4aea0ae63ea667257589ab05d3956dfd3096bb4f421ea5eb35cd","observation_id":"731c89f5-63da-4143-90f4-118aaec9c783","resolution":{"observed_at":"2026-08-02T04:39:21.848031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i11.29153","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"73c337a6-3622-43ce-8450-ddc1db1c995a","year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:21.965081Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:55db631310817d221bac1c84015e3b3a06dfb8ddece7be7ee9e6ba023e750227","observation_id":"a6cfe175-ce89-4e70-ac4d-9a23e7a636e0","resolution":{"observed_at":"2026-08-02T04:43:29.737710Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00574","last_updated":"2025-02-04T07:57:52Z","snapshot_observed_at":"2026-08-21T13:21:18.529817Z","submitted_at":"2024-05-01T15:25:54Z","title":"EALD-MLLM: Emotion Analysis in Long-sequential and De-identity videos with Multi-modal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00574","snapshot_observed_at":"2026-08-02T04:39:22.156833Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.156833Z"},"links":{"cited_paper":"/paper/2405.00574","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:9dd4ff27438194ec1f2f01395e608d507c57f21a4a182af4213258e8022bc8b1","observation_id":"a4e4769e-0b75-4510-bc7e-de9cb6209634","resolution":{"observed_at":"2026-08-02T04:39:22.156833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:22.325153Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.325153Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:9d5b2035f863d96901465e42882919f63330940aad68b4ed8a0dd22c87ce88b0","observation_id":"b314c453-3f39-491c-be9e-b5372eb8592a","resolution":{"observed_at":"2026-08-02T04:39:22.325153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:22.421838Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.421838Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:b477e94ba8ccc75d680379a16b2be4ed8fb5376d8a908d05036c0cbbe50b8a8c","observation_id":"774331b8-91cd-41f1-86c4-068eae62fa9e","resolution":{"observed_at":"2026-08-02T04:39:22.421838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10624","last_updated":"2023-07-20T06:44:42Z","snapshot_observed_at":"2026-08-16T15:14:47.310461Z","submitted_at":"2023-07-20T06:44:42Z","title":"Joint Skeletal and Semantic Embedding Loss for Micro-gesture Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10624","snapshot_observed_at":"2026-08-02T04:39:22.608102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.608102Z"},"links":{"cited_paper":"/paper/2307.10624","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:56b3d41a2fe1a48a143d48a0e925fd6f039ebc72344654836e4510274f5c1767","observation_id":"c45aaf4a-e069-4bc4-816d-5433edcbb738","resolution":{"observed_at":"2026-08-02T04:39:22.608102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:22.736602Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.736602Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:bb24e28e99436d768b5533c40a109c26a4506d2f7b2404a4d51409a20674fa4d","observation_id":"f171a7d5-7a98-478a-86df-6507756d5e3a","resolution":{"observed_at":"2026-08-02T04:39:22.736602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:22.834761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.834761Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:b8612e4210c60652c6d3e6af287c4a963fd4115dd64e6816fc1c38d89f7c5d5f","observation_id":"99c7b198-d7e4-48b9-b21c-cff0c64cdd5a","resolution":{"observed_at":"2026-08-02T04:39:22.834761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:22.922363Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.922363Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:6ab046e141955bbfb1610abf1e4d070953037937deb2b3cc95e8a5ace31dd34c","observation_id":"017e13da-f2d5-4da6-82d5-5902fa31d067","resolution":{"observed_at":"2026-08-02T04:39:22.922363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.123702Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.123702Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:f1764bf63738b1ecf5ccaa9f16dc840d4f0936850d1601f84e786df818a8286e","observation_id":"72cbf9f2-59f1-4064-b1ab-57b9c31a2f1a","resolution":{"observed_at":"2026-08-02T04:39:23.123702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.184297Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.184297Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:4ea9bca157f852bd9c478cde18888fe5e4eca7621795fcbe2a39e7e5e88135eb","observation_id":"cb98fa2d-fd08-4596-a88b-c74622dc1823","resolution":{"observed_at":"2026-08-02T04:39:23.184297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-02T04:39:23.291308Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.291308Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:2236018057bfd5c80f03f4fed8c81bea9fb4e09c42f062756fa5b7229ccf20bf","observation_id":"8d247950-7646-4d11-9910-d936e0bc26f3","resolution":{"observed_at":"2026-08-02T04:39:23.291308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.362091Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.362091Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:8be8a4be5a4551aef1394e11d9a32797759627b53c4e44c1ffe13404e09a2600","observation_id":"29f50747-e717-4173-b0a7-97edbdd37958","resolution":{"observed_at":"2026-08-02T04:39:23.362091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.565135Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.565135Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:28620a8a88307e49a6f1d598d848a7020db767555ee27bb55b36a1b5bde33a93","observation_id":"ca7a43db-8c8a-4dbd-86a5-d29c9f3bad41","resolution":{"observed_at":"2026-08-02T04:39:23.565135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.08387","last_updated":"2026-07-05T15:23:25Z","snapshot_observed_at":"2026-08-17T23:27:34.758744Z","submitted_at":"2026-03-09T13:45:21Z","title":"AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.08387","snapshot_observed_at":"2026-08-02T04:39:23.724508Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.724508Z"},"links":{"cited_paper":"/paper/2603.08387","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:34cbcfcee5bd6173abd47a91e13efca31184a3fa420e05d8f1a90105d0d359c5","observation_id":"c44a8cd3-d081-4464-900a-70761b175275","resolution":{"observed_at":"2026-08-02T04:39:23.724508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.812040Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.812040Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:73d9de87bc1e915749dbde033b3f88eaef9d1d0d5194d31f2136fa9c482bfd8e","observation_id":"e7a7d824-a8a3-4511-a61c-fc9870757787","resolution":{"observed_at":"2026-08-02T04:39:23.812040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-02T04:39:23.879918Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.879918Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:1b6cb57f493466294da098b7ac16a90822324353079c88361ed3a4e4d778d697","observation_id":"aea717ba-26ed-41ca-9f82-3d0cbae78d58","resolution":{"observed_at":"2026-08-02T04:39:23.879918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13230","last_updated":"2021-06-24T17:59:46Z","snapshot_observed_at":"2026-08-18T11:27:26.316374Z","submitted_at":"2021-06-24T17:59:46Z","title":"Video Swin Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13230","snapshot_observed_at":"2026-08-02T04:39:23.642262Z","title":"arXiv:2106.13230 [cs.CV] https://arxiv.org/abs/ 2106.13230","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.642262Z"},"links":{"cited_paper":"/paper/2106.13230","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:43fcd9455fb3d0b244d83a376281f98233c98ef5b5a713cc25ae11804112b041","observation_id":"c8c7c708-419f-498a-94fa-83116a766446","resolution":{"observed_at":"2026-08-02T04:39:23.642262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-02T04:39:24.073035Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.073035Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:27e6cc5fddc34b9787e6d305283b1a76214b6ff541a303c2ae94d1ef977676f8","observation_id":"c7dd1f00-cefd-409f-a242-fc50fab5747b","resolution":{"observed_at":"2026-08-02T04:39:24.073035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T04:39:24.195259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.195259Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:c843ccb96895547f0f5a37d9ca0bb0cd3fb9e7cf945467dcb5d0733d7822f43e","observation_id":"1a86dcf9-8a59-4fad-9be2-938b8f7d9008","resolution":{"observed_at":"2026-08-02T04:39:24.195259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:24.264095Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.264095Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:588eeebe22b1cdac7380f41ba8717e6c0abb69f819a1d714b8e09ee2fc271288","observation_id":"0d13f1c6-3b5b-44cf-bee2-c9f7ffc946e0","resolution":{"observed_at":"2026-08-02T04:39:24.264095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.974267Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.974267Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:50c2363ad610bbde19a636e7451b17ce8d94b3d6ce11ada60742bf6c0f30973b","observation_id":"b61df231-2766-477d-bc4e-00d3ea5f451c","resolution":{"observed_at":"2026-08-02T04:39:23.974267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-02T04:39:24.560012Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.560012Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:72d645c1dd1c7ca447478dced5bb1bd6b6bdb2c653758b8d1eaa2ba273a51d0f","observation_id":"ffc8129b-f843-4222-81bc-f9ed8b9e17fe","resolution":{"observed_at":"2026-08-02T04:39:24.560012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:24.648399Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.648399Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:f79b32d463542fca63a696c58ce121f75711af0589c46531117f7b6ad5e0702e","observation_id":"59d99cc3-cbfa-4e79-8ac2-44b409c87c8d","resolution":{"observed_at":"2026-08-02T04:39:24.648399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:24.776972Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.776972Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:5f6ef088fd7f692ff22a331592917ddb358c53a4ca671eca8277a25798fb4fec","observation_id":"3ba9d21e-139b-454c-a9f7-60461c3171ce","resolution":{"observed_at":"2026-08-02T04:39:24.776972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:24.394983Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.394983Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:26aac7be67fdabb58616dc3822710c091df53d2f4411d13b255b600a70e81b68","observation_id":"160379f7-7ef4-4cf0-a68e-a5e5171e247b","resolution":{"observed_at":"2026-08-02T04:39:24.394983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.28266","last_updated":"2026-06-26T16:57:40Z","snapshot_observed_at":"2026-08-12T16:54:45.166709Z","submitted_at":"2026-06-26T16:57:40Z","title":"RSICCLLM: A Multimodal Large Language Model for Remote Sensing Image Change Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.28266","snapshot_observed_at":"2026-08-02T04:39:24.904144Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.904144Z"},"links":{"cited_paper":"/paper/2606.28266","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:a737eb68bf52c1d7291c7a084136a05b179563be0561c937f9b86a1dd53de58a","observation_id":"57c0ec15-c3dd-4a0f-807e-56a8fb261ffd","resolution":{"observed_at":"2026-08-02T04:39:24.904144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12735","last_updated":"2026-08-05T08:52:46Z","snapshot_observed_at":"2026-08-13T01:48:08.167925Z","submitted_at":"2026-04-14T13:49:19Z","title":"AffectAgent: Collaborative Multi-Agent Reasoning for Retrieval-Augmented Multimodal Emotion Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12735","snapshot_observed_at":"2026-08-02T04:39:24.967160Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.967160Z"},"links":{"cited_paper":"/paper/2604.12735","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:951caba3ac0af56272d04e9c0b257b54f2a25c25ee229737e0f1c49c3ab0d4e8","observation_id":"d3b80661-a50d-4281-afbf-07ab30bfca0a","resolution":{"observed_at":"2026-08-02T04:39:24.967160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18884","last_updated":"2026-05-16T10:04:48Z","snapshot_observed_at":"2026-08-18T15:36:15.824096Z","submitted_at":"2026-05-16T10:04:48Z","title":"Navigating the Emotion Tree: Hierarchical Hyperbolic RAG for Multimodal Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18884","snapshot_observed_at":"2026-08-02T04:39:25.084048Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:25.084048Z"},"links":{"cited_paper":"/paper/2605.18884","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:71e6df1f5b5b09acb009e80fefc15329522001fc29d073f9f8eadd17519486c3","observation_id":"d9346b6b-68a7-4b10-8f8b-770a76375b74","resolution":{"observed_at":"2026-08-02T04:39:25.084048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:25.210085Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:25.210085Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:356a516def4b3c34aa7fa28cd3ffd9b618ba08b9b283afcc20b050094361a806","observation_id":"9eb02893-1386-4fae-9706-2c73e33f5bd8","resolution":{"observed_at":"2026-08-02T04:39:25.210085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.27410","last_updated":"2026-06-25T11:49:21Z","snapshot_observed_at":"2026-08-16T02:09:56.533340Z","submitted_at":"2026-06-25T11:49:21Z","title":"DFM: Difference Feature Modeling with Text-Guided Gated Contrastive Loss for Remote Sensing Image Change Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.27410","snapshot_observed_at":"2026-08-02T04:39:24.840350Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.840350Z"},"links":{"cited_paper":"/paper/2606.27410","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:fb5d45e33f1b5a176cfad2d97f02a49a57e6a5aab24f1782ce1351ca10d61f64","observation_id":"8179b1ca-d6cb-4a37-93cc-c97400a57830","resolution":{"observed_at":"2026-08-02T04:39:24.840350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T04:39:25.513445Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:25.513445Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:cd37e44a225e91188a9a7aac8a1a6e6fa12b028c889d5253ff175ac433ff7e72","observation_id":"9a1c1757-0192-402c-9f5f-b8a20e0dad86","resolution":{"observed_at":"2026-08-02T04:39:25.513445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:25.628390Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:25.628390Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:cf577368f69f223a0784fe37319c78ed30494f14fd3e114e66292c5f74879d6a","observation_id":"5672f548-e2d1-4880-b2ec-1290d1e1045e","resolution":{"observed_at":"2026-08-02T04:39:25.628390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:25.774055Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:25.774055Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:834cfbe1a5cf011b59dbd17c9cfa65d06157e130cda01d41435ef435bde18391","observation_id":"bac6035f-1e0c-48b5-8044-3eb8f7c87258","resolution":{"observed_at":"2026-08-02T04:39:25.774055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:25.927673Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:25.927673Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:62d7e718797635d8eff9f033e4b6bd3d82a26045a1a07da022bc09f6fb3eea23","observation_id":"ea77deee-e61a-40a5-9948-f20e3dcce45c","resolution":{"observed_at":"2026-08-02T04:39:25.927673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:25.356485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:25.356485Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:c82f3e614ce3d613baa58fe3ea642a5f715a9c9e50bce12bdfc17266ca7b09cd","observation_id":"2aaac03a-f440-4546-87fc-db7ecb6fbe96","resolution":{"observed_at":"2026-08-02T04:39:25.356485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:26.162124Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.162124Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:db149127e9c2ffa52828407413ec7272fb6c530747dff3ae23cce9a1aeab7a9c","observation_id":"6f910519-ef50-4a25-86f9-cbc213737f0d","resolution":{"observed_at":"2026-08-02T04:39:26.162124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.11385","last_updated":"2026-07-31T21:56:40Z","snapshot_observed_at":"2026-08-16T03:09:38.549116Z","submitted_at":"2026-06-09T19:08:00Z","title":"DeceptionX: From Multimodal Evidence to Explainable Deception Detection","version":2},"cited_work":{"arxiv_id":"2606.11385","doi":"10.48550/arxiv.2606.11385","metadata_source":"pith","pith_arxiv_id":"2606.11385","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"DeceptionX: Explainable Deception Detection with Multimodal Large Language Models","venue":"cs.CV","work_id":"68a5a952-350e-4fa9-8d2e-0cb4b93af55a","year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.309498Z"},"links":{"cited_paper":"/paper/2606.11385","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:112281dc97361a202783bcf7d3cc1abe87dafdf4e3c80890cc41ed0ce340de81","observation_id":"c306a56a-3c1d-4a2c-b542-010de74f56bb","resolution":{"observed_at":"2026-08-02T04:43:29.487747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:26.454016Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.454016Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:d15cc7437a0f4e015a4af16dc2cfeb24d90b21cefc8af840de6198e4d5bd127c","observation_id":"ac9f6c4a-afce-4747-9912-fc65880c5201","resolution":{"observed_at":"2026-08-02T04:39:26.454016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05517","last_updated":"2025-05-19T06:50:53Z","snapshot_observed_at":"2026-08-19T21:41:40.386018Z","submitted_at":"2024-08-10T11:00:13Z","title":"SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05517","snapshot_observed_at":"2026-08-02T04:39:26.757188Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.757188Z"},"links":{"cited_paper":"/paper/2408.05517","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:f4b72c16562bded41b516fe34e85cc92d59b27d26b5266ef2670c710b8a90b21","observation_id":"f5c2ae28-eea9-41e4-bc5a-c3c73aedd59b","resolution":{"observed_at":"2026-08-02T04:39:26.757188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11633-025-1625-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Machine Intelligence Research","work_id":"af9de48a-08f7-484a-95bc-d941575da215","year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.044921Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:0b1b666b722fb00c768fb97911f742471a2c05b90c8945e4aa0dd855f3704e30","observation_id":"442a94c7-6717-4492-bb28-a10773c75877","resolution":{"observed_at":"2026-08-02T04:43:29.612107Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:26.966070Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.966070Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:31012e880b749889b3de2c1db5e1a1f6dd0c54ca219dd644f33b337936553d37","observation_id":"cd422758-761a-4c67-aefb-0c9b5d860ff4","resolution":{"observed_at":"2026-08-02T04:39:26.966070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:27.045319Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:27.045319Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:2da734618a3b9e4a045869fc60c1427c7acccb603fab20ceafef434a83e5c5b1","observation_id":"4348f2d7-64ab-4baa-a470-bdf25410f2ac","resolution":{"observed_at":"2026-08-02T04:39:27.045319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-14T08:29:40.209724Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23372","snapshot_observed_at":"2026-08-02T04:39:27.176697Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:27.176697Z"},"links":{"cited_paper":"/paper/2507.23372","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:8bbb21428e32bcca147d31875cd78582cddadd3c44fb28df35907ce0f8371060","observation_id":"423c5ced-3169-4a71-8d84-f3d355418a2c","resolution":{"observed_at":"2026-08-02T04:39:27.176697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15513","last_updated":"2025-06-10T14:30:19Z","snapshot_observed_at":"2026-08-14T19:51:36.696522Z","submitted_at":"2025-01-26T13:10:12Z","title":"TinyLLaVA-Video: Towards Smaller LMMs for Video Understanding with Group Resampler","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15513","snapshot_observed_at":"2026-08-02T04:39:26.597389Z","title":"arXiv:2501.15513 [cs.CV] https://arxiv.org/abs/2501.15513","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.597389Z"},"links":{"cited_paper":"/paper/2501.15513","citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:10eb8f044fb8b019390c728e80c22375d7072a3f3dd7a4b87971b024b54a64c5","observation_id":"ca6bb9bc-a892-4943-a3f2-fc70019a7e86","resolution":{"observed_at":"2026-08-02T04:39:26.597389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:26.853743Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.853743Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:6a47c9c79bf1ec2b977375e93a54921fe0e310d9c5b52bc995a30f43d46f504a","observation_id":"08f76a6f-3c24-474f-87f6-99e608cdc1fb","resolution":{"observed_at":"2026-08-02T04:39:26.853743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:24.463895Z","title":"In Proceedings of the IEEE international conference on computer vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:24.463895Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:48fc1f11d2e67b25533d81fd5ac840cf5fc94782a020fe4a7c2bab099331503e","observation_id":"e08c2318-2c0e-4625-932e-06941fd1e921","resolution":{"observed_at":"2026-08-02T04:39:24.463895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.469431Z","title":"InProceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.469431Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:95203f8239af0f8f2c919d3d7ac58d07096e58a4c0e05c08d01ac69f79f4aa01","observation_id":"44b3269d-e116-4192-b83e-efadb942e06e","resolution":{"observed_at":"2026-08-02T04:39:23.469431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:23.015283Z","title":"InProceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:23.015283Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:6df8a6cf34bf49c6dcf01bc89412e028e70329391159eab8a0f0726949e5b91d","observation_id":"a903d1ad-a2c8-4433-b788-62bda966d91b","resolution":{"observed_at":"2026-08-02T04:39:23.015283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:22.506347Z","title":"In Proceedings of the 33rd ACM International Conference on Multimedia","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:22.506347Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:96ebfebd024abc4bf00e642a65c0c99a2a518108329fe02276e7501461e8271d","observation_id":"05d672d2-97b6-4a57-8dd3-4fe81f59e908","resolution":{"observed_at":"2026-08-02T04:39:22.506347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:39:26.916944Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:26.916944Z"},"links":{"citing_paper":"/paper/2607.16322"},"observation_digest":"sha256:6f5755d8c3db0b44f1f7892f683702348d3f10ece6244fa2c07db2b2450027b7","observation_id":"bf83e59b-847c-4207-97e2-e519360e97e6","resolution":{"observed_at":"2026-08-02T04:39:26.916944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16322","last_updated":"2026-07-15T09:37:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T16:59:32.184418Z","submitted_at":"2026-07-15T09:37:58Z","title":"GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2607.16322."}