{"as_of":"2026-08-13T10:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:863a69e1c1236ec9a99086377ec91dc66ffbb79d9b4080f2a3ea52a42d3fc079","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:03:40.424407Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17532/citation-record","integrity":"/paper/2411.17532/integrity","json":"/paper/2411.17532/citation-record.json","paper":"/paper/2411.17532"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.955947Z","title":"Text2action: Generative adversarial synthesis from language to action","venue":null,"work_id":"d353db3b-72bd-4f69-b001-3063fd93415e","year":2018},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:39.950413Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:6141e5ff84d7489eb5cca52cd8ed4a41944baf93131ea39f3160444059ad388f","observation_id":"805e7c67-56af-4ad5-8235-ab96cfe6bb1b","resolution":{"observed_at":"2026-08-12T12:03:41.964751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.908816Z","title":"Hp-gan: Probabilistic 3d human motion prediction via gan","venue":null,"work_id":"e5ce5866-7d46-4800-a2e2-b62c8e0de0be","year":2018},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:39.960409Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:cd47daccaec6ab476f6f69ab2fb8c8ddcfe91b119d4b06db5058d806dc91caf7","observation_id":"8f7849c8-5da6-44f8-be94-69c047dbce21","resolution":{"observed_at":"2026-08-12T12:03:41.923734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.867343Z","title":"Frequency domain analysis of human mo- tions in surveillance video","venue":null,"work_id":"c7ab8e10-97af-41cf-aace-1f3fb3c26a63","year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:39.967450Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:45ff18694117cd0e6a48efaccf2d370a2579984e427abd8411897d54f8c04328","observation_id":"3802c779-0429-4f10-b168-a648272b6220","resolution":{"observed_at":"2026-08-12T12:03:41.876436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.828576Z","title":"Fre- quency domain state-space system identification","venue":null,"work_id":"88169854-ff31-4742-8501-28676b65c409","year":1993},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:39.977259Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:ceac6ee4426d49911b1c24dc8ce0f6eda25dd82db904763c72f0704c417ec1bb","observation_id":"737d76c5-f6ec-46c6-a714-03854dfab9d3","resolution":{"observed_at":"2026-08-12T12:03:41.838376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:39.988961Z","title":"Executing your commands via mo- tion diffusion in latent space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:39.988961Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:9e6ac026c4b0bcdd7690d30bda56c44fb380df47b87d00c1d3faa78b7568e987","observation_id":"f0c620ff-9f18-443c-b0c9-7d1d37606a68","resolution":{"observed_at":"2026-08-12T12:03:39.988961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.758441Z","title":"Slowfast diversity-aware prototype learning for egocentric action recognition","venue":null,"work_id":"8379a221-2b62-41aa-9121-93859e46c6d0","year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.002159Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:fb798876b9c7980f0cd15aa6d619c48eb94e974d8282ffd99753e5bd0dd5b44c","observation_id":"b779188e-0c1e-4b44-8cfe-95a40dff1aec","resolution":{"observed_at":"2026-08-12T12:03:41.769083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09146","last_updated":"2024-04-14T05:28:46Z","snapshot_observed_at":"2026-08-13T06:23:44.782486Z","submitted_at":"2024-04-14T05:28:46Z","title":"Fusion-Mamba for Cross-modality Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09146","snapshot_observed_at":"2026-08-12T12:03:40.024276Z","title":"Fusion-mamba for cross-modality object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.024276Z"},"links":{"cited_paper":"/paper/2404.09146","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:32754ccf7700a68a7693559456a69f8e3a90eb97a52f4786e8fde421bd95362b","observation_id":"070f0797-74d3-4b53-a713-d4d4e20440bc","resolution":{"observed_at":"2026-08-12T12:03:40.024276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.703957Z","title":"Synthesis of compositional animations from textual descriptions","venue":null,"work_id":"92b5cf28-f479-4a5c-ac2a-b7113c26c3e1","year":2021},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.038273Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:68028aa5101ecd00759149e3e52684f7991273bb58ea19ad7292d0f7c6d39ee9","observation_id":"c9c157ca-c4e2-4d2b-ace0-a8a958a33142","resolution":{"observed_at":"2026-08-12T12:03:41.716589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.656162Z","title":"Tm2d: Bimodality driven 3d dance generation via music-text integration","venue":null,"work_id":"9dc4df55-f763-46a6-b791-0161e7d3826a","year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.046877Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:692181c7f1d9f0a703e52de2a20ce7515e6ff081dd0d32da9152067485b9bf69","observation_id":"7eb3285e-a32e-4dfe-9831-4ed02d816b87","resolution":{"observed_at":"2026-08-12T12:03:41.665529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-12T12:03:40.058052Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.058052Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:cb5d2a83843e2a15e7fe5cefe939d743ab85f49b3b5a6d55ddb4f413a72aeecf","observation_id":"e06f4d08-f725-409a-b8fa-8c22bc94c8dd","resolution":{"observed_at":"2026-08-12T12:03:40.058052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.066979Z","title":"Ac- tion2motion: Conditioned generation of 3d human motions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.066979Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:ff40dc03bca5f807108c72c9cb06b34688bbbf90afb5093110856fbc1a7da1df","observation_id":"1fec69f2-870c-4b66-b61d-d7d8ca361fb8","resolution":{"observed_at":"2026-08-12T12:03:40.066979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.079553Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.079553Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:cbd2ae656dfcf457e8f2fcb2f40c6caf1d4c785b7305f69adbaeb8b1ba966fbe","observation_id":"091fab5c-81e2-4026-8676-5eaa8939f3c1","resolution":{"observed_at":"2026-08-12T12:03:40.079553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.536325Z","title":"Tm2t: Stochastic and tokenized modeling for the reciprocal gener- ation of 3d human motions and texts","venue":null,"work_id":"247b02d4-14e7-4edd-a1fe-a097fbdec1de","year":2022},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.091432Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:9caa214d1f859ed8e5f69e998d209cad4ee721a4627c463fb719ea2c263b7377","observation_id":"2f761ef5-3345-4959-bf12-79bf4065186b","resolution":{"observed_at":"2026-08-12T12:03:41.553459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.480107Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"e0dafce6-f50d-41dd-aa82-508d9123cc21","year":2020},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.101558Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:d760bd64ecb46271054c9876172379cc6bd609520a49146358a96dd071759b69","observation_id":"a01aad46-6ce9-46b9-b0c4-e9f94aec2545","resolution":{"observed_at":"2026-08-12T12:03:41.494017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09873","last_updated":"2025-02-17T01:24:21Z","snapshot_observed_at":"2026-08-13T00:06:05.271694Z","submitted_at":"2024-05-16T07:49:24Z","title":"IRSRMamba: Infrared Image Super-Resolution via Mamba-based Wavelet Transform Feature Modulation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09873","snapshot_observed_at":"2026-08-12T12:03:40.108167Z","title":"Irsrmamba: Infrared image super- resolution via mamba-based wavelet transform feature mod- ulation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.108167Z"},"links":{"cited_paper":"/paper/2405.09873","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:276828c3d8eb6eb39abe2270b8f385c6d26e0b27a84824b10b7de63a4d868491","observation_id":"5a847840-8e0e-4f3c-ba21-69d100284c98","resolution":{"observed_at":"2026-08-12T12:03:40.108167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.435797Z","title":"Stablemofusion: Towards robust and efficient diffusion-based motion generation framework","venue":null,"work_id":"ab6ff23e-2942-4611-9962-26af3ff6f833","year":2024},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.115131Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:fbf0a7857af55195a0832b6a1337b42b03bb684744ec3d06d2e546163b3c44d2","observation_id":"3565ccc6-d513-42da-a91c-75723fb13a2f","resolution":{"observed_at":"2026-08-12T12:03:41.452163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.392126Z","title":"Motiongpt: Human motion as a foreign language","venue":null,"work_id":"359d7d1e-db19-4559-94f3-3968c5541dc1","year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.124736Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:8631af7706d45c99adaddd23cc17ac79890aa8857017d10ce33694cf7926836d","observation_id":"2d66b7e1-3bf2-47d2-956a-8f8b1f817401","resolution":{"observed_at":"2026-08-12T12:03:41.400984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09194","last_updated":"2022-10-05T01:06:04Z","snapshot_observed_at":"2026-07-06T13:53:55.769885Z","submitted_at":"2022-09-15T22:16:52Z","title":"Differentiable Frequency-based Disentanglement for Aerial Video Action Recognition","version":2},"cited_work":{"arxiv_id":"2209.09194","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.09194","snapshot_observed_at":"2026-08-12T12:03:40.723086Z","title":"Differentiable Frequency-based Disentanglement for Aerial Video Action Recognition","venue":"cs.CV","work_id":"62c74bd8-4c42-4973-99f1-ee9865fc6d56","year":2022},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.140662Z"},"links":{"cited_paper":"/paper/2209.09194","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:007a2f11f8828ad1aed7f3caceb473d6f20ac5967d6bce30bef526ad00edd1d9","observation_id":"706b7dc2-993a-4b7e-8366-eb59db7b5a82","resolution":{"observed_at":"2026-08-12T12:03:40.735347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.357460Z","title":"Tfformer: A time frequency information fusion based cnn-transformer model for osa de- tection with single-lead ecg","venue":null,"work_id":"90bab889-fb86-4b3b-97e9-0a7c9f49c4cc","year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.160468Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:9fb158db5b12be155434fa45cd7b887349b68ea51936ba4e67471d0e125d3ca8","observation_id":"13bd5395-9900-4c27-a8c0-72b99122d84a","resolution":{"observed_at":"2026-08-12T12:03:41.367914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19450","last_updated":"2024-08-07T17:30:16Z","snapshot_observed_at":"2026-08-12T23:54:50.258395Z","submitted_at":"2024-05-29T18:58:59Z","title":"FourierMamba: Fourier Learning Integration with State Space Models for Image Deraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19450","snapshot_observed_at":"2026-08-12T12:03:40.175898Z","title":"Fouriermamba: Fourier learning integration with state space models for image deraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.175898Z"},"links":{"cited_paper":"/paper/2405.19450","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:86bfdd42670c8c20b185d5b32a2e53c7b83d1c0ff1f14f456a2de3ff6132d330","observation_id":"a855cf21-c904-4bb4-9d19-5b382db37a41","resolution":{"observed_at":"2026-08-12T12:03:40.175898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04339","last_updated":"2024-12-14T18:41:03Z","snapshot_observed_at":"2026-08-12T23:48:29.295997Z","submitted_at":"2024-06-06T17:59:47Z","title":"RoboMamba: Efficient Vision-Language-Action Model for Robotic Reasoning and Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04339","snapshot_observed_at":"2026-08-12T12:03:40.189876Z","title":"Robomamba: Mul- timodal state space model for efficient robot reasoning and manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.189876Z"},"links":{"cited_paper":"/paper/2406.04339","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:718f292f974b55b32d10b69907920ddbef2538704ee48139b48b814b8178109e","observation_id":"185255c8-8d5b-447c-ada7-71861a3731c3","resolution":{"observed_at":"2026-08-12T12:03:40.189876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.199088Z","title":"Amass: Archive of mo- tion capture as surface shapes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.199088Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:1e10127fcac931c4d2d170e2c6f3f33eed2c241040ec4cd8ca03fe05d732c149","observation_id":"a6901443-6a18-4dbf-84b8-9887c18f86c9","resolution":{"observed_at":"2026-08-12T12:03:40.199088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.276637Z","title":"Temos: Generating diverse human motions from textual descriptions","venue":null,"work_id":"6cea8251-c177-4e8c-be81-6102c0d5552b","year":2022},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.212932Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:88887d26ead38237f76593d620e937fd2a67c0f7b066a8428db4a18ff8a25767","observation_id":"00ee6fa8-4573-4c81-aad5-ad7bc048866b","resolution":{"observed_at":"2026-08-12T12:03:41.294901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.238027Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"371e2b2f-87d4-491b-9dea-73d22a4695f5","year":2021},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.223447Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:d985638e2b3a216532074d11bd381c533a7122ab6cdd02440658526930bb58dd","observation_id":"5c2de1b4-9032-4343-a704-e9982b8ef39c","resolution":{"observed_at":"2026-08-12T12:03:41.254613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-04T22:38:03.106382Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-08-12T12:03:40.235762Z","title":"Human motion diffusion as a generative prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.235762Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:e5cad98bafca7fe6800081615705913cad2d6e55b4984fc3f50f2c3e6a4244ec","observation_id":"b4898f8f-9e29-4248-8c6f-d665fc786871","resolution":{"observed_at":"2026-08-12T12:03:40.235762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.208298Z","title":"Finestyle: Semantic-aware fine- grained motion style transfer with dual interactive-flow fu- sion","venue":null,"work_id":"221c58a2-5322-4c9b-8bff-c28c36e6422a","year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.245037Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:b343c21a4287899ee3b8add7ffbd736c2ba13eeb1c41c3169a7d798f4e7c8cad","observation_id":"4dba9771-143c-4a1c-bbb7-d564b43b98a3","resolution":{"observed_at":"2026-08-12T12:03:41.217290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.152822Z","title":"Motionclip: Exposing human motion generation to clip space","venue":null,"work_id":"195a0ed7-0f2b-4c5e-a716-219d53fc704c","year":2022},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.263376Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:8d4b0739ff6cf5195ea1f4bbd61a62dfbdead02e86a733e422dda6852908c95c","observation_id":"a0c1eafb-b821-4ada-a9b8-762eb3c8cc4b","resolution":{"observed_at":"2026-08-12T12:03:41.169833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.112460Z","title":"Human motion diffu- sion model","venue":null,"work_id":"12588a22-d31a-4ed3-9e19-3f1fc136b473","year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.273271Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:f4cddeecb5387d74a9470b6fa1c9fe71d3bccddda64aa9c7ffcc04bcfb0ba741","observation_id":"dbe4457d-1dfb-4ea8-b2eb-c66b477536f6","resolution":{"observed_at":"2026-08-12T12:03:41.121642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.287304Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.287304Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:6d8a80176338555e0bb0c2dcde13f9a2c17673cc62ea53d70594f35fc5b839f3","observation_id":"66a08cc6-197f-4737-bc4c-03ec432a2e01","resolution":{"observed_at":"2026-08-12T12:03:40.287304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04256","last_updated":"2025-09-10T06:02:46Z","snapshot_observed_at":"2026-08-13T00:36:53.747396Z","submitted_at":"2024-04-05T17:59:44Z","title":"Sigma: Siamese Mamba Network for Multi-Modal Semantic Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04256","snapshot_observed_at":"2026-08-12T12:03:40.305436Z","title":"Sigma: Siamese mamba network for multi-modal semantic segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.305436Z"},"links":{"cited_paper":"/paper/2404.04256","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:8777e3e3b13ad46aa0d43f3978e64904f3499f126291b95f64b5829b6b32e928","observation_id":"e07f31a4-c4ba-45ac-aa80-7de1e189202e","resolution":{"observed_at":"2026-08-12T12:03:40.305436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:41.050511Z","title":"Fg-t2m: Fine-grained text-driven human motion generation via diffusion model","venue":null,"work_id":"2342daac-3ccf-4343-a636-ad73472f996f","year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.316394Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:efa601cb39b65cb721e6dca217c245018ef26c6dc5e198d05cf765852b4c4e4f","observation_id":"0e670320-ad77-4f05-aa30-d655f76c8141","resolution":{"observed_at":"2026-08-12T12:03:41.063125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10679","last_updated":"2025-08-10T15:13:03Z","snapshot_observed_at":"2026-08-12T23:00:52.292224Z","submitted_at":"2024-08-20T09:31:03Z","title":"Alignment-free Raw Video Demoireing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10679","snapshot_observed_at":"2026-08-12T12:03:40.328142Z","title":"Demmamba: Alignment-free raw video demoireing with frequency-assisted spatio-temporal mamba","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.328142Z"},"links":{"cited_paper":"/paper/2408.10679","citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:f336417969b2b3cd44a5088e906e96e88b6876ee74bbaa754c3a87967bb43cf7","observation_id":"2a58c3d8-f335-40cf-b661-b7d7ce136346","resolution":{"observed_at":"2026-08-12T12:03:40.328142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.339064Z","title":"Physdiff: Physics-guided human motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.339064Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:c9b8f67808349acc29155742a0cfcfd1409494be0a1a6acda603e15d855bd5ff","observation_id":"613a51ad-ae72-43e9-8680-58fd3980f994","resolution":{"observed_at":"2026-08-12T12:03:40.339064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.995266Z","title":"Gener- ative motion stylization of cross-structure characters within canonical motion space","venue":null,"work_id":"eec89f56-3858-49b9-8b31-3b77c7e00a83","year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.349257Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:1bd7906b387faa6d5ebee3a6197908c4227bbcc61b52306b31bc0c02cc023d8e","observation_id":"276548ab-c021-4cc8-8833-d380386dc76a","resolution":{"observed_at":"2026-08-12T12:03:41.005394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.968775Z","title":"Motiondif- fuse: Text-driven human motion generation with diffusion model","venue":null,"work_id":"3068ee76-91d2-4501-a861-3af06469335f","year":2024},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.363819Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:ca21dc6e8b8cb804a5fa7c2f1ac426ea91c1e3ab9b9474db98d932c932f6de0d","observation_id":"60944d11-b371-4bcd-9647-250d8cd63c07","resolution":{"observed_at":"2026-08-12T12:03:40.976474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.916715Z","title":"Motion mamba: Efficient and long sequence motion generation","venue":null,"work_id":"7038c32b-7c02-4bc8-9fcf-82bdfcf9cacd","year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.395248Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:b5c4298bfeb69745edbeb9494ded76130944c48dfbfe6cce20d31ffde1036ad6","observation_id":"0530904c-2786-4350-be09-faee51e99599","resolution":{"observed_at":"2026-08-12T12:03:40.935389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:03:40.876213Z","title":"Attt2m: Text-driven human motion generation with multi- perspective attention mechanism","venue":null,"work_id":"8ea71c5f-5c53-49c6-8b38-16f34076f602","year":null},"citing_paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T12:03:40.424407Z"},"links":{"citing_paper":"/paper/2411.17532"},"observation_digest":"sha256:dd498e30d165f022899f569a30c433c5be1d165af6ebe7d3b2361de6aa36c8be","observation_id":"dfff1a87-ba85-4c1e-aa75-48a80b22a2ce","resolution":{"observed_at":"2026-08-12T12:03:40.886560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17532","last_updated":"2024-11-26T15:48:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T15:26:44.176567Z","submitted_at":"2024-11-26T15:48:12Z","title":"FTMoMamba: Motion Generation with Frequency and Text State Space Models"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2411.17532."}