{"as_of":"2026-08-08T01:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2a9da7da04f1599db826bdaae624a4d500ced9731e6671e2444da9eeef27e0b","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:05:17.605587Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06590/citation-record","integrity":"/paper/2507.06590/integrity","json":"/paper/2507.06590/citation-record.json","paper":"/paper/2507.06590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.755081Z","title":"Surface motion capture animation synthe- sis,","venue":null,"work_id":"21ee49e9-d953-4652-8f76-9b87abb41c7b","year":2018},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.030922Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:58723fb5fe9be9fcb64427821f33e21848444adb9603aafb0f7fa0419260159f","observation_id":"d7a20916-db73-465e-b05a-8f8024452bca","resolution":{"observed_at":"2026-08-06T19:05:18.758067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.745563Z","title":"Adaptive score alignment learning for continual perceptual quality assessment of 360-degree videos in virtual reality,","venue":null,"work_id":"11b61c31-f655-4ed2-821f-894b3a865221","year":2025},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.097349Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:f2a9ebc28c4d357e757dbe3ec8a63450521cb3abc0ff2f6044b5fba59ce968ef","observation_id":"989ead4a-b701-49ca-a33f-0fec9379d60c","resolution":{"observed_at":"2026-08-06T19:05:18.748901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.736229Z","title":"Two-character motion analysis and synthesis,","venue":null,"work_id":"ac6b01f7-cc2d-49d5-b26c-4529d90cbf3f","year":2008},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.180649Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:5dd62b960b78c30a161fee4499bb1d81173c88c8223dfbba610f85521453f479","observation_id":"2db31901-9e63-4667-bfff-15b9784b8178","resolution":{"observed_at":"2026-08-06T19:05:18.739233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.726439Z","title":"Hierarchical graph convo- lutional networks for action quality assessment,","venue":null,"work_id":"32e21e69-3de0-4975-b363-4d77074da95a","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.272983Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:a13f7b55f2737cd9c0eb303ca3dca361c901b2464bee65d9e027be8115885ffe","observation_id":"bf35708c-4283-48c3-ae25-5c654fc382e3","resolution":{"observed_at":"2026-08-06T19:05:18.729957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.716882Z","title":"Combining recurrent neural networks and adversarial training for human motion synthesis and control,","venue":null,"work_id":"513a0e1e-37c3-4e85-8cfb-060756fe6404","year":2019},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.367394Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:861a6d0c11923f3c145b9b4f1ccb2962c8efebc2e6b7f7f7483e25fcc5c06888","observation_id":"ba509069-8f57-4bbb-899e-a7ee71f88322","resolution":{"observed_at":"2026-08-06T19:05:18.720482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.706885Z","title":"Multi-task spatial- temporal graph auto-encoder for hand motion denoising,","venue":null,"work_id":"69a6be37-4d12-40c0-8cfc-24063c59d039","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.402658Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b3be54d400d071078e691abedb39544151788d6fd4ae3d97fcaa220a319aae06","observation_id":"4a49d6cf-48ab-448e-ae36-6370bf421c07","resolution":{"observed_at":"2026-08-06T19:05:18.710887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.697649Z","title":"Temporally guided music-to-body-movement generation,","venue":null,"work_id":"b411bc0b-1d32-40e8-8171-d3a77e166d73","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.494016Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:7a2d1b86eeb90fdad919ef43479248ac641c6f8625288a73495084691580d335","observation_id":"bfc4c8fa-c73c-477f-a3c2-8fb74499012e","resolution":{"observed_at":"2026-08-06T19:05:18.700778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.687827Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++,","venue":null,"work_id":"4ac5b5c0-0eaf-4e76-8f10-20c87b17b24d","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.573804Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:475e8f503416bdb69a54b28c32afbcc4b048546359197a24a365860bf7ba9d69","observation_id":"eda54066-0f6c-4ec9-ac90-9c4efc9b0a2b","resolution":{"observed_at":"2026-08-06T19:05:18.691613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.677881Z","title":"Self-supervised dance video synthesis conditioned on music,","venue":null,"work_id":"7086abeb-ca1f-46ae-98c9-f1596ae98128","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.659462Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:e8f9d511069b138ed0ad88f739e6c6a39e85a1f11d09de337691433bcf594d82","observation_id":"12349d5a-7c6f-40c2-8fcc-d8d8d3583948","resolution":{"observed_at":"2026-08-06T19:05:18.681103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.667351Z","title":"Deepphase: Periodic autoencoders for learning motion phase manifolds,","venue":null,"work_id":"c47585d3-fa59-4171-9dcf-fb8409e04b73","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.745885Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:a8aea94495e36dcde3acf311f3906ab7803b7eb2e5ebd8ea9fa374944efac4c0","observation_id":"9b121207-fa5a-440f-a0fa-9ea53d94c78a","resolution":{"observed_at":"2026-08-06T19:05:18.670930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.658015Z","title":"Edge: Editable dance generation from music,","venue":null,"work_id":"5549468a-c4b2-4fa7-bc9f-b52ea18b5816","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.818284Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:1dcc01c98a8e88eda116000228539c4d2d5fa2763f3624b570bded482f1d5583","observation_id":"f3e9f655-2f7e-40ab-baa3-e67580f2e3e9","resolution":{"observed_at":"2026-08-06T19:05:18.661127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.648838Z","title":"Rhythm is a dancer: Music-driven motion syn- thesis with global structure,","venue":null,"work_id":"66c5559f-de58-4223-b61c-bafb2daf8069","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.910346Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:219dcdb75a3bf4a14f4f9f148163ddf863e52128469ed7dde4bcb99d3f4fcd6c","observation_id":"d51e72a8-0353-4d66-9480-c3a54fbf1124","resolution":{"observed_at":"2026-08-06T19:05:18.652071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.638918Z","title":"Example-based automatic music-driven conventional dance motion synthesis,","venue":null,"work_id":"ee0b6503-307b-4213-a707-3359e73f315a","year":2011},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.966936Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:3677662b7675b28089152df40434c5a59db28b2ccc2966978725fb963753d089","observation_id":"c89d02d7-65b1-4496-8ac7-ec7f6c4891e8","resolution":{"observed_at":"2026-08-06T19:05:18.642128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.628814Z","title":"Action2motion: Conditioned generation of 3d human motions,","venue":null,"work_id":"68765936-64df-46ae-8e42-8ca4131292f8","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.089034Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:9a42fc34177a5fef1ffc2d871640c78eed3c31a65c81465a78cdc6b5833aa8f5","observation_id":"3047e9d6-b12d-43ad-8837-de9a65d88c59","resolution":{"observed_at":"2026-08-06T19:05:18.632246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.619396Z","title":"Action-conditioned 3d human motion synthesis with transformer vae,","venue":null,"work_id":"ba795b1a-3838-4fa9-a99f-b4a0f4e01891","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.215934Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:32bd45ac2be7492159a38599342bf979e985459be70e1415901874025d4c1f04","observation_id":"6c5988ee-8ae5-40f7-80a5-e0c7c1ae6c54","resolution":{"observed_at":"2026-08-06T19:05:18.622630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.609103Z","title":"Implicit neural rep- resentations for variable length human motion generation,","venue":null,"work_id":"96771900-375d-49ff-abb4-55340b0d511e","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.338432Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:c4cf5ab0f39d381748cefa13982c3807a1bcf723b26511973cd6882f2cd9dbf4","observation_id":"905f2cac-4a89-472b-a7f8-f273c8c95987","resolution":{"observed_at":"2026-08-06T19:05:18.613066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.597540Z","title":"Action2video: Generating videos of human 3d actions,","venue":null,"work_id":"1b171298-58aa-43bd-a801-57ffc1f3547d","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.466698Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:27ae8e66b06c9c4631bbf05c3badfb8e64796bc2b73b4675751bb8675a146fa6","observation_id":"2955bf3c-d855-497d-9985-66c2824ba61c","resolution":{"observed_at":"2026-08-06T19:05:18.600965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.585498Z","title":"Guided motion diffusion for controllable human motion synthesis,","venue":null,"work_id":"8605c7bc-276d-4cb0-a7eb-7bc1d04f5670","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.595553Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:8b40b3ca6681903e9e74c045d4bce1ddbdb14500fe9e9c303ca37650798ff19e","observation_id":"b3f56236-41b6-4d95-b46f-9fc919e69a43","resolution":{"observed_at":"2026-08-06T19:05:18.589774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17135","last_updated":"2024-07-24T13:55:48Z","snapshot_observed_at":"2026-07-06T16:54:02.725142Z","submitted_at":"2023-11-28T18:54:16Z","title":"TLControl: Trajectory and Language Control for Human Motion Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17135","snapshot_observed_at":"2026-08-06T19:05:12.700317Z","title":"Tl- control: Trajectory and language control for human motion synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.700317Z"},"links":{"cited_paper":"/paper/2311.17135","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:91f61217c0d1845a158e2c7add2420fe14bed19c01013e0bd14c36e6679c3b42","observation_id":"cfdfd965-ddf3-4213-857e-d1bbca967cef","resolution":{"observed_at":"2026-08-06T19:05:12.700317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-04T22:38:03.106382Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-08-06T19:05:12.822597Z","title":"Human motion diffusion as a generative prior,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.822597Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:a6883f8be24de7e09692e2d478afc63cc1f67c62544ace1e1010524b74a6caf5","observation_id":"4a308fec-cf61-4d37-bb9e-b55a914adac6","resolution":{"observed_at":"2026-08-06T19:05:12.822597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.574202Z","title":"Generating diverse and natural 3d human motions from text,","venue":null,"work_id":"223d7c0a-8da7-4273-ae61-c15b36b7168d","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.976966Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:78d465837b2864c29a4d85ec2f94733fb243735d84df2dfd68b26f8ac85a8838","observation_id":"7ddd2aa0-52c1-40a0-87e3-bbfb8ab27c33","resolution":{"observed_at":"2026-08-06T19:05:18.577862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.562756Z","title":"Temos: Generating diverse human motions from textual descriptions,","venue":null,"work_id":"23af4c7f-416d-4338-8adb-2638733c1828","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.129269Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:ec8209f7c1374d40c55ce0a09ea9015e6ae3f89d9a3253e153b1850da0360fb1","observation_id":"459bfc4b-6787-4e80-83d5-14ace21c966f","resolution":{"observed_at":"2026-08-06T19:05:18.566466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.553060Z","title":"Human motion diffusion model,","venue":null,"work_id":"cb3ab87f-8b70-47d0-941d-b4ac95f14a62","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.312685Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:94577d88f73153ef8f34a1d361085b3ba2535f82cbb86d0f7f5092f8969483cd","observation_id":"812fcb1b-e5ee-4816-8ace-b63c9271e1fa","resolution":{"observed_at":"2026-08-06T19:05:18.556409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.542296Z","title":"Executing your commands via motion diffusion in latent space,","venue":null,"work_id":"8e7ff511-1100-4e6d-9369-a9b0db2e1d10","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.487879Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:3fce65056f97392a1b7200b31afa7ab4c5b97e08ee0d1a4337ba88cf5cdfe177","observation_id":"2ce66227-71d5-4717-b4c4-bc33b02dddf3","resolution":{"observed_at":"2026-08-06T19:05:18.546172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.530473Z","title":"Mo- tiondiffuse: Text-driven human motion generation with diffusion model,","venue":null,"work_id":"fbe196b2-6ba9-4999-883b-35cb9f55be86","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.663363Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:7fab3b89686121423e9f435fcbaab670d3ee8836d883c61f3f80c4ee8decaf46","observation_id":"d9e15e84-6a23-463c-a334-519942a7f9d5","resolution":{"observed_at":"2026-08-06T19:05:18.534073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.520614Z","title":"A two-part transformer network for controllable motion synthesis,","venue":null,"work_id":"3cf28d25-94a7-4d69-b802-032006573120","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.861972Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:f665c83faaacc0fe8da572cbbde8b2f11086764589deefd2b4a0b779efd2d9e5","observation_id":"03f0ff3b-83fd-4ea0-bad5-371e3b4b7870","resolution":{"observed_at":"2026-08-06T19:05:18.524141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.509857Z","title":"Generating animated videos of human activities from natural language descriptions,","venue":null,"work_id":"50e30bd2-3e28-4b90-9e19-1b636bfd6654","year":2018},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.064407Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b8938328cabd9c1f1197fb6fbf1e5bd1e4b84a65315eb06c8af32457f507e730","observation_id":"79b3a158-ef91-4d24-b579-2de74e9cd714","resolution":{"observed_at":"2026-08-06T19:05:18.513074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.499314Z","title":"Language2pose: Natural language grounded pose forecasting,","venue":null,"work_id":"67ac9ab3-7aef-4d80-9330-e5d875f1e1d0","year":2019},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.312204Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:42476a5d0e61a74d81a093e0bcc24badbf0c2f2349623bc3560439531c2caedc","observation_id":"81b94fb2-2fe7-4cc4-91ee-82947c68a9f5","resolution":{"observed_at":"2026-08-06T19:05:18.502831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.488247Z","title":"Synthesis of compositional animations from textual descriptions,","venue":null,"work_id":"85f76b53-4696-4120-b773-e155549ea32d","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.529872Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:f9b1cd26d6564ddad3d05d6db2177afdd883cff5fe8ddcb6007cd20971e2c55a","observation_id":"30d94ee8-48d9-4f6f-9f12-e56174e14ed0","resolution":{"observed_at":"2026-08-06T19:05:18.492278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.477458Z","title":"Text2gestures: A transformer-based network for generating emotive body gestures for virtual agents,","venue":null,"work_id":"203e04bf-9bce-4f44-aa88-b2500141c5f3","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.667842Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:2c37ddd2a30cb91b21ec720114bbc7033e547c79c418df39276d23e4d14e9fd4","observation_id":"cffd4cc2-9f95-4c36-9894-85ce87ce5b29","resolution":{"observed_at":"2026-08-06T19:05:18.481263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.466792Z","title":"Tm2t: Stochastic and tokenized modeling for the reciprocal generation of 3d human motions and texts,","venue":null,"work_id":"04a3a868-5b9e-4c9e-a211-e61f5d42f454","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.757232Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:4f440e4fe593318d7330f9a04c1c2628d0eb286491dab12d83a2b2da256a365c","observation_id":"0a4fbdcd-8001-4a30-af6b-6f80629f6ef5","resolution":{"observed_at":"2026-08-06T19:05:18.470565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00063","last_updated":"2023-11-29T19:04:10Z","snapshot_observed_at":"2026-07-06T16:55:17.192399Z","submitted_at":"2023-11-29T19:04:10Z","title":"MoMask: Generative Masked Modeling of 3D Human Motions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00063","snapshot_observed_at":"2026-08-06T19:05:14.872481Z","title":"Momask: Generative masked modeling of 3d human motions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.872481Z"},"links":{"cited_paper":"/paper/2312.00063","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:8276fbae17c9cc0b207546472ae370647a365442ff54c8558b19d66bfa75f04b","observation_id":"5c8891ef-98e6-400a-9522-84f5a66999b2","resolution":{"observed_at":"2026-08-06T19:05:14.872481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.455337Z","title":"Generating human motion from textual descriptions with discrete representations,","venue":null,"work_id":"eb4ee896-c0ce-4007-9020-d8a48f79af01","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.957867Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:5f085bafe60e9a7102b1982b42b1b17676be77376a2ccdc59b3307a372511947","observation_id":"0b83869b-b0c4-43f3-a883-65b1c71eb2dc","resolution":{"observed_at":"2026-08-06T19:05:18.459707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.444606Z","title":"Tm2d: Bimodality driven 3d dance generation via music-text integration,","venue":null,"work_id":"9d6e997c-01f1-4065-9549-86a179d1065b","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.014882Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:f8fffc2ea83011184c7181e571a0e47f1c8cfddc04a45f01d772546c7749c0c8","observation_id":"00155982-36a2-4696-b483-99fba34f62cd","resolution":{"observed_at":"2026-08-06T19:05:18.448532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.432648Z","title":"Motiongpt: Human motion as a foreign language,","venue":null,"work_id":"445a6937-a865-4422-a0aa-28cc0d18ef69","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.102847Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:133bbba11c92b5c4fb0f9e86c0aeb569fcc7caac69f94560e8c0a8837f8829f7","observation_id":"aa26e5b6-907e-4434-b383-850aad09de10","resolution":{"observed_at":"2026-08-06T19:05:18.436418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.420757Z","title":"Fg-t2m: Fine- grained text-driven human motion generation via diffusion model,","venue":null,"work_id":"06d77a3a-b8a6-4d66-b14e-94e5c2960a37","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.201528Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:53bac7a3c026c52aef6b0f0e305d92d89134a873906e7dc702d499cf96aa2747","observation_id":"a53a58dd-722f-4265-a70e-63a46b52c6e4","resolution":{"observed_at":"2026-08-06T19:05:18.424329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.410682Z","title":"Human motion diffusion model,","venue":null,"work_id":"fdffd3a5-a7f8-41cc-889b-d210328e20fc","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.271245Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:5e76317c9ff47f44b7d2ad770afe2c540069235e3bbbd9913c79cce574a89da2","observation_id":"c32ee190-3a31-4fdb-be21-3cbf0f6f438f","resolution":{"observed_at":"2026-08-06T19:05:18.414309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.399852Z","title":"Flame: Free-form language-based motion synthesis&editing,","venue":null,"work_id":"dcd25c7a-4ceb-40d2-979a-f91c9d6354a6","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.382608Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:ee389502125b2c13f42ff68c985b17bfda98c0e1d4a6cfe18f99350dfb5d2368","observation_id":"34013278-2e9d-4cc9-b670-b0e60c21d151","resolution":{"observed_at":"2026-08-06T19:05:18.403638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.343940Z","title":"Guess: Gradually enriching synthesis for text-driven human motion generation,","venue":null,"work_id":"5157787f-57a6-49d0-92bf-2c54a71ec7d7","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.466621Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:fbb474fcad0342d4f44495ed3dca8e6b283356cff8aff90dba77a8b9b78b51be","observation_id":"4d7f26d8-1651-4740-969d-ac6859a7ce55","resolution":{"observed_at":"2026-08-06T19:05:18.391969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01116","last_updated":"2023-04-03T16:29:00Z","snapshot_observed_at":"2026-07-06T15:11:32.429514Z","submitted_at":"2023-04-03T16:29:00Z","title":"ReMoDiffuse: Retrieval-Augmented Motion Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01116","snapshot_observed_at":"2026-08-06T19:05:15.554689Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.554689Z"},"links":{"cited_paper":"/paper/2304.01116","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:c258f7da23001d62f45cc8e9869e8c3f93d4862ec56532c90633570406f17794","observation_id":"8bc565f4-1bd0-4dd0-9820-45f703bfe01a","resolution":{"observed_at":"2026-08-06T19:05:15.554689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.103720Z","title":"The kit motion-language dataset,","venue":null,"work_id":"e01178f1-a479-4684-b3e9-974333d7a6b6","year":2016},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.665731Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:c9fb54fa9c0b242d1ca884f378cb35c0f8535772124e7cd13310a534108b79bb","observation_id":"845a39eb-a8a4-49dc-95f2-26ababc4d37a","resolution":{"observed_at":"2026-08-06T19:05:18.216750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.012793Z","title":"Attt2m: Text-driven hu- man motion generation with multi-perspective attention mechanism,","venue":null,"work_id":"d3c2869f-6d46-474d-87f4-eb1652e5f7f8","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.756167Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:8b29ce58e5c4c10e965999479f26022dace7fe498c50f5bf4c7e3cadd6b1ffc1","observation_id":"c0a9ab5b-fc46-48df-8f14-d329907d9277","resolution":{"observed_at":"2026-08-06T19:05:18.090613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03596","last_updated":"2024-03-28T03:26:51Z","snapshot_observed_at":"2026-07-06T16:57:46.724781Z","submitted_at":"2023-12-06T16:35:59Z","title":"MMM: Generative Masked Motion Model","version":2},"cited_work":{"arxiv_id":"2312.03596","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.03596","snapshot_observed_at":"2026-08-06T19:05:17.712459Z","title":"MMM: Generative Masked Motion Model","venue":"cs.CV","work_id":"6a305628-7e5a-41d8-b3a6-c4a2c47f2782","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.847604Z"},"links":{"cited_paper":"/paper/2312.03596","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:eb104dd6671a84bb5c15401f5f84a085e45c1e18a0c7c048dba4d9a587123a23","observation_id":"055f5fa3-5f19-4b89-a492-68e73ae5102a","resolution":{"observed_at":"2026-08-06T19:05:17.715917Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.977263Z","title":"Moconvq: Uni- fied physics-based motion control via scalable discrete representations,","venue":null,"work_id":"970587fb-1530-4bcc-9fb2-45627d643ea7","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.969431Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:cad86a31c0f4f1837a9b0197802d20e1c271a8ca2c7fdc8269d32aba26b37a5e","observation_id":"a4e9c966-4bcd-4944-b874-7a483f1cdcbe","resolution":{"observed_at":"2026-08-06T19:05:17.984295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.963300Z","title":"Ase: Large- scale reusable adversarial skill embeddings for physically simulated characters,","venue":null,"work_id":"d8683346-7452-4062-a156-d573eec87bda","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.055440Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:1ae9eda704891b5aab2486ad1338d9c656b9a190a3fabd88c5ad2054f3abcb9a","observation_id":"b243e724-8277-4e80-93f9-753598e74f61","resolution":{"observed_at":"2026-08-06T19:05:17.967875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.951842Z","title":"Physdiff: Physics- guided human motion diffusion model,","venue":null,"work_id":"377656c8-b7a9-4d1b-a5ec-df9aeaca4d6b","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.121121Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:09baf8bb1e6bb92da472396369062fe39684c869ceb0b7575863ba8750be2ede","observation_id":"6d24086d-83a4-4ddf-bbcf-9c0a31518d10","resolution":{"observed_at":"2026-08-06T19:05:17.955358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.937904Z","title":"Posescript: Linking 3d human poses and natural language,","venue":null,"work_id":"57b2af83-a200-41c3-831e-90b18cd262eb","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.207010Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:c1802917bf5df11e0f953c14e835dc1ca01e33725a6474925f70cc73c773fad8","observation_id":"62d35948-5884-4b99-9db5-ac013c4f16ac","resolution":{"observed_at":"2026-08-06T19:05:17.943978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13900","last_updated":"2024-09-19T14:03:00Z","snapshot_observed_at":"2026-07-06T17:47:55.578224Z","submitted_at":"2024-03-20T18:11:10Z","title":"CoMo: Controllable Motion Generation through Language Guided Pose Code Editing","version":2},"cited_work":{"arxiv_id":"2403.13900","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13900","snapshot_observed_at":"2026-08-06T19:05:17.698675Z","title":"CoMo: Controllable Motion Generation through Language Guided Pose Code Editing","venue":"cs.CV","work_id":"4d086da3-8478-40f2-badb-ae33738ff2cf","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.269616Z"},"links":{"cited_paper":"/paper/2403.13900","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:0d8d3669588c0546e27dabbee2508167bbac782f2fa110e64ca265f4440e0778","observation_id":"1d66729d-b5be-4962-b006-beb616118d49","resolution":{"observed_at":"2026-08-06T19:05:17.702272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.922193Z","title":"Fg-t2m++: Llms-augmented fine-grained text driven human motion generation,","venue":null,"work_id":"10f3a0b1-e7b5-428c-bb0f-0840c3fbeef6","year":2025},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.347230Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:76503c9f83f70a6fa7b8302b44b9a935bb710938ab0310309f5b790114140d00","observation_id":"1241cb61-694b-455c-82fd-f80a4eab5455","resolution":{"observed_at":"2026-08-06T19:05:17.928491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.909570Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"4f17f785-8551-486d-9dc4-ecdae5952909","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.421532Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:365da3ef2a519b183eb23e670e2b839f9ff666b9b8838ebc0c1f5d57d60ef6cf","observation_id":"56fbe260-2da6-4d82-8cf6-c244db4d3ba7","resolution":{"observed_at":"2026-08-06T19:05:17.914079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.898234Z","title":"Text-to-motion retrieval: Towards joint understanding of human motion data and natural language,","venue":null,"work_id":"1cde3d1e-5f6d-41a3-8748-d1664c7efc94","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.498594Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:effff2edc4e5b1a04c370c108f5e6e87ad8aa8c4216e8b96f32278511d864fb1","observation_id":"aefecad9-0e9f-42fb-ba65-deb36f6a3680","resolution":{"observed_at":"2026-08-06T19:05:17.903135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.883749Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"00bd4948-c50d-4978-9553-89108acd3704","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.591242Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:ab86cde13d84d9861c4960c1a12628cbdfe4c6a6da5188e794ab29d7ff1fac0f","observation_id":"3baa55f0-78cb-4764-b955-e175319255f3","resolution":{"observed_at":"2026-08-06T19:05:17.889886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.869724Z","title":"Attention is all you need,","venue":null,"work_id":"ae64dd2f-6586-419c-b80b-7f41fd5743f5","year":2017},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.710754Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:d6d484a2e976b3f545801e9f221b0c0e13d499a1f6ca1edd7f0ea22655434c93","observation_id":"ecdb8c73-efe0-4009-a52e-e80895690647","resolution":{"observed_at":"2026-08-06T19:05:17.873879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.857123Z","title":"TMR: Text-to-motion re- trieval using contrastive 3D human motion synthesis,","venue":null,"work_id":"a9d65e87-2406-413f-8729-970f6270246d","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.783339Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:faf27b2e8a6343904149d75e8e20d26538b382ec5eb10afebf6f79f3a7508857","observation_id":"428a3448-992a-4d3d-9319-d062f654bc37","resolution":{"observed_at":"2026-08-06T19:05:17.862185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.845392Z","title":"Fine-grained semantically aligned vision-language pre- training,","venue":null,"work_id":"a0ad1aff-8364-4c24-a120-e21211a01e00","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.796067Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:3115917847d01fdf1bce516153f193e174b8e190a5ba19d86990ed4d34bbac77","observation_id":"d3f87205-782d-404c-8930-da7a0843bacc","resolution":{"observed_at":"2026-08-06T19:05:17.849199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.833537Z","title":"Random shap- ley forests: cooperative game-based random forests with consistency,","venue":null,"work_id":"576e0973-3ffa-4967-9238-54509d0093bd","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.873276Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:70aeb5b90b9a6d6cfa279b0a1dc172eb7a91b5dda73b50beaa7e30ecf62b7de2","observation_id":"0042f53a-d7ec-4815-9d60-bf49c50a2c53","resolution":{"observed_at":"2026-08-06T19:05:17.836973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10049","last_updated":"2023-05-18T06:27:06Z","snapshot_observed_at":"2026-07-31T00:47:21.156357Z","submitted_at":"2023-05-17T08:42:53Z","title":"TG-VQA: Ternary Game of Video Question Answering","version":2},"cited_work":{"arxiv_id":"2305.10049","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10049","snapshot_observed_at":"2026-08-06T19:05:17.684547Z","title":"TG-VQA: Ternary Game of Video Question Answering","venue":"cs.CV","work_id":"ef6978ae-4731-449c-bd9e-391d0f82f549","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.974524Z"},"links":{"cited_paper":"/paper/2305.10049","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:89490fe183c5285c5c6a86f7a6ec5927e00090dbe9428e42db13cae9e389e2e2","observation_id":"f880c27c-27bd-4832-9f51-5ffb06b0122e","resolution":{"observed_at":"2026-08-06T19:05:17.688234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.823647Z","title":"Weighted banzhaf power and inter- action indexes through weighted approximations of games,","venue":null,"work_id":"9d4a14f7-9129-457f-8460-95346c400f84","year":2011},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.084340Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:a41a9be77b98a01cd0f681a2020bcc8328f29c4e87d3032e6cf68ccd0f57cc36","observation_id":"2a43ced9-e990-4c8c-bc27-4083c869b55f","resolution":{"observed_at":"2026-08-06T19:05:17.827384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.813380Z","title":"Video-text as game players: Hierarchical banzhaf interaction for cross- modal representation learning,","venue":null,"work_id":"e70b7eec-3380-4469-875b-595abbb3de49","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.209160Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b72c158e02a69865b103f2ee9212bcb016a2093acb834053e6a7cf83c16440cc","observation_id":"ae19982a-ab71-498a-9aeb-6431fa57444b","resolution":{"observed_at":"2026-08-06T19:05:17.816932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.803422Z","title":"An axiomatic approach to the concept of interaction among players in cooperative games,","venue":null,"work_id":"79d0b582-c69d-4af8-94f3-5db0ff01f9e2","year":1999},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.363449Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:604555dd37d0d0046ababcd310fadb0552601cf6645f428487b1afe5f2456398","observation_id":"58dbcbc6-cc10-4f25-bf97-650d404c0aed","resolution":{"observed_at":"2026-08-06T19:05:17.806647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.793608Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"ee749cfa-e9eb-42d6-816a-9812089bc048","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.516014Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:ec38053e8678147ca74cb5b627420740ff43660a3eac3ecf4308de745d693970","observation_id":"7573f23f-9cd8-4b31-a928-c4dcda7d8944","resolution":{"observed_at":"2026-08-06T19:05:17.797084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T19:05:17.587570Z","title":"Representation learning with contrastive predictive coding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.587570Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:42a69cbe0bf1809dcd3ec50f59fe4d1e3f85a8a995510825a1ec69229d487e78","observation_id":"b185ea9e-390e-4ab8-9f77-09ffe117ec18","resolution":{"observed_at":"2026-08-06T19:05:17.587570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T19:05:17.591745Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.591745Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:2ea5009703e0f84623abe9378d2f5c925f25da60fd3bb3e756188b1ba67e23c0","observation_id":"316c5d5d-1418-4c78-962a-65306ef9c8d5","resolution":{"observed_at":"2026-08-06T19:05:17.591745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.784064Z","title":"Efficient attention: Attention with linear complexities,","venue":null,"work_id":"700ee41b-f5ca-4b37-a84d-e0d3c7d2118c","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.595479Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:c4959da8e6cab55afe9bb1af82aa31d410b8634e1d84f6a82bfde7dc2dd34c3b","observation_id":"c0a0af57-b7f5-478c-99b7-edf5c8dc5bc1","resolution":{"observed_at":"2026-08-06T19:05:17.787224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.774111Z","title":"Amass: Archive of motion capture as surface shapes,","venue":null,"work_id":"d831539d-de62-4f91-87a1-193c1a052889","year":2019},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.599083Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b876c2a178145178c5e28f6405c8410a4e63512846eb1d87c35b83c59c7a8d1d","observation_id":"14a29102-65e0-460b-9132-4c08196fd576","resolution":{"observed_at":"2026-08-06T19:05:17.777364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.763449Z","title":"Finemogen: Fine-grained spatio-temporal motion generation and editing,","venue":null,"work_id":"1542b7e6-ed2a-4632-acac-b875aa0db500","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.602314Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b792fbeed20a890d66e443b52125a6d6e4e7e29157fa15bf5a7753d4ee1e7cf5","observation_id":"56ec4982-1186-4300-bebd-055c22bf0d29","resolution":{"observed_at":"2026-08-06T19:05:17.767147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16468","last_updated":"2023-11-28T04:10:07Z","snapshot_observed_at":"2026-07-06T16:53:35.776613Z","submitted_at":"2023-11-28T04:10:07Z","title":"AvatarGPT: All-in-One Framework for Motion Understanding, Planning, Generation and Beyond","version":1},"cited_work":{"arxiv_id":"2311.16468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16468","snapshot_observed_at":"2026-08-06T19:05:17.642636Z","title":"AvatarGPT: All-in-One Framework for Motion Understanding, Planning, Generation and Beyond","venue":"cs.CV","work_id":"3eecc231-47ea-4437-b402-7126f7797cc5","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.605587Z"},"links":{"cited_paper":"/paper/2311.16468","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:5419154ad6d17ceb9de4aaf530c4f98075905e6d98d460c6c0620c4beecdb8f2","observation_id":"ca5481eb-bacb-49ec-bf30-869238a627ac","resolution":{"observed_at":"2026-08-06T19:05:17.648713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T18:57:13.941090Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":4,"verified_fuzzy":57},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2507.06590."}