{"as_of":"2026-08-08T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b0025fb73b024e1eaff31e582f651c1f326b3648f5075f8f695b2f0b704b805","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:47:51.995684Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02278/citation-record","integrity":"/paper/2509.02278/integrity","json":"/paper/2509.02278/citation-record.json","paper":"/paper/2509.02278"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.277180Z","title":null,"venue":null,"work_id":"65f621f1-7c80-4dbf-9ca6-af7d272267ce","year":2019},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.667441Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:49638e7e4073f3bbc761d006cc006a66254cfc34f0bb66efc99b5698a0fade25","observation_id":"5d794cb8-455f-4660-a93b-be07727ca0e0","resolution":{"observed_at":"2026-08-05T11:47:53.281630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04369","last_updated":"2024-07-14T17:16:43Z","snapshot_observed_at":"2026-07-06T16:58:23.647152Z","submitted_at":"2023-12-07T15:40:36Z","title":"SingingHead: A Large-scale 4D Dataset for Singing Head Animation","version":3},"cited_work":{"arxiv_id":"2312.04369","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.04369","snapshot_observed_at":"2026-08-05T11:47:52.279807Z","title":"SingingHead: A Large-scale 4D Dataset for Singing Head Animation","venue":"cs.CV","work_id":"7f037751-0c41-48ab-b4b3-db00cc19c4ed","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.741404Z"},"links":{"cited_paper":"/paper/2312.04369","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:364659380d11745a6f9a3a2c6ae5e889c94073c45dceca9a5cd90ac907d3480a","observation_id":"b24a38fa-0396-4ad6-98c0-f71dd78a304a","resolution":{"observed_at":"2026-08-05T11:47:52.284791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.262741Z","title":"Musicface: Music-driven expressive singing face synthesis,","venue":null,"work_id":"dbc69355-fc69-4280-bb23-7b6ab2c146e8","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.843881Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:65015991da52beebc32b4784cd4fe6ac2a2e5869c22f13d9aa26519ac43d972b","observation_id":"748eadf3-e237-4202-878c-11c90441f8da","resolution":{"observed_at":"2026-08-05T11:47:53.267369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.248674Z","title":"Let’s chorus: Partner-aware hybrid song-driven 3d head animation,","venue":null,"work_id":"6e0514f8-a407-4396-a6ed-ad1677af5078","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.917425Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:89675a953ee935fd2ff0dad207f6bc239cfd5ebecd13c2b84c45b438534d7b9f","observation_id":"6e8be1b5-c660-402c-96f1-31744de153a8","resolution":{"observed_at":"2026-08-05T11:47:53.252967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.233314Z","title":"Emotional commu- nication in speech and music: The role of melodic and rhythmic contrasts,","venue":null,"work_id":"20cbd109-4afd-4c3f-ad76-ca1b28737436","year":2013},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.020857Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:386f3d2ec522633c61a26d16c57fba560358d611a66575aeae54df88dc14a260","observation_id":"36c8f110-d2b4-4d17-8784-4f0dad6d4677","resolution":{"observed_at":"2026-08-05T11:47:53.237902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.219586Z","title":"Acoustic differences in the speaking and singing voice,","venue":null,"work_id":"a1d37b9e-5d35-4d57-a1c1-863aede843cd","year":2013},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.133745Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:051fb215c30fcb6e66e195b31b5dff0f350bb5882b0a7c136a320eff42c3af75","observation_id":"7718b787-9b42-4ac8-af27-5f3c19ae95b4","resolution":{"observed_at":"2026-08-05T11:47:53.223765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.205696Z","title":"Emotion in the singing voice—a deeperlook at acoustic features in the light ofautomatic classiﬁcation,","venue":null,"work_id":"5315ce81-da14-4b06-974c-0a4cf3284edf","year":2015},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.246697Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:139609d39822becb887c2157460c8f047b11574c6b12c4dbc2d31be264c22e45","observation_id":"cbf3b9f9-e874-4f3f-86d2-617f4fcd3a52","resolution":{"observed_at":"2026-08-05T11:47:53.209898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.192160Z","title":"Common cues to emotion in the dynamic facial expressions of speech and song,","venue":null,"work_id":"4187e60c-6a37-41d2-8789-1b770453cf66","year":2015},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.322855Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:999c4a0c48b501e86f139c1f02db7aefc9ae06fff26468df74dbf54706f265fe","observation_id":"3870d79d-6139-497b-b6c3-aa9752185cb3","resolution":{"observed_at":"2026-08-05T11:47:53.196170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.178458Z","title":"Occlusion-insensitive talking head video generation via facelet compensation,","venue":null,"work_id":"fe4f07a7-447c-4ddb-9a9c-c82ab84ce2cc","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.439783Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ddd90f2fef5839e49674556f4eea7de5a8227268eb67df335585b11066d0acb5","observation_id":"2ff66d46-b7ff-4a63-a05b-28559bb0f61d","resolution":{"observed_at":"2026-08-05T11:47:53.182822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03430","last_updated":"2024-12-04T16:19:47Z","snapshot_observed_at":"2026-07-06T20:01:36.670000Z","submitted_at":"2024-12-04T16:19:47Z","title":"SINGER: Vivid Audio-driven Singing Video Generation with Multi-scale Spectral Diffusion Model","version":1},"cited_work":{"arxiv_id":"2412.03430","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03430","snapshot_observed_at":"2026-08-05T11:47:52.259298Z","title":"SINGER: Vivid Audio-driven Singing Video Generation with Multi-scale Spectral Diffusion Model","venue":"cs.CV","work_id":"9f882c6c-051d-4805-9df0-c4f1fdf7b78a","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.534590Z"},"links":{"cited_paper":"/paper/2412.03430","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:b97f8c43918b8d737462059a1a1080e67ed2ec28a179915b431a270c73a905d8","observation_id":"b1dae37c-e687-4d06-9f3e-5c93c144d6d0","resolution":{"observed_at":"2026-08-05T11:47:52.264043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.164437Z","title":"X-portrait: Expressive portrait animation with hierarchical motion attention,","venue":null,"work_id":"45e38169-48eb-4f2e-88f6-a8f22d94afc8","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.664202Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:27aaa70a4eed820a4e6d245f813579036485aec457828610a9b26f139fb33793","observation_id":"b058fcd2-d6f3-4a9e-8213-a7e9047744f2","resolution":{"observed_at":"2026-08-05T11:47:53.168944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.150281Z","title":"Faceformer: Speech-driven 3d facial animation with transformers,","venue":null,"work_id":"a4623431-ae0c-4cc1-b3a3-a86f1a136d76","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.772329Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8e872eb8528d439e4e44ce9e2b2674586e5e3b650ce40ff03ab38ed9e49bf75c","observation_id":"33cdf02a-b89b-4715-ab6f-cbb2d0a93f25","resolution":{"observed_at":"2026-08-05T11:47:53.154598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.135851Z","title":"Codetalker: Speech-driven 3d facial animation with discrete mo- tion prior,","venue":null,"work_id":"3e6ca04f-44ee-4d1c-89b0-f5fec05b418a","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.901411Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:bcb4036e5113508e91f629800ebe374b1df11701897cae4a8dd0378a4f8cc292","observation_id":"25b0ed20-fa97-48a8-aeaf-47b0afd69145","resolution":{"observed_at":"2026-08-05T11:47:53.140162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.119837Z","title":"Facediffuser: Speech-driven 3d facial animation synthesis using diffusion,","venue":null,"work_id":"257d5d40-cc92-4d87-9bca-aba26aa35b6c","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.055282Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f743807b8a9abb42d52bc595190dd2b45f8e03cdcee1ec437561dad75cbd56cd","observation_id":"2655c60c-3d4f-4dc8-843d-a047bdf3271f","resolution":{"observed_at":"2026-08-05T11:47:53.124596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.104160Z","title":"Selftalk: A self-supervised commutative training diagram to comprehend 3d talking faces,","venue":null,"work_id":"620a0601-0cfc-40dc-987a-81656710a52e","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.218860Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c617f57f0aa88e94a67305f912cd0a5459b5330c172705e4daaf1de6645e0f9d","observation_id":"8bebf398-0ced-4f58-8987-368eb6374b83","resolution":{"observed_at":"2026-08-05T11:47:53.108790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.088088Z","title":"Singing emotionally: a study of pre-production, production, and post- production facial expressions,","venue":null,"work_id":"2fbaf0b7-a75f-498a-855f-a168587c1658","year":2014},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.306972Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:3e123ea1650d069bf37c17bcc2a311afde95ba58086b608186d14126302a8112","observation_id":"667a8fff-a2f2-4097-9867-15b3948077b2","resolution":{"observed_at":"2026-08-05T11:47:53.093217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.071946Z","title":"Jali: an animator-centric viseme model for expressive lip synchroniza- tion,","venue":null,"work_id":"8d7c4473-bf1a-4fb2-b5ac-b6f5330c129a","year":2016},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.436612Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8bcea5ff256c174abd36d5375cc75a478d5f4bee721be09457c217d3e329b2a5","observation_id":"a36d1eb1-ce64-418c-87c4-3600638ba7d4","resolution":{"observed_at":"2026-08-05T11:47:53.077012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.054531Z","title":"A deep learning approach for generalized speech animation,","venue":null,"work_id":"6ec05645-edf1-482f-9bc7-0ae8800970da","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.563632Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:07e4231915c325dcce6829762ea109c84f6b292d3a69102e4d5bb67b49979293","observation_id":"904fe5d9-ad5c-4864-835c-80b6780c4df8","resolution":{"observed_at":"2026-08-05T11:47:53.059327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.037425Z","title":"Dy- namic units of visual speech,","venue":null,"work_id":"9f4ab288-b597-42f6-854b-5e4022c52ab7","year":2012},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.607044Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c115a722ea05a115ff29639de95edba6ff29de40a615415f55c4611fd9262a1b","observation_id":"6f4cdee0-a006-4a24-80e1-d57c3d3a3cf2","resolution":{"observed_at":"2026-08-05T11:47:53.043169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.019560Z","title":"A practical and conﬁgurable lip sync method for games,","venue":null,"work_id":"bbe58c9b-4e40-4593-a7b4-51d9711ddcb2","year":2013},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.664557Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:150e49adab449e35abb0c4be820d4745127d6c7de513bb502b807efdc4667728","observation_id":"c8395fc5-958d-416c-95a3-f0410bf8aadc","resolution":{"observed_at":"2026-08-05T11:47:53.027215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.003980Z","title":"Visemenet: Audio-driven animator-centric speech animation,","venue":null,"work_id":"fd86974a-4a70-4e5c-bc7b-6c6251671d97","year":2018},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.819132Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:b59ef7874b505cc45ed3220bd57f0f840f25f371fee5d706c3b058869fc0bc0e","observation_id":"bfffccb0-f76c-4d25-b976-b2755e49c69c","resolution":{"observed_at":"2026-08-05T11:47:53.008433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.988331Z","title":"Capture, learning, and synthesis of 3d speaking styles,","venue":null,"work_id":"901affd6-8f94-4e96-8953-9715ac36bb02","year":2019},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.979461Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:5c5e3143b9551694c2ee490e0b3240ee8cb452d9a5f7b12a11f61a9e94e88e56","observation_id":"20bd65d0-84b1-4ce9-9909-40be054dd872","resolution":{"observed_at":"2026-08-05T11:47:52.993306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.972720Z","title":"Speech- driven 3d face animation with composite and regional facial movements,","venue":null,"work_id":"4c46a76e-1b1d-4b9c-aca1-0c40ecfb65ec","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.105294Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:07b25c3945a3ba00085b35531d229e462dd3cc58139492079caf49bb80e00146","observation_id":"7b024a8d-1c76-4d8b-9356-5939be7ef2df","resolution":{"observed_at":"2026-08-05T11:47:52.977409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.957171Z","title":"Meshtalk: 3d face animation from speech using cross-modality disentanglement,","venue":null,"work_id":"d8123c3d-56ce-43a4-9ef8-8bb4e83cf09a","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.180885Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:5d2cd2288ef1ab95a0abd94e61fff56e7ebad95912f95d99df4bea82121c6d09","observation_id":"eadf0f95-a5c4-418d-9678-30802fe9d33d","resolution":{"observed_at":"2026-08-05T11:47:52.961888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.941015Z","title":"Audio- driven facial animation by joint end-to-end learning of pose and emotion,","venue":null,"work_id":"0f445068-484f-4938-9583-9f7e7e9bfc66","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.286985Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:11e77ca29523f56fc15268df2132e91faa83d4e19963d169d1a15cb5b3f75b6c","observation_id":"0d7c9330-5dea-42a2-aaa3-0003563e9cfa","resolution":{"observed_at":"2026-08-05T11:47:52.945498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.925895Z","title":"Emotional speech-driven animation with content- emotion disentanglement,","venue":null,"work_id":"9a4c7bd8-45ba-49c3-ae9a-64d3c61c0964","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.368881Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c74606b842bc8117d44904361c84b880e8e9d7866694ea873ce94caa22c76a11","observation_id":"8f3b0589-ef95-4b13-8cb3-4398eff035c9","resolution":{"observed_at":"2026-08-05T11:47:52.930565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.908792Z","title":"Emotalk: Speech-driven emotional disentanglement for 3d face animation,","venue":null,"work_id":"e21f776d-bc3a-43d7-950a-be1ac0cd2b79","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.464912Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:e827b740b36b3c54f7796ffce02b65f58306910d60ffe83e25427265fac00b3b","observation_id":"c071ba47-f404-4585-947d-4a5e86ca25fd","resolution":{"observed_at":"2026-08-05T11:47:52.914387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.893492Z","title":"Mead: A large-scale audio-visual dataset for emotional talking-face generation,","venue":null,"work_id":"05a6577d-bdc7-478a-8d1e-c1ae94c721f5","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.543243Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:923e493e056edb17ad2681d24ee7a5d646c9fef8994c959c620c451c960de925","observation_id":"80883496-1681-4654-b7bc-750ef0b3bb57","resolution":{"observed_at":"2026-08-05T11:47:52.898184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.874481Z","title":"Ex- pressive 3d facial animation generation based on local-to-global latent diffusion,","venue":null,"work_id":"2271b22a-6c05-4b6b-a58f-ea83e13e0bc9","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.605424Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8922f090f04c8cfc13b2ae95a033a0ca0a49dea730949220923dc89a105df5ff","observation_id":"4552e344-ab86-45a4-a77a-cfcfb47e2e98","resolution":{"observed_at":"2026-08-05T11:47:52.879683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.856132Z","title":"Emoface: Audio-driven emotional 3d face animation,","venue":null,"work_id":"43755fd7-02cc-4074-b1a4-cd2b6ae75e08","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.682193Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:582e1450d66dcdbcc80bbff744b6c92b35b1ff98add6a85c3f9b652714ab99f1","observation_id":"e7cf192f-cf9c-4b80-9879-976301e87aa8","resolution":{"observed_at":"2026-08-05T11:47:52.860493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.841100Z","title":"Emovoca: Speech-driven emotional 3d talking heads,","venue":null,"work_id":"828bf8f4-8fe6-47cd-825e-e66933b486cd","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.750128Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:d81ebf51010a9a75c3fd7a8faf0571acf63c9904f6b3fb783994767a9acb37f3","observation_id":"d5f995dc-7f55-444d-b9b9-63fc3b563c83","resolution":{"observed_at":"2026-08-05T11:47:52.845880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.826319Z","title":"Learning diverse stochastic human-action generators by learning smooth latent transitions,","venue":null,"work_id":"0c9f8345-5e85-4ba6-ab58-b9bf6e905185","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.849998Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:3be06cb0cd301737a543a9cf10f675535d1c4216133f750ac898b78c68418265","observation_id":"c42e93c3-167d-4d21-bb56-81ecb96f788e","resolution":{"observed_at":"2026-08-05T11:47:52.830766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.811759Z","title":"Action2motion: Conditioned generation of 3d human motions,","venue":null,"work_id":"7f2c6100-ebc5-4339-8bc2-4bbd9fb47c32","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.898285Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:1634a2579c54776af09affb18591a25149042f1720367a8552fbede16e11287a","observation_id":"601a8519-f715-4303-b9b7-f534d7819dd5","resolution":{"observed_at":"2026-08-05T11:47:52.816099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.795867Z","title":"On human motion prediction using recurrent neural networks,","venue":null,"work_id":"55c420d4-9c23-4466-880b-3f10e9c8b5df","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.967393Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c4033aebf9e927d9fb3a53ccb10d595aa70130a4e2835c39d5b41c50a6a2ec2c","observation_id":"ea27e6da-be67-4e88-b942-5764ef5bd1a8","resolution":{"observed_at":"2026-08-05T11:47:52.800459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.780404Z","title":"Action-conditioned 3d human motion synthesis with transformer vae,","venue":null,"work_id":"139b05b4-27ea-4aee-ada2-8e3c98d990d5","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.047457Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8177cb4def38d22fed436648741e2b34c16db86266846d633c68a6841fbc1fc1","observation_id":"b466777a-1d5d-4297-aeef-0b5fb21cb5d4","resolution":{"observed_at":"2026-08-05T11:47:52.785050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.765207Z","title":"Temos: Generating diverse human motions from textual descriptions,","venue":null,"work_id":"dae95e16-2854-4ec9-972d-286fb861356b","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.121210Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:73d6aa1f5827d9ca802c3287724141bb0ea98f106eab7de18527737a2d7b1da0","observation_id":"04f69daf-f380-44ef-836a-5b9cd0ff5c63","resolution":{"observed_at":"2026-08-05T11:47:52.770042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.749642Z","title":"Tm2d: Bimodality driven 3d dance generation via music-text integration,","venue":null,"work_id":"704e8b1a-4080-4644-a760-2e979610ecd6","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.203943Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:d33d7c373b414a128e752c52906d178ba27a46ec9e74cfadcb0faf62cabc5e30","observation_id":"c253c313-c7ce-441f-817c-7f9d24d4c23c","resolution":{"observed_at":"2026-08-05T11:47:52.754447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-07-06T13:57:50.746457Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-05T11:47:50.283740Z","title":"Human motion diffusion model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.283740Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f6e47763303b93710e36f1fe5a0385c5e1655927a27d6f504d4b35f04265d176","observation_id":"ab5f7798-4079-452c-820f-6aaa32a622ec","resolution":{"observed_at":"2026-08-05T11:47:50.283740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-04T22:38:03.106382Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-08-05T11:47:50.317810Z","title":"Human motion diffusion as a generative prior,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.317810Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c1f4698ba43d88fe0fe09a42f33094a417c3914f5b8b8741328d95098e2f34e2","observation_id":"eca335c4-c273-47d9-8cb4-4368a377ae4e","resolution":{"observed_at":"2026-08-05T11:47:50.317810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19686","last_updated":"2024-09-29T12:26:24Z","snapshot_observed_at":"2026-08-07T05:00:30.112279Z","submitted_at":"2024-09-29T12:26:24Z","title":"Text-driven Human Motion Generation with Motion Masked Diffusion Model","version":1},"cited_work":{"arxiv_id":"2409.19686","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.19686","snapshot_observed_at":"2026-08-05T11:47:52.203035Z","title":"Text-driven Human Motion Generation with Motion Masked Diffusion Model","venue":"cs.CV","work_id":"3de50b19-18bf-4e61-a3e7-1f0b771beb2a","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.421909Z"},"links":{"cited_paper":"/paper/2409.19686","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:78c6b3d378631d2d60229c008a5daab4d26d903e00e577674bb2e9489d31d7c6","observation_id":"0b6197a0-99bb-4b67-a116-67de29bc3a1d","resolution":{"observed_at":"2026-08-05T11:47:52.209542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.733467Z","title":"Motiondiffuse: Text-driven human motion generation with dif- fusion model,","venue":null,"work_id":"82a2ab73-9450-48da-a936-77f6dd213c2e","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.463655Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:15c06d385db75205a8fba212a2b81ddcb531c980ff7d117d4ae9c5af1639a395","observation_id":"c46d0d54-fa8a-4ecd-a52a-cf25e46b370a","resolution":{"observed_at":"2026-08-05T11:47:52.738417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00334","last_updated":"2024-08-11T10:01:03Z","snapshot_observed_at":"2026-07-06T15:10:52.936785Z","submitted_at":"2023-04-01T15:10:02Z","title":"TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00334","snapshot_observed_at":"2026-08-05T11:47:50.527329Z","title":"Talkclip: Talking head generation with text-guided expressive speaking styles,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.527329Z"},"links":{"cited_paper":"/paper/2304.00334","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:743827778af1a5afeecf085b4a5a71e901733ac7bf829497a4107d434afe46c4","observation_id":"aafaaea3-8f20-4361-a88c-38dd72fe881e","resolution":{"observed_at":"2026-08-05T11:47:50.527329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.719182Z","title":"Avi-talking: Learning audio-visual instructions for expressive 3d talking face generation,","venue":null,"work_id":"8af0b04d-0815-46e3-81e1-df81781ee0d2","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.596143Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:1a423e8eed8ac2978cbd6820c128fe7f9bd557c9fddabf9b88d79ec4aca38d3f","observation_id":"c35e6c2c-41b7-4d18-b664-029ff60bca82","resolution":{"observed_at":"2026-08-05T11:47:52.723746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.704627Z","title":"Mmhead: Towards ﬁne-grained multi-modal 3d facial animation,","venue":null,"work_id":"a6debbc6-66ba-4cc2-be35-dab41c385b93","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.636304Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:a8570c4e3b88b4c74caf768f48d792d7978a22b34ee100399374dbe31438e1e3","observation_id":"346d843d-e105-4bd9-9567-f92e39f5cb2d","resolution":{"observed_at":"2026-08-05T11:47:52.709087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.690062Z","title":"The ryerson audio-visual database of emotional speech and song (ravdess): A dynamic, multimodal set of facial and vocal expressions in north american english,","venue":null,"work_id":"df0450be-9456-4851-9874-54adfa5edc5f","year":2018},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.702896Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:5e317a26d460fe6c131ea6eb0b96589443f3d7584b14a1ab3322689226fbb316","observation_id":"474e3c73-ccca-4d0f-8ad3-ccd37dfbdfcc","resolution":{"observed_at":"2026-08-05T11:47:52.694724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.674196Z","title":"Song2face: Synthesizing singing facial animation from audio,","venue":null,"work_id":"74ba0f4f-4daa-4c75-9fdb-06f5023ea761","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.770588Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8f6f9c458436cc892f2326bf37a853a8b195d2cff9e3e1191ad80a3b120f6734","observation_id":"82736750-9980-4a13-bbb9-29591b4a39ca","resolution":{"observed_at":"2026-08-05T11:47:52.678717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:50.824866Z","title":"Learning a model of facial shape and expression from 4D scans,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.824866Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:b77877357ad997c66b086788450aedb83cb43d787f322410cf8af2b4a8d4cb2b","observation_id":"ad71fe22-4b98-4145-8c67-4ab3d78a7cfc","resolution":{"observed_at":"2026-08-05T11:47:50.824866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.655420Z","title":"Emoca: Emotion driven monocular face capture and animation,","venue":null,"work_id":"367d91b2-6247-418c-856d-baff0783c59a","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.901780Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:0f051f9909fb76c8cdecd4a05e294751e6508362312e5033823a5b59b49358d7","observation_id":"1d105886-e5e5-4cee-b22c-89d25eb570e2","resolution":{"observed_at":"2026-08-05T11:47:52.662545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.639885Z","title":"Learning an animatable detailed 3d face model from in-the-wild images,","venue":null,"work_id":"b14b8c24-d970-4586-a477-2e7f5d5e944a","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.973331Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:32295bb52893997adeac9be4c9301b15b7e052668252e3dc2815238cc4397689","observation_id":"c32a6011-465d-43db-9599-9663845c177e","resolution":{"observed_at":"2026-08-05T11:47:52.644486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-06T05:31:42.749956Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-05T11:47:51.041119Z","title":"Visual speech-aware perceptual 3d facial expression reconstruction from videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.041119Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:58b1dd6c1550368edafbf999728b9f3bc31eb9bbaec45724b3855e6e263efcba","observation_id":"3bb0b6b6-f777-46df-92da-1279ade4ce8e","resolution":{"observed_at":"2026-08-05T11:47:51.041119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.625453Z","title":"Facial action coding system,","venue":null,"work_id":"36fa3ebe-f1b4-4b36-b7f7-81cb43b9c665","year":1978},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.111669Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:5788f975514789e0c724cb69df80e68d14c97d3ffbd5e98b58528eaaa8f4679d","observation_id":"ac4b4073-2383-4d07-80cd-95d1b8790995","resolution":{"observed_at":"2026-08-05T11:47:52.630230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.608228Z","title":"Emotion recognition from singing voices using contemporary commercial music and classical styles,","venue":null,"work_id":"216247ec-0930-4723-9f2c-b44264debcd6","year":2019},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.197489Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:5eb8bf91d9204976cbc202756f6cc67091a61ff07301a21de4a35b9574e41397","observation_id":"cbdb04b1-bf93-405e-baef-8c0c491226b2","resolution":{"observed_at":"2026-08-05T11:47:52.613884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.592436Z","title":"The expression of emotion in the singing voice: Acoustic patterns in vocal performance,","venue":null,"work_id":"376566cb-fbc6-4432-b309-a0df25034fb1","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.309393Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f7aeef0697941922c417fbf0e3b9571a719e970f26847de92736c35c8a794130","observation_id":"a1c3a6a0-1faa-4924-8e9e-dcf1ce7981d9","resolution":{"observed_at":"2026-08-05T11:47:52.597121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21315","last_updated":"2024-12-23T12:35:12Z","snapshot_observed_at":"2026-07-31T18:13:32.261738Z","submitted_at":"2024-07-31T03:53:14Z","title":"Beyond Silent Letters: Amplifying LLMs in Emotion Recognition with Vocal Nuances","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21315","snapshot_observed_at":"2026-08-05T11:47:51.385958Z","title":"Beyond silent letters: Amplifying llms in emotion recognition with vocal nuances,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.385958Z"},"links":{"cited_paper":"/paper/2407.21315","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:72cfd864f5370ba01478877829552cc1673562b0de399064ba55386cc60ae259","observation_id":"d2326d59-5d95-4bd5-8451-8b09c24fc493","resolution":{"observed_at":"2026-08-05T11:47:51.385958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.577326Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":"398e83cf-2846-44cf-99b5-c99bf3e9ba6c","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.463470Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:24d85a7e0fa931a4fde62075f290aa74aa7b14e089975872f8ecff23da1da7da","observation_id":"31c2dfe0-65ed-4a14-bef8-9903b894003a","resolution":{"observed_at":"2026-08-05T11:47:52.582097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.562189Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"1758151e-5fe3-4187-a0a9-f86d1ea6710e","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.573094Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:63436ede6309c54be224fb5cb737a8ac1513d410ff9fd33eb4791b95598540bb","observation_id":"e98b8603-e568-4991-9391-9bd73eda833c","resolution":{"observed_at":"2026-08-05T11:47:52.566788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.547748Z","title":"Observer-based measure- ment of facial expression with the facial action coding system,","venue":null,"work_id":"1221eeb2-c2bf-415d-802d-13c04a154238","year":2007},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.619714Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:781d51c2a7a2b1c9631235137d31f38ad0ce5fb444c0d52444b98718c008278a","observation_id":"363ec67b-5fb8-46c9-b984-2756e96d6762","resolution":{"observed_at":"2026-08-05T11:47:52.552240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.533191Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"fc5e8eef-8f4d-4af5-a661-72bd8ab0fe8e","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.760314Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:4488a6e641b37d80d47b9be5d8d565132d3295ea9864669ca36dcb24c27fef5a","observation_id":"3e928711-3677-43aa-b608-6fc2449919ea","resolution":{"observed_at":"2026-08-05T11:47:52.538182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.518510Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"236d25c7-15ab-4a74-97ce-101954f50d5e","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.810043Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:1539c7980079b2feb865640021f58d1847882148c15733547be2bc1249f32167","observation_id":"d23142c2-096f-4196-86f2-4858e0d15ffa","resolution":{"observed_at":"2026-08-05T11:47:52.523349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.504085Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"207709b7-84eb-4f4d-8755-ca7def8d4d97","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.895283Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ad10fb55cb5a44cdf9cf5af4693e7465ef578dc78da8d2b34b82ce6ab1fd87dd","observation_id":"b36928d7-50b1-42d8-bbf3-a700df727e22","resolution":{"observed_at":"2026-08-05T11:47:52.508463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.488539Z","title":"Scalable diffusion models with trans- formers,","venue":null,"work_id":"348ec36d-3867-485b-9230-e43d83b3a3b5","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.927815Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c490b22da290730f484217c89ae9821c3b4caf503adf18e7d9b38db20759907c","observation_id":"8d3d9e37-fcd3-459d-8c2f-f2a90f64b983","resolution":{"observed_at":"2026-08-05T11:47:52.493394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.474316Z","title":"Imitator: Personalized speech-driven 3d facial ani- mation,","venue":null,"work_id":"be08ebfc-3d46-48e1-a381-4e98985259b4","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.933031Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:4073396bb4cf1e9bc35bbc51bdda694ae6d3a30934fd02dd75c129022e2c4ae4","observation_id":"e3ea0edf-d88b-49c4-91e7-43bda0b33325","resolution":{"observed_at":"2026-08-05T11:47:52.478808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.459292Z","title":"Deeptalk: Dynamic emotion embedding for probabilistic speech- driven 3d face animation,","venue":null,"work_id":"679fecef-8592-4cb1-8861-8786846707fe","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.937248Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:3ce9dd286cb9c7284fdb77a17a0af604ea9a837f8b6e7e4cd3c381bed403dbc0","observation_id":"23658957-8630-4a5f-b552-1d9f6cf8b9af","resolution":{"observed_at":"2026-08-05T11:47:52.464085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-05T11:47:51.941596Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodal- ity , long context, and next generation agentic capabilities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.941596Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:d0c4cafdf2c4df596deb88ef04653d10a3ef2e900a5155fa47abe32a2d02f2d2","observation_id":"b535b4bf-0397-4e06-9378-8e7e898ee932","resolution":{"observed_at":"2026-08-05T11:47:51.941596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.444146Z","title":"Adan: Adaptive nesterov momentum algorithm for faster optimizing deep models,","venue":null,"work_id":"d96cfec5-2153-428b-b5fd-b76b271b8d3d","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.946111Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:a5c2da32157b53aab999a2a57ddfc1b3ea86cac910dcb1358ef502b13a108a45","observation_id":"594a4d58-c742-4a8b-b239-2df0df806bba","resolution":{"observed_at":"2026-08-05T11:47:52.448970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.429932Z","title":"Beat-it: Beat-synchronized multi-condition 3d dance generation,","venue":null,"work_id":"7dff2512-e8df-45e4-ae4b-df40da55b811","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.950326Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ff7b9f77abba070f6e084879e91ee9a667e79fa7c34345e6036df6f659134e1a","observation_id":"7193862b-8bb6-4f01-aa85-35724bd897ee","resolution":{"observed_at":"2026-08-05T11:47:52.434330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.414628Z","title":"Bailando: 3d dance generation by actor-critic gpt with choreographic memory ,","venue":null,"work_id":"1491f80f-efae-4770-b3df-9322fea95ac7","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.954781Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ac01efe6ed1300d94ca130cb5a3df988f2c1090e8d24c77f69efe6820a69ac5a","observation_id":"324e14b9-3d4e-4201-84ae-1695d7f9f033","resolution":{"observed_at":"2026-08-05T11:47:52.419743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.399875Z","title":"Edge: Editable dance gener- ation from music,","venue":null,"work_id":"9afc1b5f-ad95-4f8f-8b1b-18d5a8a448e2","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.959709Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:57718fc2f5a94963ed6f11c28490f1c81ac5fc7e2bf2db48831bba7f6cf794dd","observation_id":"550a664d-4914-4dea-aeff-bc3b2662363f","resolution":{"observed_at":"2026-08-05T11:47:52.404326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.385094Z","title":null,"venue":null,"work_id":"e2b55aca-a65e-47bc-80f6-ad5558946b3e","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.965817Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:2189eb0c539528425a7bd4f9a874763ae8a918631b5b3ec6eceb0677f44696a6","observation_id":"d3e61615-14f9-499b-b6e0-b705fecf3366","resolution":{"observed_at":"2026-08-05T11:47:52.389265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.369540Z","title":null,"venue":null,"work_id":"d024cfe3-3051-41b1-822b-a06e8e3941d5","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.971210Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:0f359d5a6fa31389b9d0182e8c38c54913959a57bd7efda617e6a9d783cd1395","observation_id":"16827f71-affc-4773-8dfb-08607c4be09b","resolution":{"observed_at":"2026-08-05T11:47:52.374764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.354304Z","title":null,"venue":null,"work_id":"8b2d0ab6-ab23-40e8-af41-c7c7a007954c","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.975408Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:768e57c5751a540227be87a0afd69ceb24ee1bba16c3c3e68aceb6159bcf4c81","observation_id":"42f21043-7771-49f1-86b2-cbf394332432","resolution":{"observed_at":"2026-08-05T11:47:52.359039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.338816Z","title":"lower”, “furrow","venue":null,"work_id":"5d6392a7-2f97-4119-9ef1-e7180da8e7a7","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.979970Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:dc9713d71ea480992d88a6fc4503d24fc73ca1645565205c80a58f3e95b2fa7c","observation_id":"ce5b041f-b2bd-4ac4-947a-1c616f21357a","resolution":{"observed_at":"2026-08-05T11:47:52.343335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.324065Z","title":null,"venue":null,"work_id":"c8fd2524-6bb1-4f60-9083-01a7b97cb555","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.985166Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8600863c3a49109737a6f0162c85a5cd0a23da52b1a9d26f94d3303134a6166e","observation_id":"10924845-49d3-4014-8451-9bbe39315ab3","resolution":{"observed_at":"2026-08-05T11:47:52.328345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.309801Z","title":null,"venue":null,"work_id":"a23b73de-900b-4e8e-b4c2-6b0ebbbfe7f5","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.990150Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:3852ee6c4dc367e0e20cdbfc429dee5efdd2ac699af35afdeb24444819ddb743","observation_id":"b2e062f8-701e-428f-9a0d-a0f6902836e6","resolution":{"observed_at":"2026-08-05T11:47:52.314091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.295230Z","title":"score: 4,5,4","venue":null,"work_id":"4025f1de-3cde-4ba2-b317-f2ff61be3ed2","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.995684Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f807d5be7f4be97dd995d13f63ee858c4b01e990c97975fe25b7f64c12ae09a8","observation_id":"9a92d657-06e7-4b08-95f9-6cac92ac8ba7","resolution":{"observed_at":"2026-08-05T11:47:52.299983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-05T11:47:44.562374Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":3,"verified_fuzzy":59},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2509.02278."}