{"as_of":"2026-08-08T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c4c9dd5925b07471d35f788926477e976caeffa9227fb97ae72ad2dfe42c7a15","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:08:12.906852Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17769/citation-record","integrity":"/paper/2607.17769/integrity","json":"/paper/2607.17769/citation-record.json","paper":"/paper/2607.17769"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:09.864207Z","title":"Including signed languages in natural language processing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:09.864207Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:dd08fb916dc553758c6d3aa401bafab07a9ee822187a0f682417fb2a867d3f70","observation_id":"4aa120ed-5dde-481e-b0c7-22fe2197e095","resolution":{"observed_at":"2026-08-01T17:08:09.864207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.001627Z","title":"Signbot: Learn- ing human-to-humanoid sign language interaction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.001627Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:8cdfbd29b8f30eef4ac3e8d65029c8167bc49f5c61e70e5bcd4dc98b4a5a3f89","observation_id":"33d5dad9-3721-4378-8578-eb750065608e","resolution":{"observed_at":"2026-08-01T17:08:10.001627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.134423Z","title":"Towards online sign language expression for real-time human-robot interaction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.134423Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:a04d53536745b6a593da2cebb6db777041438e68a29a3d71b1563afbf4cf9505","observation_id":"4df7f961-2a3c-4bd3-94c3-fd58315ebe2a","resolution":{"observed_at":"2026-08-01T17:08:10.134423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.221743Z","title":"A review of deep learning-based approaches to sign language process- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.221743Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:03b71f032d5e123caafacf945736a15da9074f06efcb00e38dd826cdec46923b","observation_id":"165eb115-2607-43f2-915e-ce0c33b31fc9","resolution":{"observed_at":"2026-08-01T17:08:10.221743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.295797Z","title":"Signflow: End-to-end sign language generation for one-to-many modeling using conditional flow matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.295797Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:10c46b475c57445cc6efb73b818b8de23d1bbc1df7c1246aeeb42f941aceb288","observation_id":"f222c1dc-0342-46bf-b550-228bc727da51","resolution":{"observed_at":"2026-08-01T17:08:10.295797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.376797Z","title":"Expressive body capture: 3d hands, face, and body from a single image,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.376797Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:9baf61c3d8a74c7dd88ddd0c9244ba461065cbb4049f670d873a3f5a19072fa9","observation_id":"3fd368b3-ae19-4b2c-a9a8-f82d5d2c5a7b","resolution":{"observed_at":"2026-08-01T17:08:10.376797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.464505Z","title":"Retargeting matters: General motion retargeting for humanoid motion tracking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.464505Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:522a1f79ef33af8d70c1d208f2aed069420048f6e394404a97d318466db50625","observation_id":"82118f7e-6e94-4641-887d-3731a758c60d","resolution":{"observed_at":"2026-08-01T17:08:10.464505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12773","last_updated":"2024-10-16T17:48:50Z","snapshot_observed_at":"2026-08-07T23:49:15.433379Z","submitted_at":"2024-10-16T17:48:50Z","title":"Harmon: Whole-Body Motion Generation of Humanoid Robots from Language Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12773","snapshot_observed_at":"2026-08-01T17:08:10.524740Z","title":"Harmon: Whole-body motion generation of humanoid robots from language descriptions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.524740Z"},"links":{"cited_paper":"/paper/2410.12773","citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:844949bdc4b4081aa42c14bcb5bf98d004dcaf9f4047138c51c996c84d8a2faa","observation_id":"bdf8b972-f0ac-459f-a64b-cf558c55bef0","resolution":{"observed_at":"2026-08-01T17:08:10.524740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.612329Z","title":"V olumetricsmpl: A neural volumetric body model for efficient in- teractions, contacts, and collisions,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.612329Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:2abaec6fd33e59341f4bafbbffbdfae6074cf4a3b33c27459c52ab3db3c8f850","observation_id":"5d0bd696-477e-4338-a37f-690707d3a52f","resolution":{"observed_at":"2026-08-01T17:08:10.612329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.704594Z","title":"Towards fast and high- quality sign language production,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.704594Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:5a8320f162b868e3a9b76154cc2527e2a96ba2458fbdfb8c1b0516c83a7bbc8b","observation_id":"04450227-b215-4c1e-9346-391e6005ea90","resolution":{"observed_at":"2026-08-01T17:08:10.704594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.766596Z","title":"Signing at scale: Learning to co-articulate signs for large-scale photo-realistic sign language production,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.766596Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:331f8748c189ef3b8bf9c16abe7fb7508fb4d60a72d91a61884724ad96b39a54","observation_id":"bc41221b-bb36-4c25-80f3-1bcdf4037baf","resolution":{"observed_at":"2026-08-01T17:08:10.766596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.851132Z","title":"Gloss semantic-enhanced network with online back-translation for sign language production,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.851132Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:73598f9a3a6d35fad3bb9fcc9e0b1e34a79d8dbc0b1072c7e51c89f789e3f915","observation_id":"f47b7084-a1f0-4614-8286-46f5a0dcc39a","resolution":{"observed_at":"2026-08-01T17:08:10.851132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.912735Z","title":"G2p- ddm: Generating sign pose sequence from gloss sequence with discrete diffusion model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.912735Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:190a747a222114d4d550f3ab3ff6f831711e666ef7ec3307120c838654448c1b","observation_id":"40f2833a-7f30-4b21-8ec3-bcce1b8261dd","resolution":{"observed_at":"2026-08-01T17:08:10.912735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:10.974357Z","title":"Select and reorder: A novel approach for neural sign language production,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:10.974357Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:f73610858150726358d4225e477382c856abea03027fce9cecc30f566591a732","observation_id":"0d456f2d-34f7-45f7-94f3-44ee2869c0b2","resolution":{"observed_at":"2026-08-01T17:08:10.974357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.068735Z","title":"Gloss-driven conditional diffusion models for sign language production,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.068735Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:01d7e26fe4f0f2fc029b381ec031f3d419080105457c441965bc81fc6575bd08","observation_id":"c06b1b19-8bb7-461d-bfb4-5d7da1419322","resolution":{"observed_at":"2026-08-01T17:08:11.068735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.130791Z","title":"A simple baseline for spoken language to sign language translation with 3d avatars,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.130791Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:66c3c4f18e02225f7ee877e11a5a5f99b9f254e50f5a05d1e52608252d038760","observation_id":"f30d0ecd-2028-45d1-a3ec-267df8dc1403","resolution":{"observed_at":"2026-08-01T17:08:11.130791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.186301Z","title":"Sign language production with latent motion transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.186301Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:96208933d60c4ef594f7e8b980cbcd2f8724e233a0e3a9669e2c0f66bb1cdeda","observation_id":"fb7d1b94-278b-42bf-94b8-9362015376e1","resolution":{"observed_at":"2026-08-01T17:08:11.186301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.262479Z","title":"Towards ai-driven sign language generation with non-manual mark- ers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.262479Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:11e5f9df776fc90573a6d8664ade4b879bf7385fe72b577acd84ce225a49e585","observation_id":"d95aaa78-24be-4f95-a9f6-92d16f6a65de","resolution":{"observed_at":"2026-08-01T17:08:11.262479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.342756Z","title":"Progressive transformers for end-to-end sign language production,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.342756Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:dac7331fbcbfa053f09d5474bb900935415ed086d6e8862adfd0ec6d9a335feb","observation_id":"a7c9def4-b363-4833-bd4d-fa2b48ffa650","resolution":{"observed_at":"2026-08-01T17:08:11.342756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.421488Z","title":"T2s-gpt: Dynamic vector quantization for autoregressive sign language production from text,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.421488Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:7649dba2660b754180e22e519e660f593f1e005efc39d3b5f47d04076c794f26","observation_id":"baed0c70-9dc8-4bfa-b3ed-458bf92d20bd","resolution":{"observed_at":"2026-08-01T17:08:11.421488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.516796Z","title":"Continuous 3d multi- channel sign language production via progressive transformers and mixture density networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.516796Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:43f474a655c08310d74a4547dc28422af699b7db045d42338735c621cd0d0c13","observation_id":"c384214c-b3dc-4cdf-b114-82ab52cf97c6","resolution":{"observed_at":"2026-08-01T17:08:11.516796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.642191Z","title":"Multigau: Real time sign language generation using multimodal gated attention,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.642191Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:0c08aee2ef1b956cd4bbcc3f1913330830e127414992b40efdce6dccb68536b0","observation_id":"d36df2bd-c179-41c5-a029-6f95805cc625","resolution":{"observed_at":"2026-08-01T17:08:11.642191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.750181Z","title":"End to end text to sign language generation using multigau,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.750181Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:078ee39344e5537f72a95fa55a3e896155280ad58df91bbfa8fac191f94e2362","observation_id":"80b5c5cd-8890-42fa-b8a7-1cea472748d3","resolution":{"observed_at":"2026-08-01T17:08:11.750181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.817817Z","title":"Signs as tokens: A retrieval-enhanced multilingual sign language generator,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.817817Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:e465e785d7a370a8a025d5874b9ea5615bf17498a46dd4026902e17b4e85cacb","observation_id":"c3d0a045-729e-4c2f-812c-829767307ca2","resolution":{"observed_at":"2026-08-01T17:08:11.817817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:11.912972Z","title":"Neural sign actors: A diffusion model for 3d sign language production from text,","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:11.912972Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:25dce69e2d9856788a1249051c7e35524329c2f15973acf74a12bf407363579a","observation_id":"f2071cd2-402e-4f5e-a9db-e068fd048c0b","resolution":{"observed_at":"2026-08-01T17:08:11.912972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:12.014511Z","title":"Remips: Physically consistent 3d reconstruction of multiple interacting people under weak supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.014511Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:d3f77816780e6e639e9c7fdced9d1b1902567d57470b44d3cf38094403ee91d0","observation_id":"ee625ccd-5691-4ab8-9ddb-6fe9ad4e6269","resolution":{"observed_at":"2026-08-01T17:08:12.014511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:12.107649Z","title":"Coap: Compositional articulated occupancy of people,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.107649Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:38dc85f9a69d13bf1cd7232754d0eb74c278e1f235efead8ca86d59520162bcf","observation_id":"35b483b3-e42e-48e6-ae95-3359e5d2a94a","resolution":{"observed_at":"2026-08-01T17:08:12.107649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:12.218145Z","title":"Cloaf: Collision-aware human flow,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.218145Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:f54d4ff3bc52c5d8d62ee8c657300598329b71ad190e7fad7e57cd1b75523b91","observation_id":"2c81aa14-9839-478e-a441-1c6572df97e2","resolution":{"observed_at":"2026-08-01T17:08:12.218145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:12.378924Z","title":"Local optimization for robust signed distance field colli- sion,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.378924Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:4fe00a65a93d4ee7de751faa1aa5d4df9759b2f7cbb80f56e398bdbfdb8ce256","observation_id":"11d5ceea-3dfa-403b-880f-f2791fc3220e","resolution":{"observed_at":"2026-08-01T17:08:12.378924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:12.537430Z","title":"Real-time self-collision avoidance in joint space for humanoid robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.537430Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:db1295e1acefa2cb34cc5ddac2c88de5a10f708a60fe2903b576cd1d64357a3d","observation_id":"cd274e3c-dcd3-4808-a8ae-ae7aa3cc1bfd","resolution":{"observed_at":"2026-08-01T17:08:12.537430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09829","last_updated":"2024-07-13T09:42:02Z","snapshot_observed_at":"2026-08-07T23:48:45.716361Z","submitted_at":"2024-07-13T09:42:02Z","title":"VLMPC: Vision-Language Model Predictive Control for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09829","snapshot_observed_at":"2026-08-01T17:08:12.650534Z","title":"Vlmpc: Vision-language model predictive control for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.650534Z"},"links":{"cited_paper":"/paper/2407.09829","citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:bd859f0144f1470e188182f8f5729a201e329f66e7c418af10a0de05dbae98d9","observation_id":"dfeddf20-e3c3-410d-ba2b-9c2dadb8a505","resolution":{"observed_at":"2026-08-01T17:08:12.650534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-01T17:08:12.717524Z","title":"Aha: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.717524Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:cd555a0db7463f084f729343a178e545500213a61b5c8ba566ca4ce0321ee2b3","observation_id":"48b162a2-7a9b-4816-8fe4-ce3e25d567e5","resolution":{"observed_at":"2026-08-01T17:08:12.717524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-01T17:08:12.823203Z","title":"Adam: A method for stochastic optimiza- tion,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.823203Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:ff655b28425a8dda0ddfbcf70afa16fa00d8c93a0cb9b074bac2dbed03245d43","observation_id":"5b8e6743-b6bd-494c-8aa0-88d8f20e618c","resolution":{"observed_at":"2026-08-01T17:08:12.823203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:08:12.906852Z","title":"Improving sign language translation with monolingual data by sign back-translation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.906852Z"},"links":{"citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:860cb437bf6d2c029dbe8134ad5af18838f1b534c4f718d82c673d89ef60f836","observation_id":"014c5363-9cd8-4e6b-9f06-69d9e2bb5fce","resolution":{"observed_at":"2026-08-01T17:08:12.906852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2607.17769."}