{"as_of":"2026-08-08T13:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5857764cd31054b7a50f43869f63821f2320eac4d138a17288cae6d44f9e01cb","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:04:52.120077Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06530/citation-record","integrity":"/paper/2507.06530/integrity","json":"/paper/2507.06530/citation-record.json","paper":"/paper/2507.06530"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:58.994489Z","title":"documentation debt","venue":null,"work_id":"4527ee3f-1c54-466f-8afd-506bbd96a581","year":2021},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:48.512543Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:27828fb77ab1abed0ec747ae42ab418f9948816547d074c4829d37d603904417","observation_id":"52f99957-6c8b-4ac2-b06b-4383fd966de0","resolution":{"observed_at":"2026-08-06T19:04:59.150235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:58.668854Z","title":"Sign language recognition, generation, and translation: An interdisciplinary perspective, 2019","venue":null,"work_id":"7d631289-9879-4858-80c2-30e5ec171910","year":2019},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:48.576048Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:74ee2f9929aac9aa39259fde19a9a697bdaa304f03207116dc119a698b8c8527","observation_id":"65eee5ef-ad83-4604-9e82-ebbe82d90594","resolution":{"observed_at":"2026-08-06T19:04:58.823589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:58.381099Z","title":"Neural sign language translation","venue":null,"work_id":"c1879ae7-51b2-4afe-b9d7-a6cc8aefa2a6","year":2018},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:48.661337Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:178a27f94dee5cc404dcce84cb7cec98f3a50723f810a3ff981e45a9a4cb4823","observation_id":"c4d33122-24c6-46cf-934d-18c9a19e14d1","resolution":{"observed_at":"2026-08-06T19:04:58.538373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:58.063022Z","title":"Signnet ii: A transformer- based two-way sign language translation model","venue":null,"work_id":"39eec96e-7241-433f-9198-ace7c4618681","year":2023},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:48.772999Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:bf40fe3286a884aa1d482c0a95b6c07f2c7c3f7d92fdea277e107837661a9703","observation_id":"03142578-6607-4ae7-b2ab-f4bbf359b7ac","resolution":{"observed_at":"2026-08-06T19:04:58.175429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:57.732524Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing","venue":null,"work_id":"034e5daf-233b-43a4-b2e8-fac9c263b013","year":2021},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:48.871314Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:1c79e551e38c6849746a28cb8918e5a2819bfe87ecaac7e66efe3762d9529bdf","observation_id":"2cd73f91-1346-4b17-9b54-20e2453f9c46","resolution":{"observed_at":"2026-08-06T19:04:57.887459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:57.566061Z","title":"Towards an open platform for machine translation of spoken languages into sign languages","venue":null,"work_id":"a1051473-ee3a-4162-82d5-d7d09fa0da5c","year":2019},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:48.949589Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:15b2ea2735bf01d4e3e40e0602cb2345fb79db42c12c8f182519b7898e8ce692","observation_id":"0c446550-70bf-4ec2-96ef-f247fb99133c","resolution":{"observed_at":"2026-08-06T19:04:57.638644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:57.208053Z","title":"3d avatar approach for continuous sign movement using speech/text","venue":null,"work_id":"ea70eedd-6e22-41af-bf49-10945b274974","year":2021},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.040033Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:1071fc5e2cea8eaff4bcd795c83c57f1ae25ad0af4f9e32d135c5be03e2e1168","observation_id":"9080f1be-2aa3-4fa9-b9f0-663ddec5f2cf","resolution":{"observed_at":"2026-08-06T19:04:57.410339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:49.123821Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.123821Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:1e8c58e02cd54136d4864e36f6c203ba61d5a9afe9ee3ea7ef0375e385863d2f","observation_id":"6193ad22-be7c-4425-9c32-fc71cbe0cd78","resolution":{"observed_at":"2026-08-06T19:04:49.123821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:56.852692Z","title":"How2sign: A large-scale multimodal dataset for continuous american sign language, 2021","venue":null,"work_id":"7cc7a206-7fda-4925-ba3c-1ed5f8f450bc","year":2021},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.217622Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:fd0240658dcd79a3b74cbe0ad76df6eaa401a50743bb9277ec9fd527b4d41670","observation_id":"610aadee-1cd5-4d1f-a12c-ad26d3ddd16f","resolution":{"observed_at":"2026-08-06T19:04:57.006664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:56.563371Z","title":"Building a Swiss German Sign Language avatar with JASigning and evaluating it among the Deaf community , volume 15","venue":null,"work_id":"b4179711-61d0-4e47-902b-c0a6faac2333","year":2015},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.298031Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:60fb9bff2451c07334613fcd0201c976c39549611896bfb33d7df3aaf6584e01","observation_id":"ed2a90a7-71d8-46a8-aa94-f999cc5f2b81","resolution":{"observed_at":"2026-08-06T19:04:56.681769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:56.340493Z","title":"Rwth-phoenix-weather: A large vocabulary sign language recognition and translation corpus","venue":null,"work_id":"e721851d-974d-45da-8dfa-71692d2a15a8","year":2012},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.389286Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:42393737865c816eabbacf554e8635e1dcae6a9ad38ef059958236f681a8df65","observation_id":"6932e07b-504d-4186-9af0-3b2006029cc2","resolution":{"observed_at":"2026-08-06T19:04:56.445084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:56.159053Z","title":"In the wild human pose estimation using explicit 2d features and intermediate 3d representations","venue":null,"work_id":"7f194d79-086b-4b4b-86da-f9f45cf4dd94","year":2019},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.479240Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:1584428e9666e88edc9a51357886e028586d22a0d30f9970d481170e254af789","observation_id":"cdb5452b-8447-4f59-99f2-dca122ca1674","resolution":{"observed_at":"2026-08-06T19:04:56.245624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:56.067292Z","title":"Contextnet: Improving convolutional neural networks for automatic speech recognition with global context, 2020","venue":null,"work_id":"de94b05b-6e1f-4b85-9f30-19b524eabf76","year":2020},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.569022Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:6da713818e405abc461cc43fe60b133cc5e720165e20402b21386548fe872ebe","observation_id":"5f6379c2-8053-4fc1-99a8-902e9b7a3c6b","resolution":{"observed_at":"2026-08-06T19:04:56.099828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:49.684545Z","title":"Deep residual learning for image recognition, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.684545Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:c0a9ac037ec70179a80e6c9e13847f03bf9e087dc75cb84db1d9269ffdb8154a","observation_id":"f5040445-4fab-4df2-b8f3-efb7cb166588","resolution":{"observed_at":"2026-08-06T19:04:49.684545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:49.794413Z","title":"Rtmpose: Real-time multi-person pose estimation based on mmpose, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.794413Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:bc765334dbd3c84ae5f7b153aa01337b94e1e3b62967823c757b6b4aae513a5d","observation_id":"683be648-1fee-4332-9a42-de286c144756","resolution":{"observed_at":"2026-08-06T19:04:49.794413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:55.917432Z","title":"Bag of tricks for efficient text classification, 2016","venue":null,"work_id":"abf49955-4064-4541-9621-b129b06738c7","year":2016},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:49.893753Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:1dc3fdf833024d7fdf20f4f5d7fd29d964ce438b57aa580fb4342d827f4960c6","observation_id":"47a133bc-8816-4761-a894-656e09ccbec3","resolution":{"observed_at":"2026-08-06T19:04:55.985963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:55.738639Z","title":null,"venue":null,"work_id":"63f8dc61-a147-4b64-9632-996a3c2b4670","year":2018},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.004517Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:2d7f6f8a2d10795189afa54388097a0d98d1a9445655f32a24be65687752bacb","observation_id":"301e0237-b13a-4be7-9512-93420d817566","resolution":{"observed_at":"2026-08-06T19:04:55.834309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:55.602306Z","title":"Deep hand: How to train a cnn on 1 million hand images when your data is continuous and weakly labelled","venue":null,"work_id":"08906747-730f-4279-80a9-7426f8643377","year":2016},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.139953Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:e664040788478da692ad71af41548b2b2e94a1b49bce96a907af3e228fc25c20","observation_id":"fb59f1dc-9ef3-4365-972a-71b8f4c9477d","resolution":{"observed_at":"2026-08-06T19:04:55.657839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:55.414937Z","title":"A deep learning approach for analyzing video and skeletal features in sign language recognition","venue":null,"work_id":"51d9ad65-b43c-4a10-85a9-614b15349acc","year":2018},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.218077Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:7095730c157955c583dc3a4c70f7cfeb6be1424f96c235a2b2d322108569b3ae","observation_id":"2e95b482-d644-4380-93a5-d00630f70df2","resolution":{"observed_at":"2026-08-06T19:04:55.510958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:55.252995Z","title":"A deep learning approach for analyzing video and skeletal features in sign language recognition","venue":null,"work_id":"fd725014-8684-426a-91d8-eee125e1d6ac","year":2018},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.316159Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:2d3f13841ec302e839c0b667da39bd5647c9772eb2f32460caf3cc981d150738","observation_id":"a7b51735-26e5-4915-aa65-af3b78408440","resolution":{"observed_at":"2026-08-06T19:04:55.319919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:55.073088Z","title":"Corchado","venue":null,"work_id":"1e7a88ba-6d8b-41aa-8843-08672b54119a","year":2022},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.419405Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:f1ccdc39fa44c98d8c43a9f9dddbd57fd7d6e163e2728393c913f845629ffeb5","observation_id":"8b467491-7e3a-437c-a456-c202e2b92e0e","resolution":{"observed_at":"2026-08-06T19:04:55.149982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:54.837959Z","title":"Openpifpaf: Composite fields for semantic keypoint detection and spatio-temporal association, 2021","venue":null,"work_id":"5eed1f88-5d65-4e37-ba50-bf60dcea5986","year":2021},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.492464Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:83f77bb1b4f1a5a13dad4e882396ede1c85825cb5cc457d500fd0adb36728c46","observation_id":"cafd1923-0a7f-402d-b283-e32ed1814911","resolution":{"observed_at":"2026-08-06T19:04:54.987049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-06T19:04:50.622018Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.622018Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:056e33464ad22b2a2a887967d7ef4bf078b710ad4d05d071cfffee53d7f8ddab","observation_id":"dbdbdb6f-bbac-4183-b95c-7ec9f5fbd039","resolution":{"observed_at":"2026-08-06T19:04:50.622018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:54.607825Z","title":"Word-level deep sign language recognition from video: A new large-scale dataset and methods comparison, 2020","venue":null,"work_id":"6103d3f5-2437-41cf-8617-d6b221bcc77f","year":2020},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.703072Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:97b638e5eda612bb41200f23bb070e29cc131fc8f082e73836fc6b666dd2b578","observation_id":"0efb4dc4-da16-4f81-a8a6-b86ea07b4af1","resolution":{"observed_at":"2026-08-06T19:04:54.724042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:54.400038Z","title":"Speech enhancement method based on lstm neural network for speech recognition","venue":null,"work_id":"d27579ef-826a-4f57-92b6-1e1733dd203f","year":2018},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.766246Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:d52513667de678b5a4d46190cd6ac2eca0c6ed50ddc068c89b48ed1d7c8f05e4","observation_id":"fcced08a-2c7e-4236-9dcd-3a61d6cc0a64","resolution":{"observed_at":"2026-08-06T19:04:54.510441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:54.199121Z","title":null,"venue":null,"work_id":"a7e2b2b8-9124-43ed-967b-5d86a325cc92","year":1976},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.854554Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:c4bbab6a122d2834d16c2ef5db34c771432a1869342954ad9aa7b8ede9fd9a58","observation_id":"586eeb0e-a3a5-42c0-a824-6c79ed5f1e00","resolution":{"observed_at":"2026-08-06T19:04:54.341371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:54.025560Z","title":"Mediapipe: A framework for building perception pipelines, 2019","venue":null,"work_id":"726b238b-ac5d-4ce9-ac0d-265e06433c0b","year":2019},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:50.938677Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:b0c334622bf5d1f26ab6d569d9c902828d7e5b82c24a4a9856ec45100225f7e6","observation_id":"19b3fdb7-b77d-457f-8bdc-bb9e285023d0","resolution":{"observed_at":"2026-08-06T19:04:54.135948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:53.830590Z","title":"Jointformer: Single-frame lifting transformer with error prediction and refinement for 3d human pose estimation, 2022","venue":null,"work_id":"f9b3157c-d2c1-422f-a324-795db3b4f98b","year":2022},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.035532Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:a3add0431fb4d33e4a80d4423e4eb2f2bdcee62d34bb47db1a6a846d8448e0e0","observation_id":"8144dec3-26a4-4657-821d-88217887ae9d","resolution":{"observed_at":"2026-08-06T19:04:53.923672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:51.132839Z","title":"Efficient estimation of word representations in vector space, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.132839Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:bb7b67c71c3e200f57e7d89cdc8ee35c2a0ea51226264b7bd853000ab5311c99","observation_id":"f5cd1593-60d5-4b55-ab9a-33f7564bb6ae","resolution":{"observed_at":"2026-08-06T19:04:51.132839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:53.619061Z","title":"On feature selection in environmental sound recognition","venue":null,"work_id":"37107bce-a180-4991-be9c-eb6eb07018f9","year":2009},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.269070Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:4010b7627caeba949f0e63b8fa0f87727d0136f78b4d3f2fc84fd0fafb4ecbd2","observation_id":"8f13d103-792a-40c1-919b-f3807a82f748","resolution":{"observed_at":"2026-08-06T19:04:53.689381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:53.437801Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"c9421e1b-2516-49c9-a26a-400504048fe6","year":2002},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.358090Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:343a2f7a240db5d1319f1b880a238b8c094476353e21edee2fd4f8cb77a5d5bb","observation_id":"70b249d0-9b60-4e49-b07f-d8ccd0b3e337","resolution":{"observed_at":"2026-08-06T19:04:53.493796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:53.248556Z","title":"A hybrid of deep cnn and bidirectional lstm for automatic speech recognition","venue":null,"work_id":"ea67a60e-a210-4a23-a920-db0b3f9b8786","year":2019},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.437103Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:fe722faf88db37cf6d817222f65ad63e2a834bdb6a5ff3dc267e4d872f71d754","observation_id":"93a9c2a9-b896-4f8c-9202-b83b305b6eeb","resolution":{"observed_at":"2026-08-06T19:04:53.319597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:53.124946Z","title":"Iterative alignment network for continuous sign language recognition","venue":null,"work_id":"ad4599e7-e3ed-4332-b862-aa4d2fd97a9d","year":2019},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.507468Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:f8df52865162a76771923039502137892d1ccb704a33f52f09a2a3a580e48b8a","observation_id":"9f887ba1-5b57-4492-8f5e-089ac7618f7d","resolution":{"observed_at":"2026-08-06T19:04:53.150520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:51.581309Z","title":"Robust speech recognition via large-scale weak supervision, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.581309Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:5453f1c91039df0726511c827be42b9f6074ccb193091726eee815c6eb895378","observation_id":"f0f3086c-3af0-4176-8e09-e2da11dad933","resolution":{"observed_at":"2026-08-06T19:04:51.581309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:51.631137Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.631137Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:2d4cc5b81cab53bf74b0e43b3df74945650cfd857e638745b52e7f348662e8a2","observation_id":"c0e52a58-89cc-4df7-8cda-5d91300a73dd","resolution":{"observed_at":"2026-08-06T19:04:51.631137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:52.954460Z","title":null,"venue":null,"work_id":"d7da848e-5950-45e0-9302-b4bce56ffb6e","year":2008},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.734371Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:03e68086641ccb3074b58e05524ca56f3ec4c6e8435fbedcb23c8b593ace1f26","observation_id":"ae44341f-d9cf-4b03-bc57-6cd57930df1b","resolution":{"observed_at":"2026-08-06T19:04:53.021036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:52.735157Z","title":null,"venue":null,"work_id":"ad790351-7e8c-4c5e-b2d7-bd3140132331","year":2009},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.782752Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:0d12a34dd97a0d65f4c8cba49e9ac038e4fff396321d9a4b53c560b3800b8fab","observation_id":"dcaf632c-7017-4f92-bb5f-daf4a0fd9b5d","resolution":{"observed_at":"2026-08-06T19:04:52.825633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:52.506440Z","title":"Adversarial training for multi-channel sign language production, 2020","venue":null,"work_id":"7087f144-c6bb-4c43-805a-20bf76807d3a","year":2020},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.910402Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:38aa3634c845e06e6a58f56355e38e37b721bfb409417fff5fd2f6fff9b9e657","observation_id":"0d15ded1-25ca-4400-a991-8acc67a174cf","resolution":{"observed_at":"2026-08-06T19:04:52.610595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:52.375768Z","title":"Text2sign: Towards sign language production using neural machine translation and generative adversarial networks","venue":null,"work_id":"4b6b087f-8a57-4081-a254-06519ef635a4","year":2020},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:51.969179Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:15c4d23a1e440a061d2bb3e5a7b6fb439e75a9460d4f19dcf17a47aaf97ad952","observation_id":"1c169127-232f-45d3-bbc5-fcbcaf5b2ae6","resolution":{"observed_at":"2026-08-06T19:04:52.439331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:04:52.226246Z","title":"There and back again: 3d sign language generation from text using back-translation","venue":null,"work_id":"13359a55-973b-4e0a-98c5-58b5e4bef1db","year":2022},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:52.053268Z"},"links":{"citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:6bffaa7895e134bdfcadc53bfd177579d295e117f66c982bb06c2ad199972f73","observation_id":"633d7c5b-6cc8-44fc-b596-f8b451314a91","resolution":{"observed_at":"2026-08-06T19:04:52.318944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.07597","last_updated":"2021-06-10T09:17:28Z","snapshot_observed_at":"2026-07-06T10:33:43.407313Z","submitted_at":"2021-01-19T12:53:43Z","title":"UniSpeech: Unified Speech Representation Learning with Labeled and Unlabeled Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.07597","snapshot_observed_at":"2026-08-06T19:04:52.120077Z","title":"Unispeech: Unified speech representation learning with labeled and unlabeled data","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:04:52.120077Z"},"links":{"cited_paper":"/paper/2101.07597","citing_paper":"/paper/2507.06530"},"observation_digest":"sha256:24d14c9f6d9869916786fadaa1d11a04217067932fe7a0085c2e796585855247","observation_id":"1c2202ee-6000-4ecf-9e71-23f0ae384b6e","resolution":{"observed_at":"2026-08-06T19:04:52.120077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06530","last_updated":"2025-07-09T04:13:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T18:58:56.672685Z","submitted_at":"2025-07-09T04:13:49Z","title":"Speak2Sign3D: A Multi-modal Pipeline for English Speech to American Sign Language Animation"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2507.06530."}