{"as_of":"2026-08-08T20:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b877c7850a52835dbc8a7eecb4e90fbcbf10d1f38f41a2d03e0f257024c77c9","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T05:13:54.021731Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09126/citation-record","integrity":"/paper/2607.09126/integrity","json":"/paper/2607.09126/citation-record.json","paper":"/paper/2607.09126"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: CVPR (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:4bdd3fa74134d738cb54e20a17cb992b562d108b5fe74bb71e8efe5e64dc379e","observation_id":"f6d7f34a-61ef-4018-8daf-72c4cb9c375e","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: CVPR (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:a4e336d98519b6c621a5d3679bc90eb2cb2721894e3e1f0b3922c306bae1e3a9","observation_id":"69e5add0-da46-47c8-a435-e897c7603772","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICLR (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:87f43928d7c9f759da4079df59622737d4d262be9543d1a788beb1d76e1127b1","observation_id":"a56ff23d-0d94-4934-993e-6f3621f71569","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: CVPR","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:b2a9844a835412b908257982b9dfec6889d43d8cadd134a484a2e19813ea700b","observation_id":"4f27003d-f2e7-4b7a-8e3e-47d3a2e357d4","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: NeurIPS","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:e2ef05c3b2861ca1ae0105a0ab7578f959b8821405b3e75d788c119a669f95b7","observation_id":"3e033a4a-44a8-4864-88a9-3e091274b234","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"IEEE Transactions on Circuits and Systems for Video Technology (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:d4fab39d126914a120e84576aecbec6750f8a404eb559e5d50ea64db8b6a82b6","observation_id":"8f40463f-0f91-4f86-9eae-4aebe96e60a2","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: Proceedings of the 2024 Joint International Conference on Compu- tational Linguistics, Language Resources and Evaluation (LREC-COLING 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:656f9607aa64cf437f09ba2a51c689d3cf1fcbcc6caee9a98cba800fffbab327","observation_id":"bbffcc3b-2d8d-43cf-8448-da11f2ee81dc","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: NeurIPS (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:33331ed38377777cc9ac86bb69a266b2fac4380b8ae7c1c5ab4496a34ef4a035","observation_id":"bdb619ce-3d1f-4e3e-9a72-70407708949a","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"JMLR25(70), 1–53 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:ea925cff71f0dbe3d01507a1adff8ec116b97637638efbfc14c661ce21b5950d","observation_id":"52cd37a8-6a6d-4adc-9650-334e186a5ea0","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: NeurIPS (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:80b94fb4b75d7251c12a83ab892d73fc2833963be7acf199741123b66e594957","observation_id":"f66caf4e-d2d6-4104-9695-2a8959c6d8de","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: CVPR (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:689c4a06bd470b8bb5bd1a0d65277b65ee76d2c4d7101d3f07c0f8fdefb9056b","observation_id":"5734c5c8-c5ef-4050-90b4-5c9c3f1600ae","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICASSP","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:00c63bb2f192153b871726d6360479f4c5242f7e7319810b8cbba78815748d0f","observation_id":"c63536c7-c196-4087-888b-23c2308908f1","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:c03399ddebbbcf88680300b1985078f82913a79ad0016b2a6b9d116b8ef69a29","observation_id":"8ba4f66b-af29-42c0-b2cb-ec14dc5ce324","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:c38ea0a69d7cc0ac615084bf4cf64259ceec2dcb6eb2e9fbb4c68dcd24f6184f","observation_id":"65498a64-baff-4f42-9f0f-11c22f11c24c","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICLR (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:215207729a0c588307905707d82f34f43658419d92c026e9a85fa8164d6df08f","observation_id":"fe36692a-1d0b-4430-a282-105f72c72198","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: NAACL (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:9ee66cccb83f30dcb794c105950e1b24947b1024ae61b0756da28cf43dbbc642","observation_id":"3110c4a8-5b89-4a3b-aaa5-92ddedb07965","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ECCV (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:e4fc944bbc2fe6dd34f241db74fe4f4e7f0011eb64f17d83d26f17d6ab7473b8","observation_id":"af1a9156-e975-4861-a095-a5895eedf531","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICASSP","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:bde5278d568db0a08c2abecba6e5bfb4e09500afe97c05747395af94e80fd7ca","observation_id":"c0a309ce-6d01-4179-a148-bca233fb0a79","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICLR (2018) VTaMo 17","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:cc6118e786d025e0ca6dc0cdbac3dced1c564df473dba9df73488a8026696410","observation_id":"c4220805-1181-4bfa-9162-003fa2306257","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: NeurIPS","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:564c5db037e321bcc9292827f1d2d953459d36032572e0a91c7d15aaa2afee9f","observation_id":"58e6c513-7d9d-4109-b174-26ab4fd3ffd5","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICLR (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:57e348661dcd1f6513cb147a5a4e2d76f322ebbc002796330664ff8cb6b75425","observation_id":"02c5a09c-4887-4f92-a932-41c1ecf787c6","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: Text Sum- marization Branches Out (2004)","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:4bc211f5f4c85609baa7d895116f26f8ec66053716b41069f94e602ae8ee41f4","observation_id":"70a337f1-91e5-42d3-9e3a-ea641b4e698a","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:3e2c96d0ae80a93672d8a730ddf55621971512965fd34e7c6c99108f9721c758","observation_id":"a84f2ce2-b064-440e-a8f2-6916bc4e8fbc","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICLR (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:054395c8eac73222c8522042337b36f921332024c53016e28d9f3d960e431148","observation_id":"308a3753-ba5d-44f8-89b2-2c2d94843af5","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"Neuro- computing508, 293–304 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:4e23c3c7333e73e00fb671c871ef81bb942736142ba6387e5fe5364a6f5bfbb0","observation_id":"99c589e4-4b96-4dcb-9e02-c0d8fce47f7c","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ACM MM","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:831b3daadceb022009ff5c9538fa6ce53ded3a9f2983f875fb284c7ebc5e8a39","observation_id":"83759391-79b3-4104-b5ec-862a102b2a91","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICCV","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:be0ba73560505187ec86e8dbae438cce779b0b8fd9068b59166ef9fe4f1f2339","observation_id":"8ac3b6ad-0501-416f-b87c-97809857160a","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:a8ce0a3fadd85954edf1ee3fc927a76a47cb5111acd6bd0203a4dfb23609e85b","observation_id":"ac49c6c4-7b24-4459-a25e-f4509346e96e","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"arXiv preprint arXiv:1807.03748 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:f1a0b531efb4c2bf2d81ce65e404fd932d1a9da75a38cfce4c4718f8c77dbfd8","observation_id":"94e2832a-250b-44c1-a9b2-93ee3fb2bea2","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ACL (2002)","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:8c018fb5a0f22d085c26c5e68c18651428f209e478a6d2b1c3916715407f2cf8","observation_id":"7e7ce4d8-98c5-4a2e-bd06-f9b523685760","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICML (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:a586d6e5a2019be0e32c2a681292692bccaa01ebdb25218c88750e2c466d05ed","observation_id":"3b3040cf-d5f2-41ae-ac9f-4571d3c56f4a","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: CVPR (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:63dbb506adec3e9748cab52fa08f4aca0aae776903bcabd43e2a2d31396a05fa","observation_id":"f1341f25-9507-4299-90d8-d91140f58688","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:b592fc68a7138688382e706c3f66aad79d78c08d7ff36e3ab38c3d4962d7fd10","observation_id":"56ef0cc8-cb5a-416f-a1c2-7c98cc033181","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ACL (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:f3c80ea4c57195dd00aea3a7941fabe7d621f7987e221f8590131b2ca4547d08","observation_id":"f54d553b-fc8c-4cbb-987c-6062b855f387","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:7fce86ffe8bf483ed8bd812324bdade54389e1fca86c75b1f7346fb25f170ed3","observation_id":"191b5519-3bfb-4404-b886-0b33b528fb39","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: EMNLP (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:bbccda3205e085f9ccee6ba442bc2b5932e1152acec3fe775d524a39b6a92f9b","observation_id":"2e41a6a6-8e48-4a89-b661-8dd37d1878c4","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00401","last_updated":"2020-08-02T05:36:55Z","snapshot_observed_at":"2026-08-02T01:12:22.380353Z","submitted_at":"2020-08-02T05:36:55Z","title":"Multilingual Translation with Extensible Multilingual Pretraining and Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00401","snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"arXiv preprint arXiv:2008.00401 (2020)","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"cited_paper":"/paper/2008.00401","citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:8a6a0f2bf1750afabee9086b97b775cc72fde1c47be114d823890391ac599a10","observation_id":"c62eb876-2726-43b9-b9f6-2bcac1399b9d","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"arXiv preprint arXiv:2307.09288 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:7f32330de991feb17a67eed8af94ede97c0babed8f62ff2ebb6ac2e4957be53b","observation_id":"a57eba0c-849b-4520-9d7b-46e12c9c3e5a","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: NeurIPS","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:b240d535d3ebf248c310ee8ee01860b68e4ecaa176839f56dc6032e5123ae87e","observation_id":"0cacea1a-d7cc-41c5-b969-af5c7cf5a4ef","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICLR (2024) 18 J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:fd1700255233bf152c98b37c99dfb2b93bac5abe1d89f26995345a73dcf69969","observation_id":"23cc595c-36da-4661-b86a-34295c00a558","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: EMNLP","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:ac70246f2455b11487a3653351c46638a52dff7e1fae46be696fa77d6e55a998","observation_id":"1839d33b-711e-4399-b26b-3e796ee93165","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ACM MM","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:ae5ce1588a81fb4dd3008879438a37bfba4e7c33db5755d59c27600f06ca42d8","observation_id":"fbd7810a-2060-49e3-9729-19078cb10653","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: CVPR","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:657a8ba21f7f28a1e2f51293f48ab53bde1f5d83a7105785ff36b6c8c47e4fcb","observation_id":"b1fbf979-cdb3-4351-a32c-98e1ff69f31e","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICLR (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:4ff3e745cab51b95aab07128436535d3aafc71de004564c560c68a5beabfdabd","observation_id":"ba894199-af3a-4e48-a63d-f03c23d85188","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICCV (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:b5b4502fb7c903bf58b422ff02bdf2d1f94481c2deec37cfc6e287e742cd6ce4","observation_id":"009b3b2c-8a88-4938-b2fb-d43f2ddedc02","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"IEEE TMM 24, 2662–2672 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:26dd3045e80bd8dad73812d18a2de75e4ed214ba5e5e46f239c9cdf3cf17b994","observation_id":"820c61b4-19bf-44b1-81ea-f2e9b4815047","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: ICCV","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:7fad982a682c0a10597c8abf862824a3c095bb1ca0388db1202a4426c49af13c","observation_id":"e7b04373-b486-4af1-bebd-eea8c37956f5","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"In: CVPR","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:ba90de36b49be1180d936532d7165a33b8dbca5351ee2f243c99ac4246d8257d","observation_id":"c8180982-6047-4f17-9778-5540d5178799","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:13:54.021731Z","title":"IEEE TMM24, 768–779 (2022) VTaMo 19 Appendix This appendix provides expanded details and additional results complementing the main paper","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T05:13:54.021731Z"},"links":{"citing_paper":"/paper/2607.09126"},"observation_digest":"sha256:12eddb0d6d59c314d56bbd446805e852baee95d279c5e505fd3ac50f511b40f3","observation_id":"4a0c1e5f-8610-4d74-abf6-4d664d290300","resolution":{"observed_at":"2026-07-13T05:13:54.021731Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09126","last_updated":"2026-07-10T06:30:50Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-15T23:18:03.988786Z","submitted_at":"2026-07-10T06:30:50Z","title":"VTaMo: Video-Text Alignment Model for Sign Language Translation"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2607.09126."}