{"as_of":"2026-08-13T03:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a1405203dcd03407860210f77145963a493e738799bfe8d5787c79de5f32b20","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:29:38.817694Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16789/citation-record","integrity":"/paper/2411.16789/integrity","json":"/paper/2411.16789/citation-record.json","paper":"/paper/2411.16789"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T13:29:38.544231Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.544231Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:3956282013ac9741134564ee96d841da7d17eb4a61eeed158d978c1c1b73c6ee","observation_id":"cc220289-1862-421b-929d-ffdee92c35fa","resolution":{"observed_at":"2026-08-12T13:29:38.544231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.569128Z","title":null,"venue":null,"work_id":"6ac69487-00e0-4266-9806-2d3e561ad386","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.549397Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:4989124b599969a23385f6d639e5032668d4d8550d9c6f5dc0d005b729a69908","observation_id":"78a03b31-83a3-4c54-95f1-b2ab07a8c06a","resolution":{"observed_at":"2026-08-12T13:29:39.573187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.553405Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.553405Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:2a63433c0ee8326b54626866ef88dc7ccce75d7ec68784b6ce86a374ece3af11","observation_id":"dbc14c4d-a11d-4f30-943c-b994e22c04e8","resolution":{"observed_at":"2026-08-12T13:29:38.553405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.557676Z","title":"Neural machine translation by jointly learning to align and translate, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.557676Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:cd305a41feadc9ae9c34829d5b01ba9db016a6dcf6792566dac82975f7fea4a5","observation_id":"02ab73de-873c-4c63-b4c0-c92a34890341","resolution":{"observed_at":"2026-08-12T13:29:38.557676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.541882Z","title":"Neural sign language trans- lation","venue":null,"work_id":"d6b3bab5-1573-421c-9483-aec41d295c9e","year":2018},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.562505Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:678253234aee4eb785e69b49eea4407d0ac8c5e347f56fb36bf00c3bca479961","observation_id":"b61c9b6d-b9da-4cf2-9dfc-8904c4e6afd7","resolution":{"observed_at":"2026-08-12T13:29:39.545904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.530059Z","title":"Sign language transformers: Joint end-to- end sign language recognition and translation","venue":null,"work_id":"c70e0fe1-ae91-43da-9711-3d64b19e5e47","year":2020},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.566480Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:a1b831f56830146fd91ffb33bf76f46f6e5bbe3a903daee60201fc98da4a0361","observation_id":"00afdf95-e356-4546-9a99-d6390cd22b7c","resolution":{"observed_at":"2026-08-12T13:29:39.534216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.517939Z","title":"Vlp: A survey on vision-language pre-training","venue":null,"work_id":"f2c1e224-367d-4c77-887b-01fffee3c106","year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.571243Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:4340201f070f3b8bf1352e757d1c1e83e3f441912396b49cbd6e72f8b4a4cf4e","observation_id":"4a7095a8-338e-4e94-ac80-3a99ecd6f8b7","resolution":{"observed_at":"2026-08-12T13:29:39.521902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.506224Z","title":"A simple multi-modality transfer learning baseline for sign language translation","venue":null,"work_id":"7d867026-95b2-414f-9197-c8e61ef74347","year":2022},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.575203Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:1d75445de57b90e6bac0ecdc91b323f9224e273b307d64a889b9e8796b2c6737","observation_id":"43b9bf60-53b0-4758-8dcc-3b408ceb0735","resolution":{"observed_at":"2026-08-12T13:29:39.510265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.494827Z","title":"Two-stream network for sign language recognition and translation","venue":null,"work_id":"dc1655c5-ae46-48b2-b537-25071edd343b","year":2022},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.580047Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:bc43274ac892716273f0fb914658fbce4bade19d1515af854c537da6391f3dbb","observation_id":"c55e7028-f33c-445e-8d3d-ccd135d3033b","resolution":{"observed_at":"2026-08-12T13:29:39.498828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.584309Z","title":"Uniter: Universal image-text representation learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.584309Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:649667396e8eeaed9cc4df046ce58337fc10f9e672c464eab4e9f0e068370993","observation_id":"385bdbcf-5efb-4656-9bcf-619746cb50bb","resolution":{"observed_at":"2026-08-12T13:29:38.584309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.476914Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks, 2024","venue":null,"work_id":"c392eaad-4483-4694-9e24-a53a9c974dc2","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.588938Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:ecfcdc5e6607fd456918abe53c97c9c3bb8cf9c102d7975ba9199c1d5e78ac25","observation_id":"0bc48692-8b41-4bbc-bd5a-e10733ec5ad4","resolution":{"observed_at":"2026-08-12T13:29:39.480868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12556","last_updated":"2024-03-19T09:00:23Z","snapshot_observed_at":"2026-08-13T00:50:31.887415Z","submitted_at":"2024-03-19T09:00:23Z","title":"Factorized Learning Assisted with Large Language Model for Gloss-free Sign Language Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12556","snapshot_observed_at":"2026-08-12T13:29:38.592741Z","title":"Factorized learning assisted with large language model for gloss-free sign language translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.592741Z"},"links":{"cited_paper":"/paper/2403.12556","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:299dd821b278a40b6d91d2a461a8474cb28905ba160e272fb11a91f04968861d","observation_id":"af90ec1d-5d54-492f-9bb1-e65b0f2cf57c","resolution":{"observed_at":"2026-08-12T13:29:38.592741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.597387Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.597387Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:e00cbc11f99624ed9a7edc691d36b3430362ad84d5d0aa38e2125ef02e832631","observation_id":"ffd18d61-9ec5-459d-8220-5616902187bf","resolution":{"observed_at":"2026-08-12T13:29:38.597387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.602474Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.602474Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:8aa9cc211d988eb64a87e41de446e1fa6b37cfd5bf123da6d52c86c82ad2485a","observation_id":"6fe4f81a-b3f1-4f96-904f-989a4c170183","resolution":{"observed_at":"2026-08-12T13:29:38.602474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.451660Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding, 2019","venue":null,"work_id":"c92959dc-e03a-4543-af41-e71e5512d200","year":2019},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.606360Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:a0970e42e3c8e4d7a38a14f5ba3860eafd34d3f902dde7f24467045674b255e4","observation_id":"d2ddf952-df40-4e2b-92d6-1749172efe1e","resolution":{"observed_at":"2026-08-12T13:29:39.455833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.440491Z","title":"Cross-modal neural sign language translation","venue":null,"work_id":"ded3a295-d262-457d-931d-11f51495a0c0","year":2019},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.610118Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:8948e6c691a880598857a8bc48ab4cf4cd3f1028bd67343ebc7f24d4d30309fa","observation_id":"746775db-b27a-45e5-82be-b813294f2a65","resolution":{"observed_at":"2026-08-12T13:29:39.444358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.429398Z","title":"A token-level contrastive framework for sign language translation","venue":null,"work_id":"11628676-bef2-45a9-9d36-afd8a5f42a58","year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.613680Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:80d4ef9632aad71174cb2997a53f4a5ea99bb08260f8cf41d9fe6b2a94fd88eb","observation_id":"b7cdb79a-de6b-46b9-8d90-e17ef10fd2c8","resolution":{"observed_at":"2026-08-12T13:29:39.433519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.417383Z","title":"Llms are good sign language translators","venue":null,"work_id":"979d84fd-9aa1-4b9e-9edc-8b0600458a9c","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.617624Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:4049883ae307e52e0e18c196c16e494e3317819b0508b1cb5e2baa9fd974b782","observation_id":"487b59a8-5b83-4032-835d-3d2a70406dab","resolution":{"observed_at":"2026-08-12T13:29:39.421677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04790","last_updated":"2023-06-13T13:31:12Z","snapshot_observed_at":"2026-07-06T15:24:38.226044Z","submitted_at":"2023-05-08T15:45:42Z","title":"MultiModal-GPT: A Vision and Language Model for Dialogue with Humans","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04790","snapshot_observed_at":"2026-08-12T13:29:38.621365Z","title":"Multimodal-gpt: A vision and lan- guage model for dialogue with humans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.621365Z"},"links":{"cited_paper":"/paper/2305.04790","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:06863bb080e1cb67027a7144c931a0d72ac4053d9e1959dbd29be4f9cd0fe9f5","observation_id":"39e8fed9-23d4-40bc-8e52-5bc5877118d3","resolution":{"observed_at":"2026-08-12T13:29:38.621365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.625910Z","title":"Deep residual learning for image recognition, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.625910Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:867c4c65522a1de92028ac552504a6d6a3c532ceac3cdfa305f7e9ceb36aae03","observation_id":"f6596e01-8e38-419f-b531-9c9ed519f184","resolution":{"observed_at":"2026-08-12T13:29:38.625910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.399154Z","title":"Egolm: Multi-modal language model of egocentric motions, 2024","venue":null,"work_id":"ac3abb30-95b1-4fe6-9c51-d499616d969e","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.629739Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:820110c6d09a1e623157c18e259dd53b0ba1556d6a1dba6936b2c98183956f34","observation_id":"3d1d312f-cde0-4266-82f2-6038a9f58e59","resolution":{"observed_at":"2026-08-12T13:29:39.402787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.387891Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"2e329225-7d21-43ca-9840-3dd1b0a2dbce","year":2022},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.633717Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:37248b6a331d68efb96dee2dc222c806701d6ebffd608b54fa23242e33e2f779","observation_id":"6b48aea3-741d-4d82-9ef6-f8242e884dc2","resolution":{"observed_at":"2026-08-12T13:29:39.391816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.376535Z","title":null,"venue":null,"work_id":"386ecaf4-0d24-4572-8fbd-1a8480ffcc21","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.637674Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:5968240db3961cf6aaf8fd77fccccc43f5b36589f96103785f86714ea9ddd311","observation_id":"6f9add32-5eb8-4890-b8a5-0e1336bb4217","resolution":{"observed_at":"2026-08-12T13:29:39.380374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10593","last_updated":"2025-02-24T06:04:45Z","snapshot_observed_at":"2026-08-12T23:00:58.173975Z","submitted_at":"2024-08-20T07:10:40Z","title":"An Efficient Sign Language Translation Using Spatial Configuration and Motion Dynamics with LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10593","snapshot_observed_at":"2026-08-12T13:29:38.642207Z","title":"An efficient sign language translation using spatial configuration and motion dynamics with llms.arXiv preprint arXiv:2408.10593, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.642207Z"},"links":{"cited_paper":"/paper/2408.10593","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:cc9172bada1efb4d7fb8cfb75390b36d3f4e06e6179517f57de9d405b0ebccba","observation_id":"c9047da4-2215-40c0-b754-70f74a27a2ce","resolution":{"observed_at":"2026-08-12T13:29:38.642207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.365151Z","title":"Unsupervised dense information retrieval with con- trastive learning, 2022","venue":null,"work_id":"21a196f7-b52e-4fb6-9176-d3824d202bb7","year":2022},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.647024Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:bc8a2558eca726078c714e64cd5ab5615d2fc471c9b4f49a94dd2af4b5017743","observation_id":"ffbcb2c2-1db9-4b78-a31d-3706368dd630","resolution":{"observed_at":"2026-08-12T13:29:39.369078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.651114Z","title":"Scaling up visual and vision-language representa- tion learning with noisy text supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.651114Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:6f56b9480f775963dd7d233d54a468dac6ce0520c285c0c2eaa7b73b6a77858f","observation_id":"9a95c125-d5d9-42a8-908e-fc8b49537725","resolution":{"observed_at":"2026-08-12T13:29:38.651114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.346474Z","title":"Visual alignment pre-training for sign language translation","venue":null,"work_id":"39a005c7-c4cc-4b3f-84ec-7a9fa0e9c35a","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.655353Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:b0424c4e04bd669e4e5a08a9666270e1129eb8b655289344b548eed83d34745a","observation_id":"5d473063-5680-400c-b7dc-2c242d4afab2","resolution":{"observed_at":"2026-08-12T13:29:39.350472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.333462Z","title":"Prior knowledge and memory enriched transformer for sign lan- guage translation","venue":null,"work_id":"38caa92f-f7cf-4603-bee4-ccdd7959b9ef","year":2022},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.659649Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:e6e1cf7dc36aa4735af86f83cac6f4a288332226e22471bcc464a26c6ac636ef","observation_id":"71059831-13bd-45b6-b545-a59927701ed6","resolution":{"observed_at":"2026-08-12T13:29:39.338493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.663852Z","title":"Llava-onevision: Easy visual task transfer,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.663852Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:00eab515432c13a0a9a61fedffddddf788e5c0f2895bc1107b5e03caaaaca00b","observation_id":"c03986d8-f1f4-4abf-9d92-53062b88c8a7","resolution":{"observed_at":"2026-08-12T13:29:38.663852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.312687Z","title":"Tspnet: Hier- archical feature learning via temporal semantic pyramid for sign language translation","venue":null,"work_id":"819cc8cf-dffd-43c2-97b6-b604a65edb4d","year":2020},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.668626Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:e769c81eaa49d2bd8f6884173ca1fbbc1a1a72f05c3245f2a687f7efc4969e2e","observation_id":"9ead581b-9ad1-4f45-9c57-4d97686cf0ed","resolution":{"observed_at":"2026-08-12T13:29:39.318103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.299948Z","title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models, 2024","venue":null,"work_id":"86a3aba8-c347-4c49-893c-6565e3d3413f","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.672741Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:c527f806f3439ae94b104d9b7601354d45b51069240b268ea5faa8d417b60be1","observation_id":"7cd13d56-7b61-4df0-80ea-e9c323bb9055","resolution":{"observed_at":"2026-08-12T13:29:39.304110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.676608Z","title":"Align before fuse: Vision and language representation learn- ing with momentum distillation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.676608Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:a56f1220ae65f4a5516d7269dba86a1317dda8a76dfb428719a736bd6a3785b7","observation_id":"d728d2d0-fa2c-486c-a7bb-e14c59b17bca","resolution":{"observed_at":"2026-08-12T13:29:38.676608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.680554Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.680554Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:8eed321c5832965df908e01d3f747775804df3f227afa73fa344d7e6cbe8ff70","observation_id":"8e884ccd-f4f2-4efb-a31b-759c120f6910","resolution":{"observed_at":"2026-08-12T13:29:38.680554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-12T13:29:38.684321Z","title":"Video-llava: Learning united visual represen- tation by alignment before projection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.684321Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:82b725d9809f45094fcc10774259160a93272b87723e393725ba6a705958af6f","observation_id":"5f586168-b339-4201-bfce-98a84424f833","resolution":{"observed_at":"2026-08-12T13:29:38.684321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.688409Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.688409Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:6aa4181cace31493819cb0b2a7d8740bf975784b34beebf807b84260cc595816","observation_id":"53e974d1-4f66-43d3-a4a1-45fe86de5b33","resolution":{"observed_at":"2026-08-12T13:29:38.688409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.692541Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.692541Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:87efa5b9c72bc40c10f5b8addbef1d95b238b5a543f4219b4e690b33a72800da","observation_id":"178470ab-dcf0-4765-b13f-54961d040228","resolution":{"observed_at":"2026-08-12T13:29:38.692541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06353","last_updated":"2020-09-15T13:27:13Z","snapshot_observed_at":"2026-07-06T08:57:29.493849Z","submitted_at":"2020-02-15T10:03:25Z","title":"UniVL: A Unified Video and Language Pre-Training Model for Multimodal Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06353","snapshot_observed_at":"2026-08-12T13:29:38.696353Z","title":"Univl: A unified video and language pre-training model for multimodal understanding and generation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.696353Z"},"links":{"cited_paper":"/paper/2002.06353","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:057492b7953f653e31931fd41fb2eb069c21d75c78eefb7c1dd65933242de8e5","observation_id":"e9cec1b5-8f68-4617-a553-49b21ff1c1dd","resolution":{"observed_at":"2026-08-12T13:29:38.696353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.258994Z","title":null,"venue":null,"work_id":"b8bb6403-7a6a-40f6-ad15-3b8d16a3a041","year":2015},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.700306Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:54ca0c2536afaac2585d16bd7f539e6be829dbb8563085f8fccccf7c0006c0e4","observation_id":"4c723ac5-89fb-4c14-a665-d49569331794","resolution":{"observed_at":"2026-08-12T13:29:39.263765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.246871Z","title":"Min and X","venue":null,"work_id":"e2a7a9c1-17c3-4732-ae43-5f03604d4f7f","year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.704159Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:8fa861b469f0f1a3b09a6e46e842da1defa545733464f420688329f3f9cf950f","observation_id":"c7b4161d-ddde-4407-89fd-5a6fd9f0b6a7","resolution":{"observed_at":"2026-08-12T13:29:39.250987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.234435Z","title":"Mochat: Joints-grouped spatio-temporal grounding llm for multi-turn motion com- prehension and description, 2024","venue":null,"work_id":"875055d4-9c61-4184-a9c1-ebd4ce272ed8","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.707890Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:fd13eec5bb5816444b885dbf941bcfd69930f877b440711e33c494230eb83737","observation_id":"6ec0a447-74c8-4471-a927-f7fc816f116e","resolution":{"observed_at":"2026-08-12T13:29:39.238640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.711387Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.711387Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:ccdede5978aa271cf3a00fa581a14fda4b6d064e6ca9b62e26ee9602a47230d5","observation_id":"a7f3262a-3ad1-40ed-9e3c-ca3b9d16a725","resolution":{"observed_at":"2026-08-12T13:29:38.711387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-12T13:29:38.714865Z","title":"Kosmos-2: Ground- ing multimodal large language models to the world","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.714865Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:797fe4830110f8fa1550a294cb368b91ec9d7e844e0e66070d64180b8ae1f6d7","observation_id":"495c74e7-e722-40c5-90f3-f26492b61239","resolution":{"observed_at":"2026-08-12T13:29:38.714865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.718786Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.718786Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:4455dd58c261305ff058f10be0bcca52a9abb76f75f8f051c99dd34810d86e0a","observation_id":"062a08ae-c86f-41c2-bc47-05c43374d427","resolution":{"observed_at":"2026-08-12T13:29:38.718786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.205375Z","title":"All you need in sign language production, 2022","venue":null,"work_id":"8be29de8-e10b-4fd0-903b-a4fa17cd6a26","year":2022},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.722690Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:3556acb01e6412069d77caff82ab8cf7e4826fe70e7436e1f965781c3160f631","observation_id":"b58a1a3d-c7a0-45e6-a9c1-1a40af0595f8","resolution":{"observed_at":"2026-08-12T13:29:39.209776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.191675Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks","venue":null,"work_id":"af75fede-527b-4840-acad-6f461c70b514","year":2019},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.726335Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:f9aa6c0948b270f3ef5e5a515c6236994ffe1e38e763f45c3d1c5fbebdcddcbd","observation_id":"3c8ef19b-91b0-4ed3-8f0a-e74f6edf55f8","resolution":{"observed_at":"2026-08-12T13:29:39.196172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.176161Z","title":"Sign lan- guage gesture recognition","venue":null,"work_id":"2fcaa573-46ac-456f-93c6-694853572114","year":2020},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.729848Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:993b626fa550bc956f96f71cf48273b5031c4f100c8ae06c4be15c072190ea41","observation_id":"f75eafeb-402f-4352-ba74-94fcc15c401c","resolution":{"observed_at":"2026-08-12T13:29:39.181795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.163818Z","title":"Stokoe, William C","venue":null,"work_id":"249ad8aa-9889-4e4e-8b09-9321caed7b54","year":2005},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.733667Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:ef1d102ea59da3f473ef4017647a62496f03572c9d2622c7eb585006b72ce552","observation_id":"12ff8d24-0f0d-4ac4-99e6-3c7c8903cb13","resolution":{"observed_at":"2026-08-12T13:29:39.168120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.151804Z","title":"Mul- tilingual translation with extensible multilingual pretraining and finetuning, 2020","venue":null,"work_id":"cd461965-fd3f-45ff-bad5-1a7b4491a0e0","year":2020},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.737664Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:bf0843b458f2b227a1453e313866ace3aa7c00a5a3dffc84fa61c0c516a64418","observation_id":"055f7db6-69d4-48f9-a29e-20c8abcaeed5","resolution":{"observed_at":"2026-08-12T13:29:39.156078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.741216Z","title":"Alpaca: A strong, replicable instruction- following model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.741216Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:1a29d22ab252165733f4704f11f820f9ac9f76aa73e7092897bce0d69abcea3a","observation_id":"4db1ac9b-b154-49ba-bf87-6aebb17f93a6","resolution":{"observed_at":"2026-08-12T13:29:38.741216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T13:29:38.744746Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.744746Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:6fff8637a18b9a436c66a409ab4735b66a8dde62b949b5bcb1d1be51e5282fe6","observation_id":"f659b246-d33b-4f1e-bed4-9a27e48c3b35","resolution":{"observed_at":"2026-08-12T13:29:38.744746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.748069Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.748069Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:026e2f1903599dd2885c9de0bb7322c6e04a22e45c805372815310686afe0d82","observation_id":"02645460-0fa6-4901-a33d-c3a94ac67a8d","resolution":{"observed_at":"2026-08-12T13:29:38.748069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.127536Z","title":"The chal- lenges of cross-modal translation: English-to-sign-language translation in the zardoz system","venue":null,"work_id":"b19140eb-2a4b-44f8-9f85-8bd3d8994a90","year":1998},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.751995Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:0d7ef8e2b5f3360b07b945e07c437bb2b51314947ede566d3b2b93c817cc3fdb","observation_id":"31bc6551-96fc-4eb5-9d86-89323efafc91","resolution":{"observed_at":"2026-08-12T13:29:39.131312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.116399Z","title":"Stochastic transformer networks with linear competing units: Application to end-to-end sl translation","venue":null,"work_id":"2207198d-66e3-4803-8ad6-f86f920cb068","year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.755453Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:91fd6a03b13647f506e8911d25e583d2e11d396afae6be995f4a3404038ce29a","observation_id":"4392214c-bdeb-4e83-a388-2fdf79ef35f6","resolution":{"observed_at":"2026-08-12T13:29:39.120244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.104881Z","title":"Text embeddings by weakly-supervised contrastive pre- training, 2024","venue":null,"work_id":"2fd8789c-4fcf-4f64-bf5f-840a301475a7","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.759597Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:c429a3ccfdf3558fd16502d746a8ce02e867c2db4f6a22fc0f0c0b920a85f71c","observation_id":"27a2d85b-24f4-4dfb-93f9-dc476566e13f","resolution":{"observed_at":"2026-08-12T13:29:39.108602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.093575Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution, 2024","venue":null,"work_id":"05d06eed-4c68-4e0e-b262-9d3414986dc6","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.763502Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:6cb9e14d64ed4bc76e625a536cb9f57dea982c4b00945578ad1d58a8c4904095","observation_id":"196f4d4e-6c0b-40f6-a1dc-e9989fe03004","resolution":{"observed_at":"2026-08-12T13:29:39.097641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10904","last_updated":"2022-05-15T23:20:46Z","snapshot_observed_at":"2026-08-06T05:59:00.316195Z","submitted_at":"2021-08-24T18:14:00Z","title":"SimVLM: Simple Visual Language Model Pretraining with Weak Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10904","snapshot_observed_at":"2026-08-12T13:29:38.766732Z","title":"Simvlm: Simple visual language model pretraining with weak supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.766732Z"},"links":{"cited_paper":"/paper/2108.10904","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:a87bc9a0ba89c5638e9c7c3332efc5a8cd61cf61be883deaccb4b4ef8bc8568f","observation_id":"fa6ca9c6-ae4c-4d06-b0e6-3e7c3c229a8d","resolution":{"observed_at":"2026-08-12T13:29:38.766732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04164","last_updated":"2024-05-07T10:00:38Z","snapshot_observed_at":"2026-08-13T00:13:16.797997Z","submitted_at":"2024-05-07T10:00:38Z","title":"Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04164","snapshot_observed_at":"2026-08-12T13:29:38.770507Z","title":"Sign2gpt: Leveraging large language models for gloss-free sign language translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.770507Z"},"links":{"cited_paper":"/paper/2405.04164","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:dae46e3a1eb39b6c3779295a37d2124d9677ba7c523f1436c3b65ee536f86ea9","observation_id":"be9ff8d1-144b-420e-8266-be58b41a4f6a","resolution":{"observed_at":"2026-08-12T13:29:38.770507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.082338Z","title":null,"venue":null,"work_id":"ff79e067-d801-4833-aff5-51e38fdd098c","year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.774344Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:ab8362fea4ec11a35cf4a20076ab73496da513ea6ecb51b0c364ef026d70cc58","observation_id":"bf34ee9b-7752-4bb7-81d5-bd1eedefdacd","resolution":{"observed_at":"2026-08-12T13:29:39.086143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.071058Z","title":"Qwen2 technical report, 2024","venue":null,"work_id":"7e257876-d449-408b-84ee-f9ca9a8b743e","year":2024},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.777915Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:41cc61055ae721457f0ca3c3a82fffaf2116c0a6fd0525df076297e14f415b7e","observation_id":"06388f9e-7130-4f78-9e7f-2b2f371992f7","resolution":{"observed_at":"2026-08-12T13:29:39.074837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-07-06T12:08:35.761426Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-12T13:29:38.781663Z","title":"Filip: Fine-grained interactive language-image pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.781663Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:64dc2f86cba237273cf72c2dc60af8762210d1f08b5176ba0eac7fa1791de6de","observation_id":"60393313-46e1-47ce-ab04-12388d1ba672","resolution":{"observed_at":"2026-08-12T13:29:38.781663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.059490Z","title":"Simulslt: End-to- end simultaneous sign language translation","venue":null,"work_id":"3c327fdd-adc6-4baf-a5b8-82101e629728","year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.785489Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:eedabe4a686625af28e7f2c921981614e705b4b2ad2a87720a6f55e52542019a","observation_id":"6889a2a1-e5ac-472f-9036-c9bf778963c6","resolution":{"observed_at":"2026-08-12T13:29:39.063297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:38.788960Z","title":"Gloss attention for gloss-free sign language translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.788960Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:a3f42b69d507b3cf6c7473fd47b892d96802a592a16d1c2f5512a280228da9bd","observation_id":"740c7d74-4cc6-4822-a170-3af1a23e7163","resolution":{"observed_at":"2026-08-12T13:29:38.788960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01778","last_updated":"2023-05-02T20:41:59Z","snapshot_observed_at":"2026-08-11T18:28:10.947340Z","submitted_at":"2023-05-02T20:41:59Z","title":"SLTUNET: A Simple Unified Model for Sign Language Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01778","snapshot_observed_at":"2026-08-12T13:29:38.792419Z","title":"Sltunet: A simple unified model for sign language translation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.792419Z"},"links":{"cited_paper":"/paper/2305.01778","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:f096dcae3fabbb922cb87f7cd2ffd7d2411319f85a167de416194550d2caa6f8","observation_id":"48148b8c-9e70-4f67-80ef-e8349592c4dd","resolution":{"observed_at":"2026-08-12T13:29:38.792419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-12T13:29:38.796201Z","title":"Speechgpt: Empow- ering large language models with intrinsic cross-modal con- versational abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.796201Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:02d2b2fe306bac72f01fe62573cf7319b5a65b1206dee41ebd89190ea7de57e7","observation_id":"0d17e710-c343-4ceb-9801-61fd116c416a","resolution":{"observed_at":"2026-08-12T13:29:38.796201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-07-06T15:38:39.712379Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-12T13:29:38.799820Z","title":"Video-llama: An instruction-tuned audio-visual language model for video un- derstanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.799820Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:3a1dce08601b5bdc8554efbc944d48c9b398ef3839f06e75df59dc7ed22aeadc","observation_id":"41be5ed8-ee64-4fe3-9e96-edd6fdaf443b","resolution":{"observed_at":"2026-08-12T13:29:38.799820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.041577Z","title":"Conditional sentence generation and cross-modal reranking for sign language translation","venue":null,"work_id":"0dfc21fd-f746-459b-9083-39bc460941dd","year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.803581Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:34f5a682f996c452fcdcce245b256418cf04a6a0104330a88515c2c2e22709b7","observation_id":"7ca34b3c-7f03-4ce3-9577-2ad217947891","resolution":{"observed_at":"2026-08-12T13:29:39.045769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.030089Z","title":"Gloss-free sign language translation: Improving from visual- language pretraining","venue":null,"work_id":"57edb297-7849-4468-aa57-15d7f8fc4543","year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.806815Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:5e04c9b0af83fea21ab71965c4b1ad632d36d280c1b3de6d384bc2e5c2f2079f","observation_id":"00dc8db9-e615-46f8-9a16-b49d0b018fcd","resolution":{"observed_at":"2026-08-12T13:29:39.033916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.018168Z","title":"Improving sign language translation with monolingual data by sign back-translation","venue":null,"work_id":"cbe09187-f424-4b70-9de0-a2cce9adf8e8","year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.810697Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:a25c6a23fecaddd17ff7d627e24dadfc1fb4815b1a20e5d5a65756a38f633e2c","observation_id":"a1af92b6-9f01-4266-8d45-f777d5fddd10","resolution":{"observed_at":"2026-08-12T13:29:39.021941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:29:39.004762Z","title":"Spatial-temporal multi-cue network for sign language recog- nition and translation","venue":null,"work_id":"916edade-4487-4e4c-b572-702fe23a5d68","year":2021},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.814243Z"},"links":{"citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:f968288967fbd1a6adbf90be2ac09e405ea5315be3c0acbd42cdfbb410df135f","observation_id":"6d2ad3ef-9cab-4938-ab2c-b25cf8ebfe64","resolution":{"observed_at":"2026-08-12T13:29:39.010503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-12T13:29:38.817694Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T13:29:38.817694Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2411.16789"},"observation_digest":"sha256:1e12b0974f518c8f2ac00280c0eee76a422b5a4d79a025d3377ad7ead8c6bcbc","observation_id":"405515db-d559-45d8-9f7b-d2a23873df5b","resolution":{"observed_at":"2026-08-12T13:29:38.817694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16789","last_updated":"2025-08-25T12:12:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T13:20:40.266329Z","submitted_at":"2024-11-25T09:01:41Z","title":"Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2411.16789."}