{"as_of":"2026-08-09T02:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6e779ccbfcd8d0be8a0ddbd2c68f665aea20d168fc1eddef5c7612422ffd41a","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:00:13.409331Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00235/citation-record","integrity":"/paper/2608.00235/integrity","json":"/paper/2608.00235/citation-record.json","paper":"/paper/2608.00235"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-04T01:00:10.924806Z","title":"arXiv preprint arXiv:2309.16609","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:10.924806Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:ae788dc7e61b9c713d5bdf695c305862651145e442ec05c03e31d826e1fe4f4d","observation_id":"78799370-05fd-469f-8f38-25bbe7eb66cc","resolution":{"observed_at":"2026-08-04T01:00:10.924806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-04T01:00:11.373099Z","title":"Amanda Duarte, Shruti Palaskar, Lucas Ventura, Deepti Ghadiyaram, Kenneth DeHaan, Florian Metze, Jordi Torres, and Xavier Giro-i Nieto","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:11.373099Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:1c5241e11c13fd30bc46178eb23c5f7d18a7ac3af6ba5e7a60b47a0cf6ee1984","observation_id":"181e2960-f78b-416c-95fc-ad12a27ae49f","resolution":{"observed_at":"2026-08-04T01:00:11.373099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24290","last_updated":"2025-07-05T09:01:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T16:36:05Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24290","snapshot_observed_at":"2026-08-04T01:00:11.630931Z","title":"Eui Jun Hwang, Sukmin Cho, Junmyeong Lee, and Jong C Park","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:11.630931Z"},"links":{"cited_paper":"/paper/2503.24290","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:aaa397104a81e76686561131e51742aededa9ef3b7fb5d5be6aa6a79d47a5f34","observation_id":"bf3d7857-b1b1-4c69-89e7-828fc3418580","resolution":{"observed_at":"2026-08-04T01:00:11.630931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:00:11.918228Z","title":"InFindings of the Association for Computational Linguistics: ACL 2025, pages 3691–3706","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:11.918228Z"},"links":{"citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:6670c325b8d38a5408f71631dc47ec35b308207556371f05f616febbda9b3b1b","observation_id":"03f19c66-c7bf-41dd-8907-40e73dd52010","resolution":{"observed_at":"2026-08-04T01:00:11.918228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:00:13.409331Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:13.409331Z"},"links":{"citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:e00acb64881e7de5dbd4c21452825e0d9c2ec2652b80b2258e3d1ab53bd2ea57","observation_id":"427acfca-d6f2-4899-b330-e11d9dc2479b","resolution":{"observed_at":"2026-08-04T01:00:13.409331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:00:12.106130Z","title":"Jungeun Kim, Hyeongwoo Jeon, Jongseong Bae, and Ha Young Kim","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.106130Z"},"links":{"citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:e8c6d4b0d807168dfce306ac08a90ff4dc05885f3b3224f09c090d7e9865d739","observation_id":"396ace77-f43b-4ae0-8fb4-0acad0e48ff9","resolution":{"observed_at":"2026-08-04T01:00:12.106130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-04T01:00:12.178781Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.178781Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:c6c1a8bbfd86cca58875da4e0d18c3976b9c8935f9e604aaa075f4446e6a8f95","observation_id":"dad83d2f-0d40-4149-adec-bb428e99952f","resolution":{"observed_at":"2026-08-04T01:00:12.178781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15187","last_updated":"2025-03-13T12:51:29Z","snapshot_observed_at":"2026-07-06T20:26:03.338338Z","submitted_at":"2025-01-25T11:51:23Z","title":"Uni-Sign: Toward Unified Sign Language Understanding at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15187","snapshot_observed_at":"2026-08-04T01:00:12.241541Z","title":"arXiv preprint arXiv:2501.15187","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.241541Z"},"links":{"cited_paper":"/paper/2501.15187","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:5a0fa27a11e2845df2975397919cc452e4cfafa7fc452d8e7048481b90b18e04","observation_id":"2485f82d-dfc5-4bbb-841c-18a15b19c7ed","resolution":{"observed_at":"2026-08-04T01:00:12.241541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16524","last_updated":"2024-12-21T08:01:08Z","snapshot_observed_at":"2026-07-06T20:11:24.538172Z","submitted_at":"2024-12-21T08:01:08Z","title":"LLaVA-SLT: Visual Language Tuning for Sign Language Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16524","snapshot_observed_at":"2026-08-04T01:00:12.304433Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.304433Z"},"links":{"cited_paper":"/paper/2412.16524","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:c55ac2b1ba9e35e68fa15d0e6819d511ae7b70850942514e4f6f5195b0a9b2c1","observation_id":"8ef20c0d-6956-4657-9850-540d34c6b882","resolution":{"observed_at":"2026-08-04T01:00:12.304433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12876","last_updated":"2023-05-27T16:43:18Z","snapshot_observed_at":"2026-07-06T15:30:34.082083Z","submitted_at":"2023-05-22T09:57:43Z","title":"Gloss-Free End-to-End Sign Language Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12876","snapshot_observed_at":"2026-08-04T01:00:12.360459Z","title":"Haotian Liu, Chunyuan Li, Qingyang Wu, and Yong Jae Lee","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.360459Z"},"links":{"cited_paper":"/paper/2305.12876","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:9a6fa8637fdefecdfc67daab448cc5e3b4cd8234746517304e7907182f3f7d20","observation_id":"129816de-eeef-4ecc-8577-3d493b323e51","resolution":{"observed_at":"2026-08-04T01:00:12.360459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-04T01:00:12.516370Z","title":"Kishore Papineni, Salim Roukos, Todd Ward, and Wei- Jing Zhu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.516370Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:53e42a4f701fb7050dc9e800c4e313ff00fcca63a35d888510aae469c555ab24","observation_id":"fc00cfd1-1ddd-496f-b583-b312c7d1ec5e","resolution":{"observed_at":"2026-08-04T01:00:12.516370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.18034","last_updated":"2026-04-20T09:59:18Z","snapshot_observed_at":"2026-08-06T22:17:27.223160Z","submitted_at":"2026-04-20T09:59:18Z","title":"SignDPO: Multi-level Direct Preference Optimisation for Skeleton-based Gloss-free Sign Language Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.18034","snapshot_observed_at":"2026-08-04T01:00:12.673782Z","title":"Zhi Rao, Yucheng Zhou, Benjia Zhou, Yiqing Huang, Sergio Escalera, and Jun Wan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.673782Z"},"links":{"cited_paper":"/paper/2604.18034","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:8c9b3beab985330e57daa9bdf7b01ef7b99e1b31111786a71dbddba10e27e4f8","observation_id":"d6f28f0b-226f-4d8a-b879-dd71a45f85b9","resolution":{"observed_at":"2026-08-04T01:00:12.673782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:00:12.750334Z","title":"Phillip Rust, Bowen Shi, Skyler Wang, Necati Cihan Camgöz, and Jean Maillard","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.750334Z"},"links":{"citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:d1d995c81d16b9529e2a8e526ec7ea7e8a90a31da5296294491140b6f0e3888a","observation_id":"25bddd58-1e02-461a-a0b0-cf7d62eae2c8","resolution":{"observed_at":"2026-08-04T01:00:12.750334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09611","last_updated":"2024-08-07T19:27:53Z","snapshot_observed_at":"2026-07-06T17:30:21.100876Z","submitted_at":"2024-02-14T22:57:03Z","title":"Towards Privacy-Aware Sign Language Translation at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09611","snapshot_observed_at":"2026-08-04T01:00:12.828415Z","title":"Thibault Sellam, Dipanjan Das, and Ankur Parikh","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.828415Z"},"links":{"cited_paper":"/paper/2402.09611","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:d751f133dea4f569e5c8f0d56e776786bc57a8c77c00f42e37e70093e0e097f0","observation_id":"29f0be70-c52c-4ba1-b6e9-6c0196dfc622","resolution":{"observed_at":"2026-08-04T01:00:12.828415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-04T01:00:12.887990Z","title":"Bowen Shi, Diane Brentari, Gregory Shakhnarovich, and Karen Livescu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.887990Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:0747413b5a54c4f04b7e82e80dc8c145727dd11694ac25c47f2ba6a851f92c6a","observation_id":"734e8249-fcfa-481f-9278-c7a5c94770dd","resolution":{"observed_at":"2026-08-04T01:00:12.887990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-04T01:00:12.956463Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.956463Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:f69abf6929d03336514bb69e9ad6ab6d29652f9fa0b9db73888c96368fe547bc","observation_id":"da7d3dd4-a551-4e14-9e76-25ea0c72a124","resolution":{"observed_at":"2026-08-04T01:00:12.956463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T01:00:13.035177Z","title":"Dave Uthus, Garrett Tanzer, and Manfred Georg","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:13.035177Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:edecab9f8891b18a0af63a137b7c813af9a3db8752bd8c5531d74ae8f7254a9e","observation_id":"76de9bcd-1e99-4356-926d-39ead8a66ccd","resolution":{"observed_at":"2026-08-04T01:00:13.035177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04164","last_updated":"2024-05-07T10:00:38Z","snapshot_observed_at":"2026-07-06T18:10:53.622248Z","submitted_at":"2024-05-07T10:00:38Z","title":"Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04164","snapshot_observed_at":"2026-08-04T01:00:13.111746Z","title":"arXiv preprint arXiv:2405.04164","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:13.111746Z"},"links":{"cited_paper":"/paper/2405.04164","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:ef79e33573bf667ebba5b18b2f459f877f3acf7bdd4a2d6d52bc42827572aa2c","observation_id":"3979c841-3685-424d-bc23-68e006fbbe02","resolution":{"observed_at":"2026-08-04T01:00:13.111746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:00:13.180722Z","title":null,"venue":null,"work_id":null,"year":1918},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:13.180722Z"},"links":{"citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:a636b08bbac553b04070b3d08bd338cb238492d1b8aa751d4e9b571816acd521","observation_id":"d203e0d9-2696-496b-aab7-f4cdc0d43153","resolution":{"observed_at":"2026-08-04T01:00:13.180722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-04T01:00:13.231444Z","title":"Biao Zhang, Mathias Müller, and Rico Sennrich","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:13.231444Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:dbe582e6f9664e80fa1e7711aef8e8880111425a6994afcccf71aecc4bd40700","observation_id":"0acc7da7-c588-4a37-b89a-208a92f622e8","resolution":{"observed_at":"2026-08-04T01:00:13.231444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01778","last_updated":"2023-05-02T20:41:59Z","snapshot_observed_at":"2026-07-06T15:22:32.448249Z","submitted_at":"2023-05-02T20:41:59Z","title":"SLTUNET: A Simple Unified Model for Sign Language Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01778","snapshot_observed_at":"2026-08-04T01:00:13.336132Z","title":"Biao Zhang, Garrett Tanzer, and Orhan Firat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:13.336132Z"},"links":{"cited_paper":"/paper/2305.01778","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:74ce791acaea21f831013a3377fca26fdec446a6b67d20e38fb64d3bded4ffc2","observation_id":"da7e96d0-5ce3-4680-9d6b-a7c0a54f9fa2","resolution":{"observed_at":"2026-08-04T01:00:13.336132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:00:12.601422Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.601422Z"},"links":{"citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:c5a6e59a58e970046b9cfc6c2eef68e825360e1608963bf119d5df2f3ae3db41","observation_id":"3c8e876d-4ebb-40cf-bfbe-0a30a85a4580","resolution":{"observed_at":"2026-08-04T01:00:12.601422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08172","last_updated":"2019-06-14T05:49:22Z","snapshot_observed_at":"2026-08-05T19:15:35.517082Z","submitted_at":"2019-06-14T05:49:22Z","title":"MediaPipe: A Framework for Building Perception Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08172","snapshot_observed_at":"2026-08-04T01:00:12.437039Z","title":"Maxime Oquab, Timothée Darcet, Théo Moutakanni, Huy V o, Marc Szafraniec, Vasil Khalidov, Pierre Fer- nandez, Daniel Haziza, Francisco Massa, Alaaeldin El-Nouby, and 1 others","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.437039Z"},"links":{"cited_paper":"/paper/1906.08172","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:3cb0ab09543f7d6e7373177211747021ea67e05f0e55c364868f9ed6e88cce1d","observation_id":"ce6a3a5a-d506-4bd8-8b4e-69622ce9867e","resolution":{"observed_at":"2026-08-04T01:00:12.437039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-04T01:00:11.539517Z","title":"Hezhen Hu, Weichao Zhao, Wengang Zhou, and Houqiang Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:11.539517Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:38b68c3ca819b8f3b5b9e0828ea3d9120577b4b1ee7142c0aff264de74850a78","observation_id":"7dff6ef3-7b3d-4568-ab18-26de9da3acfa","resolution":{"observed_at":"2026-08-04T01:00:11.539517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-04T01:00:11.250557Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:11.250557Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:461c68ce45a787ea97971ae6b2e2bfca0f4a088e804ce24b15bc189e37845328","observation_id":"44ec9c65-414a-454c-81bc-e0be461176ce","resolution":{"observed_at":"2026-08-04T01:00:11.250557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T01:00:10.802276Z","title":"Jinze Bai, Shuai Bai, Yunfei Chu, Zeyu Cui, Kai Dang, Xiaodong Deng, Yang Fan, Wenbin Ge, Yu Han, Fei Huang, and 1 others","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:10.802276Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:665b84de00f6524659f33addeeefa04b3ca605ab6a32ac99421b0e4f55c3d8ce","observation_id":"58c4a974-95d3-42c4-90db-ba77c9f46c3d","resolution":{"observed_at":"2026-08-04T01:00:10.802276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10593","last_updated":"2025-02-24T06:04:45Z","snapshot_observed_at":"2026-07-06T19:03:18.242943Z","submitted_at":"2024-08-20T07:10:40Z","title":"An Efficient Sign Language Translation Using Spatial Configuration and Motion Dynamics with LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10593","snapshot_observed_at":"2026-08-04T01:00:11.772701Z","title":"Mert Inan, Anthony Sicilia, and Malihe Alikhani","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:11.772701Z"},"links":{"cited_paper":"/paper/2408.10593","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:875adba871ec6ae674063b3a79795dbe6e6136e114917fe7fcd25a360aa14de2","observation_id":"c66087e8-7dcb-41d0-90ef-41fae2e4a5a4","resolution":{"observed_at":"2026-08-04T01:00:11.772701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-04T01:00:11.079442Z","title":"5-vl technical report.arXiv preprint arXiv:2502.13923","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:11.079442Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:db443c4b3e0c7e28c9a6a1c3485dd1e044d603467187b673a1fa3d316e8b3cd3","observation_id":"5ba17715-4537-4200-ad31-243d6dad5221","resolution":{"observed_at":"2026-08-04T01:00:11.079442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15301","last_updated":"2026-04-17T07:02:15Z","snapshot_observed_at":"2026-08-02T19:53:21.062944Z","submitted_at":"2026-04-16T17:57:24Z","title":"Think in Latent Thoughts: A New Paradigm for Gloss-Free Sign Language Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15301","snapshot_observed_at":"2026-08-04T01:00:12.023737Z","title":"Oktay Karaku¸ s","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T01:00:12.023737Z"},"links":{"cited_paper":"/paper/2604.15301","citing_paper":"/paper/2608.00235"},"observation_digest":"sha256:044d1ec39f7a23f0610aa5c200eb9745781fcac379f5e8f4b2c8088dcac7a06e","observation_id":"234e3bd4-0de4-4002-a5d1-9a3bc0c4df42","resolution":{"observed_at":"2026-08-04T01:00:12.023737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.00235","last_updated":"2026-07-31T19:30:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T18:04:59.974631Z","submitted_at":"2026-07-31T19:30:03Z","title":"Attention-Steered Vision-Language Models for Sign Language Translation"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2608.00235."}