{"as_of":"2026-08-05T20:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:678b6585ac2c652830f819460dba72bfda2aa937ed60e61b52dd41f453240cbf","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T22:15:46.443207Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T20:02:56.057102Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T20:08:55.159229Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"cited_work":{"arxiv_id":"2606.06966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.06966","snapshot_observed_at":"2026-07-03T20:08:55.159229Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","venue":"cs.CV","work_id":"4f21237e-e08d-4d2e-9d4f-bcc46312ab23","year":2026},"citing_paper":{"arxiv_id":"2607.01442","last_updated":"2026-07-01T20:05:46Z","snapshot_observed_at":"2026-08-05T16:25:01.875940Z","submitted_at":"2026-07-01T20:05:46Z","title":"From Forgeries to Foundation Models: A Systematic Survey of Identity Document Attack and Detection","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-07-03T20:02:56.057102Z"},"links":{"cited_paper":"/paper/2606.06966","citing_paper":"/paper/2607.01442"},"observation_digest":"sha256:7e754ce7156e2187b393cf71fd8180e09c9fc018f91ca1ee167e1f9d4df81920","observation_id":"b5c595b8-eb31-4b16-8e78-d7270e19743c","resolution":{"observed_at":"2026-07-03T20:08:55.160994Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.06966/citation-record","integrity":"/paper/2606.06966/integrity","json":"/paper/2606.06966/citation-record.json","paper":"/paper/2606.06966"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Foundation models defining a new era in vision: A survey and outlook,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:bb9d8be8d5f8652af9ddf276450f02e6052535ac3ed06e5c0f0b105eb3a74ef7","observation_id":"809f1a42-7bcb-4fa7-b04a-419e782eff67","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05263","last_updated":"2025-06-05T17:24:11Z","snapshot_observed_at":"2026-07-06T21:37:23.562748Z","submitted_at":"2025-06-05T17:24:11Z","title":"Can Foundation Models Generalise the Presentation Attack Detection Capabilities on ID Cards?","version":1},"cited_work":{"arxiv_id":"2506.05263","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05263","snapshot_observed_at":"2026-07-03T20:08:55.128697Z","title":"Can foundation models generalise the presentation attack detection capabilities on id cards?","venue":null,"work_id":"e9f7ee93-c036-43a6-8b27-7b9166c5900c","year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"cited_paper":"/paper/2506.05263","citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:5c0e7c205e07cf958a667984f2d668bc7cbc8ba8cdad8da0fc0a8bb5e5c02846","observation_id":"25200abf-456a-4639-870f-33a8118d0928","resolution":{"observed_at":"2026-07-02T16:57:10.138300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Explainability and vision foundation models: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:5d1e2689d93eab3acd2995181625478d67773c0637f169c314a8a477ef6f88b9","observation_id":"69e792aa-bc1e-445a-8bc4-61053d034b91","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.06056","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:08:55.162587Z","title":"Identity card presentation attack detection: A systematic review,","venue":null,"work_id":"d67fa35a-5a0d-4f37-94d6-7e74389fb626","year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:554064ec1ec32a3ca8be61c186c14fb30c8ad4174aa6f8db3d4d815b6193940b","observation_id":"2ea4526b-43d1-4d2b-bde8-1b47be545cac","resolution":{"observed_at":"2026-07-02T16:57:10.150879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Forged presentation attack detection for ID cards on remote verification systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:53c8190dba30fe5bf46ec8a7ae330c9ab5af8cb86ed01c9be4ef6c6504849e8d","observation_id":"54d081c6-16f0-4c7a-8713-b0e52aa23883","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Hybrid Two-Stage Architecture for Tampering Detection of Chipless ID Cards,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:6a159ab8d77cdd3c23eb2159c759e8ac0f9c849e3b90e29a6677e506b322a042","observation_id":"0266b710-8418-48cd-8e7e-a4451fca85ea","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/9197632","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:57:10.142440Z","title":"Available: https://ieeexplore.ieee.org/document/9197632","venue":null,"work_id":"279bfa0a-981c-4117-bb77-b08a6146063d","year":null},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:4d4a056bff910d931d51e17a4172e1635c75d97afc3f37c834545a122df02002","observation_id":"1c945517-c9db-4437-9b63-c5997f60252d","resolution":{"observed_at":"2026-07-02T16:57:10.144229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1052089","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:57:10.152572Z","title":"Open-Set: ID Card Presentation Attack Detection Using Neural Style Transfer,","venue":null,"work_id":"1f2ea63a-89e8-48fc-8d16-463c7da7322c","year":2024},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:c1d085df3a64b1056963c18332778784fde19aa14a502c17576572be031c631a","observation_id":"f00886d8-5559-442e-8d29-80a1bd692df8","resolution":{"observed_at":"2026-07-02T16:57:10.154499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Image-to-image translation with conditional adversarial networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:be271da7770ffba1a89e19b33f9fec4713f06702fb1bdc52259f4685f1c65ac0","observation_id":"84ccfe37-e57e-447f-a8b9-d47793964010","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Synthetic ID Card Image Generation for Improving Presentation Attack Detection,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:b98e6684295f73264e9c346363f516192978dba95ac74c93aab260502fffdd38","observation_id":"0907a6b4-1496-4419-a706-57eec118b0e9","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Available: https://ieeexplore.ieee.org/abstract/document/ 10065533","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:9529839987d1e7f957936e85b28021007788387ff0c77e9e4940ccf0464c58ab","observation_id":"2a70317f-b298-4aaa-8bad-5b6a582aa0f3","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Idnet: A novel identity document dataset via few-shot and quality-driven synthetic data generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:232e85fe62e17f509afea7d4c3abe12c7bec2030dedced11d0e41bec6498cf8e","observation_id":"54a1de37-bcf5-4a3e-8dc3-4486b12591ee","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Fan- tasyID: A dataset for detecting digital manipulations in ID-documents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:c99bd0bcaf9b86252deac8b4d4332cf1729ec21cedc03536ce6c7a30732c7c7f","observation_id":"087e81c2-e11c-4098-9db3-1f1a17c55ebe","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"First competition on presentation attack detection on ID card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:87c9ab82eaf81920c0db0075e818ab56ec5aaa0def57a9ab34fc6ab131881042","observation_id":"9d21c896-97df-476f-8a66-eebba498ea7d","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Second competition on presentation attack detection on ID card,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:be422e71d48ef626641f25977c4950145eba789189e5c7146b065e539a59b98b","observation_id":"1287b9c6-36a3-4625-8ece-3719fc4dca78","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Contrastive localized language-image pre-training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:c7941c00d277fcd342f6d406f79f4ec1c8152d18b4f3b7ee85d85f3d2c4ed546","observation_id":"151d6d18-7e19-45ed-b719-fcc1ea1dc812","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"DINOv2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:e1a05f1c421bfd882697ed4a5df423d4d43e43db19c9bb581e380502fea88163","observation_id":"a0be2dba-954b-4e20-92b9-d177408f580d","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Fakeidet: Exploring patches for privacy-preserving fake id detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:7a35b871bf624c3a5cb4ae4118ad957af85871312f408447e0b694c0ad3de3db","observation_id":"fecdadf3-cca5-439d-9fe8-643aa5002368","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Syn- idpass: Passport synthetic dataset for presentation attack detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:4828a59d1de83a385df9765041ab9e84d58fac2ecf3a5ec883507a024ad7f281","observation_id":"76b9edde-7573-4415-95ff-3add35aaf39a","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Densely connected convolutional networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:99c898b91dfcefa091ea5bd9adc113016dab31145ae621f6d5773b3c01c53d2a","observation_id":"0df8dd2e-2d31-493d-a503-181af36013a4","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Pixel-wise supervision for presentation attack detection on identity document cards,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:5ceb7ecc9e94c2f91970f9fe7cbc9a39e6ae99bed3eee2e7b81dbc1f9b3ff13a","observation_id":"6d8edd93-8af8-4f17-9d93-967f64fc87fc","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:dbc1229c698f5df7157994c34a8b6a3f28e12570900d034b05b4dfc5d7530137","observation_id":"a324b11c-2a55-41c6-a0fe-cb11a2a9ecbd","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Sigmoid loss for language image pre-training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:b72ac80f89565d6005b44df279644c861d0a85dc3dafafa293f3c64e669016f1","observation_id":"1d94a737-7631-46c8-ab52-19c9264d970b","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":"2010.11929","doi":"10.1175/jcli-d-22-0357.1","metadata_source":"pith","pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":"cs.CV","work_id":"e96730e3-129b-4db6-b981-15ab7932e297","year":2020},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:a037185bb0951904bf8def80ab79eb0d6d113af03d51edec3414302aa3420ef1","observation_id":"99d523b5-78ea-4151-a915-25586bcce5a3","resolution":{"observed_at":"2026-07-02T16:57:10.147255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:90560c6fc41e5d6f1dfd298d35a53ab8cfe31c1c23ba04286da8beb5a73bf969","observation_id":"2534972f-1223-42db-ac21-de83df8711c9","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":"1606.08415","doi":"10.18653/v1/n19-1122","metadata_source":"pith","pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gaussian Error Linear Units (GELUs)","venue":"cs.LG","work_id":"0466fd22-03a1-4a61-af0a-a900e77bb023","year":2016},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:7723ac171a136937bcda3a16417e4055f094ebb15ef2f89356f3142eaadf97e0","observation_id":"afba7989-d17a-4242-9816-225d9e481e2a","resolution":{"observed_at":"2026-07-02T16:57:10.151436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05299","last_updated":"2025-04-07T17:58:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T17:58:57Z","title":"SmolVLM: Redefining small and efficient multimodal models","version":1},"cited_work":{"arxiv_id":"2504.05299","doi":"10.18653/v1/2025.acl-long.718","metadata_source":"pith","pith_arxiv_id":"2504.05299","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SmolVLM: Redefining small and efficient multimodal models","venue":"cs.AI","work_id":"810cc87f-f6bd-4443-9673-5e30982426b9","year":2025},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"cited_paper":"/paper/2504.05299","citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:a7c4137c64191240831cf193f812c96223fd05437d621973306f9e051b2a2332","observation_id":"12949c30-1b5a-4549-b894-11d4365b6626","resolution":{"observed_at":"2026-07-02T16:57:10.163298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:48ef62377c0246cb4d78a63403313297b8ff862908c2af23cb42b7c0c29c6a64","observation_id":"79192c26-547d-450f-a8f1-b05e23b168d8","resolution":{"observed_at":"2026-07-02T16:57:10.157108Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":"1608.03983","doi":"10.21203/rs.3.rs-7055642/v1","metadata_source":"pith","pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","venue":"cs.LG","work_id":"ad476478-c5ea-495b-a454-168c504bbfcc","year":2016},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:8453a803a3c974f00423929551ddb18e93ae9b4a9faafda5b5da41f47f864678","observation_id":"d27b502e-549d-4383-b916-4d256e43935a","resolution":{"observed_at":"2026-07-02T16:57:10.160567Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Why warmup the learning rate? under- lying mechanisms and improvements,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:beba3b3e56da9c260ce115d4359cbe0a4477fde3f286e4a0bb0dd8bdaad9df90","observation_id":"e3a429bc-d7cf-4367-8f36-a1561e4cb7e1","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Optuna: A next- generation hyperparameter optimization framework,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:9849110fc00820084c3bb377cafc42122fd7ab26d7e9cc9df537df7a708ee8f1","observation_id":"9436d348-1234-4988-af97-23cc8a6d7c62","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:3517b6b1b8f13687ba2e90ab8498380bee1f3eea5fc2a2932211622478bddb46","observation_id":"f4596ea6-e5bd-40a9-a939-0af7028e5498","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Feature selection, l 1 vs. l 2 regularization, and rotational invariance,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:45d57659553dad2ec6a9de2e5dddb35902d38929b472a1d7823305c3fd8b1dcd","observation_id":"ee6e5614-ee52-43ff-959f-29dd05e482e8","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:15:46.443207Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T22:15:46.443207Z"},"links":{"citing_paper":"/paper/2606.06966"},"observation_digest":"sha256:217b0d1f06007db4116d6ac5e1a361000e87e60924a5b40d1af07de6d3413921","observation_id":"d453e9f2-9b3d-4d47-ac9b-ba85ca18a7ee","resolution":{"observed_at":"2026-06-27T22:15:46.443207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.06966","last_updated":"2026-06-05T06:45:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T06:45:39Z","title":"From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2606.06966."}