{"as_of":"2026-08-20T21:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0c930d108b911d0c2ec32530941d9575d03174c9ad8587776128f2768df2b72","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:34:17.696520Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:34:17.591479Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:34:17.722518Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"cited_work":{"arxiv_id":"2507.10552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.10552","snapshot_observed_at":"2026-08-06T17:34:17.722518Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","venue":"cs.CV","work_id":"2814e079-c98c-41d5-a721-9a11ac7b19e1","year":2025},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.591479Z"},"links":{"cited_paper":"/paper/2507.10552","citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:263dc9a8772e7ba3424762fbaf6807d035d04354bf56bd8c170c6f7078d0e1d3","observation_id":"6999bf4c-548d-4c64-ba69-9231bf4f8432","resolution":{"observed_at":"2026-08-06T17:34:17.727420Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.10552","snapshot_observed_at":"2026-08-02T23:43:46.074733Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12819","last_updated":"2026-06-01T14:45:05Z","snapshot_observed_at":"2026-08-12T05:59:29.191948Z","submitted_at":"2026-02-13T11:03:06Z","title":"WISE: A Multimodal Search Engine for Visual Scenes, Audio, Objects, Faces, Speech, and Metadata","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T23:43:46.074733Z"},"links":{"cited_paper":"/paper/2507.10552","citing_paper":"/paper/2602.12819"},"observation_digest":"sha256:5b2fcbb468b3f57c3b2dff60811eb0f1319c0b73ad45e2304cf12b40a2cc33c1","observation_id":"49fe1455-d905-454b-9c9e-8158a324db88","resolution":{"observed_at":"2026-08-02T23:43:46.074733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.10552","snapshot_observed_at":"2026-08-01T18:10:11.300312Z","title":"arXiv preprint arXiv:2507.10552 (2025) 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17395","last_updated":"2026-07-19T20:00:40Z","snapshot_observed_at":"2026-08-16T22:13:13.367199Z","submitted_at":"2026-07-19T20:00:40Z","title":"Automating Visual Recognition of Leprosy in Wild Chimpanzees","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T18:10:11.300312Z"},"links":{"cited_paper":"/paper/2507.10552","citing_paper":"/paper/2607.17395"},"observation_digest":"sha256:f8f649fb3f1d18ed6e92ab6d1fd1c180276bc04cee1cc05564c148133b717a59","observation_id":"0306131d-63c1-4d48-80d8-c2677e2d587e","resolution":{"observed_at":"2026-08-01T18:10:11.300312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.10552/citation-record","integrity":"/paper/2507.10552/integrity","json":"/paper/2507.10552/citation-record.json","paper":"/paper/2507.10552"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"cited_work":{"arxiv_id":"2507.10552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.10552","snapshot_observed_at":"2026-08-06T17:34:17.722518Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","venue":"cs.CV","work_id":"2814e079-c98c-41d5-a721-9a11ac7b19e1","year":2025},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.591479Z"},"links":{"cited_paper":"/paper/2507.10552","citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:263dc9a8772e7ba3424762fbaf6807d035d04354bf56bd8c170c6f7078d0e1d3","observation_id":"6999bf4c-548d-4c64-ba69-9231bf4f8432","resolution":{"observed_at":"2026-08-06T17:34:17.727420Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:18.027548Z","title":"Freytag et al","venue":null,"work_id":"7db295e1-1260-4201-8194-988e8c246e8f","year":null},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.594851Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:bc93f6b076507d9a2cfef018bd96b799572a6c271120abd0ed349de2657d6ca3","observation_id":"caa51235-7fb0-4fd8-b91b-dd01617a2f2e","resolution":{"observed_at":"2026-08-06T17:34:18.030117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:18.020042Z","title":"The approach is outlined in Figure 1","venue":null,"work_id":"e4768141-6b0a-464a-9b35-de56b4f340ab","year":null},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.597557Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:6c15f029fa3cdfe2275a5fa16117d73d2d85d193ad21bf9f445c85b9a507c40b","observation_id":"35ff44bd-5b98-4355-b125-f5b602408812","resolution":{"observed_at":"2026-08-06T17:34:18.022913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:18.011997Z","title":null,"venue":null,"work_id":"97882f11-496d-42ab-adb4-a14a0a32c2e3","year":2000},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.600320Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:212b3f33fe2cff7588ee8d83f7e3667a050a120d9b412943c902ccca9e9ff053","observation_id":"e2e83f36-f1d6-4952-b00f-d55ef82de197","resolution":{"observed_at":"2026-08-06T17:34:18.014533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:18.004208Z","title":"We mine two balanced corpora with the Data Engine in §3.2: PanAf-20K and Loma Mountains each contribute ∼314k high-quality face crops","venue":null,"work_id":"ac691756-5660-47aa-a2e3-bf56e8a9e80a","year":null},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.603303Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:849bb9dc10da49bc3bae0423dbc7ec38b9a43d975e45b95b92d0f2bc6aff3164","observation_id":"d48f662a-fa37-46e1-92e9-ab8566701b76","resolution":{"observed_at":"2026-08-06T17:34:18.007001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.997020Z","title":null,"venue":null,"work_id":"368c9be0-025c-4f73-a99b-5d906d751376","year":null},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.606581Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:14c3d28b75350af1755e5e2e567357d0abf221eba27bb1831b49e92a15ea4ea1","observation_id":"f75cf552-3fe9-443b-a8a5-db326777d44a","resolution":{"observed_at":"2026-08-06T17:34:17.999493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.989255Z","title":"Metadata accompanying each camera-trap sequence, e.g","venue":null,"work_id":"f74d6aec-7308-45fa-bafb-fb66ad5ed710","year":null},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.609238Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:0499fd5d90460d126260a6984ac1b6891db130d0fef0ea9059fcae5be6dbf56e","observation_id":"20354256-0f8b-4478-918c-b28957037b9c","resolution":{"observed_at":"2026-08-06T17:34:17.991912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.981569Z","title":"Camera traps unveil demog- raphy, social structure, and home range of six unhabituated western chimpanzee groups in the moyen bafing national park, guinea,","venue":null,"work_id":"740fbb5a-0ada-499a-be1a-132634d9fbd9","year":2024},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.611837Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:a4a12f4eff34061855c9ba805d2b2548b2506f21a2c9f358ac0f6717a67b46e8","observation_id":"73e08373-69a0-4b55-b5d5-8a78cc80529a","resolution":{"observed_at":"2026-08-06T17:34:17.984640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.973736Z","title":"Automatic identi- fication of individual primates with deep learning techniques,","venue":null,"work_id":"8a56ef65-232a-4545-a8b4-d5134ba435d2","year":2020},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.614384Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:329a95726b446047c89819b9de0c1c900b4a0e24d46fa99bef984174c5a44bbb","observation_id":"9267f769-dbf7-4b22-b4e2-304cf3e78e6a","resolution":{"observed_at":"2026-08-06T17:34:17.976408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.965877Z","title":"CosFace: Large margin cosine loss for deep face recognition,","venue":null,"work_id":"829597ea-47a0-49e6-93a0-2e983111e132","year":2018},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.617506Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:115fb2c9dc6539c7b8166d16223047e3383a1ac722d3b3799d67307bd7420f1c","observation_id":"1baaeefe-2db0-4eaf-ac4f-d13d5319f7a2","resolution":{"observed_at":"2026-08-06T17:34:17.968587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.957609Z","title":"ArcFace: Additive angular margin loss for deep face recognition,","venue":null,"work_id":"62abe873-bc05-44ac-a250-eaea05b82f08","year":2019},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.620194Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:810e0b2ceaeff86495056429bcfff34849702587fc7efb035ea664a46ae9eb37","observation_id":"e7678c0d-c68e-49e6-b6d9-e2faef3d8d9e","resolution":{"observed_at":"2026-08-06T17:34:17.960536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.949901Z","title":"MS-Celeb-1M: A dataset and benchmark for large-scale face recognition,","venue":null,"work_id":"ecba612b-856f-4b90-a3b8-d0bcf1449407","year":2016},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.623179Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:cf6cf88677f3ebcc832ebf921681cb45445ce65cfaf00412511c919f0f54c7e0","observation_id":"f6fe8510-8892-4b7c-a1a6-341a9a1b2db3","resolution":{"observed_at":"2026-08-06T17:34:17.952463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.941717Z","title":"Chimpanzee faces in the wild: Log-euclidean CNNs for predicting identities and attributes of primates,","venue":null,"work_id":"af6b8802-0ed8-48a1-8ec5-e3369f2ce41c","year":2016},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.625887Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:9949335762e11c6488189f7394f2965a1a31ce613100ea282d9a857469cc34e7","observation_id":"523a36b4-532f-43f3-acd8-1458581be00d","resolution":{"observed_at":"2026-08-06T17:34:17.944595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.933882Z","title":"Face recognition ven- dor test 2002 performance metrics,","venue":null,"work_id":"5839c48b-8d85-40e0-8e8d-f59be2c11847","year":2002},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.628922Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:db34da5819e98056ea8f878dbccbac7fef0d002ffababb9373cac2e5572caef6","observation_id":"545790a4-0033-41ce-8d1a-368bc81289c2","resolution":{"observed_at":"2026-08-06T17:34:17.936752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.925074Z","title":"Toward open set recognition,","venue":null,"work_id":"c3a97823-b90b-4b2e-ba0c-4693cabbbe66","year":2012},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.631671Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:fa0fe9cadbb15f19dfda449d133d48635cb96bc8bb4c7f6a692c9f72ae3f1060","observation_id":"3c10b80f-e1a9-4c65-93bf-a16e4408b715","resolution":{"observed_at":"2026-08-06T17:34:17.928015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.916694Z","title":"Emerging properties in self- supervised vision transformers,","venue":null,"work_id":"00c0a9b9-9a9b-4350-9434-6fff2637e3ec","year":2021},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.634315Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:1d32d60e84130a834649ec66ee88fc5119cb19f3820879c70dae4d571d12cf94","observation_id":"6aaee8f3-3492-407a-b661-4e2c4d1ce7a9","resolution":{"observed_at":"2026-08-06T17:34:17.919413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.909007Z","title":"DINOv2: Learning robust visual features without su- pervision,","venue":null,"work_id":"d02555b1-fe67-484c-9764-c0077551ffe8","year":2023},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.636954Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:c41c4f454b6592785bd8dfb9421d9c5c528d82ef7ec9d16fc9260b9fdfa2c1f6","observation_id":"ac0c4f85-f8a7-4d47-abd6-02d15d2c6854","resolution":{"observed_at":"2026-08-06T17:34:17.911577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.901293Z","title":"An automated chimpanzee identifica- tion system using face detection and recognition,","venue":null,"work_id":"0b17a36e-8b59-4d49-abda-44342933720e","year":2013},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.639401Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:de4e1cd5658cbcb128f3ef254844d8d0a536206f566c8db229d7e8fbf5d258a6","observation_id":"deb25434-72ae-46ba-bbb6-4c8278f11be0","resolution":{"observed_at":"2026-08-06T17:34:17.904028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.893519Z","title":"Face recognition: Primates in the wild,","venue":null,"work_id":"8f090ab7-2ecd-4ad1-861d-50156b41bef1","year":2018},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.642633Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:89b9fedf067abaa6060e80d0a3a8c0a8a070796afb24d86b57748a769e4d989f","observation_id":"ac816906-5682-4d9e-8760-7316ce9bb602","resolution":{"observed_at":"2026-08-06T17:34:17.896070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.885669Z","title":"Chimpanzee face recog- nition from videos in the wild using deep learning,","venue":null,"work_id":"3e290c42-ce9e-410f-97d5-81f59ae79fbb","year":2019},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.645358Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:7f0ba533b8a8eb6e1ff1f1df9a7877b64b61b344d1c52e9bd65e929edfa1d1b7","observation_id":"f917321f-876a-4662-b56f-dcf841f20777","resolution":{"observed_at":"2026-08-06T17:34:17.888263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.648069Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.648069Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:5c5ea9bc4ab9bc0e93d8e0fc4ba67024a2f62eba6db537c0f241baa2a44e7180","observation_id":"c63ab24e-3644-4585-a916-ea1d596da9e3","resolution":{"observed_at":"2026-08-06T17:34:17.648069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.870391Z","title":"Petface: A large-scale dataset and benchmark for animal identification,","venue":null,"work_id":"027ba56d-99e8-4328-8384-0e3011a3fac9","year":2024},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.650794Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:da818db7d91ab96cb7f3b33124e4321201dca910eb7e67b3193254fa1d646014","observation_id":"7941559b-ab53-464b-8752-d73322282437","resolution":{"observed_at":"2026-08-06T17:34:17.873592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.861371Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":"8bf8da89-71e6-4114-860f-e21fa769634d","year":2021},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.653593Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:dccf31661a9dd569659e31a31944250c9ddedfb9b1eaf31723e1733a329bf8e4","observation_id":"e3af4892-147f-4117-9164-c4e73ba4d2e6","resolution":{"observed_at":"2026-08-06T17:34:17.864420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.853319Z","title":"Wildlife- datasets: An open-source toolkit for animal re-identification,","venue":null,"work_id":"17b69f6e-356b-4994-a793-0d0ca7ce933a","year":2024},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.656124Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:6a841c1def6162e4d109f48850751c2045215d96b6d6628125045a52f08b4278","observation_id":"434a98f9-7b01-4265-8e5d-4f16a6fa6ba5","resolution":{"observed_at":"2026-08-06T17:34:17.855910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.845460Z","title":"Otarashvili, “Miewid,” 2023","venue":null,"work_id":"4bbefe5c-8ec0-440a-b751-1021e3db16cf","year":2023},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.658750Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:a1015ecc07c122e14219a89ff99f1088e2a401cf7438b8abbb4b1f6da6b51365","observation_id":"108b7469-8396-4dd2-85f4-4949174ce389","resolution":{"observed_at":"2026-08-06T17:34:17.847898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.837811Z","title":"Gorillavision – open-set re- identification of wild gorillas,","venue":null,"work_id":"78ef15a3-13b8-4263-9015-f66e87791214","year":2023},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.661305Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:f8b666b76344f6a0f4b41f45f0555ff902b054f72b3535143ccf3c75749e14b7","observation_id":"3393b0e9-7e2f-4704-bb3c-b49584a289c6","resolution":{"observed_at":"2026-08-06T17:34:17.840444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.830072Z","title":"The FAISS library,","venue":null,"work_id":"5457d84b-9e2b-46d0-8d86-5f7f973d3979","year":2024},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.663693Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:5ca71110bdde6a59d119f03350891a5b5962b710e991b49b28a51bc093a4b7fa","observation_id":"bf5cc95a-97ab-40ac-93f4-03f1bf7aca42","resolution":{"observed_at":"2026-08-06T17:34:17.832556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.666270Z","title":"A simple framework for contrastive learning of visual representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.666270Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:99bf5bd53b7ef3fc9ffe10b20579be220ae84341e3a897ea5638ba53dcc5f1ec","observation_id":"90d51948-9590-4c9b-a66c-b47f6a48afe8","resolution":{"observed_at":"2026-08-06T17:34:17.666270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.816456Z","title":"An empirical study of training self-supervised vision transformers,","venue":null,"work_id":"37149202-780f-4716-90fa-67aa5b10b5ba","year":2021},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.669081Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:36a19aa7e580b68d2d2e7eafc5fb61b44cee2d2c0ae858686e083ba273bf0a04","observation_id":"10505c78-89af-4cc4-bbad-c899625990bd","resolution":{"observed_at":"2026-08-06T17:34:17.819416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.808850Z","title":"Masked autoencoders are scalable vision learners,","venue":null,"work_id":"4e2437ab-5572-4a77-aa3c-c09fb88c8d9c","year":2022},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.671628Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:c3e4d96b45a8eaffbbc6a22f8f7ba2476946bf6d651f6b9481065de87c54cd15","observation_id":"c705e98d-3d4b-423d-9187-365f13b07a26","resolution":{"observed_at":"2026-08-06T17:34:17.811447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.801396Z","title":"iBOT: Image BERT pre-training with online tok- enizer,","venue":null,"work_id":"e5f04a21-cfae-495e-b782-106365fbc9b0","year":2022},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.674291Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:d27e902ddd2a26b653ea4baaa07a29179bbea2db56f5f1e2db7428a17a83d780","observation_id":"893b886f-6c91-4c63-8781-9e10f9a79e99","resolution":{"observed_at":"2026-08-06T17:34:17.803925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.793723Z","title":"AnyFace: A data-centric approach for input-agnostic face detection,","venue":null,"work_id":"4db04632-157e-453c-952d-7ffc0b3a8b1f","year":2023},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.677048Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:38fae9b140ccca3c09dfe84a506d79430e6ee88539b2a709d240483a2145ba51","observation_id":"b8c38a56-801d-4563-9534-53df2c326978","resolution":{"observed_at":"2026-08-06T17:34:17.796458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.786230Z","title":"YOLOX: Exceeding YOLO series in 2021,","venue":null,"work_id":"2c9da2a4-6eb7-4ad5-9042-ed7bf5cf4e4a","year":2021},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.679838Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:e03297b5d64ac1b4301c9664f032cd07855fe65566e417ed0554d2216448297a","observation_id":"b26b108b-0a9b-4365-a1aa-c542c2f7f2a6","resolution":{"observed_at":"2026-08-06T17:34:17.788690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.777793Z","title":"ByteTrack: Multi-object tracking by associating every detection box,","venue":null,"work_id":"2a3a4b89-3074-47cf-9554-cc8203fbee32","year":2022},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.682436Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:03585cd564d8f70c2d553d50964523bb7ab89bf4301d79b9e11a0adef3f3e2f9","observation_id":"06e99557-ca56-4dd2-bc03-6d94f0aa02b5","resolution":{"observed_at":"2026-08-06T17:34:17.780532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.767827Z","title":"PanAf20k: A large video dataset for wild ape detection and behaviour recognition,","venue":null,"work_id":"f061acde-ae26-4259-b47d-c9596796a715","year":2024},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.685461Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:b1906618804872e3575e0c3e533cddfbffbf45d0fb6bc5ceab126932a7cdc65e","observation_id":"000d1b42-4ef7-4d24-876a-c51d2ddc10df","resolution":{"observed_at":"2026-08-06T17:34:17.771162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.758681Z","title":"Reaffirming the loma mountains national park in sierra leone as a critical site for the conservation of west african chimpanzee (pan troglodytes verus),","venue":null,"work_id":"7daae69c-a18b-47eb-8a2a-88c6883c0215","year":2023},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.688309Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:45a0fdbf71f571a96c13902237dd9f1c5b0043793ca738e562e2197ed8164c1e","observation_id":"97bff2a9-a272-4c22-8825-991baa1a4525","resolution":{"observed_at":"2026-08-06T17:34:17.761770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.749608Z","title":"C3-DINO: Joint contrastive and non- contrastive self-supervised learning for speaker verification,","venue":null,"work_id":"7623baff-253c-42b8-813f-f8420c268103","year":2022},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.691322Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:c89d17099742b450f59961bdea71643a4fbcfa5dba24b70fc54feeac241bcded","observation_id":"82ede3b4-adaa-4ece-90b0-95bcea8fb27d","resolution":{"observed_at":"2026-08-06T17:34:17.752488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.741162Z","title":"Self-supervised pre-training with contrastive and masked autoencoder methods for dealing with small datasets in deep learning for medical imaging,","venue":null,"work_id":"6bcbabd6-85db-45db-ab76-934a43d70ab9","year":2023},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.693956Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:885c724455cfce74234e48b17c49e1431157d53eb5a0cc87df8b34bc3fb6db57","observation_id":"d482ec30-f228-4e85-81f2-274a25d1890f","resolution":{"observed_at":"2026-08-06T17:34:17.743975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:17.733025Z","title":"Vic-MAE: Self- supervised representation learning from images and video with contrastive masked autoencoders,","venue":null,"work_id":"35bfdbef-e8a4-4572-b9c5-f7f07564f29b","year":2024},"citing_paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:17.696520Z"},"links":{"citing_paper":"/paper/2507.10552"},"observation_digest":"sha256:d5c05ea22bcac0c23de90a6ab158641740b49399cc2f5d517abdebccfa881dae","observation_id":"a5ae8f70-5825-4219-9bd1-931050a1d026","resolution":{"observed_at":"2026-08-06T17:34:17.735902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.10552","last_updated":"2025-07-14T17:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T12:42:58.498959Z","submitted_at":"2025-07-14T17:59:59Z","title":"Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 3 inbound Pith citation observations for arXiv:2507.10552."}