{"as_of":"2026-08-07T23:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c66ac1843ef9bbc98985d2686cebf047916ce20192f9fbb22d99af1e2f2f89f8","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T21:27:25.757351Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:22:55.664897Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T05:51:08.265461Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"cited_work":{"arxiv_id":"2603.20508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.20508","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring reasoning trace legibility: Can those who understand teach?","venue":null,"work_id":"a98445e8-fa42-4277-8c6e-25ac587d2512","year":2026},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2603.20508","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:9c4288423fe8c11f00bd55fce6c07ae8e5a01f5472e991bf7a992b75516fea0a","observation_id":"b69ac798-fe59-4f60-8192-591d2afd54a0","resolution":{"observed_at":"2026-06-03T02:05:14.472947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.20508","snapshot_observed_at":"2026-08-04T15:22:55.664897Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02089","last_updated":"2026-08-03T11:48:39Z","snapshot_observed_at":"2026-08-06T23:36:52.716922Z","submitted_at":"2026-08-03T11:48:39Z","title":"How Much Does a Reasoning Summary Reveal? An Observability Ladder for Large Language Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T15:22:55.664897Z"},"links":{"cited_paper":"/paper/2603.20508","citing_paper":"/paper/2608.02089"},"observation_digest":"sha256:a78223886e0115d2b4546b0688a943243de6c8f6ba7f5c171647ddb7d0a221c7","observation_id":"4a502dba-f086-44ab-a5fb-40a1dea5224f","resolution":{"observed_at":"2026-08-04T15:22:55.664897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.20508/citation-record","integrity":"/paper/2603.20508/integrity","json":"/paper/2603.20508/citation-record.json","paper":"/paper/2603.20508"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:c1f4c25e3e604662d3a388102af881aca00350636effe4ebde47867db29fd2d3","observation_id":"6b382bfc-c27a-44b2-9049-e2b1973b49e2","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Gradient based sample selection for online continual learning.Advances in neural information processing sys- tems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:b6533ab530286df358a91f1cbfabca8ff5729b99cbe25c0b604625b26ea767e4","observation_id":"f7a3c8af-0d98-4df9-a460-8e844eb8520a","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Monitoring the mammalian fauna of ur- ban areas using remote cameras and citizen science.Journal of Urban Ecology, 4(1):juy002, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:6ef214f09eb54b711c5f532c0087dcb5fab2c7e58c48c361cc85b9704446a506","observation_id":"d928332c-6f55-4737-8a5c-0afae09b7a46","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"The MegaDetector: Large-scale deployment of computer vision for conservation and biodiversity monitor- ing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:5bbd9ea90b6b74715f4c77f6c0858808aded3d9696879ebc9073118307435d4c","observation_id":"f883d107-5597-44e4-9b59-01853e4ec7d7","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Recognition in terra incognita","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:8d28d37e337524ee46b1640e7bf151af987273b134f815dfef179b4a0e11319a","observation_id":"0e6ee8ae-cf4d-4de6-99e0-d60a5da99058","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Recognition in terra incognita","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:e843d7081a834efcaf8c6a86e2aa9e5ffcadfe7628d785718b963d30544b975f","observation_id":"8ebd5ff6-236f-4e2f-aa96-f635b458239d","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05986","last_updated":"2019-04-24T20:21:23Z","snapshot_observed_at":"2026-08-06T15:09:57.442978Z","submitted_at":"2019-04-11T23:48:19Z","title":"The iWildCam 2018 Challenge Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05986","snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"The iwildcam 2018 challenge dataset.arXiv preprint arXiv:1904.05986, 2019","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"cited_paper":"/paper/1904.05986","citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:9c5c572b172f7e0367b7dd7fadc98810dc71c02b9ed42697d7277bfa0f371660","observation_id":"c2c1e84c-af88-47b4-9bd4-07e809ffb951","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.03494","last_updated":"2021-05-07T20:27:22Z","snapshot_observed_at":"2026-08-05T21:12:51.646985Z","submitted_at":"2021-05-07T20:27:22Z","title":"The iWildCam 2021 Competition Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.03494","snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"The iwildcam 2021 competition dataset.arXiv preprint arXiv:2105.03494, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"cited_paper":"/paper/2105.03494","citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:b969cdb8a06e32a273651b0105d0cfa6d190aadc8df11424a9a99ffd1336382a","observation_id":"92e32500-717d-4423-93db-83cb643ae9c7","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Deep learning-based ecological analysis of camera trap images is impacted by training data quality and quantity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:56483e2139d5ba6266bb12eaf9e3d2e9beda17822e8595ca9994339684b00a7f","observation_id":"bbd7e06d-f42f-40aa-a23c-9d3f8f993a17","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Pelagic Publishing Ltd, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:35de4bb47466574658e7fe9ddd42a830ae76e83164a47362ecd45c631361847c","observation_id":"6f0dc4e2-bff9-4e7f-9c4e-2b935747a5b0","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Automated wildlife image classification: An active learning tool for ecological applica- tions.Ecological Informatics, 77:102231, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:4affb404aac8c764e209ed6973988de6dc934cf7831be2f99620a09dbb21be6f","observation_id":"f677d566-2910-4f7c-9208-0d90d50b0cbf","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Class-balanced loss based on effective number of samples, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:07c532815cab025a2ae5b839beb21ea223421e11bbb166e4c49d06aaeae8fee9","observation_id":"0ef351b1-0919-493b-a423-92293dc37fc2","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Class-balanced loss based on effective number of samples","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:f85e447dba4fa101fe80e821ebb474db2267d4a76006bca0369990a9fb59356e","observation_id":"39271814-7e61-4969-ace6-b8ccf425f6bc","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"A continual learning survey: Defying for- getting in classification tasks.IEEE transactions on pattern analysis and machine intelligence, 44(7):3366–3385, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:4b04bf3ba2eaa3607004a0d5366499405444dce09e0a10560e6c2a918af3b095","observation_id":"091daa16-a9e6-44d8-ad9c-b35a0a0d185c","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01064","last_updated":"2023-11-02T08:32:00Z","snapshot_observed_at":"2026-07-06T16:42:04.139453Z","submitted_at":"2023-11-02T08:32:00Z","title":"Multimodal Foundation Models for Zero-shot Animal Species Recognition in Camera Trap Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01064","snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Multimodal foundation models for zero-shot animal species recognition in camera trap images.arXiv preprint arXiv:2311.01064,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"cited_paper":"/paper/2311.01064","citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:5f21878d02bb1dc284609665f3c00531c587c43cd843f207421d7365adb0f7bb","observation_id":"54f5a203-bae5-43c0-bccc-11b213267009","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"A brief review of domain adaptation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:533b8a8fd095cefbf4c2c99eb53e427d4e3bd199251050d58495776fdc1a90f3","observation_id":"3b121c01-963a-4459-88f5-21037137c4da","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Wildclip: Scene and animal attribute retrieval from camera trap data with domain-adapted vision-language models.International Journal of Computer Vision, 132(9): 3770–3786, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:3c0df32c65ce62cb4b77473495544051b35379fea4ee3a08be38072e3fe5d14e","observation_id":"e84ad5bc-fb64-4865-b263-f961dbb02494","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Geodesic flow kernel for unsupervised domain adaptation","venue":null,"work_id":null,"year":2066},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:5c6a5dc77fba307ddb1b9ddfb4d8c0d49355b649f5a1f94cacaaae0c4ad8934c","observation_id":"9ed068d9-37db-4e28-8b12-35f469e876d9","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Bioclip 2: Emergent properties from scaling hierarchi- cal contrastive learning.arXiv preprint arXiv:2505.23883,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:8e4e7130ed4fc7b2621d099a631e84c13a72d027ef551ca2c656b87dc9590f56","observation_id":"8361d737-2f48-4fdc-b965-43c569cee17a","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02136","last_updated":"2018-10-03T07:32:57Z","snapshot_observed_at":"2026-08-02T06:41:33.803920Z","submitted_at":"2016-10-07T04:06:01Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02136","snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"A baseline for detect- ing misclassified and out-of-distribution examples in neural networks.arXiv preprint arXiv:1610.02136, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"cited_paper":"/paper/1610.02136","citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:b31674f16b98ea00803ab65856a19fd222635ea7d88ad06eb4bb714798cd5f80","observation_id":"19109b91-8462-4107-ac7c-b93705cebec4","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Parameter-efficient transfer learning for nlp, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:4da6b472b841b6a0c28fffb219cfd06763644ec716cb5a7e031e6200de3cb62d","observation_id":"5ae65cda-5fa4-4878-99f9-31c403d79f0c","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:9366127649f4223c4dd0b87542deb56768b6c0dcb2810ddfe2334d3f1f6e0eb2","observation_id":"1fb0ec56-b424-4648-8e58-cbd5400a86a7","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Idaho camera traps.https://lila.science/datasets/idaho- camera-traps/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:f6aacfa72444eb59979cfaa47ebaa14c314493e88b240d4f1950605347b51ba0","observation_id":"4a92c720-8da8-4529-9bf0-7d21ee1d266b","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Northern and central annamites camera traps 2.0","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:6291d06ee1d8114b3b48ca1c61d709e081d64e0d15191760a15200207a313471","observation_id":"9b6929e2-cf59-43a0-a9de-c8f38f520ecf","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Vi- sual prompt tuning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:ce5ab9cbe4abf987e0c1a335eb29a930fbfc2014f61a6584279042d9273ff861","observation_id":"69044240-6b5a-40cc-bc23-f30bf1638dba","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Wilds: A benchmark of in-the- wild distribution shifts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:0ab90b5bd8ea672f04a0ade8c4a5dc6bac4d86c74e585aa244e840e2b96d2b92","observation_id":"a5e8a3bf-b003-4ff4-aedf-b78e1b7e4c3e","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:a81cefa31b14fa7661d5b8d90560fc50c2fda402a3b3165f31d4b1d53e369762","observation_id":"124719a8-8276-4dca-bc31-303342ee00cd","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Supervised contrastive replay: Revisiting the nearest class mean classifier in online class-incremental continual learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:bbb202926a65f564478103e9ed9bf13be3786b5831edad28095d5d746db82014","observation_id":"d26c9eb6-25c5-45a1-9e66-6f42a92b7eb0","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Online continual learning in image classification: An empirical survey.Neurocomputing, 469:28–51, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:2e232a0e08c0748fb1addf7a6456d88718081ee5d125e28f304ec55a54900dfe","observation_id":"724bfdb0-8c5b-43c5-91a9-d85bbfa7e3c2","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Fine-tuning is fine, if cali- brated.Advances in Neural Information Processing Systems, 37:136084–136119, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:87dbc955ed95d96431484726e21ef0ed7f1f6ab0d2ace3e54fdcd65d47e28c7b","observation_id":"fb108663-5028-464e-91fc-fdd42e3bacb3","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Lessons and insights from a unifying study of parameter-efficient fine-tuning (peft) in visual recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:38c6330fe077c74c3c14a2e1756c8c660b4fed64e1442695590b8c48317d464e","observation_id":"b08828e8-fdd0-4c68-8122-91989891ca4a","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.14491","last_updated":"2021-12-29T10:47:45Z","snapshot_observed_at":"2026-07-06T12:23:12.226847Z","submitted_at":"2021-12-29T10:47:45Z","title":"Two-phase training mitigates class imbalance for camera trap image classification with CNNs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.14491","snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Two-phase training mitigates class imbalance for camera trap image classifica- tion with cnns.arXiv preprint arXiv:2112.14491, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"cited_paper":"/paper/2112.14491","citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:34e25e3cb2706868c7cec962f54a94b05a5c7099352048d6e76f8c89ad4363c1","observation_id":"4f106b69-e83b-4ab4-a6bb-4f1fd0dee1d8","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Trail camera images of new zealand animals.https://lila.science/datasets/nz- trailcams","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:5cb8aa7ab66e9c13984898b08e3b6f162949c80edfc8740eb2eb56a501a05188","observation_id":"2be7085d-d56c-4cc4-900a-4d2c5c6f01a9","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:14c6150c9352f575f8df48d2cc640b2dcc22fbd39fe0a634a9f045beb4b8b925","observation_id":"9500d4b4-adfd-434b-9c4b-b7cc3652747e","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Snap- shot safari: A large-scale collaborative to monitor africa’s remarkable biodiversity.South African Journal of Science, 117(1-2):1–4, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:5735e4433831133a43ab7e01cd7a5b62485da340f5147acd1a4ef0959b80b398","observation_id":"6a26b9a4-9a75-41e2-b703-49ff82e7f943","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Har- nessing artificial intelligence to fill global shortfalls in biodi- versity knowledge.Nature Reviews Biodiversity, pages 1–17,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:6faf6e742a1ce3a5700126f054c31339fc0daf2676af54604ee2cc7dc43d22b3","observation_id":"32e51f80-bb91-426d-bba5-f22a98e78666","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:5968e9ff7e26d24ed674ebbf7ffd241b628f3752c9f8386ec35d3efa691213b5","observation_id":"9d46db28-8e34-40bb-b2a9-3f586678f1ed","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Balanced meta-softmax for long-tailed visual recog- nition.Advances in neural information processing systems, 33:4175–4186, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:ae0bed19463284a0854f01fd81114949404b022c1d3484aee73749b521ba20d3","observation_id":"effc5770-228a-4645-859c-53c4b55dfc9c","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Balanced meta-softmax for long-tailed visual recognition, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:1e1ea6406c251e9624c213117b86c5a213335f85a9eec6d8ecc099ee6cfb9697","observation_id":"de5faf30-5719-465c-a468-fba0f843d7e8","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"A broad review on class imbalance learning techniques.Applied Soft Computing, 143:110415, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:78879ac7a9931336b1a2572a70648a0487e28a03d251b813d89cda324dae2f5a","observation_id":"c89b0ec0-3c27-4420-b992-0e89525ad570","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05090","last_updated":"2022-04-24T01:10:42Z","snapshot_observed_at":"2026-07-06T12:17:07.084920Z","submitted_at":"2021-12-09T18:32:38Z","title":"Extending the WILDS Benchmark for Unsupervised Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05090","snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Extend- ing the wilds benchmark for unsupervised adaptation.arXiv preprint arXiv:2112.05090, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"cited_paper":"/paper/2112.05090","citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:0d452c20df1cb2c35eb91b4392072eff7d8f3e56c069ef3833acd06be68b3a05","observation_id":"307450fb-991d-4c8a-9754-c1f33cec41c7","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Catalog: A camera trap language-guided contrastive learning model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:dcad118d3d0c37f6536e4dae176ab790eb1db17808690025e14c315c9d7bccec","observation_id":"fd7ece1f-8963-442a-a720-51dd83b7efd2","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Online class- incremental continual learning with adversarial shapley value","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:af2fbfe9cc856f7aa5e008c9fab1ba49a7ac15b833ee86f446c93c4b9d364e72","observation_id":"424b2a28-4813-491f-8161-6fa082f80950","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Domain adaptation: challenges, methods, datasets, and applications.IEEE access, 11:6973–7020,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:b5c83b54f5aced79c793db29e01496f13e615556f0d54e9356c019ce9ef2fef9","observation_id":"63a47c11-c66a-4560-881f-ffc885162f46","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Bioclip: A vision foundation model for the tree of life","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:56b4f42b3a4db16c0008b63dc0727e2eeaadfb1596636707829c8702e4732653","observation_id":"6b56dbb9-3f05-427a-aa51-3387e9161199","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Snapshot serengeti, high-frequency annotated camera trap images of 40 mammalian species in an african savanna.Scientific data, 2(1):1–14, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:4a5b911523b8f09451c2b81ce6e0c42fd4863852110679a9cd3269ba90263555","observation_id":"80d5c421-dfae-424d-89a8-0fbfd4812da1","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Machine learning to classify ani- mal species in camera trap images: Applications in ecology","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:b3112597042280b23ff9ba642da67f1834d5d11026c9e980666c1ed4151e4a4e","observation_id":"327a2fb6-2f69-40f7-baaf-77c3d7e3095a","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Use of camera traps for wildlife studies: a review.Biotechnologie, Agronomie, Soci ´et´e et En- vironnement, 18(3), 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:214fbc4de1815f11a89fa66705987073f570e39d435ddf10e15cd08b4cfdea59","observation_id":"033d77ed-4c81-4c2b-adf6-9c7fa3dbef63","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Holistic trans- fer: towards non-disruptive fine-tuning with partial target data.Advances in Neural Information Processing Systems, 36:29149–29173, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:d61f397702cddf0b92ad6bb5c16b99fa30181d7729ff1ded1ea097d55ccf5218","observation_id":"f0d6b01f-8c25-448c-89c4-6395017378a5","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Perspectives in machine learning for wildlife conservation.Nature communications, 13(1):792,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:d63cfe6c2a81094bf6d8ebcbec368c08bb6b3b74fbc465946dc401f9d3df6075","observation_id":"00a06f6f-6c55-4c10-88bf-4a032da31134","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"The inaturalist species classification and de- tection dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:13f2f55b4fd5d25ffcdc355eeedbb44fa075b81dc2455c3a0ad5fd34a2aaf064","observation_id":"a0f1bad4-f852-4e5f-bcc8-f8eda0f88268","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Reliable and efficient integration of ai into camera traps for smart wildlife monitoring based on continual learning.Eco- logical Informatics, 83:102815, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:cf839d107fc89756c997c6944666d021510fa896a47d95da95e1d2a63994bba8","observation_id":"c0ea4cd5-e9a9-43f0-b852-578f7a56ebee","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"An evaluation of platforms for processing camera-trap data using artificial intelligence","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:55a0fa987439ffee9b80dd66983fee18401f899bf9b41d5dc737224fff2c3a4a","observation_id":"7b545981-edbb-4e7c-a404-58cae6248175","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Robust fine-tuning of zero-shot models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:78fc077a2635195a6226857d2fda437c9f63747a0f87dabd1de421ba19ff263a","observation_id":"9c22bffe-c8c7-44c2-b187-e772342368bc","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Generalized out-of-distribution detection: A survey.Inter- national Journal of Computer Vision, 132(12):5635–5662,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:98e5d33b47b56089cd2f51136b6b0273290098fb7b77b75bf87dfc9f7c7e8bf5","observation_id":"ce2f2c02-772f-4ddb-a214-3f135baff7b7","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.01385","last_updated":"2022-07-11T01:09:36Z","snapshot_observed_at":"2026-07-06T08:48:39.509290Z","submitted_at":"2020-01-06T03:52:11Z","title":"Identifying and Compensating for Feature Deviation in Imbalanced Deep Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.01385","snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Identifying and compensating for feature deviation in imbalanced deep learning.arXiv preprint arXiv:2001.01385,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"cited_paper":"/paper/2001.01385","citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:d9a28d082beef4803efd86bb85478bbe1dc99f7f987f344993ead0a732636501","observation_id":"d853b6a5-a23c-4f50-8211-f4287a8d41c6","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Pro- crustean training for imbalanced deep learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:153c1ef16788e3f3c18d966a0f8981651aa5c6682678c0de3a4146095bb0c85e","observation_id":"bb3dfd3b-78bb-4ac2-9d0f-374ae0b309f7","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Identifying and compensating for feature deviation in imbalanced deep learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:604aa3b42d26564f51d9c96317b3e5ecb137e1cc9b2f6c0fd78575018e964eb2","observation_id":"b12ba672-3413-47d9-b723-ffe039f8fe33","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Automated identification of animal species in camera trap images","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:5defedd2c0a9b0342cc6f60d3852423d6282edfb441585ede1f8099bbeb0fb9c","observation_id":"455b9b79-5444-4dd8-84cb-efa8d91f99ac","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Deep long-tailed learning: A survey.IEEE transactions on pattern analysis and machine intelligence, 45(9):10795–10816, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:6cd164695aebd28b9515b68a2611666f88c939e8c14262165272af2a7ad518e6","observation_id":"d073de87-4fb1-424d-94b1-0ebc43c9dd62","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Domain generalization: A survey.IEEE transactions on pattern analysis and machine intelligence, 45(4):4396–4415, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:e1fb0fe73cf23a32fd155ace1dc33d02ddf7609b17e206e4b8a0f8c36d8153b2","observation_id":"775e97b2-bb63-4cd5-bb5b-9999f1e4fdb3","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:27:25.757351Z","title":"Class incremental learning for wildlife biodiversity monitoring in camera trap images.Ecological Informatics, 71:101760, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-13T21:27:25.757351Z"},"links":{"citing_paper":"/paper/2603.20508"},"observation_digest":"sha256:97dc86c1493803c893efeeafeb1523a87808767db9620adb5821f40eafa3ab70","observation_id":"3d4e4d39-cf29-4244-be7a-76d128aebda4","resolution":{"observed_at":"2026-07-13T21:27:25.757351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","latest_version":2,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 2 inbound Pith citation observations for arXiv:2603.20508."}