{"as_of":"2026-08-24T02:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a8c67f45762c5f9af51cad67b598d897807380919649fd155cb07b36db96cae","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T05:44:51.237010Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T02:54:07.457440Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.14031","snapshot_observed_at":"2026-08-02T02:54:07.457440Z","title":"arXiv preprint arXiv:2605.14031 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14072","last_updated":"2026-07-15T17:42:41Z","snapshot_observed_at":"2026-08-13T08:30:57.492041Z","submitted_at":"2026-07-15T17:42:41Z","title":"MetaPerch: Learning from metadata for bioacoustics foundation models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T02:54:07.457440Z"},"links":{"cited_paper":"/paper/2605.14031","citing_paper":"/paper/2607.14072"},"observation_digest":"sha256:220ca56ac84177f2bdd1c01dbb88c103a1f65dc6bc3287847e0e4e7ae7e324a1","observation_id":"d474a162-ffd1-4536-9a92-195bddd599ba","resolution":{"observed_at":"2026-08-02T02:54:07.457440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.14031/citation-record","integrity":"/paper/2605.14031/integrity","json":"/paper/2605.14031/citation-record.json","paper":"/paper/2605.14031"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mae-ast: Masked autoencoding audio spectrogram transformer","venue":null,"work_id":"0d9a5b49-c744-4674-b38c-2e06181f73dd","year":2022},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:7b28e6aacd81faf2caec5c6f30ad3543ec8b1850b0893a8e56f3c99dba64ee2e","observation_id":"3e4bf6dd-b949-47b9-b9c5-7423cbd051e3","resolution":{"observed_at":"2026-05-15T05:45:07.020993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Entropy-based analysis of influential factors for underwater acoustic target recognition in passive sonar data.Ocean Engineering, 342: 122908","venue":null,"work_id":"20e035c4-b9b4-4aa4-8370-2fde94c6de85","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:39a2843de394b4fcb7a61113b3ed1fd25095bd0629abfb35bd7665ad96f2f040","observation_id":"e8a3984f-2065-41c8-810d-eb7480a3cfaa","resolution":{"observed_at":"2026-05-15T05:45:06.988353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations.Advances in neural infor- mation processing systems, 33:12449–12460","venue":null,"work_id":"163aa9cd-370e-46d2-8cfb-63f1a4398ac9","year":2020},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:80e4a3bf7802ab585f952d917b508267886da2e1b3061c98b2e1600e495e20fb","observation_id":"d85d0caf-f0ec-41a6-bf66-ecbc7795ddef","resolution":{"observed_at":"2026-05-15T05:45:06.992515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Global biodiversity: indicators of recent declines","venue":null,"work_id":"a16884ff-e7e5-4560-b4d3-d4b9371a1c59","year":2010},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:6611a5be4826713e79d998146ea4631bf22b8ac26f477153c2e0a672e9ea05b5","observation_id":"95756620-50f5-47aa-86a6-a8e76f2025b0","resolution":{"observed_at":"2026-05-15T05:45:06.997262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The inaturalist sounds dataset.Advances in Neural Information Processing Systems, 37:132524–132544","venue":null,"work_id":"326b5f90-3748-45bd-bd24-ac7d5aecf34e","year":null},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:a88f9c938ce159aa6b59c0469e81d2abcbac87b23a2de3a64193fb69e881b96f","observation_id":"1df16cdc-9d33-40a3-93c2-49f575ac4514","resolution":{"observed_at":"2026-05-15T05:45:07.005892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18726","last_updated":"2026-06-17T20:57:14Z","snapshot_observed_at":"2026-08-16T13:27:12.724811Z","submitted_at":"2025-05-24T14:49:49Z","title":"Bioacoustic Geolocation: Species Sounds as Geographic Signals","version":3},"cited_work":{"arxiv_id":"2505.18726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18726","snapshot_observed_at":"2026-07-02T20:47:22.979986Z","title":"Audio geolocation: A natural sounds benchmark","venue":"cs.SD","work_id":"b972ab00-0c14-40a1-9537-f51ad303e5cc","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"cited_paper":"/paper/2505.18726","citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:d8cacf98fcacc1522b855e708c6d57a9b09f36603c7a5a12bd49f354551e50e4","observation_id":"6c4f5d5a-9e49-499f-a59e-3c133989b904","resolution":{"observed_at":"2026-06-19T17:11:29.525978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beats: audio pre-training with acoustic tokeniz- ers","venue":null,"work_id":"a396d562-b732-4bfc-b888-6e31dd9dbb04","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:66b8ef6e72d48d12f29fe50f138a0d8259e2762d9b906cfcf99efba2c9327221","observation_id":"a31cdd29-0406-4fbb-a0ac-1a701e09fec5","resolution":{"observed_at":"2026-05-15T05:45:07.024814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eat: self-supervised pre-training with efficient audio transformer","venue":null,"work_id":"19cc3152-d3f5-4227-99d8-2d7d84b8f794","year":2024},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:f161af6fc97bbf02cf61b486aaa1cd941baa62dea50809ad69a48d52686545ec","observation_id":"0c531b44-62ea-4670-81a2-7de1d239539d","resolution":{"observed_at":"2026-05-15T05:45:07.054756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Satmae: Pre-training transformers for tempo- ral and multi-spectral satellite imagery.Advances in Neural Information Processing Systems, 35:197–211","venue":null,"work_id":"79ebaa09-3936-4938-a2aa-19602ca5772d","year":2022},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:0addbfb9837b7770ddf611e619f519761501a8aa4bf671b2fba4eebfb392358c","observation_id":"9a2c5ce7-720b-4fcc-bf13-6c6b6f404b6c","resolution":{"observed_at":"2026-05-15T05:50:05.031798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pervasive human-driven decline of life on earth points to the need for transformative change.Science, 366(6471):eaax3100","venue":null,"work_id":"a0693a8e-c8d0-4314-973f-71c7b504e3e2","year":2019},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:fde7292de03d75fefa21092d4415ba2372b07f23610311414c7b8130b629c390","observation_id":"342d311d-110a-4f49-b7e4-212d91d7e821","resolution":{"observed_at":"2026-05-15T05:45:07.063136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clap learning audio concepts from natu- ral language supervision","venue":null,"work_id":"410cf75d-d400-43f8-94b5-2a3e83cf5eee","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:c5a9908d6e32d5cb92902862921c3c36f072b296fc01687ff534375f4c4388e7","observation_id":"0c9b460a-9ff3-4a3b-a3fd-9c98f66cd89b","resolution":{"observed_at":"2026-05-15T05:45:07.059023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15074","last_updated":"2025-03-19T10:13:29Z","snapshot_observed_at":"2026-08-17T12:13:51.469930Z","submitted_at":"2025-03-19T10:13:29Z","title":"InsectSet459: an open dataset of insect sounds for bioacoustic machine learning","version":1},"cited_work":{"arxiv_id":"2503.15074","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.15074","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2503.15074 , year=","venue":null,"work_id":"6e8b2ae7-6199-42bc-9ea1-c1e0a2ea3bfb","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"cited_paper":"/paper/2503.15074","citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:e8eac208b5e2801927bab263cc1a90d88f3fa4c97b0573866caf2fd337791440","observation_id":"3464601d-d706-4e1e-9cf3-58d0aa1babb3","resolution":{"observed_at":"2026-05-15T05:45:05.740024Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masked autoencoders as spatiotemporal learners.Advances in neural information processing systems, 35:35946–35958","venue":null,"work_id":"a78b90c3-c03e-498d-99fe-b5b2bfe35950","year":null},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:24f9daf464f9c7077964532aee82296fd639a9d39204700f54c76a576dfd9ab8","observation_id":"9275abcf-ea27-4da4-8a48-41639cde4f4e","resolution":{"observed_at":"2026-05-15T05:45:07.067403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fsd50k: an open dataset of human-labeled sound events.IEEE/ACM Transactions on Audio, Speech, and Language Processing, 30:829–852","venue":null,"work_id":"0d5b871e-1d43-4967-b1d4-fb77bdaeae1d","year":2021},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:c17c18296adef049817677c0f37f29c2075b805ff1604b30ccb4f1b0fa08c700","observation_id":"8621fab5-bda7-48e9-92a7-1cf373832b20","resolution":{"observed_at":"2026-05-15T05:50:05.009863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Look closer to see better: Recurrent attention convolutional neural network for fine-grained image recognition","venue":null,"work_id":"97e1a45d-a4d7-4e7b-843e-403b248829c9","year":2017},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:3e9fb73d17f601a5a4afc5c472137cd434ac5aa2e86d7eb9f1b939720f76c242","observation_id":"8cb3ac77-c668-418f-b06c-b98e0c62b6d5","resolution":{"observed_at":"2026-05-15T05:45:07.037428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemmeke, Daniel P","venue":null,"work_id":"6121802b-aad4-40e9-9a61-54461f3ab0a9","year":2017},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:948288e568809ccbf2e3cea983cc8eb70b125ed8be5774b9185b89ca92e83c12","observation_id":"19bfa3ab-926e-455f-aa5b-233e62725a1d","resolution":{"observed_at":"2026-05-15T05:45:07.070802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PhD thesis, TILBURG UNIVERSITY","venue":null,"work_id":"0b52a3fd-18ca-4730-a8f8-870b9ff073d0","year":2024},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:c14ac98ab80f3e049c81f3db50f29a4ffe9d15405a6470229dd272b817d019d1","observation_id":"377dba3a-f385-4022-948c-6d8e3eec46d1","resolution":{"observed_at":"2026-05-15T05:45:07.041524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerging opportunities and challenges for passive acoustics in ecological assessment and monitoring.Methods in Ecology and Evolution, 10(2):169–185","venue":null,"work_id":"fe4b0917-d894-45fd-b263-b74c6ec9b9c5","year":2019},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:da0298e9478216fc746a8d82c09cfaaff81d1503b18c66d877fc97aab10efa7c","observation_id":"206ca5f9-03ef-441a-bd46-5272ea9939f0","resolution":{"observed_at":"2026-05-15T05:45:07.045959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audioclip: Extending clip to image, text and audio","venue":null,"work_id":"d58bac5b-cee9-4020-a88f-654d44614f79","year":2022},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:5700a8daf198b21356f4a05cd9032200238fb98dd43c84e80f8b5f99e5f831f0","observation_id":"ee2f579c-d1a7-402d-8480-53dca80a15e4","resolution":{"observed_at":"2026-05-15T05:45:07.033114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aves: Animal vocalization encoder based on self-supervision","venue":null,"work_id":"11578691-0d26-4e61-8c3f-4a32aeda9f8c","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:bdbce66895a730c3cc9c3b41de05113d72fd771cee964207ac7d8af855e3da55","observation_id":"43719fcf-d19d-435f-97c8-653cb66dc94f","resolution":{"observed_at":"2026-05-15T05:45:07.017458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"4c78612a-9e29-4bff-a78c-17d66c9b1919","year":2022},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:6baa57a0274f84ab4f44fcbd9f6e4f51e1165b0a9e11e73881303d9a3e7602d1","observation_id":"78056374-c5e1-4fcf-b382-f55b12a14448","resolution":{"observed_at":"2026-05-15T05:45:07.001768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Searching for mo- bilenetv3","venue":null,"work_id":"ca11137c-fc0a-4750-a8f7-0e2eeee3bb2e","year":2019},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:b09865509a8abbcaff205e0706847b3fb9fea48f502b991346e62e1f928069fa","observation_id":"28511eb0-e2d3-4a03-88a8-aa3ff92482f7","resolution":{"observed_at":"2026-05-15T05:45:07.009344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units.IEEE/ACM transactions on audio, speech, and language processing, 29: 3451–3460","venue":null,"work_id":"ab935954-52db-47cc-9600-d84488aa8f70","year":2021},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:2dc72e80bd819ace5401245346a404962521de14185c0617158d5047b375a18a","observation_id":"ac45a75e-7411-4737-92af-21b9c608e157","resolution":{"observed_at":"2026-05-15T05:45:07.013588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masked autoencoders that listen.Advances in Neural Information Processing Systems, 35:28708–28720","venue":null,"work_id":"95f44b40-fd44-44a1-a2e4-ba207aed4aec","year":2022},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:2b6759fda145617db0b4dc7620048049adf7f504dff16868a881838fc1bf14f1","observation_id":"77fd861c-0554-4c66-adc6-bd4fc44aa828","resolution":{"observed_at":"2026-05-15T05:45:07.028835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"inaturalist","venue":null,"work_id":"3304f80c-c3ee-401d-8e09-4ee475d78401","year":2026},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:d211a2c92dd8162439f59f4a8a4e8247e0ecb70810ff82e80c87e7c9f7806737","observation_id":"503fd135-5e96-47c3-a458-25c18b2a2e86","resolution":{"observed_at":"2026-05-15T05:45:07.049988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Birdnet: A deep learning solution for avian diversity monitoring.Ecological Informatics, 61:101236","venue":null,"work_id":"5ebf1926-32e9-48d3-acb0-782b13be88e3","year":2021},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:84f7f62a2bc8b1372e389eae549dc979ff946cd9ac5d695859ac7cf915d3fb8d","observation_id":"d7684c2c-aa9e-43e2-84a9-83aa39857dc0","resolution":{"observed_at":"2026-05-15T05:50:05.004649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"9cca911d-1742-4f40-83c1-1e4aa726518a","year":2013},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:7279f52f3fd1ca17ed6cbbd35e2713de894bbe12aa918c04d593576379a21252","observation_id":"64fa2e22-9d5b-46f5-8095-21d25d48a851","resolution":{"observed_at":"2026-05-15T05:50:05.045835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mavis: A multimodal conversational assistant for avian species","venue":null,"work_id":"81cb8dd8-bc31-4fb5-847d-d19da1e61a84","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:aabdc7b59782672405c8987f5fdd90a0bf260a9289f0c983a4fe46e17d1981f7","observation_id":"9ac1d72d-b232-403c-bf69-ceb7ed05634e","resolution":{"observed_at":"2026-05-15T05:50:04.885948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bilinear cnn models for fine-grained visual recognition","venue":null,"work_id":"3a44dd83-37cc-43d8-a80f-cdebf8330982","year":2015},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:21abaab2be282ed2f9cee7139c6dcc2aa28b8bbbe7ee456b586146582a607617","observation_id":"b214c748-d6dd-4410-8f9a-225b4a9ea09c","resolution":{"observed_at":"2026-05-15T05:50:05.075959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0e1eb836-757f-4209-8526-0879425def61","year":2024},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:5ebac796286f7abde2ed14bf9a6fde47aec7c75c91d04ea26c6c84d3f949658b","observation_id":"315fb754-4952-4227-ad09-c1bb960b8af4","resolution":{"observed_at":"2026-05-15T05:50:04.890706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":"1306.5151","doi":null,"metadata_source":"pith","pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-07-11T03:07:53.092922Z","title":"Fine-Grained Visual Classification of Aircraft","venue":"cs.CV","work_id":"ed360110-3ce4-4959-8c74-1785cd9e537d","year":2013},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:9d9f319c369589df29a66116d12048ad5d0fc6e80b30e81bd28cdebaef7a9505","observation_id":"27832b84-fdeb-42ce-a818-7bc0928d747c","resolution":{"observed_at":"2026-05-15T05:45:05.721069Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11845","last_updated":"2026-05-14T16:33:16Z","snapshot_observed_at":"2026-08-23T21:44:44.020311Z","submitted_at":"2025-08-15T23:52:34Z","title":"AVEX: What Matters for Animal Vocalization Encoding","version":3},"cited_work":{"arxiv_id":"2508.11845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.11845","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AVEX: What Matters for Animal Vocalization Encoding","venue":"cs.SD","work_id":"b0888265-293d-46c0-800d-e506ee6be6a0","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"cited_paper":"/paper/2508.11845","citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:302af1db4855231ac9d5d960e2749661a5e0618d252b7bf6b6db7a153e77bc77","observation_id":"d66838a1-4c8f-43d8-87fd-acf5903dc162","resolution":{"observed_at":"2026-05-15T05:45:05.746528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mixture of mixups for multi-label classification of rare anuran sounds","venue":null,"work_id":"35be1e3f-1ff6-4b1e-80a2-e1339e0f33bb","year":2024},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:c7c69fd80628b5b07b0b0c7478149674b080edf1b4a4854472a8ebbda4556fd2","observation_id":"dc0cb651-d321-432a-ba14-695dfc213d96","resolution":{"observed_at":"2026-05-15T05:50:05.050087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lv-mae: Learning long video representations through masked-embedding autoencoders","venue":null,"work_id":"97046047-d08e-4acb-8474-18fad848dbe2","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:bfa2f5382595f82b62d7a26151b353ad2dd19f791216e81e8a0994173d628bf6","observation_id":"87ffadf2-1cab-4130-b289-5e3e4fd08436","resolution":{"observed_at":"2026-05-15T05:50:04.898925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The mel scale.Journal of Music Theory, 9(2): 295–308","venue":null,"work_id":"17fd84a0-12ac-4cb1-944f-3af12403e23e","year":1965},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:9fc8f3012d7ffc57f50cc3f2a8975bec481ba67be6573c2da448b075d4c5cbea","observation_id":"7aa81363-16e1-4478-b4a7-f6f8dc096f53","resolution":{"observed_at":"2026-05-15T05:50:05.062662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:06:20.313807Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"ee6b8956-3ac5-4cbe-9ab5-9c2078e5a407","year":2021},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:79fb7f7d97d940183a6ea7d36ef7347c132c226e213119914dba20f3192d1838","observation_id":"865c3991-b697-48c2-b197-b35c70614fd7","resolution":{"observed_at":"2026-05-15T05:50:05.067026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can masked autoen- coders also listen to birds?Transactions on Machine Learning Research Journal","venue":null,"work_id":"62baa8dc-aa8b-4c6f-ba1e-766e76da7f6c","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:bf45fe7f017028251cc53cf1eb3440f8a50231fd1bb78c0d7e69b43670f15ed5","observation_id":"f12fe125-6641-4b4e-8bd7-873cee119aab","resolution":{"observed_at":"2026-05-15T05:50:05.019592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Birdset: A large-scale dataset for audio classification in avian bioacoustics","venue":null,"work_id":"612095bb-15a5-47d6-a571-9b6c1e92c8bf","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:9ef685573ba33081edca108b9162eca18b84550739e17bc60fd3bda58aa13754","observation_id":"c91513ac-75f7-4ded-a35e-04cc829d51a3","resolution":{"observed_at":"2026-05-15T05:50:05.071618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scale-mae: A scale-aware masked autoencoder for multiscale geospatial representation learning","venue":null,"work_id":"95d97949-0f14-461a-b91c-362d917a4db1","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:5ec8e230d995363d56e68037d670b22d914bec703d0d7b163ed7c00e80b9ca91","observation_id":"c89e3f48-c71f-4caa-857b-f69699060abf","resolution":{"observed_at":"2026-05-15T05:50:05.080204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transferable models for bioacoustics with human language supervision","venue":null,"work_id":"2465a253-2fc4-40f1-84d4-757761d9def9","year":2024},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:22a59a8874e1d4495147454c60fb5a8b3245acc7040349aeeb5d29dfba853439","observation_id":"56cd1b6d-b6a4-47dd-a81b-dd9c3d5df1f1","resolution":{"observed_at":"2026-05-15T05:50:05.041239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NatureLM-audio: an audio-language foun- dation model for bioacoustics","venue":null,"work_id":"1cb04eeb-27f9-4581-a02a-81f68d6fb63f","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:07bb20c61fd616dbf9ce5b26213eb5d96ea489c1626b0971bac834092dad0b72","observation_id":"b22d9b02-fb5e-489c-a4bf-8f3bee67f4ba","resolution":{"observed_at":"2026-05-15T05:50:05.014865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Passive acoustic monitoring provides a fresh perspective on fundamental ecological questions.Functional Ecology, 37 (4):959–975","venue":null,"work_id":"b1ba1c17-52c4-4f44-be87-257448cfc182","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:b6d8a37380da482e8406f05ba65d7dd0bad3f24c2cc2372cea44a4ae6847f500","observation_id":"3b03a324-87d4-4eb1-ad1c-d1021be31eff","resolution":{"observed_at":"2026-05-15T05:50:04.985247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards a global terrestrial species monitoring program.Journal for Nature Conservation, 25:51–57","venue":null,"work_id":"310a88c5-31f6-4743-a873-966832e9a830","year":2015},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:c1b2971fd8e121aa0a2be79367ce5c08c13c280d59f2e68af11963db44e290c4","observation_id":"882c84a7-e55b-44db-88c0-5b9fabd790ee","resolution":{"observed_at":"2026-05-15T05:50:05.058586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wav2vec: Unsupervised pre-training for speech recognition","venue":null,"work_id":"6d8afce2-c867-4710-b0fb-2768b4f0d5d9","year":2019},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:f73d1ab591a48f83bcf6ff1b6cbb8d7de9c494618416aeb8aa82e896799eedcf","observation_id":"13d535cf-a7ff-43f5-83b5-7662ae92c29d","resolution":{"observed_at":"2026-05-15T05:50:04.999530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Foun- dation models for bioacoustics–a comparative review.Eco- logical Informatics, page 103765","venue":null,"work_id":"8381e0dd-12a4-41bd-9d57-fb2ea91ff036","year":2026},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:4edae9eaff79853ec7bf196d84fe6d00ee0dab202af45ba1897861f4854a4695","observation_id":"77e1ed9b-9358-4a15-a604-288f163200ea","resolution":{"observed_at":"2026-05-15T05:50:04.994728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.18099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T22:49:01.392868Z","title":"Ruijie Tao, Zexu Pan, Rohan Kumar Das, Xinyuan Qian, Mike Zheng Shou, and Haizhou Li","venue":null,"work_id":"5bd56fef-407a-4446-be8f-25022aa39c63","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:0871c346303e35d060bbff4db278da664de9cc8dba0cbfdba5a17990e8c6cb19","observation_id":"b4619a5a-19f0-4720-8ec5-5bbd2e8d6cfe","resolution":{"observed_at":"2026-05-15T05:45:05.734040Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Terrestrial passive acoustic monitoring: review and perspectives.BioScience, 69 (1):15–25","venue":null,"work_id":"63c9b3d3-b9fa-4ca5-986b-446d328f1911","year":2019},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:80b5b9bbf20556d15a87c3dfbbbb7e7f2fa069ef49e8ded04bc32ebcb0b3ee0f","observation_id":"edfd85f8-65de-4164-84a7-50a5e3c9ea8f","resolution":{"observed_at":"2026-05-15T05:50:04.903204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Merlin l48 spectrogram dataset","venue":null,"work_id":"0a836251-6f54-40ee-887b-c22918985bd6","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:b77a54be29a6f7c93d45bdcb837c8d7e39524f96dfb3cabced3509ed2ae9ed2c","observation_id":"b861d612-0319-468b-b736-7c69688db783","resolution":{"observed_at":"2026-05-15T05:45:07.095234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-scale mae: A tale of multiscale exploita- tion in remote sensing.Advances in Neural Information Processing Systems, 36:20054–20066","venue":null,"work_id":"847a3a66-14da-4839-80a4-83ddf06701ed","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:48b20af3e59e92c34748f9d3d34a5fa9ca478d2649bf770278c59a67f483924f","observation_id":"20bc89f3-5d33-4603-be57-89f6d7753fb1","resolution":{"observed_at":"2026-05-15T05:45:07.091196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video- mae: Masked autoencoders are data-efficient learners for self-supervised video pre-training.Advances in neural infor- mation processing systems, 35:10078–10093","venue":null,"work_id":"8e23f465-ddb9-404e-86c4-b329f2a6fbb9","year":2022},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:8a9dd0ee39dd4735c15a95b6a05c13ff9bcd1b12f26d7ca192fcb0ed53bee1fb","observation_id":"6343cb79-536f-4bf5-b17e-01eb4cf32f3b","resolution":{"observed_at":"2026-05-15T05:50:05.036774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The inaturalist species classification and detection dataset","venue":null,"work_id":"7c8f1faa-bf10-47e1-8fe0-102206fd8c2d","year":null},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:a99e75ed091867eb6ef8c5d51b74e331ee5401764c0b3d3ccf2344a95b76058f","observation_id":"73a21fe9-9811-4835-bbb9-c5ac7ce67799","resolution":{"observed_at":"2026-05-15T05:50:05.027202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring fine- grained audiovisual categorization with the SSW60 dataset","venue":null,"work_id":"042281b1-f510-40fe-8c13-05aa3bf60b4c","year":2022},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:31477828903ab40fe115ad8ed894f3fa0a7f3892940d3f2937d669183c2bf7a2","observation_id":"918b722c-4f21-4fec-bb34-c7fbf172227b","resolution":{"observed_at":"2026-05-15T05:45:07.082756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.04665","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T17:45:12.536878Z","title":"Perch 2.0: The bittern lesson for bioacoustics","venue":null,"work_id":"4913ccc3-65bc-4f98-869a-4f66e558816c","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:884672b89fbd584fe531011b4705bee10dbabfdd020ae621fb75bba6de876dfa","observation_id":"e9a0000e-2916-4889-ba0d-ca17836df109","resolution":{"observed_at":"2026-05-15T05:45:05.754810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Revisiting mae pre-training for 3d medical image segmentation","venue":null,"work_id":"81417240-2ba0-49ac-a9da-660ec72ef239","year":2025},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:93e53a3a903e39d4bbed1bed97c67f1db3a185eaeda71cbe98a31ab3fd31b857","observation_id":"beb4e399-6cd0-49df-bbc7-8a340c735f03","resolution":{"observed_at":"2026-05-15T05:45:07.074531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videomae v2: Scaling video masked autoencoders with dual masking","venue":null,"work_id":"96deaafd-8949-45f2-836e-3535e2ef30f8","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:cbf12619d30d61fb9fb656c4b69c441f3879ef48e6ee1200b3574844f359744b","observation_id":"32c703b5-41c0-451f-a9b1-fc8de5ca6dfd","resolution":{"observed_at":"2026-05-15T05:45:07.078570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models as masked autoencoders","venue":null,"work_id":"cc69da05-da45-4ae8-beb8-8a729e2db641","year":2023},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:d2ee493517eb2d7b6faa18048144bf72e9f025333a9c022f81e9c8b54c64d5db","observation_id":"2405d031-c624-42d1-a263-be8dd64d7c78","resolution":{"observed_at":"2026-05-15T05:45:07.086994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xeno-canto: Sharing bird sounds from around the world","venue":null,"work_id":"5fa81c63-c42a-4db2-9076-d5e004de5d50","year":null},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:4e179cf60885de66248c871cefabd2e0c853f5bd8fa2fd078d64c8abdcdec713","observation_id":"c25149a2-4342-442e-b925-a480f2137df2","resolution":{"observed_at":"2026-05-15T05:50:05.054403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1e8ea766-08a8-436d-b0c8-aa1e4bff0145","year":2026},"citing_paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T05:44:51.237010Z"},"links":{"citing_paper":"/paper/2605.14031"},"observation_digest":"sha256:7032303020f10c2835424ddb2058e18fe453849810785d51a58d9992359d9889","observation_id":"3b4b5bdd-d1f1-423f-a94c-2185592574a5","resolution":{"observed_at":"2026-05-15T05:50:04.894613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.14031","last_updated":"2026-05-13T18:45:08Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-17T22:08:03.085069Z","submitted_at":"2026-05-13T18:45:08Z","title":"Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":5,"verified_fuzzy":50},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 1 inbound Pith citation observation for arXiv:2605.14031."}