{"as_of":"2026-08-08T03:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8a92829b4a6ff9e7adfd41fd74e2327f6462bce541b27d3e9ebb860e9d7e2af","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:54.475780Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:08:13.297661Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:08:16.157991Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"cited_work":{"arxiv_id":"2505.14951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14951","snapshot_observed_at":"2026-08-06T17:08:16.157991Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","venue":"cs.CV","work_id":"67e1da3b-c710-45f3-a23e-0fbfe242a9ab","year":2025},"citing_paper":{"arxiv_id":"2507.13385","last_updated":"2025-07-15T22:57:29Z","snapshot_observed_at":"2026-08-06T16:59:28.191891Z","submitted_at":"2025-07-15T22:57:29Z","title":"Using Multiple Input Modalities Can Improve Data-Efficiency and O.O.D. Generalization for ML with Satellite Imagery","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:08:13.297661Z"},"links":{"cited_paper":"/paper/2505.14951","citing_paper":"/paper/2507.13385"},"observation_digest":"sha256:2bdf492c8dc7d0f3ac85517b601c8a799a8ef85b6f71e208149f84f532b667c8","observation_id":"d834033a-ee40-40b4-b0da-f4d01a61f1b0","resolution":{"observed_at":"2026-08-06T17:08:16.257595Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14951/citation-record","integrity":"/paper/2505.14951/integrity","json":"/paper/2505.14951/citation-record.json","paper":"/paper/2505.14951"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:58.305908Z","title":"Multimae: Multi-modal multi-task masked autoen- coders","venue":null,"work_id":"b1bb6476-9431-4153-b267-534f211ecdd9","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.356112Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:24f0682d220f1fe10760e576ca54b09ee424ed48a9d61b73210bd3095ae7801a","observation_id":"8abeaa84-cf6c-43ad-a98e-ef34afc4c09e","resolution":{"observed_at":"2026-08-07T15:29:58.407649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:58.095597Z","title":"Satlaspretrain: A large- scale dataset for remote sensing image understanding","venue":null,"work_id":"844fb2a3-7a60-4070-a20f-f8a238844346","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.441077Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:e73077d0b2ac20053ef889c19bc720cf569d82eafee0584fafd402c20fa33235","observation_id":"103c181d-ca92-4271-8cde-eb9fe46fa57a","resolution":{"observed_at":"2026-08-07T15:29:58.180477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.877451Z","title":"HLS Multi Temporal Crop Classification, 2023","venue":null,"work_id":"504f7f3c-5262-4743-b4a1-52450773425e","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.579948Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:9b6864f71badf94ff6e7b2a83496e83394b319643dc0f997365cc15da8a2b92e","observation_id":"c043bd61-342e-4b5a-ba6b-0810ce526277","resolution":{"observed_at":"2026-08-07T15:29:57.934653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.785748Z","title":"Satmae: Pre-training transformers for tem- poral and multi-spectral satellite imagery.NeurIPS, 35:197– 211, 2022","venue":null,"work_id":"73d9abda-02c1-4290-b3da-c26c4d9a48e5","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.695559Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:6dbce88188f89cb7d63a3938fdc61e7b6a631be3bd108756abb78a4c31494c41","observation_id":"bd5c0250-b76b-41cf-a2a9-afe910db9356","resolution":{"observed_at":"2026-08-07T15:29:57.830678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:51.806284Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.806284Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:8e8f6d25df5edf0cc8b704e05ec2cef0d9b1e480b98a1092ba0ad5918bd59efc","observation_id":"9b296322-03bd-43ea-9227-6a46225e8db9","resolution":{"observed_at":"2026-08-07T15:29:51.806284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:29:51.936537Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.936537Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:dfd55de7306c46bccfb419327281d13d50f9a921180d799b3b2c913e0e3c9aaf","observation_id":"25c6e75f-a217-47e4-9a8c-886635a3df7e","resolution":{"observed_at":"2026-08-07T15:29:51.936537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.632818Z","title":"Croma: Remote sensing representations with contrastive radar- optical masked autoencoders.NeurIPS, 36, 2024","venue":null,"work_id":"a8327077-c6d1-4cc0-a928-9b37617b66bf","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.090685Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:70652dc2d61a6467f4670f3a2e19339977063920239b2c7abadfc6fdfbe348cd","observation_id":"c654ea9e-0232-4f7c-9d08-ac6cba409b5a","resolution":{"observed_at":"2026-08-07T15:29:57.696017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.538348Z","title":"Skysense: A multi-modal remote sens- ing foundation model towards universal interpretation for earth observation imagery","venue":null,"work_id":"060e7665-d75d-4fdb-a4f6-8fe3c365af1b","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.205724Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:816b7193d49215c40a5bda3cbf695c3d9d503d49e98282e3234d771786156382","observation_id":"30ef9799-0805-4057-a7a9-a770b8ee3c4c","resolution":{"observed_at":"2026-08-07T15:29:57.586494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.424559Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"ffe875f4-3086-4873-a51a-459d1b2ef07c","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.368114Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:6c2659ff7f591660bddc3c3c5fc47def12aa86db9737490a232463eef949991a","observation_id":"b3ff44e5-cb70-4706-9018-9270e62cfc1c","resolution":{"observed_at":"2026-08-07T15:29:57.495808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.291177Z","title":null,"venue":null,"work_id":"b7df32ca-7468-4e70-8adc-f18208dbfe43","year":2019},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.502692Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:0abb2aa74543925c00c2ff9a57454e94bc977cecc8109f29cca966cd950a71c3","observation_id":"ece778ca-2009-45ec-b9bd-77e3778c8ff3","resolution":{"observed_at":"2026-08-07T15:29:57.344291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06687","last_updated":"2025-07-10T16:14:55Z","snapshot_observed_at":"2026-08-05T01:14:41.251997Z","submitted_at":"2024-08-13T07:27:02Z","title":"Masked Image Modeling: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06687","snapshot_observed_at":"2026-08-07T15:29:52.563283Z","title":"Masked image mod- eling: A survey.arXiv preprint arXiv:2408.06687, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.563283Z"},"links":{"cited_paper":"/paper/2408.06687","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:e1e241297781c4f736ab478bd615ef57de986e80a9508ef6d6d504c13e9913b7","observation_id":"304e5bbc-e06a-4e57-a0d0-9a73b31ece0c","resolution":{"observed_at":"2026-08-07T15:29:52.563283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.157890Z","title":"Masked autoencoders that listen","venue":null,"work_id":"6325d475-7b54-4620-a852-1e250cb7ddac","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.631096Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:6d882ebcc0906b968c1df96029f4547a155d68dfd101f973299cb78c24cd9cae","observation_id":"80fee846-169f-4578-8233-add4a506f278","resolution":{"observed_at":"2026-08-07T15:29:57.218245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18660","last_updated":"2023-11-08T18:25:24Z","snapshot_observed_at":"2026-07-06T16:39:52.551576Z","submitted_at":"2023-10-28T10:19:55Z","title":"Foundation Models for Generalist Geospatial Artificial Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18660","snapshot_observed_at":"2026-08-07T15:29:52.735664Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.735664Z"},"links":{"cited_paper":"/paper/2310.18660","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:b4115508086eed35d24c25df2618519715c65ca00929b13e8e9d410c781e36af","observation_id":"fc78dbde-2c4c-4696-a112-9268c208b36a","resolution":{"observed_at":"2026-08-07T15:29:52.735664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.024513Z","title":"Geo- bench: Toward foundation models for earth monitoring","venue":null,"work_id":"186c194a-ae34-4703-b7c7-c877dd1a2981","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.814349Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:e012d3f5b46fc30ee782dae943437e0698f484627216af8cb2091066c09cca7f","observation_id":"f32c05a6-7d51-483e-9d03-e173e48032d4","resolution":{"observed_at":"2026-08-07T15:29:57.077347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.920564Z","title":"Multimodality helps unimodality: Cross- modal few-shot learning with multimodal models","venue":null,"work_id":"749ad3f0-0485-45b4-93d2-040d7b92b5db","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.905682Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:93288c58d2748d59e4ee6ca909aadf0ed3aae3b9d6cfcfc8b76ef85c0446a1ef","observation_id":"8630e3c1-09c5-41f1-ba7a-9154ef8524be","resolution":{"observed_at":"2026-08-07T15:29:56.960366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.802533Z","title":"Re- moteclip: A vision language foundation model for remote sensing.IEEE Transactions on Geoscience and Remote Sensing, 2024","venue":null,"work_id":"02446a81-4ddc-40b6-9423-11a60d5e0450","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.967460Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:cabf29ca7f98468194dae546133b138dec5f37aee733d09f6fb66a51ef19d1a9","observation_id":"b2ea4498-0e3e-4906-af59-5968c43aef6a","resolution":{"observed_at":"2026-08-07T15:29:56.854441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.628026Z","title":"A convnet for the 2020s","venue":null,"work_id":"968fd43d-650c-4e42-a2ec-037a383c91d3","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.017671Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:961904816fb89b91181a6b5e62f4995095bd15d5231be7d35764806da99c1a02","observation_id":"bb8b4295-8a4b-41c9-aa36-d00daf446721","resolution":{"observed_at":"2026-08-07T15:29:56.716250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02771","last_updated":"2024-07-29T10:35:50Z","snapshot_observed_at":"2026-08-06T10:55:27.379554Z","submitted_at":"2024-05-04T23:16:48Z","title":"MMEarth: Exploring Multi-Modal Pretext Tasks For Geospatial Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02771","snapshot_observed_at":"2026-08-07T15:29:53.100039Z","title":"Mmearth: Explor- ing multi-modal pretext tasks for geospatial representation learning.arXiv preprint arXiv:2405.02771, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.100039Z"},"links":{"cited_paper":"/paper/2405.02771","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:f8c95bbbbca3ca8b3046f3c724e1b5648117d32409e95094a7274211944990a0","observation_id":"c22a0db8-849d-439d-aecf-b0511898dd12","resolution":{"observed_at":"2026-08-07T15:29:53.100039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.360829Z","title":"Rethinking transformers pre-training for multi- spectral satellite imagery","venue":null,"work_id":"9062fd94-7b4b-4762-a6a8-577811e34f77","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.188818Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:07a526b03aa9e35beea3eb11e867a0b26e0b60ec305e601dc42c9f3e22a97be0","observation_id":"0b75565f-c42a-4228-a242-2406af6445e1","resolution":{"observed_at":"2026-08-07T15:29:56.488338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18536","last_updated":"2024-09-27T08:15:14Z","snapshot_observed_at":"2026-08-07T21:24:27.416653Z","submitted_at":"2024-09-27T08:15:14Z","title":"How Effective is Pre-training of Large Masked Autoencoders for Downstream Earth Observation Tasks?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18536","snapshot_observed_at":"2026-08-07T15:29:53.273043Z","title":"How effective is pre-training of large masked au- toencoders for downstream earth observation tasks?arXiv preprint arXiv:2409.18536, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.273043Z"},"links":{"cited_paper":"/paper/2409.18536","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:98d3a71e4381d64387f3562f9f93aea4e0e5af187c8d4298a2c5e74954f7339c","observation_id":"e462cdb5-2da5-49d6-8a8c-83fdd31691ce","resolution":{"observed_at":"2026-08-07T15:29:53.273043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.174928Z","title":"Ssl4eo-l: Datasets and foundation models for landsat imagery.Advances in Neural Information Processing Systems, 36:59787–59807,","venue":null,"work_id":"78b00f5d-fb58-4c5e-a418-d5848143f73f","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.395956Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:dc5cfbc08e3e9f8c1b07be30e49844d9011e8d95f3ec08a53f7c38e0ba4dda51","observation_id":"10cc8de0-b885-4996-908d-29d742858b71","resolution":{"observed_at":"2026-08-07T15:29:56.258370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.907617Z","title":"Torch- geo: deep learning with geospatial data","venue":null,"work_id":"9b337b1b-defb-4d4c-a32f-2fbb73f05a0f","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.526054Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:460c76c36f148e57ad3fa260ed6a50d1b471372ae5239130ef958be74f1ef827","observation_id":"c21eeaab-db24-4163-bf4a-aab4f24a837e","resolution":{"observed_at":"2026-08-07T15:29:56.024179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.780548Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"51c1cb3f-51c4-4fab-9093-97e31f193d31","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.660442Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:a6c451f36b6843759acc38fb39bd9d7b31c8f64c0c0b5834cfdc00b43521f618","observation_id":"9ae240aa-34bf-4b6a-9d9d-a9fb5259c9f6","resolution":{"observed_at":"2026-08-07T15:29:55.826704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:53.749122Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.749122Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:ee3ee2851311d240a7196cd08e840557443b262213ebb25f55aa3ed30dfde33c","observation_id":"3d7d1e59-244a-4fbc-9c51-2f5aef01a770","resolution":{"observed_at":"2026-08-07T15:29:53.749122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04936","last_updated":"2024-04-02T21:45:06Z","snapshot_observed_at":"2026-07-06T14:03:17.645948Z","submitted_at":"2022-10-10T18:09:35Z","title":"EarthNets: Empowering AI in Earth Observation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04936","snapshot_observed_at":"2026-08-07T15:29:53.796800Z","title":"Earthnets: Empowering ai in earth obser- vation.arXiv preprint arXiv:2210.04936, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.796800Z"},"links":{"cited_paper":"/paper/2210.04936","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:3725977d43c7f1b4e51379665fd6fa094bea23cb6f03487fa77b7f0c6e9a0f11","observation_id":"0222f482-3379-4dda-a424-a4dd1b8dc624","resolution":{"observed_at":"2026-08-07T15:29:53.796800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.652904Z","title":"Neural plasticity-inspired foundation model for observing the earth crossing modalities.arXiv e-prints, pages arXiv–2403, 2024","venue":null,"work_id":"4bca076d-bc13-4d06-a4d9-ada31905d378","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.836145Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:e31a23f56b93b54b8a2175d7011d198d13b04db8d4cad6e9293610a3d60f87b2","observation_id":"b9a84169-9ba2-4401-bc9c-325d5c3bb5e0","resolution":{"observed_at":"2026-08-07T15:29:55.694192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.545133Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"9477833d-7878-453e-9d45-594573daa679","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.918881Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:0da8a621eb8a7c7209df0ab7a6f435af14554b1972c450cb037ce8edcd3801d4","observation_id":"d41d6eb0-0403-463d-8662-0eba0f109097","resolution":{"observed_at":"2026-08-07T15:29:55.589747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.444161Z","title":null,"venue":null,"work_id":"f60e40b4-f2bd-463d-b204-f5b71b116350","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.993947Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:77640c5c8309328114430b1a88892f007200e0df244391a95700716c1a2216b0","observation_id":"95d7c543-69a8-48b5-8026-4be353fd28b1","resolution":{"observed_at":"2026-08-07T15:29:55.493268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.318066Z","title":null,"venue":null,"work_id":"405c2e1e-ac44-40b4-b2dd-9bd41b086253","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.050525Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:31383b82a64f5af90ff529dcd53e255e6a8e0280dc52f97c4546065d9aa3d2c3","observation_id":"f6b4b861-4512-4648-8e56-2911dac23509","resolution":{"observed_at":"2026-08-07T15:29:55.391866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.115621Z","title":null,"venue":null,"work_id":"89fb5d9a-d716-4937-9c54-36943700a23f","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.147522Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:9c104b20fd966eeedbe002fe2a690f9840a2da897ca98eb4f0d7cde5d7d31861","observation_id":"ab13c586-0fcc-453f-9e67-00bb951be622","resolution":{"observed_at":"2026-08-07T15:29:55.238206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.975249Z","title":"Overall, [14] comprises multiple modified versions of standard geospatial datasets for classification and segmen- tation tasks","venue":null,"work_id":"b9d937f4-b303-4cd6-9397-3432931f0713","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.249838Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:c72bbe11ff3d80502d855171d171949dfa619720d86ed4a00653a19ec6de284d","observation_id":"53335596-d842-4a59-8443-1322123d38b7","resolution":{"observed_at":"2026-08-07T15:29:55.031397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.850278Z","title":"Pre-training objective We pre-train our approach (depicted in Figure 2) using six input modalities: RGB, IRED, SIRED, EB, DEPTH, and SEG","venue":null,"work_id":"637c98be-6524-41cc-91bd-f0a5f8ae84dd","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.305152Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:7d9496f1286aa7e708c56534461a1884d08199e0364afad403cd15d5948c3217","observation_id":"79d90d38-e04f-4499-af64-20188460bc06","resolution":{"observed_at":"2026-08-07T15:29:54.918948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.742444Z","title":"Fine-tuning setups for segmentation and classification EO tasks","venue":null,"work_id":"c05eece1-485d-4f7a-a1c6-4a8a4230a298","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.372481Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:b1e504d636678b36d82bc59a07fc553e9f9e326035d970c77afc685b0143f6a4","observation_id":"d187ac60-e375-4b51-93e7-a4a2f9d796aa","resolution":{"observed_at":"2026-08-07T15:29:54.788137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.660278Z","title":"Pre-training visualisations Masked input Prediction Masked input Prediction TargetTarget RGBDEPTHSEGRGBDEPTHSEG Figure 5","venue":null,"work_id":"2ae2dc06-a53a-406a-a318-c0ccacf7db5b","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.475780Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:570190672ffec45cdca22e6a0d612460ca6ea08a6387980dd2acd6bd3765a1b3","observation_id":"744ff84f-45e1-41f5-adf1-1287d2c7d4c4","resolution":{"observed_at":"2026-08-07T15:29:54.690361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2505.14951."}