{"as_of":"2026-08-14T16:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d77881340dbb98c342fdf0c84eaa67d8af81fe36a8fbba9233b8e84a768c3781","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:08:59.996850Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.09101/citation-record","integrity":"/paper/2411.09101/integrity","json":"/paper/2411.09101/citation-record.json","paper":"/paper/2411.09101"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.694886Z","title":"SegNet: A Deep Convolutional Encoder-Decoder Architecture for Image Segmentation,","venue":null,"work_id":"00cd3d99-4a38-4a96-bf29-b28ec242862b","year":2017},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.775354Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:8a366b58d6090aa80ea7ee5d24c88135d91542fd8dce0ea630fef2cd73ddb2e1","observation_id":"671b2a20-c65f-49d7-8992-b5fa16466907","resolution":{"observed_at":"2026-08-12T21:09:00.700597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.675911Z","title":"Per-Pixel Classification is Not All You Need for Semantic Segmentation,","venue":null,"work_id":"2627e893-fa98-4f07-a415-d8e48b39dd12","year":2021},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.782160Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:ccb5f2f579c187971104e6bff3a987e2814e345bea17bdf5e469011ac2e95ff4","observation_id":"2700adac-7108-475b-851f-0ced3677b8eb","resolution":{"observed_at":"2026-08-12T21:09:00.682649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:08:59.788178Z","title":"ImageNet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.788178Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:b04c621ac6cc637cbadd1bb517d781f0d35315967491ff86e0e3dec4673f988a","observation_id":"831b97ea-0299-4334-a927-bfdc1b6cdb6f","resolution":{"observed_at":"2026-08-12T21:08:59.788178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.647447Z","title":"ResUNet- a: A deep learning framework for semantic segmentation of remotely sensed data,","venue":null,"work_id":"98b59174-e899-46ff-a93d-a1fe7bd991ce","year":2020},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.794573Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:887b725bcd5cddc09d8c0707c203773b7f8114617a2e8d0e246c5320c945d050","observation_id":"880c0604-57e8-4b0e-8ea9-da47f6c8d9aa","resolution":{"observed_at":"2026-08-12T21:09:00.654158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.629215Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale,","venue":null,"work_id":"b780a516-5e83-4163-9fa1-9ebb680216ca","year":2021},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.799556Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:a2b88b38fa80f549142d0f943a74e1c3eaca4d329b46e4fdb115b71727598ac9","observation_id":"5e047c9e-bcd4-4afa-96f2-b3b4eb671f31","resolution":{"observed_at":"2026-08-12T21:09:00.636119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.611086Z","title":"Is Attention Better Than Matrix Decomposition?,","venue":null,"work_id":"d4cc0894-5fde-4b34-9c43-36d40e8eb1e2","year":2021},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.806226Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:0c592b5628390fd34d7dedde0709412742fae4eaca311fbbf60285f83939ecf3","observation_id":"8a3f59d8-dea0-4b45-8037-f424ca87d94a","resolution":{"observed_at":"2026-08-12T21:09:00.616694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08575","last_updated":"2022-09-18T14:33:49Z","snapshot_observed_at":"2026-08-13T14:24:23.847576Z","submitted_at":"2022-09-18T14:33:49Z","title":"SegNeXt: Rethinking Convolutional Attention Design for Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.08575","snapshot_observed_at":"2026-08-12T21:08:59.813343Z","title":"SegNeXt: Rethinking Convolutional Attention Design for Semantic Segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.813343Z"},"links":{"cited_paper":"/paper/2209.08575","citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:fbc6993a947771706bffa6dc4cb3b8ad7e37f75539eb004a35c9f65c9b1dd69a","observation_id":"c2b07af7-2ff4-49a7-884f-9abef142d929","resolution":{"observed_at":"2026-08-12T21:08:59.813343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.09741","last_updated":"2022-07-11T04:21:37Z","snapshot_observed_at":"2026-08-11T14:46:55.089040Z","submitted_at":"2022-02-20T06:35:18Z","title":"Visual Attention Network","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.09741","snapshot_observed_at":"2026-08-12T21:08:59.818921Z","title":"Visual Attention Network,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.818921Z"},"links":{"cited_paper":"/paper/2202.09741","citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:a7584ea3d72a8762a18bc79d7ef892e8e24337fa6b68f9697a14142cb451df6d","observation_id":"19b543f8-59ae-43cd-b208-9827fa6e722c","resolution":{"observed_at":"2026-08-12T21:08:59.818921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.592564Z","title":"AerialFormer: Multi-Resolution Transformer for Aerial Image Segmentation,","venue":null,"work_id":"f4567103-1eb1-44ea-acdb-ba7794dedf48","year":2024},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.825151Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:545ffe18f7604e62d4fc50fb9ca9541a100411d0fe82f80923b21826487e5335","observation_id":"e8c890f1-a288-46b3-b9ca-07209d1b1df3","resolution":{"observed_at":"2026-08-12T21:09:00.598859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:08:59.830665Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.830665Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:c355fa03472a0d3e80d2b9afcc3d94f85598cf803b422f459e03b0b8b33bdfbc","observation_id":"75504dbf-5341-48ce-9d84-9efc27e23b35","resolution":{"observed_at":"2026-08-12T21:08:59.830665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.564444Z","title":"The possibilities and pitfalls of doing a secondary analysis of a qualitative data set,","venue":null,"work_id":"31e6040e-a889-4b78-b310-da7c89e75939","year":1997},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.836113Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:bd4306395a94ab5ea178b202a60f01a7f99fc10a73988231d4e08c7371f7fff7","observation_id":"4f03c24b-8fdb-4031-8ba3-1b9e1d106348","resolution":{"observed_at":"2026-08-12T21:09:00.569537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.547334Z","title":"Weakly-supervised learning based automatic augmentation of aerial insulator images,","venue":null,"work_id":"320431a4-5ea3-4596-b572-93454c4931b2","year":2024},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.841221Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:30b750327bca1a19cc81a6678dc335f1017e6f0c23d67337265f72f5690dcce4","observation_id":"09f7a812-f9a5-4aae-b449-19135485bfde","resolution":{"observed_at":"2026-08-12T21:09:00.553129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T16:05:47.225037Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T21:08:59.846530Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.846530Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:9ecd3130379ef8bf809c57b94b7e1afff9397e748c3f1c0cdb5c07d91f4dd682","observation_id":"b1db340d-2137-4059-b13a-e783c1b93cb8","resolution":{"observed_at":"2026-08-12T21:08:59.846530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-07-06T05:54:18.908943Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-12T21:08:59.852677Z","title":"Focal Loss for Dense Object Detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.852677Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:05f035cfe8c81a10d107ee186b3b3ea9d2c3095c192f494c1a026501e7b4ea5f","observation_id":"16a09ce9-8666-4ad1-94b3-f4a1ab09fb8b","resolution":{"observed_at":"2026-08-12T21:08:59.852677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.529603Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":"5b6a7bb9-a6c9-4f13-8cb2-7d96442827d5","year":2021},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.858538Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:270fac7d1b0aa4df02db66490dcb36395086e6a9eae8a7e89abfaaa8cfcc6d72","observation_id":"18dbdcb4-6dd8-48da-b6b5-056759e6277a","resolution":{"observed_at":"2026-08-12T21:09:00.535919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.511132Z","title":"Cross-entropy loss functions: Theoretical analysis and applications,","venue":null,"work_id":"58985468-dc79-43aa-aa3f-f8d610ae3439","year":2023},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.863941Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:912d2d0d65fe6474c88128328f138b222845e2733f49604a7d26464d96b88701","observation_id":"dd50a342-60be-4e16-bb7e-5a670a563f69","resolution":{"observed_at":"2026-08-12T21:09:00.516801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.491925Z","title":"On the difficulty of training recurrent neural networks,","venue":null,"work_id":"7374c197-4064-48a8-8a20-cc847b69e9cb","year":2013},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.870640Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:13333c6b4be3a06a40f45f11e82d2e5cfb922f093674963dc8a8275b97f1c2dc","observation_id":"57fb7f74-d41f-442e-bd42-6e0f5e5de4ea","resolution":{"observed_at":"2026-08-12T21:09:00.498460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.471572Z","title":"Regmi, Unsupervised Image Segmentation in Satellite Imagery Using Deep Learning","venue":null,"work_id":"25e1500f-7429-4af1-8ca4-c0e50ad37e23","year":2023},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.875978Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:40ef6155a0d2f38f71d0c5a126c79779b262a26d2e23efb924e525f9eb8d53e5","observation_id":"47c7f685-532c-4e35-b267-1a591fa63a80","resolution":{"observed_at":"2026-08-12T21:09:00.478488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.451287Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation,","venue":null,"work_id":"5c1c3310-e3fe-4a53-a186-40c512ff2284","year":2015},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.882333Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:cb6e9bca4a58747f2f552150dfab59372446451c81fcd79fb12b242ab140bd30","observation_id":"0a39be60-8949-4504-a07f-07927f9821ba","resolution":{"observed_at":"2026-08-12T21:09:00.457905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-14T04:13:35.056640Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-12T21:08:59.888544Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.888544Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:be16508aa66a2ed7a00b486eed368273b9337625f40356814b5060416522e211","observation_id":"99c43734-1fdb-4027-9335-f119fc029935","resolution":{"observed_at":"2026-08-12T21:08:59.888544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.433757Z","title":"Generalised dice overlap as a deep learning loss function for highly unbalanced segmentations,","venue":null,"work_id":"5d422cdd-863c-4838-9ab9-9a3bdc7d6384","year":2017},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.894849Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:fbf97ac87d6782984d8525c56fb661035756728450bddafb18a0cdde3d040712","observation_id":"969b8fb8-4971-4046-ba69-b2c911839032","resolution":{"observed_at":"2026-08-12T21:09:00.439698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.415793Z","title":"RingMo: A Remote Sensing Foundation Model With Masked Image Modeling,","venue":null,"work_id":"7db1932a-92fb-4c9d-a817-6c0cd3dfb153","year":2023},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.900888Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:2da5fa1c7f99bfd117cfa5e67da407529c3089c227b208058bf081cdc4e78ce5","observation_id":"9a5ca145-bcee-4a0a-80ca-d56d3f345534","resolution":{"observed_at":"2026-08-12T21:09:00.422193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.398888Z","title":"Attention is all you need,","venue":null,"work_id":"60e9271e-bc57-4795-be8d-feb194b808e4","year":2017},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.906884Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:3efd1624e6dfcbfc73c011611a556335637cfa2993fbfb945eb0bbbc74324096","observation_id":"5b0ea9d5-d300-4f73-9501-eb22982d59f1","resolution":{"observed_at":"2026-08-12T21:09:00.404742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.383150Z","title":"Advancing plain vision transformer toward remote sensing foundation model,","venue":null,"work_id":"834f3a46-d569-4d08-bf1c-5ce216d4cf12","year":2022},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.913059Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:91241d8924aa4dcaa275bf644f9b6cccd2295ee266edc623e262ca03e053efc1","observation_id":"7ec611f1-91ec-4d05-b3ee-6df2f0130313","resolution":{"observed_at":"2026-08-12T21:09:00.388715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:08:59.919954Z","title":"Samrs: Scaling-up remote sensing segmentation dataset with segment anything model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.919954Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:89a800a18609ac845f06890f56094bde3db80aa3edac2fd06fbfbb14786284f7","observation_id":"23ecce86-770a-47ff-a3bf-5de16e372453","resolution":{"observed_at":"2026-08-12T21:08:59.919954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.354703Z","title":"Transformers: State-of-the-Art Natural Language Pro- cessing,","venue":null,"work_id":"f542f096-5898-428f-8478-67e7e533c1d9","year":2020},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.924846Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:9da3ac4c8085691e0f9f49b344aa503550999109d6b49e20112a12bf5a67e516","observation_id":"5d3441a6-7ecb-485e-b0f2-803042188300","resolution":{"observed_at":"2026-08-12T21:09:00.361546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.337483Z","title":"W-Net: Convolutional neural network for segmenting remote sensing images by dual path semantics,","venue":null,"work_id":"2790694f-1de7-4ca6-b507-890adbcde94e","year":2023},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.930252Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:01a6e3c1a89b8e050b39e5e1bab683aa0e873f739498b8021cd7c1516e244fa5","observation_id":"925cff10-8209-4b13-8f99-75d3d77a6733","resolution":{"observed_at":"2026-08-12T21:09:00.343563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.320555Z","title":"AANet: an attention- based alignment semantic segmentation network for high spatial resolu- tion remote sensing images,","venue":null,"work_id":"705af0ee-85cf-4273-853a-014ac54ce8de","year":2022},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.936873Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:e83fcc483717a5fec23edcbfd9e75b6e1f96588d53b5aba0cd94c527a24ccfb9","observation_id":"734fabe5-9102-4a9c-84b9-0949f53afa64","resolution":{"observed_at":"2026-08-12T21:09:00.326096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.304681Z","title":"DOTA: A Large-Scale Dataset for Object Detection in Aerial Images,","venue":null,"work_id":"5ca4f628-233a-483a-821a-3becd71c225a","year":2018},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.941903Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:df25c4bdb0c14bb11ac0944a8e5fb8c4dea998b45514cd0383131396ae9551ef","observation_id":"03d80cae-55aa-4bf8-8a08-3b294f671b17","resolution":{"observed_at":"2026-08-12T21:09:00.310189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.287794Z","title":"Unified perceptual parsing for scene understanding,","venue":null,"work_id":"576c6efc-de21-4c1e-b2c0-1454a8822319","year":2018},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.947070Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:9ff798ed9f34ca272e0175fdbb447b237a2983a34257159a96fa71efc572476e","observation_id":"3f0b730e-17f1-4989-a17e-3919ea25ecdf","resolution":{"observed_at":"2026-08-12T21:09:00.292761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.270707Z","title":"TreeUNet: Adaptive Tree convolutional neural networks for subdecimeter aerial image segmentation,","venue":null,"work_id":"5c00d7f3-f542-4de0-8a35-4f1529e7cf00","year":2019},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.953700Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:6ce6ace5683c2915adfb44abac5f5d5bec49b094f02498363314f65045f64015","observation_id":"9d408078-aa08-4034-a058-4f7f762f5b97","resolution":{"observed_at":"2026-08-12T21:09:00.276616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.253902Z","title":"iSAID: A Large-scale Dataset for Instance Seg- mentation in Aerial Images,","venue":null,"work_id":"d98a8d65-602b-446f-98c2-9f141b09a861","year":2019},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.958966Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:dd8cff0dd8fb3f6002c0df146541b0bbb5d572424cbc48f08c71eca1747e922f","observation_id":"25bf471d-3f77-4a5f-b2b6-63c1867d418e","resolution":{"observed_at":"2026-08-12T21:09:00.259048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.235857Z","title":"Context Encoding for Semantic Segmentation,","venue":null,"work_id":"d9a57bf4-81b2-4629-ac61-7e486ba1c067","year":2018},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.965751Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:5de6cb17261d335d1a003668f233d02b1197ca3278e916022e0f1a6f26a0f8a0","observation_id":"04182e3e-bbbc-4ae0-8179-494fb83ac3a7","resolution":{"observed_at":"2026-08-12T21:09:00.242083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.215695Z","title":"Vitaev2: Vision transformer advanced by exploring inductive bias for image recognition and be- yond,","venue":null,"work_id":"5274a7d9-0151-4e6a-ad1d-7cfd2dcce2fa","year":2023},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.971900Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:925efa359af03136450359596cb400bb1ccf6d3c322b0a8f8891995df8f0edaf","observation_id":"57fce624-14fe-4e83-aa6d-76dd8af41bdf","resolution":{"observed_at":"2026-08-12T21:09:00.222871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.195902Z","title":"Iou loss for 2d/3d object detection,","venue":null,"work_id":"8e7405ec-4b3d-44a7-82dc-9a4d051bcdde","year":2019},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.978756Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:7175b4b718b1b71be3f7bf765845fb6f7ff7a066840921a68e8dd621fb96f247","observation_id":"27d46e93-7633-4aea-9cd2-60426f983a51","resolution":{"observed_at":"2026-08-12T21:09:00.202793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.177538Z","title":"MultiResUNet : Rethinking the U-Net architecture for multimodal biomedical image segmentation,","venue":null,"work_id":"2e5c309f-d974-4123-984e-e1fe168ecc19","year":2020},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.983839Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:cb683ba32b0467ce40a4410c75e7d220d05af2f78552752e542fd513b6503578","observation_id":"94f32d10-c98d-4ad5-b2c5-b5c89d4331ef","resolution":{"observed_at":"2026-08-12T21:09:00.183197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.156888Z","title":"Learning Deconvolution Network for Semantic Segmentation,","venue":null,"work_id":"9875cd77-480a-4829-b233-f229995ed9c7","year":2015},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.989981Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:52ed073bf2f51f0d915c17a32e789888569516e6b329141fa5b16fb2c545e7cf","observation_id":"96658b5e-9e5b-4a7a-8c3d-89299bb94f00","resolution":{"observed_at":"2026-08-12T21:09:00.163123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:09:00.134598Z","title":"Using GAN Methods for Aerial Images Segmentation,","venue":null,"work_id":"70bea9b8-5ca2-40b8-a026-aac762ad4cab","year":2024},"citing_paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T21:08:59.996850Z"},"links":{"citing_paper":"/paper/2411.09101"},"observation_digest":"sha256:ba6a3ced8b881f8606fd0164a1bff3b73c03caf5c3ee628c6ffbcd5fb2cad636","observation_id":"6dbabec3-d289-482a-a09f-39f8cb51f909","resolution":{"observed_at":"2026-08-12T21:09:00.143212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.09101","last_updated":"2025-02-13T18:20:14Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T15:16:02.111464Z","submitted_at":"2024-11-14T00:18:04Z","title":"Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2411.09101."}