{"as_of":"2026-08-10T20:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6334ecdac2e58c059ae7d0f332c786c5c8e75585841da4dfd8af69d95a998f1d","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T20:52:32.939566Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.19255/citation-record","integrity":"/paper/2501.19255/integrity","json":"/paper/2501.19255/citation-record.json","paper":"/paper/2501.19255"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.637623Z","title":"Segnet: A deep convolutional encoder-decoder architecture for image segmentation","venue":null,"work_id":"12ac1aa3-3672-4ff8-b26a-7845901de39d","year":2017},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.696783Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:ce3c1d881a176ee44aa20eceebc8a5011c0ca4762f340e2221445e3bd34336a1","observation_id":"46bc04ef-8ae8-4e0b-abc0-a2871bff84d8","resolution":{"observed_at":"2026-08-09T20:52:33.641274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.628257Z","title":"Coco- stuff: Thing and stuff classes in context","venue":null,"work_id":"198d936f-660a-4c6a-a881-01165275862f","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.701817Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:c132f6b00a9ee9870fc64253aee4fd26aa05e0c28be8704dfbd7a3593d80fa7f","observation_id":"4fe85ad3-5741-45a3-81c9-4308415c83de","resolution":{"observed_at":"2026-08-09T20:52:33.631173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.618620Z","title":"Pem: Prototype-based efficient maskformer for image segmentation","venue":null,"work_id":"7fa928b4-981f-4c80-a1b4-facb81edbadf","year":2024},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.705668Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:0bf886390d7bb4370d15c7a444a18ba26ee2cd259f7dd413c51e1bdd987e4991","observation_id":"4ff7c5b3-6978-437d-9ebe-f8a686e8f838","resolution":{"observed_at":"2026-08-09T20:52:33.622056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.609922Z","title":"Encoder-decoder with atrous separable convolution for semantic image segmentation","venue":null,"work_id":"6dba343a-7e66-4901-8d84-ecec35d691f5","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.708936Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:c2e4dba5faf375f3a2af08bca60ecc9c2eb342562919159b1284855e1898c89e","observation_id":"1c27b214-fdc9-4332-bb1c-921e427884b0","resolution":{"observed_at":"2026-08-09T20:52:33.613195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.601640Z","title":"Deeplabv3+: Encoderde- coder with atrous separable convolution for semantic image segmentation [m]","venue":null,"work_id":"b82ebf2d-c857-4dff-a0ea-4af0ae1d0389","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.712562Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:d8bd8bc2bea81deb62947b2ad2dd82587146e6749906fc61be1d1889691d979c","observation_id":"5e7045ff-eefd-4580-8bdb-99efbdbcacfe","resolution":{"observed_at":"2026-08-09T20:52:33.604749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.592659Z","title":"Mobile- former: Bridging mobilenet and transformer","venue":null,"work_id":"f485fc1b-d9a7-45f3-9a72-23a99d1198bc","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.715614Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:a7fcc77bda9464a3dff2c554b17a0d58ac65014721d26ba658e4fa2519cf3664","observation_id":"6a322c93-3e18-4cf5-a638-626f4c0d7b88","resolution":{"observed_at":"2026-08-09T20:52:33.596427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.718917Z","title":"Masked-attention mask transformer for universal image segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.718917Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:1f133c07f162d9f1fc3f16a8391cb0f4ee76e77decd24ef1f38b15f7ac6068c0","observation_id":"825c5236-3783-4afa-9f63-404a63e69b86","resolution":{"observed_at":"2026-08-09T20:52:32.718917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.721723Z","title":"MMSegmentation: Openmmlab semantic segmentation toolbox and benchmark","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.721723Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:242eee623703aab916904ba4f0c7bbcd8667129d6e4e9b5d8bfd4aa80be004b6","observation_id":"615ac641-80b9-47f8-a7a4-4f7b0d790056","resolution":{"observed_at":"2026-08-09T20:52:32.721723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.573514Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":"92e167a2-5fc2-4448-98c4-d111f7636de4","year":2016},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.725282Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:4e1388898f3b2269faf6059bfbd0a33540171b04fb3173b3f7a0a7e1ed135ac8","observation_id":"85636867-fa18-41cd-9192-e5030b6f9ff3","resolution":{"observed_at":"2026-08-09T20:52:33.577459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.564358Z","title":"Coatnet: Marrying convolution and attention for all data sizes","venue":null,"work_id":"78a0bd67-6f7d-4f3d-b80b-91ace3aced9e","year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.727967Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:bc32395c5bbf570ca25ae97eecbeb17dbb21699065295e0a2d9fe27b9356a9c0","observation_id":"2cf2f549-a2a4-42e8-88a0-ca83605cf44a","resolution":{"observed_at":"2026-08-09T20:52:33.567484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.555423Z","title":"Scaling vision transformers to 22 billion pa- rameters","venue":null,"work_id":"e57441c2-89c3-4079-bdc2-07125c8ebc69","year":2023},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.731025Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:611d4ecf2699a7361a9778867c7c5d34d2667da332b0694c817a85b8d76d319e","observation_id":"231c4c8e-9711-4ef8-b2f5-7bff1cddd518","resolution":{"observed_at":"2026-08-09T20:52:33.558525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.734512Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.734512Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:bf312b539a8e78ac3b034d6d4632963bcc625d7d6f0226db842a6e106fc6b562","observation_id":"4da06ea8-3730-4686-b3ab-3a0a0c9d4e6a","resolution":{"observed_at":"2026-08-09T20:52:32.734512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.540889Z","title":"Hr-nas: Searching ef- ficient high-resolution neural architectures with lightweight transformers","venue":null,"work_id":"bd8d9574-bb88-4b4e-989a-fad32fe52ae9","year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.738069Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:0c9380b79544b3fd480fb11d72f073746e16619f30a6b4045b016d79c1c972bf","observation_id":"c0fba700-be10-44d4-b50d-e5ead070ea7e","resolution":{"observed_at":"2026-08-09T20:52:33.544132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.530870Z","title":"Acnet: Strengthening the kernel skeletons for powerful cnn via asymmetric convolution blocks","venue":null,"work_id":"08a3d62f-26fe-4606-916b-2764530b2b3c","year":1911},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.740709Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:a566e926c65d504278d4484a141555d5764dfd1c1c5034fdbf92ee83189944db","observation_id":"848658a5-a1a2-434d-992f-28e6737b2585","resolution":{"observed_at":"2026-08-09T20:52:33.534698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.743465Z","title":"Repvgg: Making vgg-style convnets great again","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.743465Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:143d3a9192e9be846f3cc385069fada40a1f212ce8dd8e144cecbb9f8a62f262","observation_id":"7f6eec5f-adeb-4e7c-8064-741b79ba1d15","resolution":{"observed_at":"2026-08-09T20:52:32.743465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.517344Z","title":"Tinynet: A lightweight, modular, and unified network architecture for the internet of things","venue":null,"work_id":"745a02bd-119c-40c3-a93d-b68343c18802","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.745971Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:5fcb860c7514edc8d0759724485b8a72b95546fe87aee215982d7bcef68fa358","observation_id":"0bca0bc5-5df0-43ad-989e-75508ac07a05","resolution":{"observed_at":"2026-08-09T20:52:33.520540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.508158Z","title":"Cswin transformer: A general vision transformer backbone with cross-shaped windows","venue":null,"work_id":"58467bba-3de0-4725-b340-eb0ccc24aad2","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.748705Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:6cbb2fd7e5ce19e04fb3deb299e7376a9b91e18c5d459aac1c96dad5111f8431","observation_id":"bc9f165c-3414-41b4-a70d-e0a987aebadc","resolution":{"observed_at":"2026-08-09T20:52:33.511327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-09T20:52:32.751426Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.751426Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:a429aa5f0776c78f69c50621c88b41a50b6eb64b92d140806e30ea89a9029304","observation_id":"efca6f2d-080c-4633-ace5-dd53b6d48e46","resolution":{"observed_at":"2026-08-09T20:52:32.751426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.754750Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.754750Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:3b6e851c8626574ff7afe7aabcaa96f5649ac7567f1b48ebb773ed32ac48ed0f","observation_id":"7e7a4f3c-d09f-4a73-a015-d162154b4540","resolution":{"observed_at":"2026-08-09T20:52:32.754750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.757396Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.757396Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:d6d913ea0b2ad5cc069921b5dbe3a01cfd7c38342fd18e692f767b641871063d","observation_id":"b3e15c0b-b66b-49a8-96a5-c7e185bdb926","resolution":{"observed_at":"2026-08-09T20:52:32.757396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.486894Z","title":"Cmt: Convolutional neural networks meet vision transformers","venue":null,"work_id":"114fbf45-fe36-45a1-9fb5-b791691e6a03","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.760249Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:facd6b23192635519b1336464283f2d013a835a6be50fbd557783a2c72b381ff","observation_id":"dc7ab93f-1a70-4d0a-b1a2-795f2114d699","resolution":{"observed_at":"2026-08-09T20:52:33.489877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.478648Z","title":"Segnext: Rethink- ing convolutional attention design for semantic segmenta- tion","venue":null,"work_id":"05ad937c-334a-4b70-b348-0f80ddc1ad34","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.762988Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:df22f8d0f63a7fe039223b438a9830ef852b94f65f5cb73545a6b05e75b0916f","observation_id":"8776d04f-d8c7-43bd-ab6e-167828123b6f","resolution":{"observed_at":"2026-08-09T20:52:33.481708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.470464Z","title":"Ghostnet: More features from cheap 9 operations","venue":null,"work_id":"790ae514-a69a-4344-9f8a-d3d20646676c","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.765973Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:bdb5f82deefd65f4744de2a13347aa888dd07ab7f82671e418f2a352621dafe2","observation_id":"ab3bd6c5-5c66-434f-aeab-9c377d6f594a","resolution":{"observed_at":"2026-08-09T20:52:33.473722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.461826Z","title":"mask r-cnn,","venue":null,"work_id":"5d5e0353-f932-4457-ac60-3f18180b8994","year":2017},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.769624Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:c5ded76c89c9bf296f11b8f9b50e03986089623783f77788fc7ba787b44b2d1d","observation_id":"3b7b280f-49b7-4af3-997b-20d693b9c901","resolution":{"observed_at":"2026-08-09T20:52:33.464823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.452399Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"b06be997-d9dd-4818-8f85-dc3d1a2bb60e","year":2016},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.772342Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:4f7ce129884b7bbda30fdd5f43784771f9e6d85fe1b0e95c858a10c9077c67fa","observation_id":"e52a5f55-c775-4445-ab24-147b229e090f","resolution":{"observed_at":"2026-08-09T20:52:33.455890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.12180","last_updated":"2019-12-20T13:27:27Z","snapshot_observed_at":"2026-08-06T23:06:09.224235Z","submitted_at":"2019-12-20T13:27:27Z","title":"Axial Attention in Multidimensional Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.12180","snapshot_observed_at":"2026-08-09T20:52:32.775330Z","title":"Axial attention in multidimensional transformers","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.775330Z"},"links":{"cited_paper":"/paper/1912.12180","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:a9cdfa2402973c4a4bf3b38e88b7f1613754ee6d25509129c447645aec36a5b1","observation_id":"0d32745e-aac7-485b-8a8e-bb912ff5aa32","resolution":{"observed_at":"2026-08-09T20:52:32.775330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.443474Z","title":"Searching for mo- bilenetv3","venue":null,"work_id":"63b9f069-6505-40f2-8a01-b388a8407fa6","year":2019},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.778885Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:9ebb24af910cd44b823ee9349a9aac2bdcb83fe147c7ecb236c852b1b0725b8e","observation_id":"2cb7b0da-1c71-4f88-8b7c-1882fe37b1a2","resolution":{"observed_at":"2026-08-09T20:52:33.446354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-09T20:52:32.782297Z","title":"Mobilenets: Efficient convolu- tional neural networks for mobile vision applications","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.782297Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:0a96142bdd5a35bef47a467ac90fd9cb031ed50d734d841b296386672d9098d8","observation_id":"d523e870-252e-45c3-a07b-506ec5b6c7d1","resolution":{"observed_at":"2026-08-09T20:52:32.782297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.435119Z","title":"Trseg: Trans- former for semantic segmentation","venue":null,"work_id":"c18f6d01-e0e6-47a9-823e-5bd556bdc1d9","year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.786692Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:883d5b1c1e4a7804d38e5082a3d2d5c15df243c64d22c2de2dec54addcf4d914","observation_id":"c3572d09-d25e-4ce1-bfb4-f72d1f199eb5","resolution":{"observed_at":"2026-08-09T20:52:33.438262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.426652Z","title":"Metaseg: Metaformer-based global contexts-aware network for efficient semantic segmentation","venue":null,"work_id":"b1dbbe6b-2059-456c-b65c-d0a37f08ca0d","year":2024},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.789425Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:f1d4c26e215c8dc07184f2be55bee3c882a1300eb53b124f7b792c230fb9c922","observation_id":"665a89cf-4cb0-427e-a6db-e3d802a277e6","resolution":{"observed_at":"2026-08-09T20:52:33.429979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.417430Z","title":"Panoptic feature pyramid networks","venue":null,"work_id":"96a48835-9321-480a-9fd4-951092565ff5","year":2019},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.792108Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:c8d8c609eb51bcf4927bc5fe27c32ea9e93cf1994b77acf9c87abf49e5f1f412","observation_id":"e8074a48-93f7-458b-8412-903eaf28b859","resolution":{"observed_at":"2026-08-09T20:52:33.420827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.407971Z","title":"Dfanet: Deep feature aggregation for real-time semantic seg- mentation","venue":null,"work_id":"b390da91-0663-45ab-a116-a69b88d36adb","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.795389Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:4f98c04932ab970babe46146bdf9fb43a723bb5dd175b07e76a83edc7c16baf9","observation_id":"b8b01e1d-9c46-4995-b3c5-4045d31fde6b","resolution":{"observed_at":"2026-08-09T20:52:33.411389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.399148Z","title":"Convmlp: Hierarchical convolutional mlps for vision","venue":null,"work_id":"b0ddea4a-e902-4442-9947-030c552d2e90","year":2023},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.798169Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:e7e995c52a4651cfb6c7e495c5be3bb9dd7da598c2eccff7e1d3bb96f8113a37","observation_id":"cd32b43d-7eb3-4acb-9a2f-d053a6af07ef","resolution":{"observed_at":"2026-08-09T20:52:33.402512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.389627Z","title":"Partial order pruning: for best speed/accuracy trade-off in neural architecture search","venue":null,"work_id":"e3a06f75-a17a-4163-8f46-4745f0fa0f03","year":2019},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.801005Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:9b965f3c6bbfd30385d579a79b8994203c142c8e0df3c2bd6d6fb4a6e90400d2","observation_id":"b2cef2dc-d41a-484e-9e51-6acfa915825b","resolution":{"observed_at":"2026-08-09T20:52:33.393261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.380031Z","title":"Efficientformer: Vision transformers at mobilenet speed","venue":null,"work_id":"139b09fa-aa51-4ba3-9f65-20c48a1add67","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.803941Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:a78a5eb3c12a87a1eba6ecfadf31c8a8d1b5de9076671de5f056285c94160096","observation_id":"b79a9334-2a91-4125-bc89-c863149dda0d","resolution":{"observed_at":"2026-08-09T20:52:33.383473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.369567Z","title":"Re- thinking vision transformers for mobilenet size and speed","venue":null,"work_id":"167dbedc-84d5-46c0-b035-2abdc105b123","year":2023},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.806751Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:905210cf82053a2fc872b40a3ef35e326a729f4ba7178689300b7a123c2880a8","observation_id":"33658867-d8d3-481c-9dea-76df88573169","resolution":{"observed_at":"2026-08-09T20:52:33.372913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.810195Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.810195Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:8414dd3ca551bc0eb285763fb28b5556aa6002ec612829dad5215064dab13bdb","observation_id":"156377b7-1f9d-47e9-bf0c-e3f4f058ce2f","resolution":{"observed_at":"2026-08-09T20:52:32.810195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.354541Z","title":"Focal loss for dense object detection","venue":null,"work_id":"abd64d66-db5f-402c-9334-22ff48862c40","year":2017},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.813258Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:c689ec6285655c2096ff872f698f8d883d6b5742d4b20732a6f9909db25c4f0e","observation_id":"bfcedb53-c866-4ec8-942c-78b115cfda25","resolution":{"observed_at":"2026-08-09T20:52:33.358355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.816104Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.816104Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:3acfdfd35c9d52ed9c19e3a8c9e1467cf0c18aa42e06c1545d85fb2b321b7837","observation_id":"1713214f-3da7-4ccf-8765-75a69b099ab6","resolution":{"observed_at":"2026-08-09T20:52:32.816104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.339387Z","title":"Swin transformer v2: Scaling up capacity and resolution","venue":null,"work_id":"532280e4-299b-4c15-a21f-02dafa25f971","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.818801Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:c5d748f6462feb5a6eea51aa9088b7acff41285d385d1880774a6fdc92facb0f","observation_id":"13162c7e-d830-401a-90b3-8c6c4de78fdd","resolution":{"observed_at":"2026-08-09T20:52:33.342464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.330764Z","title":"Fully convolutional networks for semantic segmentation","venue":null,"work_id":"c3304abf-3f04-488a-b612-80db7b5f1eea","year":2015},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.821931Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:2926b419f06f46b566634776cfdf5844578ff4eb00cce46a1ac732a1e3971bab","observation_id":"bec53f12-8408-48c2-9dac-e9386183eccf","resolution":{"observed_at":"2026-08-09T20:52:33.334409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.320953Z","title":"Shufflenet v2: Practical guidelines for efficient cnn architec- ture design","venue":null,"work_id":"048c7f3a-dd0e-43be-b173-778d6ae60482","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.824856Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:7f6de0504402cb6ca25454e2b2c67837d4b12ea71113b1ec594e233720c28c40","observation_id":"9c9d3138-29a9-4bf8-a9ab-72f68038c8a6","resolution":{"observed_at":"2026-08-09T20:52:33.324654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02178","last_updated":"2022-03-04T17:17:31Z","snapshot_observed_at":"2026-07-06T11:54:38.041673Z","submitted_at":"2021-10-05T17:07:53Z","title":"MobileViT: Light-weight, General-purpose, and Mobile-friendly Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02178","snapshot_observed_at":"2026-08-09T20:52:32.827838Z","title":"Mobilevit: light- weight, general-purpose, and mobile-friendly vision trans- former","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.827838Z"},"links":{"cited_paper":"/paper/2110.02178","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:cf4331f9a42eea3049f5b07b720c451098f887d3f849e4e59acbbfdc335707e0","observation_id":"a370ae29-0aca-488d-bce3-00d361354e5d","resolution":{"observed_at":"2026-08-09T20:52:32.827838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02680","last_updated":"2022-06-06T15:31:35Z","snapshot_observed_at":"2026-08-10T13:32:44.952895Z","submitted_at":"2022-06-06T15:31:35Z","title":"Separable Self-attention for Mobile Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02680","snapshot_observed_at":"2026-08-09T20:52:32.830789Z","title":"Separable self- attention for mobile vision transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.830789Z"},"links":{"cited_paper":"/paper/2206.02680","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:40964ffc60002cc3a729df5515e45e989074e13e2a25effde4670d936c3a811f","observation_id":"4b7d7983-24ca-4ce7-8afd-52914d7b8201","resolution":{"observed_at":"2026-08-09T20:52:32.830789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.311434Z","title":"Espnetv2: A light-weight, power ef- ficient, and general purpose convolutional neural network","venue":null,"work_id":"e4501bd0-d2c0-428b-ab7d-20ed14ce8cbc","year":2019},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.834510Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:19676173216e699f36f09706f025be4be2c2ee6966d8c7a580579eb888fb3d11","observation_id":"8ccc05f8-59b2-403c-8380-32d020e31f15","resolution":{"observed_at":"2026-08-09T20:52:33.314779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.302197Z","title":"Review the state-of-the-art technologies of semantic segmentation based on deep learning","venue":null,"work_id":"530a81dc-2ea3-4a5e-809e-f319b2d1dd84","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.837315Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:741c2cbfbff6e8f98d5931c880f8ea7962db96473d42fbb0e044333fe66b93dc","observation_id":"94d100e6-5b03-4a10-8f23-71e2cf688850","resolution":{"observed_at":"2026-08-09T20:52:33.305639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.292901Z","title":"The role of context for object detection and semantic segmentation in the wild","venue":null,"work_id":"05b723b7-9ac1-4d8e-bca8-e991afa4d814","year":2014},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.840293Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:2c37c1a509ecf5b23b1ed63840db9ffd97dd8928e99035ca4ac5d1e6d22b1fe4","observation_id":"b5784797-4126-4dea-acf3-08006712bc4d","resolution":{"observed_at":"2026-08-09T20:52:33.296528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06228","last_updated":"2024-07-18T07:52:18Z","snapshot_observed_at":"2026-07-06T18:12:26.233112Z","submitted_at":"2024-05-10T03:42:46Z","title":"Context-Guided Spatial Feature Reconstruction for Efficient Semantic Segmentation","version":2},"cited_work":{"arxiv_id":"2405.06228","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.06228","snapshot_observed_at":"2026-08-09T20:52:32.981169Z","title":"Context-Guided Spatial Feature Reconstruction for Efficient Semantic Segmentation","venue":"cs.CV","work_id":"1811562e-5a52-4afb-87cf-9023ff7643e7","year":2024},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.843334Z"},"links":{"cited_paper":"/paper/2405.06228","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:925dfe8e5a4332f48f4a65bfade570f29d52a44d222db3eeb969318df9bec2ec","observation_id":"2b66a459-d47c-46cc-af2a-a3a12e957a06","resolution":{"observed_at":"2026-08-09T20:52:32.986482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.282981Z","title":"Edgevits: Competing light-weight cnns on mobile devices with vision transformers","venue":null,"work_id":"f9c77bc4-0bb9-4183-8fb0-be165fa7de0c","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.846622Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:ec5e18679575e655da0ab5e776bea337b883c4b970ec82010f965590b5ecd05e","observation_id":"ae8435f5-3ffa-4877-ae14-b3bd08d9eef5","resolution":{"observed_at":"2026-08-09T20:52:33.287047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.02147","last_updated":"2016-06-07T14:09:27Z","snapshot_observed_at":"2026-08-01T15:22:37.552585Z","submitted_at":"2016-06-07T14:09:27Z","title":"ENet: A Deep Neural Network Architecture for Real-Time Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.02147","snapshot_observed_at":"2026-08-09T20:52:32.849312Z","title":"Enet: A deep neural network architec- ture for real-time semantic segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.849312Z"},"links":{"cited_paper":"/paper/1606.02147","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:9bcb55c64f938bc2319d884e9f768ed412f153dccc3c9f7549eadf777152c25d","observation_id":"ce56c2e4-445b-4475-83ce-97a66d0a7874","resolution":{"observed_at":"2026-08-09T20:52:32.849312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.273539Z","title":"Erfnet: Efficient residual factorized convnet for real-time semantic segmentation","venue":null,"work_id":"34368486-d0a7-412f-8934-4195fca7b1a8","year":2017},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.852291Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:935f4a134a2ec0c7b845b507c967cd2b1336d91130e3d847edfe2ec567c10325","observation_id":"f7aadef9-b9bc-4b88-91c3-6d23bd5192e7","resolution":{"observed_at":"2026-08-09T20:52:33.277427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.855519Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.855519Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:d72ba32ea1ecadbeb62b53b0963bd607d6cbd38eb1a0d4247c40b599e97d90af","observation_id":"06649997-c4b0-4e5e-a0ef-2a43fad4a9d0","resolution":{"observed_at":"2026-08-09T20:52:32.855519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.257867Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks","venue":null,"work_id":"a7df01c7-c57b-45a6-a826-9adff4c7d68c","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.858298Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:deee783898387c26506e9cba55785ae2e3235f09625d291f53d428aa0919999f","observation_id":"054c9d28-826f-43a6-8f0e-f4750dd357f8","resolution":{"observed_at":"2026-08-09T20:52:33.261541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.248283Z","title":"Ssformer: A lightweight transformer for semantic segmentation","venue":null,"work_id":"300e770d-972a-47c9-8e95-771a134de1a2","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.860887Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:8015826741af8ae6c288f1be053885e932cfc4eda1f326f9e6716bdba81e86d2","observation_id":"7b5fcc8f-2133-42c7-81f3-aeb874178e9c","resolution":{"observed_at":"2026-08-09T20:52:33.251897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.238705Z","title":"Feedformer: Revisiting transformer decoder for efficient semantic segmentation","venue":null,"work_id":"87c2f4dc-a7f0-4181-99eb-54069fac075f","year":2023},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.863646Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:8b8fd9f69b147c7f9a4a36ab21a7d11a0e2dca7d16f9d1b004dd665aaa07ce2d","observation_id":"718222f4-dbca-4b9e-ac6f-84d3867bd560","resolution":{"observed_at":"2026-08-09T20:52:33.241864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.866238Z","title":"Deep high-resolution representation learning for human pose es- timation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.866238Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:61f6fee8f30cf84f2110dc6cbea824f3e150620b9281dd88a0c94abd9c519f5b","observation_id":"1b9f968b-62b6-45a6-b006-2149b73ae7bf","resolution":{"observed_at":"2026-08-09T20:52:32.866238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.869177Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.869177Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:43017a69a7bb19e5637f92185468b4b31357327dc280c3a760e0c16f1b977d44","observation_id":"235b48a2-7a87-4d04-9365-9b1c6a7a9ff9","resolution":{"observed_at":"2026-08-09T20:52:32.869177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.872049Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.872049Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:aa233ffb4f59a7a8401254ffb27f633c6bc0b18de70c99d47f6d957ba9c0f929","observation_id":"45d2624c-477e-4665-b4c2-f3c266b55dc6","resolution":{"observed_at":"2026-08-09T20:52:32.872049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.215723Z","title":"Seaformer: Squeeze-enhanced axial transformer for mobile semantic segmentation","venue":null,"work_id":"5272f8a9-2347-40d8-aa72-7b3497bd734b","year":2023},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.875691Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:254c3d9781e66df6584794a3e13ff736b32071d4c05e610dfd8eca7a1340bc55","observation_id":"f81f2574-65fb-4812-beb1-ee8c110d5651","resolution":{"observed_at":"2026-08-09T20:52:33.219458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.205534Z","title":"Deep high-resolution repre- sentation learning for visual recognition","venue":null,"work_id":"fa987b48-636e-4b37-a6b2-65812c792085","year":2020},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.878686Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:1e14353d261f552b87380de9413d25522abec98b7a27d63c3ec5f7278651bd12","observation_id":"12c09c6b-79bf-4688-889f-4d622fde9f9f","resolution":{"observed_at":"2026-08-09T20:52:33.208942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.194818Z","title":"Rtformer: Effi- cient design for real-time semantic segmentation with trans- former","venue":null,"work_id":"cc04a887-7a16-486a-893d-59fd73ecec31","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.881374Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:50de7f8f147dd4546d8b761d1ac6d007f429326e977d624c84daff5f06bd2926","observation_id":"3e59b35b-e694-427b-88b3-2e92ad738f9b","resolution":{"observed_at":"2026-08-09T20:52:33.198173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.183385Z","title":"A novel transformer based se- mantic segmentation scheme for fine-resolution remote sens- ing images","venue":null,"work_id":"61e1f009-12c4-4615-92d1-8d99f5ccb1df","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.884689Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:c953c0cc07b0ef9053685369b2df70d6fb3c9411c26dd3fea2857a05c2fc47ed","observation_id":"c8750d39-a361-4944-8ae6-0f1a4304b173","resolution":{"observed_at":"2026-08-09T20:52:33.188566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.173392Z","title":"Segformer: Simple and efficient design for semantic segmentation with transform- ers","venue":null,"work_id":"7e902427-f9e3-412e-b8c6-7ddba3d3d100","year":2021},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.888173Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:3cade1a7228ff189db5a484f0f24149075084b29c0ab1b7ec6b43015a0040fb3","observation_id":"7d061a8d-d6ea-45d0-b3d1-b12e4dda31a7","resolution":{"observed_at":"2026-08-09T20:52:33.176991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06272","last_updated":"2023-12-11T10:19:42Z","snapshot_observed_at":"2026-08-04T06:00:12.958711Z","submitted_at":"2023-12-11T10:19:42Z","title":"U-MixFormer: UNet-like Transformer with Mix-Attention for Efficient Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06272","snapshot_observed_at":"2026-08-09T20:52:32.890935Z","title":"U-mixformer: Unet- like transformer with mix-attention for efficient semantic segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.890935Z"},"links":{"cited_paper":"/paper/2312.06272","citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:41f9e29af1a1167f431e73ffb284a84f45e60a5ccfa0b9e5994d4aaab414e2d9","observation_id":"145e7115-397a-458b-bf8e-b3a49ea6c189","resolution":{"observed_at":"2026-08-09T20:52:32.890935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.164621Z","title":"Bisenet: Bilateral segmentation network for real-time semantic segmentation","venue":null,"work_id":"9a512e0a-614f-4c27-8a24-5caba3956ee3","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.894963Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:632ef059a4aec35c24fdde2c5ace2410706afbdc43340a1f0436571670ff7519","observation_id":"f578d2d7-f011-4083-96ef-5efc25434e7b","resolution":{"observed_at":"2026-08-09T20:52:33.167741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.897890Z","title":"Tokens-to-token vit: Training vision transformers from scratch on imagenet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.897890Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:60c2299d837e2f62a857e7f1c304aa7f6bb3bdc5bb41a3e307843e9824b02604","observation_id":"2c0d11ed-68e2-41b3-88f5-086003eb2737","resolution":{"observed_at":"2026-08-09T20:52:32.897890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:32.901187Z","title":"Object- contextual representations for semantic segmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.901187Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:2cd7705e455419368755e3c0acaf22196ae2836e14b9f3462142b15f2d50de1c","observation_id":"e47590dc-1e5e-4351-aa7e-b91a9acf238a","resolution":{"observed_at":"2026-08-09T20:52:32.901187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.147477Z","title":"In- terleaved group convolutions","venue":null,"work_id":"3fb8f88f-f002-4e43-84d5-1c50e989cf96","year":2017},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.903931Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:3a450879322f378bee8b799f5e2a2d9faf421953f6b4afa6857fbd53ad4e6551","observation_id":"919964a3-c2df-4faa-9c1a-10ce36d4511e","resolution":{"observed_at":"2026-08-09T20:52:33.150319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.136897Z","title":"Topformer: Token pyramid transformer for mobile semantic segmentation","venue":null,"work_id":"98346c5b-173e-41c3-a963-7c5d370e9de1","year":2022},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.906670Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:dafaa8e618dd0b24506e47b5c799296f296fdd34cd4ea2967d100c64c6a659b8","observation_id":"628af007-c6d2-4ddb-a215-1d953079d6ef","resolution":{"observed_at":"2026-08-09T20:52:33.140101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.126757Z","title":"Shufflenet: An extremely efficient convolutional neural net- work for mobile devices","venue":null,"work_id":"d95af797-23f0-4f95-a19a-91b492ec8b67","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.910107Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:6a10b439e6f09b520d4047058a1460369e6e932576fa89fe2a8f84f0eba1571e","observation_id":"3d0a632a-46bd-44a2-86c6-d5f570ceb92f","resolution":{"observed_at":"2026-08-09T20:52:33.130112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.117042Z","title":"Pyramid scene parsing network","venue":null,"work_id":"db708eb5-40c1-4c57-aa47-818b7e3686ad","year":2017},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.912951Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:2e1a841e00079ccd5fa1aff931f20abec4a9bd07161cbb7e0f24c9b120eee382","observation_id":"0a7e57bd-7fec-4b6e-a19d-3a113d338f1c","resolution":{"observed_at":"2026-08-09T20:52:33.120137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.107696Z","title":"Icnet for real-time semantic segmenta- tion on high-resolution images","venue":null,"work_id":"b9a0d88a-b2fb-4298-be21-d24b4753e4c6","year":2018},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.915639Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:f7cf94a3c88f6954ad4817407a8ef0fa80f1c0f0de918c6e5a02aac5d61f831a","observation_id":"9901eadf-3dee-4d49-a39c-523d574c95fa","resolution":{"observed_at":"2026-08-09T20:52:33.110841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.098331Z","title":"Scene parsing through 11 ade20k dataset","venue":null,"work_id":"1892e3c5-0409-4c8c-aaec-e40a44408c5c","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.918807Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:abd75821d9489408894f1a711291833872e17235ff9cc8f067ac41a2a82f004f","observation_id":"6f857141-cf12-43fe-ac04-959070bd3759","resolution":{"observed_at":"2026-08-09T20:52:33.101926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.088118Z","title":"Rethinking bottleneck structure for efficient mobile network design","venue":null,"work_id":"f7ccf10f-e768-40db-a473-eb9d89044808","year":2020},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.921527Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:2a08785d0b44a57fa066252c344e4e53f84391f4ec93d5a55e75fbd647412f73","observation_id":"d4092ebf-24c0-46e5-8e64-b25cdb7fc626","resolution":{"observed_at":"2026-08-09T20:52:33.091402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.078875Z","title":"Biformer: Vision transformer with bi-level routing attention","venue":null,"work_id":"04775478-3bb8-450d-a299-da09be2b7b81","year":2023},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.924966Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:68d8d3beb450ec537394aebd7e05db0fa11e53176b76d5b4bc7d2d968ab91a61","observation_id":"031b5f8e-6552-482c-84e1-fe9a8113364d","resolution":{"observed_at":"2026-08-09T20:52:33.082105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.069730Z","title":"As demonstrated in Fig","venue":null,"work_id":"cc676d63-ac86-4ceb-b971-1da394ed4b04","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.928153Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:97db4b837311e228c41f550176b16014d01655fa21be621cdcb338083779d61d","observation_id":"ed5fcef9-0212-4e08-8f91-d284450b4582","resolution":{"observed_at":"2026-08-09T20:52:33.072516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.061127Z","title":null,"venue":null,"work_id":"ce1e2417-8d9c-4def-be4b-285ec2995056","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.931187Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:457b231ad23d5088d3601b35da9501293a4f22d7a941b3f9190a0df2f97cc300","observation_id":"ceb2eb99-eba3-4fb5-92e3-54be1156681d","resolution":{"observed_at":"2026-08-09T20:52:33.063986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.052519Z","title":null,"venue":null,"work_id":"49f021aa-0fa6-4b75-baa3-7b2027138995","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.934034Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:14ecbfea2696d2ae69d22c9648195cb1846b4fed4b6520d4552307fe86921a07","observation_id":"020a4226-ce03-4011-96bf-bc481f1d8df5","resolution":{"observed_at":"2026-08-09T20:52:33.055506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.041841Z","title":"C shows additional visual results of the proposed Con- textFormer model with original images, ground-truth, Top- Former, and ContextFormer (GM E)","venue":null,"work_id":"d6c14739-0703-49cf-8e78-68bc3ef9f0c2","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.936747Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:f41da280cba46111492b1134ea67b4d7154a9567f845ca9a37a85a3a871a9f6d","observation_id":"56c93e3c-1744-4918-88a6-7f260f951c62","resolution":{"observed_at":"2026-08-09T20:52:33.045891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:52:33.032184Z","title":"However, cer- tain limitations warrant further investigation","venue":null,"work_id":"b85b4492-9b59-4723-9002-ba292b366043","year":null},"citing_paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T20:52:32.939566Z"},"links":{"citing_paper":"/paper/2501.19255"},"observation_digest":"sha256:b1aa040e62523475753034adce342af19aff9b5b7d69d12635fce301ec0c2144","observation_id":"89c31889-6707-4458-aa9e-78349f4e6bd8","resolution":{"observed_at":"2026-08-09T20:52:33.036062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.19255","last_updated":"2025-03-09T14:00:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T20:45:38.477465Z","submitted_at":"2025-01-31T16:11:04Z","title":"ContextFormer: Redefining Efficiency in Semantic Segmentation"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":56},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2501.19255."}