{"as_of":"2026-08-11T17:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3140718be2e51f79daeab024c6e9aae38d06d2dc1d52f42e806311dd7c3b6038","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:06:59.593165Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.14535/citation-record","integrity":"/paper/2501.14535/integrity","json":"/paper/2501.14535/citation-record.json","paper":"/paper/2501.14535"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:07:00.010866Z","title":"Vision trans- formers for dense prediction,","venue":null,"work_id":"5c4b0f79-a6c5-4c1d-b901-f052b0e16e7d","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.463606Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:2de1ef34d1d61ecb59618093cda26300c447ca1c0eb030721a78898de37d443e","observation_id":"ab59d56d-c1e1-4879-8da0-ab204d237580","resolution":{"observed_at":"2026-08-10T15:07:00.018182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-10T15:06:59.468124Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.468124Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:3377478ba34b656113bf2d29303e04748aeb0e95df48929fda1a4945347af61f","observation_id":"0042a627-bb2c-434b-992c-d92c6ee4683c","resolution":{"observed_at":"2026-08-10T15:06:59.468124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.994675Z","title":"RefineNet: Multi-path refinement networks for high-resolution semantic segmenta- tion,","venue":null,"work_id":"84ac1833-7189-457c-b180-ad27b051fbd0","year":2017},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.472325Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:60746921564630fc8758bff553830e193d14d6c40d111cdf63ad5c1aa4e47f22","observation_id":"f93e330a-4bd0-4eab-8d99-207733666ea2","resolution":{"observed_at":"2026-08-10T15:06:59.998882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.984107Z","title":"Eva: Exploring the limits of masked visual representation learning at scale,","venue":null,"work_id":"79a2ba30-dffd-458a-871c-b33922ba8ff2","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.477122Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:0231b5a7afdf0ad828abe64018b8bf6f70a6d4b5b406d7373465ed0bcdd00a81","observation_id":"060f2921-613e-41ea-b129-aac012b674ab","resolution":{"observed_at":"2026-08-10T15:06:59.987597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.973432Z","title":"Depth anything: Unleashing the power of large- scale unlabeled data,","venue":null,"work_id":"042356f7-dec8-491a-aac6-65a40485de5f","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.481829Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:2c25e9d8f79434ee2f3e628937de127c087e92a51782d4d2b2cfa9bae423e013","observation_id":"bbfad913-ac07-4424-9235-10b6153a80e4","resolution":{"observed_at":"2026-08-10T15:06:59.976797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.963726Z","title":"Repurposing diffusion-based image generators for monocular depth estimation,","venue":null,"work_id":"67e19366-b409-46de-98e2-8bbfef6d7b09","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.486243Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:45c0bc91edc5aaefd5a0990af40571c248328b04234387dc448add41f9935032","observation_id":"64afed73-17f2-4291-a194-3bd92e96a43c","resolution":{"observed_at":"2026-08-10T15:06:59.966993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-10T15:06:59.491556Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.491556Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:5fc46ff9ad4ce6b867277e7094563fad40d1937d8c46f6f41b60cfcebd88b460","observation_id":"876ec342-8c97-4bbf-95ed-6b3fa1c90ba8","resolution":{"observed_at":"2026-08-10T15:06:59.491556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14460","last_updated":"2023-07-26T19:01:49Z","snapshot_observed_at":"2026-08-05T14:21:33.902926Z","submitted_at":"2023-07-26T19:01:49Z","title":"MiDaS v3.1 -- A Model Zoo for Robust Monocular Relative Depth Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14460","snapshot_observed_at":"2026-08-10T15:06:59.496317Z","title":"Midasv3. 1–a model zoo for robust monocular relative depth estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.496317Z"},"links":{"cited_paper":"/paper/2307.14460","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:b6221a22609f074dbc8ba419904940659fdb11799180c28b37a269be6bb2bea8","observation_id":"3d4aab51-528c-4e60-91ac-5185b1e4ef12","resolution":{"observed_at":"2026-08-10T15:06:59.496317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-10T15:06:59.500958Z","title":"Zoedepth: Zero-shot transfer by combining relative and metric depth,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.500958Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:76a62e247af02f998fc5a9631c5a07574cb0fabc073ca6fe4d2aea85fdfe6908","observation_id":"0e896ab9-8f0d-4412-b394-816cbfe07e82","resolution":{"observed_at":"2026-08-10T15:06:59.500958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13788","last_updated":"2024-12-19T17:51:42Z","snapshot_observed_at":"2026-08-10T12:27:58.880216Z","submitted_at":"2024-03-20T17:51:53Z","title":"DepthFM: Fast Monocular Depth Estimation with Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13788","snapshot_observed_at":"2026-08-10T15:06:59.504757Z","title":"Depthfm: Fast monocular depth estimation with flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.504757Z"},"links":{"cited_paper":"/paper/2403.13788","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:ce33e94a956c63cedce4ba9af334f10c33d2f40bddb3803768979f4364edb43c","observation_id":"01cbb2bb-fb1a-4a58-9fff-0290ed21ff4c","resolution":{"observed_at":"2026-08-10T15:06:59.504757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.954131Z","title":"Bins- former: Revisiting adaptive bins for monocular depth estimation,","venue":null,"work_id":"abceb8e1-0f48-4c42-99d1-c90fb56dbe1d","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.508892Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:fa98a5218c3809a198a9062145d8311c3c9eb9a962f34f6c63da96b7c6fee3bb","observation_id":"c401638b-fbc7-4514-9d88-854889d52861","resolution":{"observed_at":"2026-08-10T15:06:59.957239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.943163Z","title":"Ad- abins: Depth estimation using adaptive bins,","venue":null,"work_id":"4d7a9c07-518d-4487-8e93-cbdcd86ca856","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.515730Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:6e10966f180a79b913b7973bf55966450030467cb3dabd554d2be6bdbe467e0f","observation_id":"313e1eb8-e4cb-4400-985d-7215f594657b","resolution":{"observed_at":"2026-08-10T15:06:59.947053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.930930Z","title":"Shvit: Single-head vision transformer with memory efficient macro design,","venue":null,"work_id":"dfbeb3ef-05e6-4edf-a584-07606f32f682","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.518878Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:ee56528d167fd7579eeb486f76bdeeb81279e9a22fc6452f312ba9c4136b84e8","observation_id":"792b4371-b577-453f-b0ca-a62aee7388aa","resolution":{"observed_at":"2026-08-10T15:06:59.935246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.919608Z","title":"Fast vision transformers with hilo attention,","venue":null,"work_id":"5af25662-14ab-42a3-956d-0eaa8cfe57f2","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.522915Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:8695bcae72697426b9648aaa2e5a69aeaa046196df840e3c765db04ad89f071b","observation_id":"7ed27f85-5c3a-4919-9096-5e8949479743","resolution":{"observed_at":"2026-08-10T15:06:59.923495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.907729Z","title":"Swin transformer: Hier- archical vision transformer using shifted windows,","venue":null,"work_id":"b0e23e4d-b1c8-42d1-9307-291b9293c6af","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.526043Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:23c70fcbfcaada3c1b12fb8f5d707ebdf53aa6c9adbbb77d59ec09ed1fa1e38a","observation_id":"d460affb-467a-4c40-8cb4-2ee8c556360e","resolution":{"observed_at":"2026-08-10T15:06:59.911904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.895571Z","title":"Swin-unet: Unet-like pure transformer for medical image segmentation,","venue":null,"work_id":"737a36db-24aa-442a-b342-645e31d9776b","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.530238Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:b9c1679150ed3aa40912cf1285f7bf2ffcb221a4811cea2a16c62feff775206c","observation_id":"bb2f93d3-02d7-4c9f-a569-65a5434e0051","resolution":{"observed_at":"2026-08-10T15:06:59.899885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.883008Z","title":"Efficientformer: Vision trans- formers at mobilenet speed,","venue":null,"work_id":"fdc4ecf2-0491-49fc-87d0-53875e5dd114","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.534916Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:01e6451e21f4627a823c7cf701ee3e1723997904872f7882029dec119733aa5d","observation_id":"5e54d188-d6be-4535-a486-8631216ae583","resolution":{"observed_at":"2026-08-10T15:06:59.886239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.873338Z","title":"Swiftformer: Efficient additive attention for transformer-based real-time mobile vision applications,","venue":null,"work_id":"8ed7e4b0-ca0c-42b6-820b-25eaa757e9d2","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.539526Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:11334bab052aaeabea9085143ad123d4e9559d17ae99e9cfad41a0054993d999","observation_id":"d45a0931-ebc7-485a-8c96-4a0c31fa138a","resolution":{"observed_at":"2026-08-10T15:06:59.876699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.861836Z","title":"Fastvit: A fast hybrid vision transformer using struc- tural reparameterization,","venue":null,"work_id":"3f727952-2dce-498d-8aa3-28999086ea96","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.543625Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:57664d5de3299f25c68b1a2af1e5a26436f204374030b8b354b18c749d844500","observation_id":"b167f16a-a848-4c81-819e-8733562d28f7","resolution":{"observed_at":"2026-08-10T15:06:59.865084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.849822Z","title":"Repvit: Revisiting mobile cnn from vit perspective,","venue":null,"work_id":"fdbb5c0a-231b-49af-8437-c2c02acedc28","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.547471Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:ac4fc18df8b74617b1d201b4ba1b5d6f317ab4c4d653be5a8d814a0848fb4d13","observation_id":"269cce47-0bd5-417b-b29f-c81370b1a5a1","resolution":{"observed_at":"2026-08-10T15:06:59.853908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.838503Z","title":"Segformer: Simple and efficient design for se- mantic segmentation with transformers,","venue":null,"work_id":"b4174f24-edc5-42c2-8fce-e1478741c211","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.551479Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:430b2fb94970f82da855f540d5c95a9798c6dc2eed891a01414fd2e92d3505d5","observation_id":"6a1f778a-f50b-4054-b837-341c6ca73cf6","resolution":{"observed_at":"2026-08-10T15:06:59.842777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.825643Z","title":"Segmenter: Transformer for semantic segmentation,","venue":null,"work_id":"95c649e9-3b7b-4732-b7d3-39b77379f2b7","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.555872Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:cd7a2956fff750abb399b1ae06b49e2822e0c6f55edecd65f79902ffa6155f5d","observation_id":"fba264c2-d66b-4ac4-9ca6-3b0eecb59c35","resolution":{"observed_at":"2026-08-10T15:06:59.830495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.810842Z","title":"More than encoder: Introducing transformer decoder to upsample,","venue":null,"work_id":"8656593c-8262-4b35-b7ce-4872c2a8ded3","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.560947Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:edd00b41fb6fdd4499576f061606a0d0d744b791cb7f2835dc44db60bacca7de","observation_id":"a46b2914-2327-485a-a791-6cce23382a2f","resolution":{"observed_at":"2026-08-10T15:06:59.816265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02957","last_updated":"2024-07-22T09:07:27Z","snapshot_observed_at":"2026-08-10T19:06:52.473039Z","submitted_at":"2024-01-05T18:59:52Z","title":"Denoising Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02957","snapshot_observed_at":"2026-08-10T15:06:59.564819Z","title":"Denoising vision transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.564819Z"},"links":{"cited_paper":"/paper/2401.02957","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:cfbd4379d993e0ac757886513df1c7b83185e8b2f65a0cf97527b1eb2d5397ea","observation_id":"14cdf7e4-2780-454a-a415-fefcdba6bcf5","resolution":{"observed_at":"2026-08-10T15:06:59.564819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.799423Z","title":"Learning to upsample by learning to sample,","venue":null,"work_id":"9652caf4-1dc7-4079-85dc-db67cfeb23c6","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.568972Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:a20646f5bc9b1524d0248365af3b4bade42a62dadde3e27d6b50a8b50b5e7b74","observation_id":"434e7862-d873-42d9-9f9f-8d3582019d0c","resolution":{"observed_at":"2026-08-10T15:06:59.803185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.788008Z","title":"Imagenet-21k pretraining for the masses,","venue":null,"work_id":"7670b4c7-cb9c-4866-aa93-f41e51dbdfa3","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.572097Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:f856c4db94b1c4a4b62b1a7df85eea2e1121cbf967b07c0f1ff699cce55b38c8","observation_id":"d5b6f143-37b5-4c7b-8a89-43bb81a5d63c","resolution":{"observed_at":"2026-08-10T15:06:59.791769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.777072Z","title":"Indoor segmentation and support inference from rgbd images,","venue":null,"work_id":"e1204b08-f3e5-4be8-a412-1a614f6c708e","year":2012},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.575338Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:c4246f97fb7fcc023404665f2366f360b9bce1024cbf10c7e7bc0369279c1bad","observation_id":"a6163c73-4605-44a6-8945-63adcf640615","resolution":{"observed_at":"2026-08-10T15:06:59.781025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.764235Z","title":"Learning the depths of moving people by watching frozen people,","venue":null,"work_id":"1db03e53-6f3e-453a-9a17-285e495af1be","year":2019},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.578339Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:fa04a1c05a956b28c924c86869d980a7fa6b96754292cf6dc6b0c4a2c7697de9","observation_id":"ee294dc1-6015-427e-9e52-bfb42f18b10f","resolution":{"observed_at":"2026-08-10T15:06:59.768155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.751013Z","title":"Irs: A large naturalistic indoor robotics stereo dataset to train deep models for disparity and surface normal estimation,","venue":null,"work_id":"174bed82-ba7c-450c-a8f6-3b46b4f41e3d","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.581949Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:16aa60b8cf5f29794516a563cc98bd4df6cde910801962578a01c0052bc5aab4","observation_id":"b969f40a-ddf2-4f81-a8bd-9eb4f46e60e7","resolution":{"observed_at":"2026-08-10T15:06:59.755471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.736126Z","title":"Hypersim: A photorealistic synthetic dataset for holistic indoor scene understanding,","venue":null,"work_id":"d46e319b-7b36-4899-a5e5-186b48040964","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.585759Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:8acc829a9967876ee2867ec037e6bf55d85746d432654aea8b15ce2309af3c5a","observation_id":"21cc9aba-e41b-4218-80f4-d3a6f9df9fa7","resolution":{"observed_at":"2026-08-10T15:06:59.742261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.720705Z","title":null,"venue":null,"work_id":"6044b8d2-bb61-4f00-a124-3de678e8e8ea","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.589399Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:424e5cb74e214e1419b687c566f36a70dd2a08df857ad9369a60cd2670048aad","observation_id":"5b102dc6-554f-414d-97d7-97c3a8ac3b55","resolution":{"observed_at":"2026-08-10T15:06:59.725072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.702488Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale,","venue":null,"work_id":"f9464884-b5e9-4440-9c30-d3ecceb382e8","year":1956},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.593165Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:d4bb54f6bd45634a2e43d7ff3bbeeb208847bcf964981f0cd72db7fbcd1b49c3","observation_id":"3093b120-ccb8-41f2-8c36-5282fe4a2fd8","resolution":{"observed_at":"2026-08-10T15:06:59.710981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T13:48:31.664409Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2501.14535."}