{"as_of":"2026-08-09T14:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80817a79d56a011d58271a90c42c07c213f19321434d01e5359c0fabfaddfa28","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:03:48.913339Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05393/citation-record","integrity":"/paper/2608.05393/integrity","json":"/paper/2608.05393/citation-record.json","paper":"/paper/2608.05393"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.339162Z","title":"primitive","venue":null,"work_id":"2b767756-e4bc-4de1-b972-c108668b1792","year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.869981Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:97e6e533d99cf4bb030b9b11e11a9d1eac083354c8db16a8a743f32a57617f01","observation_id":"007d7ace-e45c-4b6e-9618-0a166ce39465","resolution":{"observed_at":"2026-08-08T14:03:49.342326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.330125Z","title":null,"venue":null,"work_id":"8b57bf0c-d84b-463b-972f-1945fc5a03fb","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.873254Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:15ad7b5bc926a80fdcbdc11d42d5e63f591f9e983139fe2417550944838abdd9","observation_id":"6886c918-f025-4bca-be45-9a8b6866294a","resolution":{"observed_at":"2026-08-08T14:03:49.333093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.321099Z","title":"primitive","venue":null,"work_id":"96e299c8-9c14-4687-bf4d-2b46c6ae89a3","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.876423Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:8875e1da5098890d42f6a21e1b01674027aebab72ba18a8a68e311d8dd22e8ad","observation_id":"a764c40d-b392-4f25-a717-ccb78d0af3b0","resolution":{"observed_at":"2026-08-08T14:03:49.324270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02937","last_updated":"2023-06-30T22:51:42Z","snapshot_observed_at":"2026-07-06T12:57:32.819460Z","submitted_at":"2022-04-06T16:55:41Z","title":"Last Layer Re-Training is Sufficient for Robustness to Spurious Correlations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02937","snapshot_observed_at":"2026-08-08T14:03:48.840262Z","title":"Densely connected convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.840262Z"},"links":{"cited_paper":"/paper/2204.02937","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:4c5dbb68f2b2e3412ceb70fee407373bfe5401082fb04a3b229163aac3f464a8","observation_id":"fba6afec-f057-4d1f-a089-a0f1e2f49260","resolution":{"observed_at":"2026-08-08T14:03:48.840262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:48.848201Z","title":"CDMask: Change customized mask architecture for change detection.IEEE Transactions on Geoscience and Remote Sensing, 64:5619919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.848201Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:6b95a2d647df31e22bbbd049d9201747b6a19d49ba4ac36aa002bdfe42a9ff01","observation_id":"11093d44-0022-4b97-b171-99cb1296bf25","resolution":{"observed_at":"2026-08-08T14:03:48.848201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:48.861936Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.861936Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:7d1244b953c08dcb12cf7957e35fd8121367431ac2764c97cc54d5ce922df30a","observation_id":"5d09e578-76df-4764-ae29-2f035efb64e3","resolution":{"observed_at":"2026-08-08T14:03:48.861936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-09T06:48:42.729935Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-08T14:03:48.865549Z","title":"Extract-Once","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.865549Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:6d2dba48490e1d606484d0be6659a2db5636abc45bb41b0e85ce91ed84da4041","observation_id":"76517eef-6970-4d1a-ad27-f0ab7844e8e2","resolution":{"observed_at":"2026-08-08T14:03:48.865549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.312914Z","title":"Color is one of the most expressive and invariant visual cues, robust to rotation and scaling (Swain & Ballard, 1991)","venue":null,"work_id":"311b97a3-4afd-4bf7-a0ce-63dd1fa4fdce","year":1991},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.879958Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:ea1f2a5033343835b43741b44bf944e35bbe19262ab803657590b8e98993dd49","observation_id":"1cb30ac1-91fe-49ba-88ff-70b4644f0f15","resolution":{"observed_at":"2026-08-08T14:03:49.315792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.304654Z","title":"Texture analysis is crucial for distinguishing materials and repetitive patterns","venue":null,"work_id":"0059beaf-ce1f-41da-99ef-2b87c4fb3eea","year":1996},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.882590Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:2d344caece019990bab29d6ebba1980e93b6d098ec73ccda889d5ccc1085e6bb","observation_id":"906e8e4e-50c5-4599-9ff3-85ca30dd78b2","resolution":{"observed_at":"2026-08-08T14:03:49.307572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.296365Z","title":"texture bias","venue":null,"work_id":"666ba8eb-99f5-4833-a87f-8703a3000c7b","year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.885471Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:64ca64e341ca7ef0d1aab16e14abd6af239db9270b708a65227a6e0597115186","observation_id":"02e4a158-934d-4833-a596-e1f4af590d62","resolution":{"observed_at":"2026-08-08T14:03:49.299115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.287444Z","title":"Removing any single component results in an information void that the randomized prompts alone may struggle to fill (as evidenced in Table 5 of the main text)","venue":null,"work_id":"31c43414-0ea5-466f-bd31-342435b0ca8f","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.888017Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:e173b34f70ff92c896c068fbd01079cdba7e7b8b00abed9aaeb0f2170a8e3a47","observation_id":"64cb2192-2eff-4fd7-91db-715ac718e3c8","resolution":{"observed_at":"2026-08-08T14:03:49.290973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.278783Z","title":"hard prompt","venue":null,"work_id":"cd075dc8-d98e-4537-b849-a5df8651a602","year":2002},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.891027Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:0c33699409f1a022fbf59875deac1304c204b070a87ae9305e44e9e289a8d36a","observation_id":"b6fee4ce-012f-4d93-a62c-8887ecabe748","resolution":{"observed_at":"2026-08-08T14:03:49.281863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.261452Z","title":null,"venue":null,"work_id":"d57f1afe-40ac-4e56-8dda-2a92b207202b","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.896855Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:3da914a026bef646fa9245a9f17c365db3d880ac4817cc58f0aff8313bc56b3f","observation_id":"ee8168ba-786b-4cfd-9ef0-e7a2113c30b7","resolution":{"observed_at":"2026-08-08T14:03:49.264340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.251950Z","title":"per-task grid","venue":null,"work_id":"5fe88394-636e-49b0-b32c-8fa1b4947981","year":2022},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.899547Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:ecaa8820fbe3eb616f8f1b569a428e35387c787a2f0c6e4383659b222dc27a23","observation_id":"46fa6309-44f8-469f-b353-462e7e67888a","resolution":{"observed_at":"2026-08-08T14:03:49.255245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.241116Z","title":"The HSV color histogram and Gabor texture priors give extra cues that the random-prompt baseline cannot recover","venue":null,"work_id":"9ecdf807-f10b-4238-8442-2d8cc493e1ec","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.902204Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:b441f98a478b05610ccfa58d2846b55429c6b8588fd138d0d7f3b83abf9704c2","observation_id":"674cab15-a029-47d1-9f36-7a2be730eb38","resolution":{"observed_at":"2026-08-08T14:03:49.244811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.230890Z","title":"Extra Params","venue":null,"work_id":"f2e6a94a-327e-4952-aebd-7c8e14bef7ca","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.905238Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:4272f4fdba2aeac37539e2bffac3e0285c41175b8d4354496b5eb0f38562c64c","observation_id":"b3f34a86-1fd5-4a69-8db2-82c76b09ad80","resolution":{"observed_at":"2026-08-08T14:03:49.234229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.221134Z","title":null,"venue":null,"work_id":"da27f55e-76b0-4003-9f9c-4d5c36bbf9fa","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.908010Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:25eebdaa28da8d6b186b8dbfede737804e962e65ca41ad384560aa204233083a","observation_id":"fa21ca36-84d3-4523-b1a4-c5b275fabd29","resolution":{"observed_at":"2026-08-08T14:03:49.224314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.210945Z","title":null,"venue":null,"work_id":"161aebc4-0936-4dce-96f2-f92e8b0052d9","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.910691Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:5e30ddceb222a060d84582d43156bb0902a77d140ff34dcf4dcbc69d85f768e6","observation_id":"ca7f5b6d-27f3-4298-810f-ff45e08f9d3c","resolution":{"observed_at":"2026-08-08T14:03:49.214612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.200865Z","title":"Spending it on re-learning a Sobel filter is wasteful when the fixed Sobel filter already does the job at zero parameter cost","venue":null,"work_id":"8c7b5404-da4f-42f6-85bb-ce2d5103afe9","year":null},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.913339Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:ab9cd8fab0409d6ece263e1797acf302a4385db9cd6cab0552d3dabd3dcfe153","observation_id":"7b2f8bff-73a5-4b5e-9514-1b3bcb4d976d","resolution":{"observed_at":"2026-08-08T14:03:49.204511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.347976Z","title":"Indexing via color histograms","venue":null,"work_id":"e068bd47-dfa1-4e7a-b3e0-8d0feb5215f6","year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.855761Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:b1558fc5f3e2301b08b61fc5ff6eee937b9fc56264dc1fa71d5058db6a14805d","observation_id":"18e1bb6d-bcc8-4740-8b0f-200e21517132","resolution":{"observed_at":"2026-08-08T14:03:49.351160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01066","last_updated":"2019-09-04T09:33:20Z","snapshot_observed_at":"2026-07-06T08:18:37.267833Z","submitted_at":"2019-09-03T11:11:08Z","title":"Language Models as Knowledge Bases?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01066","snapshot_observed_at":"2026-08-08T14:03:48.851792Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.851792Z"},"links":{"cited_paper":"/paper/1909.01066","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:4b7858114ae772a0ed38b4b2f298592057c168ee00369aa21f3c2ea7b4ef5928","observation_id":"da502af1-ccef-491e-8d8d-fbf5271bbdf8","resolution":{"observed_at":"2026-08-08T14:03:48.851792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-08T14:03:48.833277Z","title":"Qlora: Efficient finetuning of quantized llms.Advances in neural information processing systems, 36:10088–10115, 2023","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.833277Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:1e471914d6c3be0eaac3e5b61318cd31a1cefd8dd87c26ba87dd8bc66ceeb9d6","observation_id":"c9f648b5-975d-4a81-94aa-f6b7cef06fc0","resolution":{"observed_at":"2026-08-08T14:03:48.833277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13770","last_updated":"2023-07-25T19:03:21Z","snapshot_observed_at":"2026-07-06T15:58:31.756298Z","submitted_at":"2023-07-25T19:03:21Z","title":"E^2VPT: An Effective and Efficient Approach for Visual Prompt Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13770","snapshot_observed_at":"2026-08-08T14:03:48.836848Z","title":"Imagenet-trained cnns are biased towards texture; increasing shape bias improves accuracy and robustness","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.836848Z"},"links":{"cited_paper":"/paper/2307.13770","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:2d40d3f7af289c07b132e126680f0c15a1b3b010a06108993c5cd639d3b29fcc","observation_id":"e26df252-12cd-4732-a043-8c423901b5b2","resolution":{"observed_at":"2026-08-08T14:03:48.836848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.86524","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.071097Z","title":"11 Naftali Tishby and Noga Zaslavsky","venue":null,"work_id":"dcc093ea-3fbe-438d-937a-43e4b0d939d3","year":2018},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.858764Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:5d8c3b5dd701ff2723a887516ea3296bf8ef99210270756aab4bbdc3be1abe2a","observation_id":"94e04169-a0ff-4f22-8254-4b1eb7559968","resolution":{"observed_at":"2026-08-08T14:03:49.077833Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-08T14:03:48.828977Z","title":"Improved baselines with momentum contrastive learning.arXiv preprint arXiv:2003.04297, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.828977Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:6c9f8a45f77d06f2003a9d0371fde0b8dc5e80aacdeab46c76250795d145149f","observation_id":"66c9ef1f-a4e2-491c-86d4-92d7ff86c8c6","resolution":{"observed_at":"2026-08-08T14:03:48.828977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:03:49.270188Z","title":"Fundamental Image Priors","venue":null,"work_id":"c419def4-6ef6-4c76-9e82-a92e269ac133","year":2022},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.893872Z"},"links":{"citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:f35afe39e7baeb669201016f18662ea50822491228bd70f869b75ffad30e5dad","observation_id":"86ae137f-1b89-41a8-b2d2-19b9b8f58b08","resolution":{"observed_at":"2026-08-08T14:03:49.273014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-07-06T10:29:18.734092Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-08T14:03:48.844354Z","title":"Prefix-tuning: Optimizing continuous prompts for generation.arXiv preprint arXiv:2101.00190, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T14:03:48.844354Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2608.05393"},"observation_digest":"sha256:62bd28b2c9a45de0ba738e8257fd0f398efffe8b76dd35cae47511fbd9890217","observation_id":"203f00fd-6a73-42d4-9e18-a91c5e555b08","resolution":{"observed_at":"2026-08-08T14:03:48.844354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05393","last_updated":"2026-08-05T20:23:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T14:10:29.442144Z","submitted_at":"2026-08-05T20:23:40Z","title":"Adapting Vision Foundation Models with Cascaded Semantics"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2608.05393."}