{"as_of":"2026-08-13T15:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c5bcc7728a72d6c6229b97c36998e65f1b88b5c118e195476d96410d72cda55f","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:48:02.948785Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15933/citation-record","integrity":"/paper/2411.15933/integrity","json":"/paper/2411.15933/citation-record.json","paper":"/paper/2411.15933"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2202.05930","last_updated":"2022-02-11T23:15:01Z","snapshot_observed_at":"2026-08-12T17:16:52.191648Z","submitted_at":"2022-02-11T23:15:01Z","title":"Detecting out-of-context objects using contextual cues","version":1},"cited_work":{"arxiv_id":"2202.05930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.05930","snapshot_observed_at":"2026-08-12T13:48:03.148677Z","title":"Detecting out-of-context objects using contextual cues","venue":"cs.CV","work_id":"cddc2546-7fd5-4ed9-9958-f6261041d765","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.682901Z"},"links":{"cited_paper":"/paper/2202.05930","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:1de641227805a32e8eada4dcd73336d450500444f0921d7fe76c77ee9cb7add7","observation_id":"331de153-78fa-4148-a497-469a9c5992b2","resolution":{"observed_at":"2026-08-12T13:48:03.152528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.799703Z","title":"Masking strategies for background bias removal in computer vision models","venue":null,"work_id":"ad291bf4-11e9-4bc2-bae1-f41fa8830196","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.687941Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:44d6cfd53aea9381a42f2fa6779d327488fac4177f65de79bbed8ffe85f229c9","observation_id":"4c66eb94-57ad-40a3-a009-829a9d5133e7","resolution":{"observed_at":"2026-08-12T13:48:03.803159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.789806Z","title":"Masktune: Mitigating spurious correlations by forcing to explore","venue":null,"work_id":"3df3f526-a74f-42d3-af98-a65174633357","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.692043Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:66566ab59644f184d954b0113800102a22f2d92b1510e945cfb96a020d1bc78e","observation_id":"457dc473-8042-430d-9890-c5ad937ea33d","resolution":{"observed_at":"2026-08-12T13:48:03.793061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.780388Z","title":"Objectnet: A large-scale bias-controlled dataset for pushing the limits of object recognition models","venue":null,"work_id":"897c81ec-d69c-4e2c-bdc7-a82848dae7ee","year":2019},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.695724Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:1759a60eaadb42fc9fc4ecb90e985534a3728e024890a0b29ff82b9d00c92909","observation_id":"1e1f4271-db30-40a7-a6cf-f508341cd724","resolution":{"observed_at":"2026-08-12T13:48:03.783931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.771075Z","title":"Bird- snap: Large-scale fine-grained visual categorization of birds","venue":null,"work_id":"00660813-83d0-4097-bf9f-f81e13531bd4","year":2011},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.699567Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:75fa75115401659fa19605219a6a358a6c1cc5a29efc6f9f0e764301cd4f331b","observation_id":"f7746e95-65b3-4227-b0bd-50c4c25f323c","resolution":{"observed_at":"2026-08-12T13:48:03.774553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.761410Z","title":"Are we done with ImageNet? 2020","venue":null,"work_id":"a6f3c9a9-d0f3-4f52-b807-c3195488fb70","year":2020},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.703002Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:604ad45b334a5533e25f32f4b5288b073506dfb6d7ef5a4fd8e7eea12626da59","observation_id":"0f13b7fa-774b-4110-811a-a3449598665e","resolution":{"observed_at":"2026-08-12T13:48:03.765003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.751726Z","title":"Mitigating the effect of incidental cor- relations on part-based learning","venue":null,"work_id":"f442c0a8-eef8-4d36-8115-dd8aca7a219c","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.706679Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:8858879258486671a8539c102ee1c649b4b278ddacd06dca1ca2dd206704db6d","observation_id":"07d8afe5-7af0-4a86-adf8-5ed0d5aff1a0","resolution":{"observed_at":"2026-08-12T13:48:03.755241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.710040Z","title":"Masked-attention mask transformer for universal image segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.710040Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:5baae2bbd02492d92cc16005316d95ccd951e3365573a5419ca0f80da90a422f","observation_id":"2fa2aa9e-4ead-4cc0-b867-35c2e4ab3c9f","resolution":{"observed_at":"2026-08-12T13:48:02.710040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.736321Z","title":"Putting the object back into video object segmentation","venue":null,"work_id":"cd76e30e-f82b-45c8-b80a-6ce767bac8dc","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.713197Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:8a7221a178e0b233d174db26a235560c11fb0942617137e83f1831bc4811295b","observation_id":"8cda15c0-835a-4655-a1ed-23ca0e28a9b9","resolution":{"observed_at":"2026-08-12T13:48:03.739674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11646","last_updated":"2022-06-23T12:06:54Z","snapshot_observed_at":"2026-07-06T13:23:55.107856Z","submitted_at":"2022-06-23T12:06:54Z","title":"Invariant Causal Mechanisms through Distribution Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11646","snapshot_observed_at":"2026-08-12T13:48:02.716475Z","title":"Invariant causal mechanisms through distribu- tion matching","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.716475Z"},"links":{"cited_paper":"/paper/2206.11646","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:43a4e8a930bf1c3f0ffc671170a1f9fbe76b9c4f5e26dcf35da4b880efe175c6","observation_id":"b36737d8-c8ca-46cb-9731-eded1020b854","resolution":{"observed_at":"2026-08-12T13:48:02.716475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06442","last_updated":"2023-04-25T00:51:55Z","snapshot_observed_at":"2026-08-13T12:27:08.916371Z","submitted_at":"2023-03-11T16:43:59Z","title":"Fine-grained Visual Classification with High-temperature Refinement and Background Suppression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06442","snapshot_observed_at":"2026-08-12T13:48:02.720072Z","title":"Fine-grained visual classification with high-temperature re- finement and background suppression","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.720072Z"},"links":{"cited_paper":"/paper/2303.06442","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:cb8d9014bf2523b0e61f8c61ddb08319b31af79acf25b47d14ba314ac9d1a678","observation_id":"b8a6c2d3-6bcc-407b-a309-b5a237ee16ff","resolution":{"observed_at":"2026-08-12T13:48:02.720072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.726666Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"982a1abc-14c4-44b5-baf5-8a491069c44a","year":2009},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.723622Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:c119b18ffcb161ae80624091ada5121a3522127f17528e47c20965a03a17063e","observation_id":"4e248843-3078-40ad-b3bb-b80952598931","resolution":{"observed_at":"2026-08-12T13:48:03.730180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.716051Z","title":"An empirical study of context in object detection","venue":null,"work_id":"4ba3e03a-ed10-4e12-9b7d-2a14b1e6b5c0","year":2009},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.726989Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:5aefd5ff8a4a40d6615fac99544ab445db4704e8c0a7ce295fc8d8d716f7ef95","observation_id":"d293c5e4-64f2-4bfa-ac8e-1c8d3c2fda80","resolution":{"observed_at":"2026-08-12T13:48:03.719361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.706542Z","title":"Network calibration by class-based temperature scaling","venue":null,"work_id":"52d5520e-ad4a-45dd-8590-10830feac023","year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.730204Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ce2591ea69c4488a651c3da61e4920edab584be47a7661667cb16b71c3bac92e","observation_id":"c26ed2b6-531b-48f3-8385-be0f3f82978b","resolution":{"observed_at":"2026-08-12T13:48:03.709986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.733297Z","title":"Shortcut learning in deep neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.733297Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:c32429ab62aa801a98a141fadf21c6958e990f38a7c12f7e57365603c0d4bf8a","observation_id":"b1228ce9-5328-4323-bb9f-1f1cbabff51c","resolution":{"observed_at":"2026-08-12T13:48:02.733297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.691644Z","title":"Aspire: Language-guided data augmentation for improving robustness against spurious correlations","venue":null,"work_id":"6a0e6111-3342-4ba5-85cd-5af996d0dddf","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.736629Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:523abccecb59f2363948b4a28b15aa29737ebe14cbcb2464223f3490577c4d14","observation_id":"e786b4a5-92d6-4d90-bcc5-c3137a7587e8","resolution":{"observed_at":"2026-08-12T13:48:03.695125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.740083Z","title":"On calibration of modern neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.740083Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:57eb1810004f97b84c7cf9673ec8714ee5080cb5e6117b17606ceb048dd40ccf","observation_id":"5ecc3c61-8c84-4636-aed3-9e0d2215bd3c","resolution":{"observed_at":"2026-08-12T13:48:02.740083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.676332Z","title":"The two dimensions of worst-case training and their integrated effect for out-of-domain generalization","venue":null,"work_id":"7fca92cf-45e3-4fd0-8636-f296be55ec45","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.743590Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:d6cb18a9662b314ab114c5b8a3dffef4b0b142ef3381f60360ee796d4d0c7d3a","observation_id":"2f7aba02-0a67-4b04-80f2-9eb88cb2170d","resolution":{"observed_at":"2026-08-12T13:48:03.680063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.747033Z","title":"Segment anything in high qual- ity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.747033Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:6263fbe547fbcfa3cc86c14251a2e804a87ba0638f009c63cc2833fb866ea482","observation_id":"9cc46470-ffc7-4fb0-9f67-c6adb9fa3d4c","resolution":{"observed_at":"2026-08-12T13:48:02.747033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.661573Z","title":"Novel dataset for fine-grained image categorization","venue":null,"work_id":"d0a75a3c-09cf-40d4-83aa-8213e983abb1","year":2011},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.750481Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:03f8fd9fbb4f8fa10d660ea12640b26f82e491369f05a9d1eef78e147d60b06f","observation_id":"95dde192-8578-421c-9936-6f35005e0f6f","resolution":{"observed_at":"2026-08-12T13:48:03.665131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.651856Z","title":"Segment any- thing","venue":null,"work_id":"0bde079e-ef26-4d2a-801d-a86032b86e4d","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.754105Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e9f152bfad094c906065dec71b2b22e2163dd73d932bafeec4a9d0c17380886d","observation_id":"10b8ceae-6597-49b0-9ea6-be05f10e9c69","resolution":{"observed_at":"2026-08-12T13:48:03.654968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00076","last_updated":"2024-11-26T16:47:59Z","snapshot_observed_at":"2026-08-12T11:55:22.118563Z","submitted_at":"2024-11-26T16:47:59Z","title":"Flaws of ImageNet, Computer Vision's Favourite Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00076","snapshot_observed_at":"2026-08-12T13:48:02.757441Z","title":"Flaws of imagenet, computer vision’s favourite dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.757441Z"},"links":{"cited_paper":"/paper/2412.00076","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:cf8de7ea4ed544fbc0d1ca468edb860b9dbb7f85a4049e055227d75dabe82332","observation_id":"fd813e93-ef15-4dec-8e9d-127cf0c22f64","resolution":{"observed_at":"2026-08-12T13:48:02.757441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.642321Z","title":"Out-of-distribution general- ization via risk extrapolation (rex)","venue":null,"work_id":"e963c0aa-12f3-4bc3-a7a7-7ea68ea83ca2","year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.761303Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:1afcf617162957a9bfa36e3a8ee11d6eeb5b7e800dc4184f8c95f6ec47215a9a","observation_id":"b0d5d177-5654-487a-8a98-cf64fa805ba5","resolution":{"observed_at":"2026-08-12T13:48:03.645635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.764531Z","title":"Domain generalization with adversarial feature learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.764531Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:6ef4849577dd52a5bc8adca0983bc4ed997389a059b79c028106c40bd326311f","observation_id":"1ed2ce4a-4dc5-4fb7-ab81-a4d75135a959","resolution":{"observed_at":"2026-08-12T13:48:02.764531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.627329Z","title":"Just train twice: Improving group robustness without training group information","venue":null,"work_id":"ec85d7ac-b041-4fa0-883e-3d2f4b9ce9a4","year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.767768Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:b65a61564120b23b14d56627e4ab98f4b3894c90727eb09c7bb06521bc3c74c7","observation_id":"a3c26aae-d4c8-4578-a27a-fa3a5a2fc33a","resolution":{"observed_at":"2026-08-12T13:48:03.630564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-12T13:48:02.771326Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.771326Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ce273cf0bc8da6d69237d34153c7766b340928fe8edb0d7fe0b71c7f8520a979","observation_id":"b4e3838d-e24c-411a-8870-726f77a70435","resolution":{"observed_at":"2026-08-12T13:48:02.771326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.618191Z","title":"A convnet for the 2020s","venue":null,"work_id":"85443e31-e500-4a66-98be-c0c7749ce6f6","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.775349Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:f4a49f4db2e44c02ae4c054bfa5945e2715b5b631a9c0038e5a1472e03f9eb23","observation_id":"3525376d-448c-4fab-a464-5f2d671cf44d","resolution":{"observed_at":"2026-08-12T13:48:03.621372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.608511Z","title":"Camouflaged instance seg- mentation via explicit de-camouflaging","venue":null,"work_id":"bb3d32a4-fec1-49e5-aa9b-580436f3c4c4","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.778907Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:6df1c70e2f5e8567a962ff8dc4c8a174453228850e9b82203276aa0df66a2bec","observation_id":"83e12622-da3b-4abf-9700-909612643334","resolution":{"observed_at":"2026-08-12T13:48:03.612056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.599095Z","title":"Spawrious: A benchmark for fine control of spurious correlation biases, 2023","venue":null,"work_id":"effefa01-75b9-4325-b331-0aa814d2dec7","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.782617Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:98f5b268f71a13fa6983443a870d9b8c4586ed64d898153d455dff5712a94f9d","observation_id":"62665785-c0ae-4439-9f4e-62ba239608f3","resolution":{"observed_at":"2026-08-12T13:48:03.602381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.590015Z","title":"Simple open-vocabulary object detection","venue":null,"work_id":"2d204e23-ab4e-4bd2-abb0-f87fc6d6e674","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.786006Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:51c67ba9e9a9523dbee2cdd1d9570a502da19094c13521f513ddae7adef81e6f","observation_id":"09bfe1ab-9b95-429f-84e6-31f856104edd","resolution":{"observed_at":"2026-08-12T13:48:03.593207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.578893Z","title":"Scaling open-vocabulary object detection","venue":null,"work_id":"0273fbf6-2115-49fe-aa4a-299934224f6a","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.789303Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:4a460ca0e8bd8d7a18fbd713b26dbd7d0ff530e8c97f6f572cffe4088e8bb570","observation_id":"d6a3df7a-f7a5-40ac-b3fb-26f45112684d","resolution":{"observed_at":"2026-08-12T13:48:03.582437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.568837Z","title":"A comprehensive study of image classification model sensitivity to foregrounds, backgrounds, and visual attributes","venue":null,"work_id":"801f662e-a8ae-4195-a968-0f89438b7785","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.792820Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:c352c3112e51fe4f98c149a185e38f1f485ee3f3b3c4c93698b80627ecea13ba","observation_id":"ef3c50ba-5467-473c-a721-376ef695be5f","resolution":{"observed_at":"2026-08-12T13:48:03.572400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.559446Z","title":"Hard ima- genet: Segmentations for objects with strong spurious cues","venue":null,"work_id":"e84cf8e8-d789-4e33-b48b-db79670f948d","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.796368Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:1bf717ac8b238fa58f61217a6c2774226a3f4cf9dec422fcacaa21f5a4d0a124","observation_id":"1a8bb286-dfb0-46f6-b57e-8754adcae17e","resolution":{"observed_at":"2026-08-12T13:48:03.562748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.549839Z","title":"Obtaining well calibrated probabilities using bayesian binning","venue":null,"work_id":"0668ae7f-2ed9-4214-a012-e10661571d92","year":2015},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.799729Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:57a8010e228e08556d0df41db9b418190d56ffd70a8e480d07eae4f6c28f2042","observation_id":"b0a52eca-bf84-4c6f-a25d-6c2b0420bf94","resolution":{"observed_at":"2026-08-12T13:48:03.553252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.540204Z","title":"The role of context in object recognition","venue":null,"work_id":"edf977aa-19c7-405e-a189-4c3d6e7f836f","year":2007},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.803196Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:410b1a867020050c4c646e91cf341a49635387edc06a4261ad7695a06a0e8b1a","observation_id":"be4e5677-cb8d-412b-8d82-ed06505509d5","resolution":{"observed_at":"2026-08-12T13:48:03.543514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-12T13:48:02.806501Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.806501Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:9fc88c777adc0936cd38b56610c8e7879c91dc8995ef3f922a3bd28ce1e9e98f","observation_id":"9592cc9d-a722-4765-9a7d-72a7d6e45c56","resolution":{"observed_at":"2026-08-12T13:48:02.806501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.530971Z","title":"Jeppe- sen, Jacob Heilmann-Clausen, Thomas Læssøe, and Tobias Frøslev","venue":null,"work_id":"ac00f7ae-1cf4-441a-a8a9-ab260c7c10ee","year":2020},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.810326Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:9e867bab2b51932977f006395e891ea21acc23483098e6255bd19010c5484a85","observation_id":"5506d4cf-7f49-4518-a6f5-b483c51a9a38","resolution":{"observed_at":"2026-08-12T13:48:03.534548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13632","last_updated":"2025-04-25T07:11:09Z","snapshot_observed_at":"2026-08-12T22:58:06.064337Z","submitted_at":"2024-08-24T17:22:46Z","title":"FungiTastic: A multi-modal dataset and benchmark for image categorization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13632","snapshot_observed_at":"2026-08-12T13:48:02.813535Z","title":"Fungitastic: A multi-modal dataset and benchmark for image categorization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.813535Z"},"links":{"cited_paper":"/paper/2408.13632","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:89d1859e305284cabdf8154cffbd20d7bcd40ffc5f57b0756800f609bb62e184","observation_id":"1c88b1b3-1e4d-4253-9336-a4fbd7e8b503","resolution":{"observed_at":"2026-08-12T13:48:02.813535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12930","last_updated":"2024-08-23T09:19:34Z","snapshot_observed_at":"2026-08-12T22:58:46.955642Z","submitted_at":"2024-08-23T09:19:34Z","title":"Animal Identification with Independent Foreground and Background Modeling","version":1},"cited_work":{"arxiv_id":"2408.12930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.12930","snapshot_observed_at":"2026-08-12T13:48:03.069371Z","title":"Animal Identification with Independent Foreground and Background Modeling","venue":"cs.CV","work_id":"30bfbcd6-6bf8-4b0e-a17f-839318ce0ab9","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.817054Z"},"links":{"cited_paper":"/paper/2408.12930","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:bd595cef426488671b3ab6fc9abc0f8eeafb11a595d7ec295f3307dd391686bb","observation_id":"0b47860e-526d-45e3-a085-6f2ede733d80","resolution":{"observed_at":"2026-08-12T13:48:03.075030Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.820538Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.820538Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:30a27fcad0dfda3ccb5d86e678d9db05608eed934d40251717d55cd4af628cbb","observation_id":"05c4c926-4bab-47fc-bc04-9b95f2722165","resolution":{"observed_at":"2026-08-12T13:48:02.820538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-12T13:48:02.823678Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.823678Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:d8a9758e7f7c4022a3100f37db7eb60e3e3459935a0c9b40f721195f92b4cfba","observation_id":"d56b2503-2386-4572-9edb-ef39dcb964af","resolution":{"observed_at":"2026-08-12T13:48:02.823678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.516809Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"cfae6013-41db-4b6d-80f4-88da180ef57d","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.827207Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:28693c3ee9979c68a5e420cb7e78b8d173f29a180ef511ec7b694a2970ff456c","observation_id":"0dfa8ea0-3855-4a04-970b-f1cc957df6f4","resolution":{"observed_at":"2026-08-12T13:48:03.519756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.507787Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":"44a80764-7313-4532-9309-ee156e84d1fc","year":2015},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.830419Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:7dcda884d27509fb6aa082fcb39b2e4fd2c1c14a4a63739a4190b80bd8d51edb","observation_id":"8ea23f64-b02c-4ada-a150-3ee2ac881de9","resolution":{"observed_at":"2026-08-12T13:48:03.510906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08731","last_updated":"2020-04-02T05:40:29Z","snapshot_observed_at":"2026-08-02T19:28:48.954133Z","submitted_at":"2019-11-20T06:43:41Z","title":"Distributionally Robust Neural Networks for Group Shifts: On the Importance of Regularization for Worst-Case Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08731","snapshot_observed_at":"2026-08-12T13:48:02.833686Z","title":"Distributionally robust neural networks for group shifts: On the importance of regularization for worst- case generalization","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.833686Z"},"links":{"cited_paper":"/paper/1911.08731","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:28d7be08fd0515997e1cf01e06a83643536728b7e37b35269e5dc9445ed506d0","observation_id":"70ec3682-04f2-473a-a588-458bd56b8ff5","resolution":{"observed_at":"2026-08-12T13:48:02.833686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.498627Z","title":"Not using the car to see the sidewalk–quantifying and controlling the effects of context in classification and segmentation","venue":null,"work_id":"bb962c62-49c8-49fb-9043-1434535b9caf","year":2019},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.837588Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:50c0b77a37867bb9c5c7e496c368113f8670f924a2f452b71599e0a5fbbf88b6","observation_id":"2c2c717c-400d-4a28-806d-e9ebd98d75f3","resolution":{"observed_at":"2026-08-12T13:48:03.501921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09937","last_updated":"2021-07-14T00:07:51Z","snapshot_observed_at":"2026-08-06T20:03:26.839485Z","submitted_at":"2021-04-20T12:55:37Z","title":"Gradient Matching for Domain Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09937","snapshot_observed_at":"2026-08-12T13:48:02.840950Z","title":"Gradi- ent matching for domain generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.840950Z"},"links":{"cited_paper":"/paper/2104.09937","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:fe1f9fc251d5f9b5f05c7d7803a4dae891d5d3258babdbf4ea1937ebbf01b499","observation_id":"871465dc-9ae7-4099-9176-1db812638583","resolution":{"observed_at":"2026-08-12T13:48:02.840950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.489055Z","title":"Salient imagenet: How to discover spurious features in deep learning? In International Conference on Learning Representations, 2022","venue":null,"work_id":"19a51dff-4c47-4662-b590-f5e5dc2c5446","year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.844668Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2148c24675dbf46790d0834035d386ab64689ed1e61591d33af05f9eb0376bd3","observation_id":"a233fca7-cc05-49ce-979d-ef475217de9f","resolution":{"observed_at":"2026-08-12T13:48:03.492535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.479564Z","title":"Bioclip: A vision foundation model for the tree of life","venue":null,"work_id":"aa780355-81c1-497b-a7ed-902baaaba8bc","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.847824Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:49f6317b34ebac861f82dfb5d7dc62bd13cb66efc864f337790f8d8aaa583539","observation_id":"b62707f1-698d-44f7-9add-8a55a77e83ca","resolution":{"observed_at":"2026-08-12T13:48:03.482963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.469524Z","title":"Deep coral: Correlation alignment for deep domain adaptation","venue":null,"work_id":"f5e6d5d5-b8c6-441e-a298-3ef15d7bce7a","year":2016},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.851401Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ecaedcab0a1d3d054084997f1101b5c56a9c72db96bea5ef6582a0e627d746cf","observation_id":"fe7fe90a-6c9c-4181-a1f6-40f60b408750","resolution":{"observed_at":"2026-08-12T13:48:03.473138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.458940Z","title":"Imagenet-hard: The hard- est images remaining from a study of the power of zoom and spatial biases in image classification","venue":null,"work_id":"01bfb2d6-ddb1-43d7-be0f-2696ea2fd626","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.854879Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:39d1e7d925564f69780c09a46cc98cacc79553411d63af4b7ee239a77ebedcd4","observation_id":"6861247d-7b60-45a2-a3a0-b11c49406da1","resolution":{"observed_at":"2026-08-12T13:48:03.463013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.448901Z","title":"Contextual priming for object detection","venue":null,"work_id":"609d7695-a972-4bc5-b062-831a4f84bb8c","year":2003},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.858078Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:6f76ab40b1c31b4295da790d5f0886711f6f6c5f0830174eb8a777dd957ec8a9","observation_id":"ecb286ba-8366-47e1-b494-3ae0b7533bd0","resolution":{"observed_at":"2026-08-12T13:48:03.452466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-12T13:48:02.861359Z","title":"Siglip 2: Multilingual vision-language en- coders with improved semantic understanding, localization, and dense features","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.861359Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:0e890c9342e9cbba29dc0ad57643d8210f51a0966d63338a91bc63a1bebdc7c3","observation_id":"0e4552e8-2c22-44ca-ba45-224bf6e3718e","resolution":{"observed_at":"2026-08-12T13:48:02.861359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.439030Z","title":"Principles of risk minimization for learn- ing theory","venue":null,"work_id":"62b70e30-8687-4b42-aa4e-22cadaa32061","year":1991},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.865253Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:ba01a44a02c0d6eeae4e37e07e86538ccd5edab73af5370e74bc5c96340c1f57","observation_id":"a621e092-8c3c-4444-8dc2-92bbb2052d9f","resolution":{"observed_at":"2026-08-12T13:48:03.442369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.429278Z","title":"When does dough become a bagel? Analyzing the remaining mistakes on ImageNet","venue":null,"work_id":"9588a8f2-0a46-4bc4-85af-3ad060bc4c6f","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.868663Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e7cebdeb49b1b7beaf4e69366aab57e01b10163c55aef81755203e5905dfe568","observation_id":"db1f8213-2b74-44d8-86a5-eaedba5e5804","resolution":{"observed_at":"2026-08-12T13:48:03.432628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02748","last_updated":"2022-10-06T08:33:23Z","snapshot_observed_at":"2026-08-13T14:12:05.833399Z","submitted_at":"2022-10-06T08:33:23Z","title":"CLAD: A Contrastive Learning based Approach for Background Debiasing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02748","snapshot_observed_at":"2026-08-12T13:48:02.872256Z","title":"Clad: A contrastive learning based approach for background debiasing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.872256Z"},"links":{"cited_paper":"/paper/2210.02748","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e57e76bb16ab37ba253c4efb02616d9b4bb8afdfb1adecb323a2e65ee7b79cba","observation_id":"91c4ee1c-9b6f-4dba-b35d-21c115132ab7","resolution":{"observed_at":"2026-08-12T13:48:02.872256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.419522Z","title":"A sober look at the robustness of clips to spurious features","venue":null,"work_id":"90eb8645-35b5-4423-8629-7da58a4016d0","year":2025},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.875839Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:3e5ad644bf7a582a87081f8aa19246480d5c77f1651a1ebdc753cd1cf3f33956","observation_id":"5c2586b2-0f56-4a93-a50a-4c348b9d00d8","resolution":{"observed_at":"2026-08-12T13:48:03.422857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.879044Z","title":"Pytorch image models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.879044Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:73fd3704bdfe91fc94aa0858d791a5a333f63a35b1a89a0c15b74f6417544a18","observation_id":"0e8cc2b9-770b-44da-96b8-5fe64faa054b","resolution":{"observed_at":"2026-08-12T13:48:02.879044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.405191Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"79d8474a-5285-43e9-b7d5-2c9ed0a9d662","year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.882513Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:e22bd37ebc6a5fe91b3e1ec95dd924e97b467726c900b1e00613262a91adb4cf","observation_id":"69d7bfc8-ad53-4992-ba29-f6fa4d35c02e","resolution":{"observed_at":"2026-08-12T13:48:03.408234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09994","last_updated":"2020-06-17T16:54:43Z","snapshot_observed_at":"2026-08-10T14:49:17.859874Z","submitted_at":"2020-06-17T16:54:43Z","title":"Noise or Signal: The Role of Image Backgrounds in Object Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09994","snapshot_observed_at":"2026-08-12T13:48:02.885740Z","title":"Noise or signal: The role of image backgrounds in object recognition","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.885740Z"},"links":{"cited_paper":"/paper/2006.09994","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:0b62019bad601c32519f846f1ce89d46964f8c0a6f8c9e8c2dd7dbc0bba261b9","observation_id":"2b34f12e-213f-455a-8535-ca11b78112cc","resolution":{"observed_at":"2026-08-12T13:48:02.885740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.395905Z","title":"Adversarial domain adaptation with domain mixup","venue":null,"work_id":"cc18c05c-5754-4f75-adde-800290da1319","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.889360Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2706fa1c72c2f2b93f08b7c7f4a94ac5606f5ffcad3397757d42203a802c7612","observation_id":"ff393fdf-e3d2-4ae0-a3b5-7857a46e45c9","resolution":{"observed_at":"2026-08-12T13:48:03.399447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.385934Z","title":"Significant feature suppression and cross-feature fu- sion networks for fine-grained visual classification.Scientific Reports, 14(1):24051, 2024","venue":null,"work_id":"5de10049-cd28-4786-8438-817b3766ee51","year":2024},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.893258Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:4d4807a41b92839d8d3c12db2e32e8b26acefc443e496193f7b1f4eb2601d0e0","observation_id":"6a13cff2-357d-4ecc-a655-b3d6eff51d7c","resolution":{"observed_at":"2026-08-12T13:48:03.389512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:02.896685Z","title":"Improving out-of-distribution robustness via selective augmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.896685Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:621572ac05b78346a89969155781931ede999c975c9ea730a4d040f10ecbcdb5","observation_id":"217849be-244f-4f29-b423-bc9bc0bbdea7","resolution":{"observed_at":"2026-08-12T13:48:02.896685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12156","last_updated":"2023-06-21T10:08:29Z","snapshot_observed_at":"2026-08-13T11:12:44.426861Z","submitted_at":"2023-06-21T10:08:29Z","title":"Fast Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12156","snapshot_observed_at":"2026-08-12T13:48:02.900021Z","title":"Fast segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.900021Z"},"links":{"cited_paper":"/paper/2306.12156","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:419e5b34e3e0c000fdabdc963b02c2bccf61027738c5a638e559e8abe6931cf9","observation_id":"86ebc9eb-c918-44bf-993f-1cc816f34e7a","resolution":{"observed_at":"2026-08-12T13:48:02.900021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.06596","last_updated":"2017-05-25T18:15:06Z","snapshot_observed_at":"2026-07-06T05:19:23.158124Z","submitted_at":"2016-11-20T21:20:32Z","title":"Object Recognition with and without Objects","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.06596","snapshot_observed_at":"2026-08-12T13:48:02.903556Z","title":"Ob- ject recognition with and without objects","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.903556Z"},"links":{"cited_paper":"/paper/1611.06596","citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2f7c7c907b2da1b8ad4acc3348aa4afa0992def6e8a82da80b70d9771e90e02c","observation_id":"32e9caf6-c1d5-4b67-8246-d4072d9dadcf","resolution":{"observed_at":"2026-08-12T13:48:02.903556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.275045Z","title":"volleyball on snow","venue":null,"work_id":"36a7acc1-a227-46b2-8100-4daf29307436","year":2014},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.906942Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2f1bfda082d41119b19f332a7d73bbad0761b2f3bbe0cae7c6668c2944adb4e5","observation_id":"b943c99e-3fa2-486b-80ac-f9cc535120c4","resolution":{"observed_at":"2026-08-12T13:48:03.373175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.266223Z","title":null,"venue":null,"work_id":"b2cc5b02-d77b-46ed-a1e0-5049af7a7574","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.910586Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:7d534b26b9c7eb7b08083c385fdddae1c25b5ff8a1d40b3f099a1a1a442b5fc0","observation_id":"f4f4d741-7ac8-4886-815a-775d4e82bc73","resolution":{"observed_at":"2026-08-12T13:48:03.269314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.257653Z","title":null,"venue":null,"work_id":"86e7b5bb-4430-46b4-80ad-a5b0b51c496c","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.913837Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:bbc3cf2a4caacc21152d4a782e057df1e1a06349077ea02f9fb51d81f6f7fe04","observation_id":"726872f2-eb8d-460e-b213-987fbe07cdae","resolution":{"observed_at":"2026-08-12T13:48:03.260735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.248050Z","title":null,"venue":null,"work_id":"36cbff60-f055-40b0-a82f-e5d4eebc2b34","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.917425Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:4066f7a47231195ba44326a730fdf67cc3cf7361e57552e10751bcc4b5ab8790","observation_id":"182c8e4d-bc88-4c32-981e-b7217057b392","resolution":{"observed_at":"2026-08-12T13:48:03.251196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.239245Z","title":null,"venue":null,"work_id":"1d1e39da-4f3a-46b2-81d5-efac4d010d75","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.921142Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:fdab355f70384619036f5bff79454ccfd5cfb274a4ec74cf7129acc9d2b2f04e","observation_id":"38b078c5-fc63-48f2-99d6-b91244854cf7","resolution":{"observed_at":"2026-08-12T13:48:03.242295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.229909Z","title":null,"venue":null,"work_id":"0069d96c-fe74-4b4e-8de1-0417a10ebc96","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.924415Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:9a1446cfee363c1a7a2135e45561edae0e745a5ca4f81b2b2226e25c08b8a437","observation_id":"7a796fcc-1e4f-414d-8f89-0ed1310f3f73","resolution":{"observed_at":"2026-08-12T13:48:03.233220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.220539Z","title":"the one with confidence ˆpi = max(ˆp1, ˆp2)","venue":null,"work_id":"75347fa8-40ba-454d-99fe-b2a4b6bba7b2","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.927966Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:36d10b413e936c5d011ae5addc2b22354b1f136f4f34294140f5d99476c5bbea","observation_id":"b64028f5-c775-4044-8858-a002b20cf0c7","resolution":{"observed_at":"2026-08-12T13:48:03.223750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.210164Z","title":"choose the one with ˜pi = max(˜p1, ˜p2)","venue":null,"work_id":"43258dc8-2a5d-4d0f-b4ae-32dc97ca71f2","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.931318Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:322528fefbf67ada06c984670a9f7eb0a284ab43701001c13a8dea695eb262ba","observation_id":"ad016dad-88ff-42e6-b7f6-ec4125d0e3fa","resolution":{"observed_at":"2026-08-12T13:48:03.213904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.199075Z","title":"Here t >0 is a parameter maximizing the new prediction ac- curacy on the validation set","venue":null,"work_id":"4e47cdd9-0e21-4af4-8bb5-e967204de9a0","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.934580Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:6c310db8a6c9a05b999db7f7b1ae569107c4701276bfdf26a551a899350e1aba","observation_id":"3c5aa6f2-859a-419d-ac34-f371e8c416dc","resolution":{"observed_at":"2026-08-12T13:48:03.202763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.188406Z","title":"The prediction is given by argmax as usual","venue":null,"work_id":"c1fa2bb8-2468-41ae-9cad-bb3c930a2040","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.937907Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:4d545b6abdeb09489c6ebdfc31d0e0d0dcd8ae740176118d77e5053b38975800","observation_id":"85bd9e91-ecc5-4551-a32a-aed2253ad25b","resolution":{"observed_at":"2026-08-12T13:48:03.192188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.177947Z","title":"The pose of flying birds is very different from those on the ground","venue":null,"work_id":"4b4fdd71-f6b4-48ae-b157-4889d0920f4e","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.941169Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:976c22e9161f8a5154a35e4fcd0c3ef81366b97791550d9f912e66091c74585e","observation_id":"4bb27e00-174c-4300-b4de-fd89aa6bba0a","resolution":{"observed_at":"2026-08-12T13:48:03.181476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.168182Z","title":", z(C) 1 , z(1) 2 ,","venue":null,"work_id":"f0a65fa9-358f-49ef-9f19-8f7b77fbb7fd","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.944619Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:2c5e1f5b562d325581a1df72925422e5cfdbeacf9df5682eafc1c49000889ffe","observation_id":"473d8df3-dc4b-45ae-ac7b-23714be34137","resolution":{"observed_at":"2026-08-12T13:48:03.171538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:48:03.158958Z","title":"background","venue":null,"work_id":"4b079448-d33a-4377-b75d-7369a0256a26","year":null},"citing_paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T13:48:02.948785Z"},"links":{"citing_paper":"/paper/2411.15933"},"observation_digest":"sha256:943c46b3446c2385a35636bce9f1a3250cea5778550dc3bb4c7f2c20a936f657","observation_id":"7f681a5f-e023-4b4c-953b-ba4ee513726d","resolution":{"observed_at":"2026-08-12T13:48:03.162167Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15933","last_updated":"2025-03-11T12:08:58Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T10:24:09.930624Z","submitted_at":"2024-11-24T17:39:39Z","title":"Bringing the Context Back into Object Recognition, Robustly"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":47},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2411.15933."}