{"as_of":"2026-08-16T21:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4bf2dca0ab77a9373b935d7cebf99c10295e5538e949d9f7874ef429d2bcae60","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:46:13.509951Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.04501/citation-record","integrity":"/paper/1908.04501/integrity","json":"/paper/1908.04501/citation-record.json","paper":"/paper/1908.04501"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:14.059215Z","title":"Learning pixel-level semantic afﬁnity with image-level supervision for weakly supervised semantic segmentation","venue":null,"work_id":"0b640961-e472-45fd-8a08-0a379c47dced","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.328799Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:e6641b20d46f0d23ba186f1765a7695aeda5aa83e93df77f96dd0c54bb15e7ee","observation_id":"02682b69-4ee3-46db-b899-ddd35da1c820","resolution":{"observed_at":"2026-08-14T13:46:14.062863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:14.049042Z","title":"Discovering class-speciﬁc pixels for weakly-supervised se- mantic segmentation","venue":null,"work_id":"cbbcfdff-5023-406c-b329-8dcd9f9eabfd","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.332827Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:a02d83df55e7c9a088b8cfe9bb74443df5081c1abe1acf31574c4ba5b775bf93","observation_id":"be9c6428-d5b8-4d7a-9ae0-9cf1fcf5faf7","resolution":{"observed_at":"2026-08-14T13:46:14.053119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.7062","last_updated":"2016-06-07T04:00:08Z","snapshot_observed_at":"2026-08-14T23:06:27.726818Z","submitted_at":"2014-12-22T17:18:33Z","title":"Semantic Image Segmentation with Deep Convolutional Nets and Fully Connected CRFs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.7062","snapshot_observed_at":"2026-08-14T13:46:13.336146Z","title":"Semantic image segmen- tation with deep convolutional nets and fully connected crfs","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.336146Z"},"links":{"cited_paper":"/paper/1412.7062","citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:4f22c5e3fd7e2c0edf76c76ac0ca31ab5a532b233b23e1dc7aa89ec94d72c954","observation_id":"91ed2ef5-5fc2-43b2-8d9c-eac63060f428","resolution":{"observed_at":"2026-08-14T13:46:13.336146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.340464Z","title":"Boxsup: Exploit- ing bounding boxes to supervise convolutional networks for semantic segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.340464Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:6d0712c77a19c8d055adf08e9fa781dbf4e75580c497e0ff742f646cc977f8d4","observation_id":"ab70b850-f1bb-4f1c-8c56-b84a037268ae","resolution":{"observed_at":"2026-08-14T13:46:13.340464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.344528Z","title":"Imagenet: A large-scale hierarchical im- age database","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.344528Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:2301130532480de354adb396a19b512acea9307c96129822b91d1bf92fc73110","observation_id":"8c08bf40-6dd0-4f00-a396-fd77d8510762","resolution":{"observed_at":"2026-08-14T13:46:13.344528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03066","last_updated":"2016-08-10T07:46:56Z","snapshot_observed_at":"2026-08-16T17:22:52.921670Z","submitted_at":"2016-08-10T07:46:56Z","title":"Object Detection, Tracking, and Motion Segmentation for Object-level Video Segmentation","version":1},"cited_work":{"arxiv_id":"1608.03066","doi":null,"metadata_source":"pith","pith_arxiv_id":"1608.03066","snapshot_observed_at":"2026-08-14T13:46:13.591756Z","title":"Object Detection, Tracking, and Motion Segmentation for Object-level Video Segmentation","venue":"cs.CV","work_id":"62966f89-e8e5-4737-9886-03f680ed6c57","year":2016},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.352208Z"},"links":{"cited_paper":"/paper/1608.03066","citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:59074c2c9d21d2e8502c724fb2b8fcda99df14bba465953847da91acc8b4008e","observation_id":"082b6d0a-c83e-45cb-88b0-ee9c02223b9c","resolution":{"observed_at":"2026-08-14T13:46:13.595540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.356415Z","title":"The pascal visual object classes (voc) challenge","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.356415Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:a831f7b0c0533c929a9d2c33d8cce990491984cf2378176e0fba26575cc9766f","observation_id":"fec44846-5bac-4ecc-83c8-0aafc252efe5","resolution":{"observed_at":"2026-08-14T13:46:13.356415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.10842","last_updated":"2020-01-30T06:10:51Z","snapshot_observed_at":"2026-08-14T17:52:50.368109Z","submitted_at":"2018-11-27T07:03:12Z","title":"CIAN: Cross-Image Affinity Net for Weakly Supervised Semantic Segmentation","version":2},"cited_work":{"arxiv_id":"1811.10842","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.10842","snapshot_observed_at":"2026-08-14T13:46:13.576998Z","title":"CIAN: Cross-Image Affinity Net for Weakly Supervised Semantic Segmentation","venue":"cs.CV","work_id":"56e2dc04-f679-4935-9a38-04b3b51061d7","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.359971Z"},"links":{"cited_paper":"/paper/1811.10842","citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:7a650779f85464aad3e8dc82e774e6b4da0c9646272326b29712e45c13ecd1c8","observation_id":"478c92ac-29a5-4497-86e1-775dc64968b6","resolution":{"observed_at":"2026-08-14T13:46:13.581035Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.363644Z","title":"Multi-evidence ﬁltering and fusion for multi-label classiﬁcation, object de- tection and semantic segmentation based on weakly super- vised learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.363644Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:e4c6862a89006bcc29f491c84c941f15eb4965fae62ddd50d6710af9017d13f1","observation_id":"47b74f09-bbaa-4222-a399-c2b4f0c741c8","resolution":{"observed_at":"2026-08-14T13:46:13.363644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.366596Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.366596Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:8c857cb8575e74d5d806847d0bbe55506f354ae8f4bcf5fe5fac084b72af5eb4","observation_id":"62788e14-4da8-48e3-a328-0d98e6747e46","resolution":{"observed_at":"2026-08-14T13:46:13.366596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:14.003852Z","title":"Learning transferrable knowledge for semantic seg- mentation with deep convolutional neural network","venue":null,"work_id":"70388403-278e-4cf9-be20-dc4cbd405d3d","year":2016},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.369803Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:ed2b20e7d2a778a45294fdb9ea01b0c4b27d5f84a7e651a8421936baec957593","observation_id":"33cc27a4-abb8-47cf-8ba6-24be304b749f","resolution":{"observed_at":"2026-08-14T13:46:14.007712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.992529Z","title":"Weakly supervised semantic segmenta- tion using web-crawled videos","venue":null,"work_id":"4a565b18-f153-4f4f-9d27-83d8c844dd90","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.372777Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:214ec8cb6de14b201f5deeff4802f77f6ac5fe7bff320e13af492055dfec6702","observation_id":"32d4bbd7-efe8-4aed-91e3-3ef1d5cd30d1","resolution":{"observed_at":"2026-08-14T13:46:13.996867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.375648Z","title":"Deeply supervised salient object detection with short connections","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.375648Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:0bf3cb5c064d5e186aefbaa1a92acfa1659dd7a99c6fda829cf36fbfefe7db75","observation_id":"dbf2c948-a0fd-4304-b841-b02160e76ed9","resolution":{"observed_at":"2026-08-14T13:46:13.375648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09859","last_updated":"2018-03-27T02:59:13Z","snapshot_observed_at":"2026-08-14T19:32:13.124149Z","submitted_at":"2018-03-27T02:59:13Z","title":"WebSeg: Learning Semantic Segmentation from Web Searches","version":1},"cited_work":{"arxiv_id":"1803.09859","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.09859","snapshot_observed_at":"2026-08-14T13:46:13.560667Z","title":"WebSeg: Learning Semantic Segmentation from Web Searches","venue":"cs.CV","work_id":"c4b997ba-723b-4194-aea7-0913737fdffb","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.378728Z"},"links":{"cited_paper":"/paper/1803.09859","citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:e51a3a145f1e717947e76bfcfe4df53458b6eb2e32100a3d279e46195c9bbb36","observation_id":"12eb8ed2-718c-473b-a123-dc646700bdfd","resolution":{"observed_at":"2026-08-14T13:46:13.566660Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.976098Z","title":"Self-erasing network for integral object attention","venue":null,"work_id":"21416ff6-173c-4896-9c0a-1ca86e6f1a06","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.381944Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:bacd31f8591e8190ec33c5d191d358761c7505724110df81185a80fe49ce85fe","observation_id":"05989b2c-a57f-4faf-aa2d-9f044f64bf97","resolution":{"observed_at":"2026-08-14T13:46:13.979341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.966141Z","title":"Associating inter-image salient instances for weakly supervised semantic segmentation","venue":null,"work_id":"dd2fbec4-7d4b-47d7-ada6-7296212ea834","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.385458Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:e0c6cda3bcd987f35b2cd3d8fbf179c4106f55a660bbb37a9744ca7094835d66","observation_id":"718ae4f2-08af-4c86-bff2-0ba54f626aea","resolution":{"observed_at":"2026-08-14T13:46:13.969517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.388835Z","title":"Weakly-supervised semantic segmentation network with deep seeded region growing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.388835Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:00bc6a079f36467a96f7cc348724cfc397c3b3e88288fbde9e7ba70f7355f170","observation_id":"b1d04a0a-2df5-4734-a19f-e231d70a24a4","resolution":{"observed_at":"2026-08-14T13:46:13.388835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.948786Z","title":"Supervoxel- consistent foreground propagation in video","venue":null,"work_id":"adf01bda-248d-40f3-bbdc-2cd548b9ba8b","year":2014},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.392170Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:e50e6b8bd50295d299caa7d3778307a830f9305a6a0b27739e8ebc5fe3e5620e","observation_id":"95f54f61-3eca-49eb-b7a9-576a161320aa","resolution":{"observed_at":"2026-08-14T13:46:13.952855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.931995Z","title":"Primary object segmentation in videos via alternate convex optimiza- tion of foreground and background distributions","venue":null,"work_id":"1018a736-5833-4329-8bad-af7891a8da30","year":2016},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.395792Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:a90f3162709afce510861aaa3ec8bb4331e11bae12e3f03fe9390f33b480cb7e","observation_id":"1d33efd4-9c6d-47d5-8c7b-b81d2956ef38","resolution":{"observed_at":"2026-08-14T13:46:13.935800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.399295Z","title":"Caffe: Convolutional architecture for fast feature embedding","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.399295Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:7651617576988858e5f17df634abeb6734ec775a11e87a44e41e8d38cfe5f638","observation_id":"6b97cd84-f490-4fb5-98be-634cc9beb439","resolution":{"observed_at":"2026-08-14T13:46:13.399295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.915394Z","title":"We- bly supervised semantic segmentation","venue":null,"work_id":"02e7ae1f-39a0-4b20-a9a7-d0fe812907f3","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.402761Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:a1750522d3f0130d61c1ba30bae07f3a04046b0ea9992db90da2381cc67d9999","observation_id":"5cffc7f8-f57f-4a17-95ed-8565aae36622","resolution":{"observed_at":"2026-08-14T13:46:13.919204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.905876Z","title":"Two-phase learning for weakly supervised object localization","venue":null,"work_id":"705a490c-57e1-4854-a192-d7d07ceaf760","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.406106Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:055c09051d2c3d0f906d8f4cae4a919ea769ae563dbd084ae1d9cf9563ba9a2f","observation_id":"ee578fd5-5dab-42a8-8bcc-03892fedfe80","resolution":{"observed_at":"2026-08-14T13:46:13.909105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.896956Z","title":"Seed, ex- pand and constrain: Three principles for weakly-supervised image segmentation","venue":null,"work_id":"0ac1b553-dc0f-48eb-876c-b5b56824a281","year":2016},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.409504Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:49a9525a7a6acc61edbc40d8f09fe27f587acca9161d1e29379e90b27281bea5","observation_id":"35c2e2f5-1964-4abc-a136-e97dd4eb033b","resolution":{"observed_at":"2026-08-14T13:46:13.900162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.887690Z","title":"Ficklenet: Weakly and semi-supervised se- mantic image segmentation using stochastic inference","venue":null,"work_id":"b1098eb3-d444-4d70-9465-723972d1052d","year":2019},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.412823Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:038748f4559fafb7233ab5d55012292d726b32a466751ab42364e0afc1f73406","observation_id":"eed1a8c1-be6f-4fe5-bfe3-0f5d1b3411d5","resolution":{"observed_at":"2026-08-14T13:46:13.890991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11393","last_updated":"2018-05-29T12:36:24Z","snapshot_observed_at":"2026-08-14T19:09:58.211829Z","submitted_at":"2018-05-29T12:36:24Z","title":"Robust Tumor Localization with Pyramid Grad-CAM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11393","snapshot_observed_at":"2026-08-14T13:46:13.415872Z","title":"Robust tumor localization with pyramid grad-cam","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.415872Z"},"links":{"cited_paper":"/paper/1805.11393","citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:4cc1b01a7417feea5858bf780b44a0926ab21502ef91d5f316d060199e2b7055","observation_id":"f3d90260-649c-40ad-97e0-626ed8eabe5d","resolution":{"observed_at":"2026-08-14T13:46:13.415872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.877362Z","title":"Tell me where to look: Guided attention inference network","venue":null,"work_id":"5cdba210-1c88-4aed-94c1-c7a6e96f8ff6","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.419176Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:461e90b707e6285c7825553a34a44fc8a38d3e6f76221858174283fcd95f1c45","observation_id":"1bbcec27-fa34-4e37-b24f-e38c55a2a64f","resolution":{"observed_at":"2026-08-14T13:46:13.881030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.867559Z","title":"Fully convolutional networks for semantic segmentation","venue":null,"work_id":"7009e970-d73b-42f3-b28e-63853ded14aa","year":2015},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.422183Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:8dc0b211c0d58a808b0074f63a53d645e076fa4b6bfece9f4a2caea72c054aab","observation_id":"46431c71-c144-4c72-8eee-c7d722bb5ec6","resolution":{"observed_at":"2026-08-14T13:46:13.870564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.858508Z","title":"Fast object segmen- tation in unconstrained video","venue":null,"work_id":"991eacdf-f43d-4172-8d0e-b90154eff634","year":2013},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.425029Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:c962ec1694c1338b06aa6214efae9b22627e1dd5196c4fa472dbfc6d700b6cd2","observation_id":"161c241c-f68d-47a9-b690-32a0fc2f9fa9","resolution":{"observed_at":"2026-08-14T13:46:13.861453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.848478Z","title":"Automatic dif- ferentiation in pytorch","venue":null,"work_id":"9d050617-64ed-4b79-af46-9d141b181359","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.428146Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:c3e51712a299464fc52685a48eb26e8a457dfbd49d757ac81da21018abbc5f3f","observation_id":"a701efb2-1a51-4ccc-8dc3-a7f5f5f1fe06","resolution":{"observed_at":"2026-08-14T13:46:13.851971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.837089Z","title":"From image-level to pixel-level labeling with convolutional networks","venue":null,"work_id":"6f3d0ec0-0247-44cf-8739-340465d0c5a6","year":2015},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.431123Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:04e26a569505ed4edd13cc2c553b688d55bb35074f85c12fed66a5f4e661d1d4","observation_id":"1b260f41-9542-4fe1-bc11-9f0215711269","resolution":{"observed_at":"2026-08-14T13:46:13.841382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.826429Z","title":"Learning object class detec- tors from weakly annotated video","venue":null,"work_id":"98efa005-03d1-4544-ac16-6dc9616b9362","year":2012},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.434078Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:f4cc40277fa70b03bb25c3d5dcdd5b97bea91547212b06c962d435d6ce67ed8c","observation_id":"65722d76-f668-4fb4-b173-874ed4b72c58","resolution":{"observed_at":"2026-08-14T13:46:13.830087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.815499Z","title":"Grabcut: Interactive foreground extraction using iterated graph cuts","venue":null,"work_id":"15cb11d8-3af5-4e26-8bf6-902310bb29d5","year":2004},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.437550Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:e15adc69600698b7330f5182593a8188124376df4ff929c887e00bc996278014","observation_id":"f0e5c4ff-d8b8-4d28-a51b-52935d2e9378","resolution":{"observed_at":"2026-08-14T13:46:13.819403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.805322Z","title":"Combining bottom-up, top-down, and smoothness cues for weakly supervised im- age segmentation","venue":null,"work_id":"722a38fd-30d5-40dd-b8b6-35eb52ffc812","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.441079Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:086be87da023b65745a724d517e21740ba6d1be7c79164a4d9241335aa996b74","observation_id":"f1a8e1f0-f1f6-436d-b222-d499dd5065e8","resolution":{"observed_at":"2026-08-14T13:46:13.808599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.795340Z","title":"Bringing background into the foreground: Making all classes equal in weakly-supervised video semantic segmentation","venue":null,"work_id":"183105f6-84cf-42ec-a752-cad6085d595c","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.444438Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:dfb99a9c66bb6414ae0b333019a6768b9b75f932a9ff858b16e983ada810b6d2","observation_id":"6ffa9795-1811-4856-9db3-6768041ca395","resolution":{"observed_at":"2026-08-14T13:46:13.799093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.784828Z","title":"Bootstrapping the performance of webly supervised seman- tic segmentation","venue":null,"work_id":"579c37e3-d64b-492e-8ec3-c971e830090e","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.447997Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:586f569a531725105886222a2f662674097b51159b92a7f356e7642ed67789a4","observation_id":"e483c11c-21cc-4278-8ddd-70facf9dacd3","resolution":{"observed_at":"2026-08-14T13:46:13.788601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-14T23:20:42.336514Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-14T13:46:13.451608Z","title":"Very deep convo- lutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.451608Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:f5b38fce17912e1e06a84a4b4146b9a7fc6fe3fc54549e6daddff3b39a5869f3","observation_id":"53142c9e-385c-4817-a6a0-b650644eedec","resolution":{"observed_at":"2026-08-14T13:46:13.451608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.455390Z","title":"Dropout: a simple way to prevent neural networks from overﬁtting","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.455390Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:6b8e9daded8ae84a48ab5145806c7fd664d1d40ed4308a947149478064931e5b","observation_id":"12623186-c83d-43fd-9a79-866b91bcc2b2","resolution":{"observed_at":"2026-08-14T13:46:13.455390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.769347Z","title":"Pwc-net: Cnns for optical ﬂow using pyramid, warping, and cost volume","venue":null,"work_id":"cf76b001-8e73-4313-8677-077013e4e6bd","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.459023Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:050b2e36b8b68ab771da6a21ff18e9c6b23bc558157e2d56892ab281b132849d","observation_id":"c7093700-1c7d-41a4-b6c5-ac8d72163d20","resolution":{"observed_at":"2026-08-14T13:46:13.772620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.759490Z","title":"Discriminative segment annotation in weakly labeled video","venue":null,"work_id":"ba0e107c-b6a2-431a-9b7f-00dc131b5117","year":2013},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.461936Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:aa5c0b91b1d0e7ffda352297a5683ec7f668649754a845deb8d9d0abde0a5cea","observation_id":"1d153998-306c-4dd7-884d-28bc752e154e","resolution":{"observed_at":"2026-08-14T13:46:13.763542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.749625Z","title":"Normalized cut loss for weakly-supervised cnn segmentation","venue":null,"work_id":"fa7da182-b0f8-426a-8247-1b2769fb4126","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.464761Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:459c080836cfffc897736b55efc7350fb71182b33a12e83bb9c95f6e57e4c3e2","observation_id":"927c4bce-723a-4291-9209-37559661f837","resolution":{"observed_at":"2026-08-14T13:46:13.753264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.740133Z","title":"On regularized losses for weakly-supervised cnn segmentation","venue":null,"work_id":"af3e95bf-60e9-4a20-81ee-ae5c90a0d59e","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.467601Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:b38b30197542d62faaa1c719ff3fc4aa23d3b792b3aa5a7c5adb1eaed6f9a460","observation_id":"8446da94-f187-4ddf-9400-4a9efbae123b","resolution":{"observed_at":"2026-08-14T13:46:13.743432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.728669Z","title":"Weakly-supervised semantic segmentation using motion cues","venue":null,"work_id":"a141ea83-bb93-4567-b5fb-721454ce7f14","year":2016},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.470423Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:2a5993dcb1887d1d1090794dc15bf0c577a88bee8146c511add905657c104fad","observation_id":"3cf214e0-450c-41c0-b5a7-956cf73c2aeb","resolution":{"observed_at":"2026-08-14T13:46:13.732714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.718803Z","title":"Weakly- supervised semantic segmentation by iteratively mining common object features","venue":null,"work_id":"51ac7169-7ac8-48fe-a4b9-bcca5faa1976","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.473763Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:50dfd2802bd7737245281feffe38a06e717b13181d90f6baa3b99e3179fa0f1a","observation_id":"f6f16da1-ea6c-4dc4-a1a1-ffd4d695151d","resolution":{"observed_at":"2026-08-14T13:46:13.722481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.708400Z","title":"Object region mining with adversarial erasing: A simple classiﬁcation to semantic segmentation approach","venue":null,"work_id":"a1111760-cab7-4892-a0cd-9675ae688360","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.477171Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:64fe25114c1fa82be03c99e281f2f4df6e790de4c9790b09d276f7ef91667e4e","observation_id":"35486cdb-2031-4bd7-a0fb-16670e295e40","resolution":{"observed_at":"2026-08-14T13:46:13.711354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.698248Z","title":"Stc: A simple to complex framework for weakly- supervised semantic segmentation","venue":null,"work_id":"0274d497-ab34-4618-a062-50cda81a3bf1","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.480631Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:c92a63290ecc653d16e2ea64c4810048448555240e0cb8b4c4313a5b94758a95","observation_id":"6d17bd0b-fe83-4b4b-9db9-adc13a091f41","resolution":{"observed_at":"2026-08-14T13:46:13.701972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.687449Z","title":"Revisiting dilated convolution: A simple approach for weakly-and semi-supervised seman- tic segmentation","venue":null,"work_id":"60698ddb-cd9d-495b-83e6-2b27e787c887","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.484928Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:6d46836293dd7acd33996a9db047416e6619bcc456237549fb01714c0b0a51a1","observation_id":"bdc0198c-6973-4df6-bdb4-be01cf929e78","resolution":{"observed_at":"2026-08-14T13:46:13.691355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.675957Z","title":"Segmentation in weakly labeled videos via a seman- tic ranking and optical warping network","venue":null,"work_id":"87a3f04a-bb57-4fca-88a6-258cbbceac6d","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.488466Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:268f1193b7513076337425966f77d66328d4b4e904a524a39caca6b4e4985d8e","observation_id":"224c5c40-f8d8-40e8-809b-3d2539c4f7ff","resolution":{"observed_at":"2026-08-14T13:46:13.680211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.665883Z","title":"Learning a discriminative feature network for semantic segmentation","venue":null,"work_id":"768a76a7-2ab2-4db1-8df1-30736cb8ea8a","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.491936Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:75e6fd6c58d69ff6b6cc8183e3b4a71bd751a6254915ee8a9d128df3a4c95725","observation_id":"9289716b-a981-473a-86bd-467aade28d6c","resolution":{"observed_at":"2026-08-14T13:46:13.669290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.654215Z","title":"Adversarial complementary learning for weakly supervised object localization","venue":null,"work_id":"2e9048c8-e38c-454d-abb9-6358597fe41e","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.495384Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:87a5a39aef6120980d516ab69fb6e21cd1c25e83691a2f29ec3360e3a8db3686","observation_id":"b8048280-2458-440a-af43-4e3a0287479e","resolution":{"observed_at":"2026-08-14T13:46:13.658795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.643020Z","title":"Semantic object segmentation via detection in weakly labeled video","venue":null,"work_id":"c9b087a8-95c6-4215-b5e5-9e8b68f2660c","year":2015},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.499022Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:988163dd658f459237f371e1d7bd033981126181a3ba7c695fbf355d97bd789f","observation_id":"2fb351ab-ca85-40ae-9605-67f0a1a94719","resolution":{"observed_at":"2026-08-14T13:46:13.647385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.633762Z","title":"Semantic object segmentation in tagged videos via detection","venue":null,"work_id":"6ed1d7de-5b6a-4ea9-946f-f1725ad4d988","year":2018},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.503024Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:92f916578d36c62fc9b6b1763aaec42e59040ba65ec4147590cc93bf3f63c484","observation_id":"b1913582-5382-4d0e-b770-1da33d4b2f9a","resolution":{"observed_at":"2026-08-14T13:46:13.637026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.624017Z","title":"Pyramid scene parsing network","venue":null,"work_id":"bbc0968d-7a66-4e9a-890c-d1fcf440f2a8","year":2017},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.506412Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:a6f0f56adc484f1e3eb3a1e1ac1a86397efcbb9a3c8012f8f64ee1a8fea76b72","observation_id":"9bcc6e2a-d7f8-4b88-b478-0b7935421180","resolution":{"observed_at":"2026-08-14T13:46:13.627462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.612814Z","title":"Learning deep features for discrimi- native localization","venue":null,"work_id":"2c06d2b9-741d-425e-95b8-fdc2b2b54b24","year":2016},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.509951Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:bacfdaaedc0a7fdfc66e963638520fa308cabd7257faa25c3c4634e14b3fcd85","observation_id":"e0d4701a-f54e-4d40-9887-bdcb77e81571","resolution":{"observed_at":"2026-08-14T13:46:13.616657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:46:13.348322Z","title":"IEEE Conference on , pages 248–255","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-14T13:46:13.348322Z"},"links":{"citing_paper":"/paper/1908.04501"},"observation_digest":"sha256:60b774c24903f729c698e5b936816ed1372b5aef4923d541cc4334a84a569341","observation_id":"0df2e2f3-c8a1-44b4-9739-a9941f27f019","resolution":{"observed_at":"2026-08-14T13:46:13.348322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1908.04501","last_updated":"2019-08-13T06:04:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T17:41:49.295764Z","submitted_at":"2019-08-13T06:04:25Z","title":"Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic Segmentation"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":3,"verified_fuzzy":38},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:1908.04501."}