{"as_of":"2026-08-18T00:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc54d5e8c7ed268bf153d0e664d04d07ba2339b9bd67049e206998737da40e0e","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:21:37.131414Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.13174/citation-record","integrity":"/paper/2505.13174/integrity","json":"/paper/2505.13174/citation-record.json","paper":"/paper/2505.13174"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.404810Z","title":"Cuvler: Enhanced unsupervised object discoveries through exhaustive self-supervised transformers","venue":null,"work_id":"314d7503-42cf-4bf4-bf30-56c466c34d2f","year":2024},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.771948Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:8bf4d9484bd755e860943222f56968081b0c9f20ba6f679604b1d8b9592f8439","observation_id":"15023106-a249-4904-a543-f2adf375172f","resolution":{"observed_at":"2026-08-15T20:21:38.410618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.382933Z","title":"Self-supervised object-centric learning for videos","venue":null,"work_id":"bdfc66ef-90ff-4732-a342-4b5b83f58f61","year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.779353Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:aae1d137bfa414ee58016d093a3d1739a2fad7f9d6c2d8262aad5a32f6574ddf","observation_id":"f3a96ae6-af30-459d-b17c-e6af24b40405","resolution":{"observed_at":"2026-08-15T20:21:38.390232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.350325Z","title":"Emergence of object segmentation in perturbed generative models","venue":null,"work_id":"184ab267-6d8c-4dc0-98fe-abc29edbfd98","year":2019},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.787444Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:a3e82464bdf874d38e493cfa7addb490b1e75bb866dc7780b5bf9100d5231da4","observation_id":"7fdf7acf-f624-4fc1-a5ea-50414f8082eb","resolution":{"observed_at":"2026-08-15T20:21:38.357711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.326334Z","title":"Move: Unsupervised movable object segmentation and detection","venue":null,"work_id":"2bf115c9-8fe1-448c-ad13-00916b31d340","year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.795873Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:f73564dea58674675de9c6563e53327dae59aa5ba91c5eedd399ca804987b3a2","observation_id":"fec4936c-36d1-40a0-b1af-11d3a9f2301c","resolution":{"observed_at":"2026-08-15T20:21:38.333671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.300062Z","title":"Unsupervised learning of visual features by contrasting cluster assignments","venue":null,"work_id":"b1d5ce5a-8de7-4781-886b-bf6c71b01ac8","year":2020},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.805960Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:baa6e76bd8e655077dc02792667000d5fbf6bfbb6c47a526252ff14392a191b1","observation_id":"d66b11e9-4b11-427a-b6c1-e5303a50b25b","resolution":{"observed_at":"2026-08-15T20:21:38.308411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.276403Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"f8dccb98-aa32-4f6d-8fb0-4fed70c8ae3a","year":2021},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.813645Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:52a52ace76acb3a0f204ee141b29cf50adaf4e7c29fcc0d558f2eaa97aeb1db0","observation_id":"1987450c-2325-4180-9591-2096b04397ad","resolution":{"observed_at":"2026-08-15T20:21:38.284037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05587","last_updated":"2017-12-05T18:06:21Z","snapshot_observed_at":"2026-08-16T09:04:18.586776Z","submitted_at":"2017-06-17T22:48:57Z","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05587","snapshot_observed_at":"2026-08-15T20:21:36.820336Z","title":"Rethinking atrous convolution for semantic image segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.820336Z"},"links":{"cited_paper":"/paper/1706.05587","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:5d7204aa2ab63a92dddbea241792a2ca74029d371215d80d68002d331e0431cd","observation_id":"a31318b0-a11b-4c03-84ae-e127b1cf6be4","resolution":{"observed_at":"2026-08-15T20:21:36.820336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.252419Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"b3c2d738-6a72-4469-8703-3951e70838c3","year":2020},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.827568Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:7bd073247f777b8a0c6562347c624a3b41341b31242f808a9f803fb99bfca823","observation_id":"b50978c4-4638-4270-83df-d5a6750ce6b1","resolution":{"observed_at":"2026-08-15T20:21:38.260341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10764","last_updated":"2021-12-20T18:59:59Z","snapshot_observed_at":"2026-08-16T17:33:11.166137Z","submitted_at":"2021-12-20T18:59:59Z","title":"Mask2Former for Video Instance Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10764","snapshot_observed_at":"2026-08-15T20:21:36.837189Z","title":"Mask2former for video instance segmentation.arXiv preprint arXiv:2112.10764, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.837189Z"},"links":{"cited_paper":"/paper/2112.10764","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:725b2de4fd34d1496c5668f7da6b03ed07d66517e34cc96721178a05b576b722","observation_id":"31564ca5-2573-4118-a17f-5537b1ffd683","resolution":{"observed_at":"2026-08-15T20:21:36.837189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.230704Z","title":"Per-pixel classification is not all you need for semantic segmentation","venue":null,"work_id":"51218d7c-bb2e-4fe4-ba63-a31bba0c2ecf","year":2021},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.846357Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:84b51257fb6b26be4bda04e185376532723744aa855e7b49a0a9ddc8e7de9faf","observation_id":"f88abbb6-7ede-453a-957d-b232728a051a","resolution":{"observed_at":"2026-08-15T20:21:38.237944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07844","last_updated":"2022-10-13T18:01:37Z","snapshot_observed_at":"2026-08-16T16:59:56.804768Z","submitted_at":"2022-05-16T17:55:34Z","title":"Guess What Moves: Unsupervised Video and Image Segmentation by Anticipating Motion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07844","snapshot_observed_at":"2026-08-15T20:21:36.851971Z","title":"Guess what moves: Unsupervised video and image segmentation by anticipating motion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.851971Z"},"links":{"cited_paper":"/paper/2205.07844","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:b56ca5e537838c49ea268c373fb8e765bb5b68a27732f82a22ff85aa713b9e88","observation_id":"356fb76d-b7b4-4073-9545-321f160dc9f1","resolution":{"observed_at":"2026-08-15T20:21:36.851971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:36.858425Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.858425Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:225886a3823f3c1c506a9257e5e3620ee5fb7afcdbea23c72687fb53676324bf","observation_id":"0d208993-b055-4383-b089-da4315014219","resolution":{"observed_at":"2026-08-15T20:21:36.858425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08414","last_updated":"2022-03-16T06:08:47Z","snapshot_observed_at":"2026-08-16T17:14:12.128626Z","submitted_at":"2022-03-16T06:08:47Z","title":"Unsupervised Semantic Segmentation by Distilling Feature Correspondences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08414","snapshot_observed_at":"2026-08-15T20:21:36.864678Z","title":"Unsupervised semantic segmentation by distilling feature correspondences","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.864678Z"},"links":{"cited_paper":"/paper/2203.08414","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:3885dd54c5cabd47044950e1a285665112885ef71e114894095525ae3e22a9ab","observation_id":"2c6ae53a-09fe-4cfc-bb8f-fd05e8219b6d","resolution":{"observed_at":"2026-08-15T20:21:36.864678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:36.870518Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.870518Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:89f3bccc20171d7bc90cfbf8015c76ca12f99035b587514e44b772300cf268f6","observation_id":"d47da380-f06b-463a-91d9-735cf09e6500","resolution":{"observed_at":"2026-08-15T20:21:36.870518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.175476Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":"dcfacdcd-8429-4fe6-9afb-f7a46e85f5c9","year":2020},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.878561Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:6678969c4b05ff0f221ba86f14c1d63349c63d1ecd283f0743b8b19ba67be76e","observation_id":"c8c0c610-8945-4fd3-bd68-0d618d0db3dc","resolution":{"observed_at":"2026-08-15T20:21:38.182369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:36.884848Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.884848Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:debfc9a3e778fd6b31a681e48a3c03fdf7fed5902e960dc8bc2b655094b2cf0d","observation_id":"ae4b76f3-685f-43fe-8346-8200193d81f5","resolution":{"observed_at":"2026-08-15T20:21:36.884848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.135525Z","title":"Segment anything in high quality","venue":null,"work_id":"242b6d93-8712-4230-b1e6-0ce5cf057d5b","year":2024},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.890934Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:52b62a50d2e60b908711ea34932a531b18c3891eb73368b22b9ee576266cef73","observation_id":"288fb254-66fb-44af-a0ed-2a0230ab7a6b","resolution":{"observed_at":"2026-08-15T20:21:38.141970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.114095Z","title":"Motion trajectory segmentation via minimum cost multicuts","venue":null,"work_id":"02ed0e70-bd4e-407b-aeff-7b12f5b7f017","year":2015},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.896111Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:8ff2e8a4c6af661e77982467247e719c20aeb8f512b25d70cb3d11c966aa01cc","observation_id":"896e50e7-cad7-4a2a-a37d-1cd4f3d6a2b9","resolution":{"observed_at":"2026-08-15T20:21:38.121200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.086405Z","title":"Motion segmen- tation & multiple object tracking by correlation co-clustering","venue":null,"work_id":"70cd9da9-0054-46fb-b8e7-f341df0040b9","year":2018},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.902543Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:472ccee0db519cb174ad8cb64e7808f734fe53b43383b071301d9a8d271247bc","observation_id":"f6a91f21-b3ca-46b7-931a-d0c527b8d421","resolution":{"observed_at":"2026-08-15T20:21:38.094034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-15T20:21:36.907893Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.907893Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:839b7788ae730e43e7c3de85bf0ffeb783335bfe5f91b7466daa0f91801dafc4","observation_id":"7232316b-7c5f-444c-9e41-50dc8f5f5ea4","resolution":{"observed_at":"2026-08-15T20:21:36.907893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.062171Z","title":"Efficient inference in fully connected crfs with gaussian edge potentials","venue":null,"work_id":"9e702f7f-866e-4356-8178-ccb6df80ce6d","year":2011},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.915945Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:d5a7cd6ede246589183c15c212bfdfa2ffa8e4ed234f9d2fec227c721bc60c8b","observation_id":"c0847535-940c-41cb-95e9-9b13bb2c6319","resolution":{"observed_at":"2026-08-15T20:21:38.069785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T20:21:36.921652Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.921652Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:0813edc863ecb0d707055b1b4e59849c945bfbd1c061316cfd193a1c8c46ed86","observation_id":"25638229-698b-4e17-ba3b-403091b5ff8f","resolution":{"observed_at":"2026-08-15T20:21:36.921652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.038847Z","title":"Deep spectral meth- ods: A surprisingly strong baseline for unsupervised semantic segmentation and localization","venue":null,"work_id":"a4125a85-97e3-435d-98e8-17d8522671a2","year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.928001Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:a31d50833bc248baa3c2acaaae2ce28afc668fb8a89c61b0aab29e2f8565e3dc","observation_id":"d8b9aac5-0c0c-4945-a0a7-5daa44446708","resolution":{"observed_at":"2026-08-15T20:21:38.045811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-15T20:21:36.939257Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.939257Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:a0cc2121a015b3ab5235c5d8c88830cfd8fead7a945884a1755de45c77ebd5d1","observation_id":"0e1fcca5-f31f-4f2d-96cd-dc1c93698b75","resolution":{"observed_at":"2026-08-15T20:21:36.939257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-15T20:21:36.949955Z","title":"The 2017 davis challenge on video object segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.949955Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:3375a25e3d5d380f055121df6474a33c5f270e1c1733e8016dae90abebe56acb","observation_id":"7feff057-24e2-488a-b31c-a706c327cdc0","resolution":{"observed_at":"2026-08-15T20:21:36.949955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:38.015692Z","title":"U2-net: Going deeper with nested u-structure for salient object detection","venue":null,"work_id":"08a3fd80-847f-46fd-8ff6-0f159c52a838","year":2020},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.961257Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:4dbb009dc82e2f1a1b2b54341e680944fa3cb80c0392c693837d6198d52fd04d","observation_id":"4219839b-fc40-48d2-95eb-238b39b71be1","resolution":{"observed_at":"2026-08-15T20:21:38.023547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-15T20:21:36.969729Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.969729Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:a24381e85b86b689b3864acefab5e7b21d56a50750c9948e9874a701a574c87c","observation_id":"d42de9d6-70ad-4f2f-a95e-01dc759a0892","resolution":{"observed_at":"2026-08-15T20:21:36.969729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.971923Z","title":"Sempart: Self-supervised multi-resolution partitioning of image semantics","venue":null,"work_id":"67999375-2579-4f00-b980-5b1b278a3756","year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.975923Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:ffb5b121b85b5058015c38aadc1fa47e2950ed37093c1232e8b9218397bf3597","observation_id":"8902a1c4-d7e7-45fc-a8d4-be4c6163acc4","resolution":{"observed_at":"2026-08-15T20:21:37.983468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:36.984535Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.984535Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:bcd9666693220a143128ce2a221e8115f32a218f2ceb2d313dc05a5ba7f14d18","observation_id":"b1e62234-9ce0-4072-98e1-a9accfe683eb","resolution":{"observed_at":"2026-08-15T20:21:36.984535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.931723Z","title":"Multi-object discovery by low-dimensional object motion","venue":null,"work_id":"75092417-8910-4cea-aa16-27e6687fec7f","year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.990423Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:bd304a2e379b2e58be748c7dce0d16962a5ad0d5d531075bb53b08a15c80a6e4","observation_id":"c37670a3-fa27-4a4f-a829-ea1893e1dec8","resolution":{"observed_at":"2026-08-15T20:21:37.939957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03392","last_updated":"2024-11-28T13:51:19Z","snapshot_observed_at":"2026-08-16T14:03:40.086518Z","submitted_at":"2024-04-04T11:49:56Z","title":"Boosting Unsupervised Segmentation Learning","version":3},"cited_work":{"arxiv_id":"2404.03392","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.03392","snapshot_observed_at":"2026-08-15T20:21:37.291139Z","title":"Boosting Unsupervised Segmentation Learning","venue":"cs.CV","work_id":"e3d3a25d-175a-4cf5-abb0-31d56c3745f4","year":2024},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:36.996277Z"},"links":{"cited_paper":"/paper/2404.03392","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:d766042b8abd30b137134eabbd5ecea09dcaf17179f5099adc8db3e51e6742c5","observation_id":"4fd01782-d4a2-4af4-9d3f-dcbeee5bf41a","resolution":{"observed_at":"2026-08-15T20:21:37.301255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14860","last_updated":"2023-03-06T23:19:17Z","snapshot_observed_at":"2026-08-16T16:28:08.583930Z","submitted_at":"2022-09-29T15:24:47Z","title":"Bridging the Gap to Real-World Object-Centric Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14860","snapshot_observed_at":"2026-08-15T20:21:37.002560Z","title":"Bridging the gap to real-world object-centric learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.002560Z"},"links":{"cited_paper":"/paper/2209.14860","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:4bb1821b093684efcb1114e6db268357b3a119b5cc6d2fec0ed87e585593e180","observation_id":"2aa9e2f6-9a32-42e1-9ac2-f1359c5489ef","resolution":{"observed_at":"2026-08-15T20:21:37.002560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.008548Z","title":"Normalized cuts and image segmentation","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.008548Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:abe84dd392cdb4fcf553d681e900863357f9f81b085e17f0ee56a4178e79316d","observation_id":"872b4dfe-d32d-4646-b461-3888148d784c","resolution":{"observed_at":"2026-08-15T20:21:37.008548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.887477Z","title":"Unsupervised salient object detection with spectral cluster voting","venue":null,"work_id":"f45a50d8-96cd-419e-8c80-0b72e931543b","year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.020732Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:6e58ec6a6e4d109752102c75d189d7112cf45ae402e7b31341af7996a78aed1f","observation_id":"ead0b026-6018-4c12-b47e-285021c835d0","resolution":{"observed_at":"2026-08-15T20:21:37.897272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.026694Z","title":"Localizing objects with self-supervised transformers and no labels","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.026694Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:a17f86794d2cdeb5d2829bce9dcec5a4d9af87a0279d4029b28e6b72d55eace3","observation_id":"93585474-7f72-41db-8f26-6bcb698ba46a","resolution":{"observed_at":"2026-08-15T20:21:37.026694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.852235Z","title":"Unsupervised object localization: Observing the background to discover objects","venue":null,"work_id":"91f47bcc-8af2-462e-9ca3-85d2f1e81971","year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.034624Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:adb056827a5a08f2b148f5c84d13d119d109c6f602226a7b895a5edaa3572194","observation_id":"e228c4e3-dace-44c0-b25e-d613db655ed3","resolution":{"observed_at":"2026-08-15T20:21:37.859086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11239","last_updated":"2023-12-02T18:06:55Z","snapshot_observed_at":"2026-08-16T15:06:46.489601Z","submitted_at":"2023-08-22T07:27:09Z","title":"LOCATE: Self-supervised Object Discovery via Flow-guided Graph-cut and Bootstrapped Self-training","version":3},"cited_work":{"arxiv_id":"2308.11239","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.11239","snapshot_observed_at":"2026-08-15T20:21:37.235363Z","title":"LOCATE: Self-supervised Object Discovery via Flow-guided Graph-cut and Bootstrapped Self-training","venue":"cs.CV","work_id":"1db87d65-f803-4a10-9881-58d3af219c45","year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.040755Z"},"links":{"cited_paper":"/paper/2308.11239","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:279c04cc56a5cb5f2e475a758b54c4dcfc84a53985d0d149211ffed3e5335585","observation_id":"213ba733-b3a6-4454-8225-38e8acaed99a","resolution":{"observed_at":"2026-08-15T20:21:37.243752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.821889Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":"2d415615-5d85-47d0-b8a2-2f821039e95d","year":2020},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.048782Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:f44275c7ad257ea0ac6954f92bb85fae38cb6b0417a9c37aa287e568c4fb6416","observation_id":"47186e99-88b0-41d3-b2b0-ae2040eaaec5","resolution":{"observed_at":"2026-08-15T20:21:37.833557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.788655Z","title":"Cut and learn for unsupervised object detection and instance segmentation","venue":null,"work_id":"0c9a9cc1-f6dd-4bfd-8d7f-631a6af40dec","year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.055492Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:a5c873d79bd54d9e7eb1bdbe805dd70686fe48f196078c1cf2562bf2decc664f","observation_id":"bc82d896-4684-4133-a057-1e2288d31ac4","resolution":{"observed_at":"2026-08-15T20:21:37.799313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.768095Z","title":"Videocutler: Surprisingly simple unsupervised video instance segmentation","venue":null,"work_id":"2f46afef-94ed-4107-99b9-f1268b7a2798","year":2024},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.061945Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:4637018ddf924039da2457d3fa33eab0636172f0a8a6c24b9a9e2662c872e4e6","observation_id":"d69f1582-8388-4ddc-89af-5c97cc68bad2","resolution":{"observed_at":"2026-08-15T20:21:37.774760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.743293Z","title":"Segment anything without supervision","venue":null,"work_id":"f2f7c999-e5e5-4cca-9405-7e85bef27750","year":2025},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.067578Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:5753683b168ec90307e6375ac7d902d5c9714e406906ca9c04d210eb322dfe26","observation_id":"24190904-4686-4f43-8986-59201b0f9141","resolution":{"observed_at":"2026-08-15T20:21:37.751366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.699944Z","title":"Tokencut: Segmenting objects in images and videos with self- supervised transformer and normalized cut","venue":null,"work_id":"b57c5668-d413-4921-af12-4b22282f8052","year":2023},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.074487Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:74ab75b02515e9b609dcf9a6f288f3ad420921497c16ce0248ed7bd87bba3742","observation_id":"1686e8a6-b54f-43b7-8146-2e3446e5d7eb","resolution":{"observed_at":"2026-08-15T20:21:37.718903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.670974Z","title":"Segmenting moving objects via an object-centric layered representation","venue":null,"work_id":"d22ab4a3-83db-4248-a466-2b8387592db0","year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.086159Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:1378b870cd1f8a9504534e97ba2be63967e50af2a6bd94c8f6a83014306bbe5e","observation_id":"8f1e5cb7-40a4-4a5d-9d15-b4b22d1c55cc","resolution":{"observed_at":"2026-08-15T20:21:37.678862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.645690Z","title":"Self-supervised video object segmentation by motion grouping","venue":null,"work_id":"c50faf9b-4807-4ec9-89d7-f5dec434fc13","year":2021},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.095790Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:c863a75b59246580e081cfcd8220c9eb1233ae11f10dc2f6614b92e00c588434","observation_id":"33ce6912-30fa-488f-bc1f-78337161de05","resolution":{"observed_at":"2026-08-15T20:21:37.652650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.625143Z","title":"The 3rd large-scale video object segmentation challenge - video instance segmentation track, June 2021","venue":null,"work_id":"672e2638-aa35-4bfa-b8ee-0678c290897e","year":2021},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.107520Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:0a3c92ef9b9d3a522d7e3c3e997dc8ba17934507a210114ec8b952500a27537d","observation_id":"47b30564-f578-4a10-a018-6f1f753b1fa9","resolution":{"observed_at":"2026-08-15T20:21:37.630804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.599741Z","title":"Video instance segmentation","venue":null,"work_id":"fb6f6429-525f-4088-b9a9-cab85be74b95","year":2019},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.115035Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:d6c8f91b19193eb707a269b4a6e5ba9fb8789b6ed443019f033652e8d9c1fac8","observation_id":"857a2ef6-4567-4a1c-8c9a-393009c8eb8b","resolution":{"observed_at":"2026-08-15T20:21:37.605799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:37.572767Z","title":"Deformable sprites for unsupervised video decomposition","venue":null,"work_id":"767112da-99ae-4f81-a799-4d3e9949908e","year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.123566Z"},"links":{"citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:30e57c67d2a3efa38060d35a3d966e028dabac54c3fa75c8f3fd6a97154e1c98","observation_id":"1d363276-e8be-4c51-8f67-6c7f3fc82f7d","resolution":{"observed_at":"2026-08-15T20:21:37.582768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05027","last_updated":"2023-04-30T17:39:42Z","snapshot_observed_at":"2026-08-16T16:46:50.124140Z","submitted_at":"2022-07-11T17:28:24Z","title":"Unsupervised Semantic Segmentation with Self-supervised Object-centric Representations","version":2},"cited_work":{"arxiv_id":"2207.05027","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.05027","snapshot_observed_at":"2026-08-15T20:21:37.189000Z","title":"Unsupervised Semantic Segmentation with Self-supervised Object-centric Representations","venue":"cs.CV","work_id":"c91c3c2d-6fc0-4b1b-ace7-a6d6da9da32a","year":2022},"citing_paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:37.131414Z"},"links":{"cited_paper":"/paper/2207.05027","citing_paper":"/paper/2505.13174"},"observation_digest":"sha256:d19669533e5a8d6ac0520a6340a2bd22169a89070c5cbb3d2b021661376d15f0","observation_id":"cbe9b551-8598-4171-8d88-6da0ca823d88","resolution":{"observed_at":"2026-08-15T20:21:37.202224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.13174","last_updated":"2025-05-19T14:30:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T13:48:21.851778Z","submitted_at":"2025-05-19T14:30:33Z","title":"FlowCut: Unsupervised Video Instance Segmentation via Temporal Mask Matching"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":3,"verified_fuzzy":29},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2505.13174."}