{"as_of":"2026-08-16T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c6cf025ea82530e16fa7a4090ca633958791735588057152c0f03c0c74f23db","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:12:08.806060Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12532/citation-record","integrity":"/paper/2608.12532/integrity","json":"/paper/2608.12532/citation-record.json","paper":"/paper/2608.12532"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1311.2971","last_updated":"2013-11-12T22:15:26Z","snapshot_observed_at":"2026-08-14T23:55:33.345514Z","submitted_at":"2013-11-12T22:15:26Z","title":"Approximate Inference in Continuous Determinantal Point Processes","version":1},"cited_work":{"arxiv_id":"1311.2971","doi":null,"metadata_source":"pith","pith_arxiv_id":"1311.2971","snapshot_observed_at":"2026-08-16T00:12:09.971218Z","title":"Approximate Inference in Continuous Determinantal Point Processes","venue":"stat.ML","work_id":"ad538e05-1a18-4357-be86-cd7aed7cba41","year":2013},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.453720Z"},"links":{"cited_paper":"/paper/1311.2971","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d25e7370e811f83aaea9220898c530df51e63e989a4088163ec49113413c3805","observation_id":"d4dbe156-d24f-4e83-9f29-2c5b1fbf0640","resolution":{"observed_at":"2026-08-16T00:12:09.978058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/1498759","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.874921Z","title":null,"venue":null,"work_id":"4fefbce7-4a1c-4a39-b1a5-15d207631078","year":2009},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.460874Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:3e8c0530195809bb9cc7916447bb9255e5c466ef3c7bae349a64edc6a35781d8","observation_id":"1961d953-885c-4543-92ed-d205ebf8d168","resolution":{"observed_at":"2026-08-16T00:12:08.881202Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-16T00:12:08.467239Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.467239Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:82d4376d0e01d9051483361832fb67fd5dace19406df4db19dbbc7ec5c21a7c9","observation_id":"186f881d-142a-4645-9ff8-e75c35dcd6f7","resolution":{"observed_at":"2026-08-16T00:12:08.467239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.348057Z","title":null,"venue":null,"work_id":"5c62080d-4a3b-46b2-b184-d8bb520c274a","year":2017},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.472735Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:01cc21fdeef62a91603701ede20781e81e6ee304652786177f8f1a6696eaeee6","observation_id":"9dd8a055-b0e3-4684-92ae-92861a8aa046","resolution":{"observed_at":"2026-08-16T00:12:10.353795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.330244Z","title":null,"venue":null,"work_id":"227dc0f2-ac67-4bed-9517-7053797940b2","year":2006},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.480282Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:7db3714d042fd6a9bb8808295fdf005d8f18fd8eb8aab6802a899518d4b4363c","observation_id":"7490f639-693a-4fde-bcaf-04e7b525a7c0","resolution":{"observed_at":"2026-08-16T00:12:10.335576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.313254Z","title":null,"venue":null,"work_id":"9d0c0a31-16b7-4e6e-b7b9-5a6875e3cf6a","year":2017},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.488344Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:842342978773884c8f0217b4166617e175186da4010733973885482764f7b25d","observation_id":"da8d9f6b-130c-4a33-b921-1f7aadbd06db","resolution":{"observed_at":"2026-08-16T00:12:10.318049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.293722Z","title":null,"venue":null,"work_id":"a48e58ee-bf17-4078-b242-04a2d625e70b","year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.495164Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:68b94f9cacbfdc22b85ed29b311c738462405240763f570f52be904e7e61b52f","observation_id":"1d7285b9-65c3-4754-b8d0-4741a9171608","resolution":{"observed_at":"2026-08-16T00:12:10.299266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.507283Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.507283Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:3b04e2e57690525d556203c5607a77147e1ca094fab47e6544557f7ca22afb7c","observation_id":"939426ae-fe3f-45e3-ad3e-778583142945","resolution":{"observed_at":"2026-08-16T00:12:08.507283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.273142Z","title":null,"venue":null,"work_id":"e63362e8-3111-4af2-b161-1cf61dc45e76","year":2018},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.513691Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:e4171061f2de8ebd99680c03663f6d84ec17e3ae82804c5f4095ed4aa67b6561","observation_id":"a7cbc843-5ee4-4320-ada5-cb6e7da0509b","resolution":{"observed_at":"2026-08-16T00:12:10.277850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.255016Z","title":null,"venue":null,"work_id":"e24d8c6a-474b-4907-a424-cba1cefd8f8b","year":2024},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.518541Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:bff378e0ecd400b145cc51ffa9f337696dea7f092713642dfe036016f96eff1d","observation_id":"5c222176-9ba9-409e-949e-c821651c6c79","resolution":{"observed_at":"2026-08-16T00:12:10.260961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11740","last_updated":"2020-07-17T22:19:59Z","snapshot_observed_at":"2026-08-09T19:02:25.484253Z","submitted_at":"2019-09-25T20:02:54Z","title":"UNITER: UNiversal Image-TExt Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11740","snapshot_observed_at":"2026-08-16T00:12:08.524191Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.524191Z"},"links":{"cited_paper":"/paper/1909.11740","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d2a21cc647db88a69352a2299df04bbe7f21f146ae4e542c2178ba8f37a42b8c","observation_id":"cbc61fdb-edcc-469f-b999-c395dde7d123","resolution":{"observed_at":"2026-08-16T00:12:08.524191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.529322Z","title":"Bruce Croft","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.529322Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:5fabb17c109242e0a616774eeafb529cc4a72558b6894d4094cd38ab800b32a3","observation_id":"730050d4-6d3c-480b-aa68-a9ce65cd0b3a","resolution":{"observed_at":"2026-08-16T00:12:08.529322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1102.3975","last_updated":"2011-02-25T01:12:26Z","snapshot_observed_at":"2026-08-15T04:54:14.968472Z","submitted_at":"2011-02-19T07:25:00Z","title":"Submodular meets Spectral: Greedy Algorithms for Subset Selection, Sparse Approximation and Dictionary Selection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1102.3975","snapshot_observed_at":"2026-08-16T00:12:08.534150Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.534150Z"},"links":{"cited_paper":"/paper/1102.3975","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:791939335243125198b1494eaeb346ec2f315bc2115955284888ceeb67ce9642","observation_id":"6612cc48-66dd-49f3-9636-a9344a187bf7","resolution":{"observed_at":"2026-08-16T00:12:08.534150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0912.0322","last_updated":"2011-11-06T22:23:46Z","snapshot_observed_at":"2026-08-15T05:32:32.434938Z","submitted_at":"2009-12-02T02:02:27Z","title":"Submodular Functions: Extensions, Distributions, and Algorithms. A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0912.0322","snapshot_observed_at":"2026-08-16T00:12:08.539393Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.539393Z"},"links":{"cited_paper":"/paper/0912.0322","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:25d32e3f87446bde70423263636a65509983ceed0c50e0174b48a4c6757b5f02","observation_id":"a34fd930-33d2-4572-80e5-eade19308034","resolution":{"observed_at":"2026-08-16T00:12:08.539393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.237335Z","title":"Fleet, Jamie Ryan Kiros, and Sanja Fidler","venue":null,"work_id":"f98412cd-eb29-4290-a0e1-26a801a09276","year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.544243Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:b99f2824bddf2c485589dde9e452f6a35bf5e4cf16545baf441bb3c8ca3a5d32","observation_id":"3f5a4333-32c1-4fb8-8f59-2d09e7893ffb","resolution":{"observed_at":"2026-08-16T00:12:10.242818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02410","last_updated":"2023-07-02T22:58:51Z","snapshot_observed_at":"2026-08-13T14:12:29.107649Z","submitted_at":"2022-10-05T17:32:16Z","title":"The Vendi Score: A Diversity Evaluation Metric for Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02410","snapshot_observed_at":"2026-08-16T00:12:08.554593Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.554593Z"},"links":{"cited_paper":"/paper/2210.02410","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:73fd97bc2122367aaf32da015637a5fdb411002840ca6f29c2e86621a5ff4e97","observation_id":"98cc21dc-2dd8-4962-b82d-5986f1983eab","resolution":{"observed_at":"2026-08-16T00:12:08.554593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.217045Z","title":"Corrado, Jonathon Shlens, Samy Bengio, Jeffrey Dean, Marc’Aurelio Ranzato, and Tomas Mikolov","venue":null,"work_id":"ec42d2e4-8b95-4887-b729-a4469b840308","year":2013},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.559831Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:55ef9cf49c74b7f835c48ad4db3a22832e2191149881dea38d7a117695e91912","observation_id":"f8a1e626-0a5d-4de4-ba86-adb272d68aac","resolution":{"observed_at":"2026-08-16T00:12:10.222701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1207.0560","last_updated":"2013-08-24T05:35:11Z","snapshot_observed_at":"2026-08-15T00:54:36.137079Z","submitted_at":"2012-07-03T01:25:10Z","title":"Algorithms for Approximate Minimization of the Difference Between Submodular Functions, with Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.0560","snapshot_observed_at":"2026-08-16T00:12:08.565556Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.565556Z"},"links":{"cited_paper":"/paper/1207.0560","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:ecb1ae0e63c63fe98c7f2d5a25426c04d7802bcc4fe1d1bf3e4ffffa6a319d52","observation_id":"6ebcc7e9-5ff9-40de-b24d-58b07db4d237","resolution":{"observed_at":"2026-08-16T00:12:08.565556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1311.2106","last_updated":"2013-11-08T23:28:02Z","snapshot_observed_at":"2026-08-14T23:55:56.018259Z","submitted_at":"2013-11-08T23:28:02Z","title":"Submodular Optimization with Submodular Cover and Submodular Knapsack Constraints","version":1},"cited_work":{"arxiv_id":"1311.2106","doi":null,"metadata_source":"pith","pith_arxiv_id":"1311.2106","snapshot_observed_at":"2026-08-16T00:12:09.661387Z","title":"Submodular Optimization with Submodular Cover and Submodular Knapsack Constraints","venue":"cs.DS","work_id":"a654fb73-d3e2-4500-b1e3-b3a56c73b64c","year":2013},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.571927Z"},"links":{"cited_paper":"/paper/1311.2106","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:e22e1a29786d1b3e482955136bca35aa90e21e8872e1a30394531f8005e7cb25","observation_id":"5c7c92ae-6ff9-4c63-aa59-1f6663a16862","resolution":{"observed_at":"2026-08-16T00:12:09.666903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05918","last_updated":"2021-06-11T07:51:39Z","snapshot_observed_at":"2026-08-13T20:15:51.556270Z","submitted_at":"2021-02-11T10:08:12Z","title":"Scaling Up Visual and Vision-Language Representation Learning With Noisy Text Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05918","snapshot_observed_at":"2026-08-16T00:12:08.581177Z","title":"Le, Yunhsuan Sung, Zhen Li, and Tom Duerig","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.581177Z"},"links":{"cited_paper":"/paper/2102.05918","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:86310559901ae851a9193303b2a4a1b5ebfa56583922310507b05b5ac145628c","observation_id":"e59a47cb-8137-4931-a00c-1b059f3e6e87","resolution":{"observed_at":"2026-08-16T00:12:08.581177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03334","last_updated":"2021-06-10T17:15:46Z","snapshot_observed_at":"2026-08-13T20:18:54.761653Z","submitted_at":"2021-02-05T18:36:11Z","title":"ViLT: Vision-and-Language Transformer Without Convolution or Region Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03334","snapshot_observed_at":"2026-08-16T00:12:08.587553Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.587553Z"},"links":{"cited_paper":"/paper/2102.03334","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d0c04409ddedd257511a365e053ea477a73cc4143293ffa4479fa94cf00a1d20","observation_id":"5b9568b8-3fc4-4537-a771-ed819cc9b0cb","resolution":{"observed_at":"2026-08-16T00:12:08.587553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7777.11277","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:09.598269Z","title":"Krause, C","venue":null,"work_id":"205ae28f-6682-4f98-b3e5-07e8ac180f9b","year":2006},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.593062Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:8c8b6ae79ada670c4f42f4fd12eff90af9cba8299f9855519d44bdb18caafb6c","observation_id":"6587dc4b-7e08-4da8-bde2-e8d2875003f7","resolution":{"observed_at":"2026-08-16T00:12:09.608051Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.07332","last_updated":"2016-02-23T22:00:40Z","snapshot_observed_at":"2026-08-14T22:09:05.495219Z","submitted_at":"2016-02-23T22:00:40Z","title":"Visual Genome: Connecting Language and Vision Using Crowdsourced Dense Image Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.07332","snapshot_observed_at":"2026-08-16T00:12:08.599566Z","title":"Shamma, Michael S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.599566Z"},"links":{"cited_paper":"/paper/1602.07332","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:bb81c142a03e7711f7a62d6c7dab5f2a7c38ffdc677e73882bde1cd0f3ed0aaf","observation_id":"fb4e51b1-1ae0-49aa-b948-932b3ab4c6ea","resolution":{"observed_at":"2026-08-16T00:12:08.599566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.199881Z","title":null,"venue":null,"work_id":"5b113664-b2c9-49eb-a32c-4f2a7faeb9d9","year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.607848Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:b5c9edd5b78163314afa161d5fc3291b6951b5ae2f8e404d4273a7624d198c7d","observation_id":"61e67617-4be6-4314-89ae-c773ff807522","resolution":{"observed_at":"2026-08-16T00:12:10.205281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.614330Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.614330Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:ac9c5da1e9bfe7b70ddb26854ec22706c7646ea8206bea0c2e01abebf35e8b00","observation_id":"9db7dba7-abbc-45f0-b19f-b98924d2c8ef","resolution":{"observed_at":"2026-08-16T00:12:08.614330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.620349Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.620349Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:26e43d95e1036936ff1fe1ccd379ab9dfde4aa269549ba2bb52e1ae614c3d7af","observation_id":"144054c1-b9a3-483c-a04d-61fbed774c4b","resolution":{"observed_at":"2026-08-16T00:12:08.620349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08024","last_updated":"2018-07-23T04:41:57Z","snapshot_observed_at":"2026-08-14T19:33:52.138713Z","submitted_at":"2018-03-21T17:22:27Z","title":"Stacked Cross Attention for Image-Text Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08024","snapshot_observed_at":"2026-08-16T00:12:08.625959Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.625959Z"},"links":{"cited_paper":"/paper/1803.08024","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d4ab8f9ab28533fa6b76119a306fb65de0d03fa738272726698eefeef83d4aae","observation_id":"49667ef4-6ca0-4611-b7a4-acf435fc2916","resolution":{"observed_at":"2026-08-16T00:12:08.625959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.631290Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.631290Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d67aa486489753012695817a83a78a843fa6b74577277b7740be5c3a31d35c3f","observation_id":"fc1bff25-a0fc-431a-b186-51bcf1541119","resolution":{"observed_at":"2026-08-16T00:12:08.631290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-16T00:12:08.635930Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.635930Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d078263b153bdb35d28c07ff2e3e25756606c7e3ea2a7f42224ce045b37f9f58","observation_id":"142f4c79-9716-4b9d-846b-a104524d20d0","resolution":{"observed_at":"2026-08-16T00:12:08.635930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.641323Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.641323Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:3c83a0fa6aca5473e43781d94e7f440827241f31717ef8e968d2fced8e9a2269","observation_id":"126d8755-12c5-46e8-bf04-d0d2ff4fe3c7","resolution":{"observed_at":"2026-08-16T00:12:08.641323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.647393Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.647393Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:784d98a94ce171c8648d22a165f41849cfb6359bce2af48456289d0fa6c0d38d","observation_id":"76c48e83-3229-49ef-93de-fe2f1aa5e748","resolution":{"observed_at":"2026-08-16T00:12:08.647393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.169874Z","title":null,"venue":null,"work_id":"0517e944-81dc-4d5b-ac96-10c237d33112","year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.656832Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:b67aa2661f475468af19fe23e11feef468a94efb8f71ab9de1e19b3391617fd3","observation_id":"ba04c329-85b2-465f-bf14-5e87662cb69a","resolution":{"observed_at":"2026-08-16T00:12:10.176037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.662439Z","title":"Lawrence Zitnick, and Piotr Dollár","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.662439Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:e2b5ae627d2bfdbff385dd2d40abe7785be34e0721d76aa4f1b09c9bf559f3d7","observation_id":"78bb5002-2e0e-4c7e-938d-abcd6882fccf","resolution":{"observed_at":"2026-08-16T00:12:08.662439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"math/0204325","last_updated":"2003-06-18T23:00:18Z","snapshot_observed_at":"2026-08-06T23:57:08.152664Z","submitted_at":"2002-04-26T17:04:02Z","title":"Determinantal probability measures","version":4},"cited_work":{"arxiv_id":"math/0204325","doi":null,"metadata_source":"pith","pith_arxiv_id":"math/0204325","snapshot_observed_at":"2026-08-16T00:12:09.292208Z","title":"Determinantal probability measures","venue":"math.PR","work_id":"0353e471-2471-4746-9dcc-c636fc3b7c9b","year":2002},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.673552Z"},"links":{"cited_paper":"/paper/math/0204325","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:62a111ed3eba24e4347f030acae3c944ccbae213a0668215496d9172fc9a9c1c","observation_id":"afbfb54a-fd68-4f2f-a191-cbe572dcdd0c","resolution":{"observed_at":"2026-08-16T00:12:09.297919Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02051","last_updated":"2019-01-07T20:42:13Z","snapshot_observed_at":"2026-08-14T17:34:03.474416Z","submitted_at":"2019-01-07T20:42:13Z","title":"DPPNet: Approximating Determinantal Point Processes with Deep Networks","version":1},"cited_work":{"arxiv_id":"1901.02051","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.02051","snapshot_observed_at":"2026-08-16T00:12:09.268276Z","title":"DPPNet: Approximating Determinantal Point Processes with Deep Networks","venue":"stat.ML","work_id":"2d2a88b6-1dae-4f49-bf24-fd87441657e6","year":2019},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.678165Z"},"links":{"cited_paper":"/paper/1901.02051","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d8a2dcdcbd5666a2eff357e5468783d72182ee8bd9cf0a70f6ef8ccb4a7a6d07","observation_id":"7b9321ab-1b32-42d9-b4ca-5059130757e2","resolution":{"observed_at":"2026-08-16T00:12:09.273196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.132256Z","title":null,"venue":null,"work_id":"a83e3620-6c11-427e-b4c1-bf919ab677f2","year":2015},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.683067Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:ee690ae6677fa85dfee6db125c26acf080e5e6e142c69aa847981fe382632ad1","observation_id":"8299b095-9098-4cf1-8a12-196adaf7b8e3","resolution":{"observed_at":"2026-08-16T00:12:10.140969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.687920Z","title":null,"venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.687920Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:545776e48f4f111b6b54841bcc6201bd1bede54e4a915ce267266442a532efc4","observation_id":"eb46f15c-620f-400b-b475-ad456a874074","resolution":{"observed_at":"2026-08-16T00:12:08.687920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04870","last_updated":"2016-09-19T20:20:42Z","snapshot_observed_at":"2026-08-14T22:48:03.209909Z","submitted_at":"2015-05-19T04:46:03Z","title":"Flickr30k Entities: Collecting Region-to-Phrase Correspondences for Richer Image-to-Sentence Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04870","snapshot_observed_at":"2026-08-16T00:12:08.692697Z","title":"Plummer, Liwei Wang, Chris M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.692697Z"},"links":{"cited_paper":"/paper/1505.04870","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:2d4fe6300262e174df9ecbea1608756b3c3bda676184732068863c343c78f091","observation_id":"f0ec3cfe-b7b7-4b23-afae-c7f11f703ec1","resolution":{"observed_at":"2026-08-16T00:12:08.692697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-16T00:12:08.698339Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.698339Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:5801328133a8c50241eac6f99079838c19e498f7ea243a20c03a3f00cc3949ba","observation_id":"93eae2c4-05b8-45f0-a98d-dfe079959690","resolution":{"observed_at":"2026-08-16T00:12:08.698339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.705834Z","title":"Santos, Craig Macdonald, and Iadh Ounis","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.705834Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:041359e4568f4bc2ec4c07cbf5f41f39affbbe7c2518359c0603cd78ccd540f1","observation_id":"5dcb1584-a476-4d61-89b6-efd5129e7b69","resolution":{"observed_at":"2026-08-16T00:12:08.705834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.103870Z","title":null,"venue":null,"work_id":"1280459d-5933-4b8c-83de-f1ab1509e47c","year":2015},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.710498Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:2489c5c6ec3805fe0d8da8f064025f0b0556e6c091fefdfc74da66d23e64f853","observation_id":"dab0adba-56d9-4ae7-a88d-a658169442b2","resolution":{"observed_at":"2026-08-16T00:12:10.108606Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.083983Z","title":null,"venue":null,"work_id":"756c927c-de44-4f66-a098-1633779296fe","year":2010},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.715317Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:3a7da4fd0251cf345151a7a815523778c3bdf546e3aca43b130c041eed8fa067","observation_id":"aaefa40e-b066-4970-b152-56f1113b10ba","resolution":{"observed_at":"2026-08-16T00:12:10.092402Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.720711Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.720711Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:015fda1dfe80a66d0db6c50660907a8b41d6551ad46f176b7072a7d64d36f96f","observation_id":"88b166e3-72c3-4f4c-ba64-da1978118f18","resolution":{"observed_at":"2026-08-16T00:12:08.720711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10328","last_updated":"2024-06-14T17:59:53Z","snapshot_observed_at":"2026-08-14T13:42:52.882986Z","submitted_at":"2024-06-14T17:59:53Z","title":"From Pixels to Prose: A Large Dataset of Dense Image Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10328","snapshot_observed_at":"2026-08-16T00:12:08.733637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.733637Z"},"links":{"cited_paper":"/paper/2406.10328","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:00977a9257445bb1bbd3641c105fb38729ab553f0180c0fc8f97fdaef0d38abb","observation_id":"aa6e3ee2-b88f-4c9e-b7e7-8ab22a7867f6","resolution":{"observed_at":"2026-08-16T00:12:08.733637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06654","last_updated":"2025-07-09T08:38:46Z","snapshot_observed_at":"2026-08-15T17:28:15.867790Z","submitted_at":"2025-07-09T08:38:46Z","title":"MS-DPPs: Multi-Source Determinantal Point Processes for Contextual Diversity Refinement of Composite Attributes in Text to Image Retrieval","version":1},"cited_work":{"arxiv_id":"2507.06654","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.06654","snapshot_observed_at":"2026-08-16T00:12:09.029317Z","title":"MS-DPPs: Multi-Source Determinantal Point Processes for Contextual Diversity Refinement of Composite Attributes in Text to Image Retrieval","venue":"cs.CV","work_id":"c5a0fa33-a9f2-458b-9e6b-77cf49ce7975","year":2025},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.741419Z"},"links":{"cited_paper":"/paper/2507.06654","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:2a0a8a8342eceb57f843c9130086a9047dd9a7a1ffa85032c8dedf22b14cb52f","observation_id":"b32283fa-f813-4a5b-85f5-fd211ac1a3e0","resolution":{"observed_at":"2026-08-16T00:12:09.035099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.747794Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.747794Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:0dd43c0a84765844e865aa2cb03b59ae7d1ef87c50338a7092a4df1f55eaf17d","observation_id":"b02d35ef-37c0-4b13-8283-3e33e50c851e","resolution":{"observed_at":"2026-08-16T00:12:08.747794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.04236","last_updated":"2022-01-11T23:03:57Z","snapshot_observed_at":"2026-08-15T22:19:49.729961Z","submitted_at":"2022-01-11T23:03:57Z","title":"Incidents1M: a large-scale dataset of images with natural disasters, damage, and incidents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.04236","snapshot_observed_at":"2026-08-16T00:12:08.759271Z","title":"Papadopoulos, Agata Lapedriza, Ferda Ofli, Muhammad Imran, and Antonio Torralba","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.759271Z"},"links":{"cited_paper":"/paper/2201.04236","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d9663d18ad386c57da0c05086146ed252aebce10e5f5a25d3a640ce5ec52589a","observation_id":"2528cdd1-45bc-45f0-8527-8fd81187d945","resolution":{"observed_at":"2026-08-16T00:12:08.759271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.764308Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.764308Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:2ca7c890ba86d8275b8ed329edf3b9b44a291d25425b652aaf5cd4a9842ef816","observation_id":"dcf1ef8c-cfee-4216-89ee-b9c0218f57a1","resolution":{"observed_at":"2026-08-16T00:12:08.764308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14464","last_updated":"2024-02-19T00:29:54Z","snapshot_observed_at":"2026-08-14T02:30:07.369047Z","submitted_at":"2022-12-29T21:58:37Z","title":"Result Diversification in Search and Recommendation: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14464","snapshot_observed_at":"2026-08-16T00:12:08.769536Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.769536Z"},"links":{"cited_paper":"/paper/2212.14464","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:0ae9c11ce4a66604c5de783cb675bd2a7fd85dba84bb2ca6e4abf7e14a83c3c6","observation_id":"783bf5bd-7476-4f08-91b7-2dd4928ac8cd","resolution":{"observed_at":"2026-08-16T00:12:08.769536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.032041Z","title":null,"venue":null,"work_id":"4d5924d3-58d9-4629-b068-95d8880bf4d6","year":2014},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.775315Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:01fa15638251e5dcf8f4952b20aecd0b26e4507e338a4247acb2f915b9cdd18a","observation_id":"72a3abce-dc5e-426f-9625-a67ef45869e7","resolution":{"observed_at":"2026-08-16T00:12:10.037141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.011603Z","title":null,"venue":null,"work_id":"5e4a634f-9e7c-4694-aad5-91bc3e614f45","year":2025},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.780183Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:26da9149b1d98b7b5cd087559a3022d8e152e33faffb9a6cf1e467b5b5b17505","observation_id":"0417e061-5b09-470c-917e-3ee6d3d71c10","resolution":{"observed_at":"2026-08-16T00:12:10.016612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:09.992119Z","title":null,"venue":null,"work_id":"9b60a60b-aec6-487f-8e6f-96122ee4e3f4","year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.784961Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:30cc039ad27d948d5d941023b9d04eb48f5250304207eb59391aa75398e4134e","observation_id":"55f2f2cf-2677-4701-8239-27d93b7c3ee5","resolution":{"observed_at":"2026-08-16T00:12:09.997561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-13T15:12:42.567441Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-16T00:12:08.789621Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.789621Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:25e59c9684afe6abc878da60b9883da6af5e380f4aeafda25655c69a5ec816a1","observation_id":"993d96b1-cb7b-40a7-8daa-19283f7d2c40","resolution":{"observed_at":"2026-08-16T00:12:08.789621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11432","last_updated":"2021-11-22T18:59:55Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:55Z","title":"Florence: A New Foundation Model for Computer Vision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11432","snapshot_observed_at":"2026-08-16T00:12:08.794672Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.794672Z"},"links":{"cited_paper":"/paper/2111.11432","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:267746ca7e7076cc2e40dde32ef71c611c145bd03ae406b2aaacfc235247ef7f","observation_id":"9c91e209-f4d5-4205-af08-e869a5e250b3","resolution":{"observed_at":"2026-08-16T00:12:08.794672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.00607","last_updated":"2017-08-23T23:34:28Z","snapshot_observed_at":"2026-08-14T21:03:35.510339Z","submitted_at":"2017-05-01T17:53:51Z","title":"Determinantal Point Processes for Mini-Batch Diversification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.00607","snapshot_observed_at":"2026-08-16T00:12:08.799830Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.799830Z"},"links":{"cited_paper":"/paper/1705.00607","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:2b9d2d644dcc2cd88a5848e45a577c8da3f8a7127cde8836b1a8947bc13c4261","observation_id":"d0329b95-48ca-4c51-ab4e-de3796c57f34","resolution":{"observed_at":"2026-08-16T00:12:08.799830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00529","last_updated":"2021-03-10T01:27:16Z","snapshot_observed_at":"2026-08-03T19:27:03.174412Z","submitted_at":"2021-01-02T23:35:27Z","title":"VinVL: Revisiting Visual Representations in Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00529","snapshot_observed_at":"2026-08-16T00:12:08.806060Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.806060Z"},"links":{"cited_paper":"/paper/2101.00529","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:1c4eb2fb24990bbd9284cee79e026c82c18ab42cc6efd0e4d5b0c5a5381843cd","observation_id":"d70aadd0-591e-4151-b336-91d4d0f2279e","resolution":{"observed_at":"2026-08-16T00:12:08.806060Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1105.4255","last_updated":"2011-05-21T12:09:46Z","snapshot_observed_at":"2026-08-15T04:46:13.783649Z","submitted_at":"2011-05-21T12:09:46Z","title":"Efficient Diversification of Web Search Results","version":1},"cited_work":{"arxiv_id":"1105.4255","doi":null,"metadata_source":"pith","pith_arxiv_id":"1105.4255","snapshot_observed_at":"2026-08-16T00:12:09.923641Z","title":"Efficient Diversification of Web Search Results","venue":"cs.IR","work_id":"aa210517-3cdb-4e13-8a54-ce6004dc5d27","year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.501081Z"},"links":{"cited_paper":"/paper/1105.4255","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:72c42f97d2afccee9addecf38502c9d1c86fe8e68aa3ece3b98e133d995b2ec1","observation_id":"397c72b2-ec5c-4cac-a7af-bd1fc6350fd5","resolution":{"observed_at":"2026-08-16T00:12:09.929005Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-16T00:12:08.668270Z","title":"arXiv:1405.0312 [cs.CV] https://arxiv.org/abs/1405.0312","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.668270Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:5786b6ce0334f199060e8563a6ff5ef246eb3f2ac8546cededadb96a1caf21e2","observation_id":"cbc65d56-7e75-4c83-bb86-bb94924c0342","resolution":{"observed_at":"2026-08-16T00:12:08.668270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05612","last_updated":"2018-07-29T19:11:57Z","snapshot_observed_at":"2026-08-14T20:46:56.185352Z","submitted_at":"2017-07-18T13:51:32Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.05612","snapshot_observed_at":"2026-08-16T00:12:08.549021Z","title":"arXiv:1707.05612 [cs.LG] https://arxiv.org/abs/1707.05612","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.549021Z"},"links":{"cited_paper":"/paper/1707.05612","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:b177243f254932b1715913d92ae60be53101620305f0f86889013e4d680ec853","observation_id":"c55203a9-f553-4fe8-bf65-00ee0065a725","resolution":{"observed_at":"2026-08-16T00:12:08.549021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.06165","last_updated":"2020-07-26T00:46:46Z","snapshot_observed_at":"2026-08-09T03:42:28.505858Z","submitted_at":"2020-04-13T19:18:10Z","title":"Oscar: Object-Semantics Aligned Pre-training for Vision-Language Tasks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.06165","snapshot_observed_at":"2026-08-16T00:12:08.651989Z","title":"arXiv:2004.06165 [cs.CV] https://arxiv.org/abs/2004.06165","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.651989Z"},"links":{"cited_paper":"/paper/2004.06165","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:de114cf8b3cf78cb866bd0cd04ce83f9844d85d43faa72663e970d700bb2b090","observation_id":"3c011e3b-6dd6-449e-934c-e63de9153502","resolution":{"observed_at":"2026-08-16T00:12:08.651989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-16T00:12:08.726460Z","title":"arXiv:2111.02114 [cs.CV] https://arxiv.org/abs/2111.02114","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.726460Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:6a0e4deca539f454c231156b3ced672f20acd8c98022d1e8ab40b11ad572cdc4","observation_id":"f65b8d65-d6a0-4f6a-aab4-a9efcc8c33d6","resolution":{"observed_at":"2026-08-16T00:12:08.726460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12856","last_updated":"2023-12-20T09:19:48Z","snapshot_observed_at":"2026-08-13T10:20:56.067988Z","submitted_at":"2023-12-20T09:19:48Z","title":"SkyScript: A Large and Semantically Diverse Vision-Language Dataset for Remote Sensing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12856","snapshot_observed_at":"2026-08-16T00:12:08.754344Z","title":"arXiv:2312.12856 [cs.CV] https://arxiv.org/abs/2312.12856","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.754344Z"},"links":{"cited_paper":"/paper/2312.12856","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:a2ed319e6f808e25bf42cb7971038780e9c1f3175c4453b31c883e7f68239c28","observation_id":"08314d22-c3e8-4752-b23f-611cfa0b47ee","resolution":{"observed_at":"2026-08-16T00:12:08.754344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-16T08:10:05.719931Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":2,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":50,"verified_exact":6,"verified_fuzzy":2},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2608.12532."}