{"as_of":"2026-08-15T06:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbf24cadda64aa7654d876e60288e98ebe45507c34eb5e2ed6df84a7eb11fc84","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T00:02:06.641566Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06553/citation-record","integrity":"/paper/2607.06553/integrity","json":"/paper/2607.06553/citation-record.json","paper":"/paper/2607.06553"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:52.804736Z","title":"In: Proceed- ings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"e50b6329-8e1e-405f-9a1e-cf7d6a1196fd","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:0cafed36fa8c024fc1ebb47f13b61290efcbfc543d43d7fdd097df10c05dbc07","observation_id":"29d96e86-c2e1-44f4-b957-fa02b2d685f0","resolution":{"observed_at":"2026-07-11T00:47:52.832354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.155494Z","title":"co / black - forest - labs / FLUX.2-klein-9B(2026) 2, 5","venue":null,"work_id":"964e5e74-914d-4ab8-843f-370840aa31b6","year":2026},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:fc8c67dd001e015b6c15a37b50f17cad1b109926da54a5e0e15370bf92d2ce55","observation_id":"91456758-485c-4a8d-8ddb-776e55d31f16","resolution":{"observed_at":"2026-07-11T00:47:53.185325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.005697Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"6ef8ade9-dfe3-4a61-95e1-1c3964421137","year":2021},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:5f3dd20b582d9bbf1b7d8c631a87626d1c73be6c813325aa5b5dc00126497c01","observation_id":"75e564b5-2d52-45a8-93ee-f42f7959434b","resolution":{"observed_at":"2026-07-11T00:47:53.035022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:52.714907Z","title":"In: Proceedings of the 26th ACM international conference on Multi- media","venue":null,"work_id":"c0e291b8-cc79-41fe-b917-2e5244feacf8","year":2018},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:4919cca9b91b862c1771bc25a951bee9fcdb175039f5e930a8913ca2e0159c05","observation_id":"1b7b0b1a-4dd8-4ee8-88c0-ef9547d101e1","resolution":{"observed_at":"2026-07-11T00:47:52.738039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.499335Z","title":"In: Proceed- ings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"6fd86670-e948-467e-8fe3-b06bb8b84baf","year":2022},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:94f3284a7b279b585f3610dfff48e893b175daed5fa4f76c8e3d1b4c15ca940d","observation_id":"75d8881c-c85a-4dc7-823c-cc540ce281d4","resolution":{"observed_at":"2026-07-11T00:47:53.528457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":"2010.11929","doi":"10.1175/jcli-d-22-0357.1","metadata_source":"pith","pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":"cs.CV","work_id":"e96730e3-129b-4db6-b981-15ab7932e297","year":2020},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:8acfdfa75db4c8ed5cb8ceb3267fe9f38e5419c933929bd2a335bb1282fec40c","observation_id":"2e27e68b-3da5-4684-811b-b10a55d946e2","resolution":{"observed_at":"2026-07-11T00:07:42.357787Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.670232Z","title":"In: Pro- ceedings of the IEEE/CVF International Confer- ence on Computer Vision","venue":null,"work_id":"fb87828f-1f81-49aa-bd4c-3f6cb3d0a8ae","year":2021},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:b100bb601544fe63ca4639891e4d13b1801ba422ecec5d953960232c698e9266","observation_id":"7d2134f6-048d-4992-a7dd-1e354fe87643","resolution":{"observed_at":"2026-07-11T00:47:53.702514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:52.741500Z","title":"In: European Confer- ence on Computer Vision","venue":null,"work_id":"e0dcc667-7ad8-41ca-ae23-cf8c301a8330","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:081ecad5b92bbc55592ed31ab6f10cfc611fbd5db2a1b7569d0585cf932e9e79","observation_id":"8a7b8edb-9602-4ad4-9fe1-9dfbad44c48d","resolution":{"observed_at":"2026-07-11T00:47:52.766280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20329","last_updated":"2026-06-03T18:02:24Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:23:48Z","title":"Image Generators are Generalist Vision Learners","version":3},"cited_work":{"arxiv_id":"2604.20329","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20329","snapshot_observed_at":"2026-07-11T00:07:42.154080Z","title":"Image Generators are Generalist Vision Learners","venue":"cs.CV","work_id":"71cd4d6e-573d-4c90-8835-f18259bdbaf7","year":2026},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"cited_paper":"/paper/2604.20329","citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:7043bc961403b4d993d4197ac35b4732b7fd3c9b76ca08b73daa3fe5d322a000","observation_id":"50a9de6a-de7e-413a-81cb-069495677a9a","resolution":{"observed_at":"2026-07-11T00:07:42.171356Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.128570Z","title":"In: International Conference on Learning Representations","venue":null,"work_id":"7f44d761-1d5d-4133-8883-62a5d387776d","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:fa52705bb143e816d1f99e4f2cfc6eb24e350e0aa10b3607799d903eda42bcfa","observation_id":"9cf9c86e-6805-4c7c-82cc-b18a345eab20","resolution":{"observed_at":"2026-07-11T00:47:53.156003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.368289Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"eba0b710-9c45-4532-92dc-6d792584a1d2","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:38b6a2fb95355fe59937276f1c6e74c92a8ad77f4e6d277f85172824093bb930","observation_id":"11dc36b6-17dc-4f9a-a890-af1ff38d1f91","resolution":{"observed_at":"2026-07-11T00:47:53.395756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.159920Z","title":"In: Proceedings of the AAAI conference on artificial intelligence","venue":null,"work_id":"f9ad9367-e53d-4ec7-9a28-6502d4f88ab1","year":2022},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:6df7a353d8cdf12d37cedd489599560e27a80c6aa1c1a5143e1167f272379002","observation_id":"9cd0f276-5216-4b41-965c-75b5c73b8474","resolution":{"observed_at":"2026-07-11T00:47:53.190872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.884848Z","title":"In: Proceedings of the IEEE/CVF international con- ference on computer vision","venue":null,"work_id":"168e72f0-8a17-482a-a42a-2db664e8c6a1","year":2023},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:61fcef9bb4724efb64614dd456a818a9602435681a5daf2388f9d39d9c9c7e89","observation_id":"9e4a162b-1c39-450c-b9d0-007231010db0","resolution":{"observed_at":"2026-07-11T00:47:53.910645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.748460Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"96ec9468-755c-46a3-8595-b9fe874da891","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:b11c1df3956fe6064e833edc2589af7dd39a7ea0a2a77b7ebf46d8f41a3a7fc2","observation_id":"370fa70d-f4a5-4a8f-a7e3-502f94f243e3","resolution":{"observed_at":"2026-07-11T00:47:53.778365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.709206Z","title":"In: In- ternational Conference on Learning Representa- tions","venue":null,"work_id":"546dfb4f-fc18-48b1-868c-1e82a9ed8261","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:22d6a1285338ba1323de6e8bd5467d3552a9aea2fbb92d54622771ee42b20fe5","observation_id":"0ce562d6-c788-4afe-825d-6a39c965ce19","resolution":{"observed_at":"2026-07-11T00:47:53.744042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.608714Z","title":"In: Proceedings of the 29th ACM international conference on mul- timedia","venue":null,"work_id":"985a40dc-4950-4a0d-aeab-18cd6d050c17","year":2021},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:079ce85d9f642a91a078bb34a906d6a7736d6fe330d251782d9fe07f481f641f","observation_id":"58ef7a95-4072-4f99-9db8-961b1847193a","resolution":{"observed_at":"2026-07-11T00:47:53.633844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.298257Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"293f81f6-20a7-48e3-b055-bfc528eef802","year":2026},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:58054172c04598bb8052bfbb9fcb05873e96b6c5925215116052d756be158d6b","observation_id":"413e41da-360a-4fb1-9436-cf4fb31200da","resolution":{"observed_at":"2026-07-11T00:47:53.328915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.430883Z","title":"In: Pro- ceedings of the IEEE/CVF International confer- ence on computer vision","venue":null,"work_id":"ad904c4b-50c1-4d14-ade9-be1947d78605","year":2021},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:1bd7753d60a6a5899cbe83222685eb14fee1ac0a9f411cd1b82078dcb853b908","observation_id":"edc6b078-b3f9-4ce2-b741-06c3029e5481","resolution":{"observed_at":"2026-07-11T00:47:53.462971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.820477Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"ee785eba-5de2-4a25-b8b4-8ff686df8b6e","year":2023},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:b3346b1fba8fb8c821840cbcc5ac79cac468a0a6bcf62bbb6c9e4992dc5e1188","observation_id":"86afdffa-462b-4254-a462-9e5832653e39","resolution":{"observed_at":"2026-07-11T00:47:53.847543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.266019Z","title":"IEEE Transactions on Pattern Analysis and Ma- chine Intelligence46(11), 7300–7316 (2024) 7","venue":null,"work_id":"9249c040-f728-496b-b2d3-d67c2a2367a6","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:eb5a3857f7c66dbbee3855c7ffe5243c0ead564a30b4aa771b9608dbd2249914","observation_id":"248816a6-81e6-490e-8aec-6f21548deae6","resolution":{"observed_at":"2026-07-11T00:47:53.293771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.038358Z","title":"IEEE Transactions on Pattern Analy- sis and Machine Intelligence (2025) 7","venue":null,"work_id":"ede50e0b-80d5-4d39-9813-7b53d2f80e3e","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:b907b70c959202f657249c2e55c18ae679c49d7ba72533a9620b49221a7c96e3","observation_id":"314fb8d9-e812-4739-b9cf-99d25e09db8d","resolution":{"observed_at":"2026-07-11T00:47:53.065025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.068950Z","title":"In: Pro- ceedings of the IEEE/CVF conference on com- puter vision and pattern recognition","venue":null,"work_id":"1a3e271a-5e66-458d-b37a-79b340d9f509","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:c609d425618691f199ab74b61465387ac95a869113c4d1fd6dfb21c3561000c4","observation_id":"2e9f2c93-b705-4148-b0a8-2793836be7ea","resolution":{"observed_at":"2026-07-11T00:47:53.094310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.11173","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:07:42.132120Z","title":"CoPRS: Learning positional prior from chain-of-thought for reasoning segmentation","venue":null,"work_id":"ab93feaa-37f7-4d22-bb34-f3c1defedc54","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:51b13aa7d530ac0e3dc916af3ac7f622faeb487a4ec303cb39345de3db823eca","observation_id":"93572f9b-a742-4b1b-a149-632d2fef4eeb","resolution":{"observed_at":"2026-07-11T00:07:42.150653Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.574991Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"15711404-035a-4f18-bc29-93ca2ab5ba92","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:92b0990085e9578375d5e28e680af87a403fc47a002e78c816ab15ef73429cf4","observation_id":"a65caee0-78b9-4d3a-9717-d69c704376fe","resolution":{"observed_at":"2026-07-11T00:47:53.605135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.535643Z","title":"International journal of computer vision 131(8), 2172–2197 (2023) 5","venue":null,"work_id":"d89c63cd-dbe7-4504-b620-aefa8ffdf41c","year":2023},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:f7e04e33c804ab24b2cdf095428ca05cf52e6729619de0e99bc795be3a2ab64f","observation_id":"bf056d64-b86a-4927-85ab-345178da2645","resolution":{"observed_at":"2026-07-11T00:47:53.569940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:8bae74c56993e3647fab98611948b6e3f194953d6b901691dd3c699950b3c820","observation_id":"fac5cdef-869c-4a92-8772-638c7595a364","resolution":{"observed_at":"2026-07-11T00:07:42.317207Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.123445Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"6f8a6ca9-0f3b-408e-a635-ffa9f82755fc","year":2023},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:7c4cbbbc83afbde45089e7280d3df5ef41c80a39f0c90fba57be2d823c3d1754","observation_id":"98cb0697-e667-4b20-9d68-215152a4027a","resolution":{"observed_at":"2026-07-11T00:47:53.151077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.637594Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"37c4aa54-95c4-4e72-bda8-9a0080aaaa93","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:7ea800467f68c2f5e6d45cf7c411b1f90d96bd46ed729a0d967dff3e8e13e6b6","observation_id":"207783fc-7a70-4a4c-b8b3-7a970b2d6a96","resolution":{"observed_at":"2026-07-11T00:47:53.665851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.093728Z","title":"In: Pro- ceedings of the IEEE/CVF Conference on Com- puter Vision and Pattern Recognition","venue":null,"work_id":"fa0e2316-1df6-483f-9ac4-2e88fa479101","year":2020},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:538bc9d1e0701fc2428e29cc61ebfcd83d56aae0aef60c0546f3378842c7cf4c","observation_id":"cfa1055f-15fe-4620-bcb2-19e6ffd0fbaa","resolution":{"observed_at":"2026-07-11T00:47:53.119594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.234426Z","title":"In: Proceed- ings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"90676d8c-1872-43bb-80db-aeb4c447b24f","year":2021},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:843defbe728f55632c305859a9e29f4a02066da6d2acf6cc863f4f2ff6229219","observation_id":"8f41b60a-50b3-4af2-91ee-b15563b277a6","resolution":{"observed_at":"2026-07-11T00:47:53.260714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.914693Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"942a3837-9640-43cc-86c1-97d153a962f9","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:5665948549d4cd49ec85b20362a0c389ed0641e137f1b620d399016e8d7a5f74","observation_id":"fab48320-e237-405d-a705-89d4526592a8","resolution":{"observed_at":"2026-07-11T00:47:53.942122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20427","last_updated":"2025-12-10T16:37:54Z","snapshot_observed_at":"2026-08-13T15:50:14.892321Z","submitted_at":"2025-09-24T17:59:04Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","version":3},"cited_work":{"arxiv_id":"2509.20427","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20427","snapshot_observed_at":"2026-07-11T00:07:42.259448Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","venue":"cs.CV","work_id":"15c839a0-48a3-4218-82b6-cac5b7f66e13","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"cited_paper":"/paper/2509.20427","citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:c2adab5334c3dc9daa45172881eddf80e11bb644685ee239ece95173c752fd51","observation_id":"52cc4fbb-8605-45d3-acbb-2d6fc9d604b0","resolution":{"observed_at":"2026-07-11T00:07:42.274712Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.14957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:07:42.278070Z","title":"arXiv preprint arXiv:2603.14957 (2026) 3","venue":null,"work_id":"ada62adb-d74f-411d-82ff-21b3e9b7baeb","year":2026},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:55e27b7b07c5ef5899178a668b46700e6ca9cbf742f222d75fdd49d3f8e5a8c3","observation_id":"93cf89af-c995-4d47-8a18-ae35924467e0","resolution":{"observed_at":"2026-07-11T00:07:42.295546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.18673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:07:42.342783Z","title":"arXiv preprint arXiv:2511.18673 (2025) 2, 3, 5","venue":null,"work_id":"43ce2ca9-5935-4954-aae8-5954fcf14ebe","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:a89b4391d5289f198462b6460144ccdbc2a1e74d2ba4e574df7c252b81dcc0ce","observation_id":"5cce2290-e3c1-447f-b0da-381700e12243","resolution":{"observed_at":"2026-07-11T00:07:42.357929Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.784438Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"dc641961-c46d-45d6-880a-72473a32e74f","year":2019},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:64a30fd0ffffaf093f2c0eda3e48d7304eb58936c872c13190bb11da97ef26a9","observation_id":"72da0448-30ec-4bdb-85fd-2451eaa22f18","resolution":{"observed_at":"2026-07-11T00:47:53.816049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-13T02:23:40.621810Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"cited_work":{"arxiv_id":"2511.22699","doi":"10.48550/arxiv.2511.22699","metadata_source":"pith","pith_arxiv_id":"2511.22699","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","venue":"cs.CV","work_id":"f1080a62-48e1-4255-b023-7556be57370d","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"cited_paper":"/paper/2511.22699","citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:ba06b0b004585d9a3d74d8f79850c1dd2ff2ff6bd6ba90296148d60a6feabd61","observation_id":"b7685dc5-9fa8-4526-8d2f-a7f149f00309","resolution":{"observed_at":"2026-07-11T00:07:42.338978Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.152696+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.152696+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.04338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:07:42.239703Z","title":"From editor to dense geometry estimator","venue":null,"work_id":"a952eed3-0506-4bdd-981c-641c21220a60","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:155e90beb7372335e88d4183d4c7d6f84793048c57619c7b5f2be0e096761dec","observation_id":"697118b2-b906-4b25-89b8-2ffdaf9638c6","resolution":{"observed_at":"2026-07-11T00:07:42.255589Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.467213Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"4ec69fad-8711-4b4b-a49c-5a0d6aa30066","year":2023},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:fe91cf02179b405201db576a7f73f2b7c11226fe2969ea0cc41fa8f9149de68e","observation_id":"fcd7bd9e-7838-41a2-a33b-2e84354420a2","resolution":{"observed_at":"2026-07-11T00:47:53.495406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06139","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:07:42.278795Z","title":"Deforming videos to masks: Flow matching for referring video segmentation","venue":null,"work_id":"4f7a63d4-bfb7-46fa-b72f-f92458d9a85f","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:adef4d08c87fae4180a5918993ab4f84aa200017a737409254577191dfee1cc6","observation_id":"2e2c9625-b529-4f96-b9e0-4ba1cde95643","resolution":{"observed_at":"2026-07-11T00:07:42.295656Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.194250Z","title":"In: Proceedings of the IEEE/CVF con- ference on computer vision and pattern recogni- tion","venue":null,"work_id":"55172891-9300-4933-8dce-f15e7cb0dae3","year":2022},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:6b5f4da053c4f9597858acb482019b674c1138ba5bbd1f857e014cf57e3bbb42","observation_id":"5a6cb949-a44f-4bae-8c0d-1cc07ee47d0d","resolution":{"observed_at":"2026-07-11T00:47:53.226597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:b3b357e8f0dd8b1f122fcb17abbc99c658e7f31f02607ccc7e052d352baedbf0","observation_id":"0220daee-cce5-4eef-9994-02bd7b40f899","resolution":{"observed_at":"2026-07-11T00:07:42.235545Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.399904Z","title":null,"venue":null,"work_id":"cb6982c6-c88a-4720-955d-9b69cb455369","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:3867d22f4e24190cecc1653fe1df185f9beefb96f33c7b32a43f127308df5483","observation_id":"6d57ea65-d439-434d-8704-37cb5b56f386","resolution":{"observed_at":"2026-07-11T00:47:53.426547Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.946791Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"3ac76c70-a368-430a-ad1a-ab45e8e442d2","year":2025},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:483434ac21674a22e18b42c576453b2db36e79d3f43b9a1c5aac9cd73051fa61","observation_id":"8bef9519-8ce2-47c8-809a-09b4dde00a35","resolution":{"observed_at":"2026-07-11T00:47:53.974591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.333895Z","title":"Advances in neural information processing systems35, 38571–38584 (2022) 2, 3, 7","venue":null,"work_id":"edb24427-9a62-4ffb-9e5a-c50dc984ae50","year":2022},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:382f547896880bc2bf3c7d3330994107ef8a7b767ed088649e0d25028f2fc7a0","observation_id":"b811d8e2-fe65-4b05-8713-1008561655a1","resolution":{"observed_at":"2026-07-11T00:47:53.362890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:53.851365Z","title":"In: Proceedings of 9 the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"7e87b01f-9ae3-4007-9dd2-7391d0c90fda","year":2026},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:2f86aeadcfc81fd0d4eb09c02f11dffcc86062ab9155b6a3d39be8113a33a428","observation_id":"53a08852-208d-47fc-a28b-b18cef6bdab0","resolution":{"observed_at":"2026-07-11T00:47:53.879834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:52.939273Z","title":"Advances in Neural Information Processing Systems37, 21875–21911 (2024) 2, 3, 5","venue":null,"work_id":"bf528bd4-3e6f-4df2-ba9f-e68999ac24ed","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:83c01a1df632197703609d9f351586ccea3ded49e2485a5d86540887c8194734","observation_id":"5a58a3f0-5d56-49dd-8e82-fd1c9ecb599a","resolution":{"observed_at":"2026-07-11T00:47:52.965536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:52.770480Z","title":"Advances in neural in- formation processing systems37, 71737–71767 (2024) 6","venue":null,"work_id":"71cd25ca-44bd-46a0-9e05-8aa81b92bc05","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:8c4e94b61751d2dd8e9561d94430c1472beeca672c741add7e6682b3e76f2dd9","observation_id":"5666b124-f6bd-47b0-a8ed-5eb7329d0d47","resolution":{"observed_at":"2026-07-11T00:47:52.798884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:52.870078Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"10bc19bf-8ed4-4e2b-8d34-f8bc0be7f821","year":2024},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:de85d1ec1b5c5cca009994ca81beb976089a095c551adcb642f490b2a2d63d9a","observation_id":"961783e2-c297-4c67-aad9-265392508a83","resolution":{"observed_at":"2026-07-11T00:47:52.899162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2606.15162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:07:42.321802Z","title":"arXiv preprint arXiv:2606.15162 (2026) 3","venue":null,"work_id":"8368dad8-f3ce-4d16-9f58-9f4020a50cd2","year":2026},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:b5f426acaa336b562ed025096ea1334f4b9cbb34b239168c083c3816721b78fb","observation_id":"33988093-6c98-4e08-828c-727067d8a5ed","resolution":{"observed_at":"2026-07-11T00:07:42.338764Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:52.832994Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence45(3), 3738–3752 (2022) 7 10","venue":null,"work_id":"dfa5d66a-57a5-49de-8036-3d0c467d44e3","year":2022},"citing_paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T00:02:06.641566Z"},"links":{"citing_paper":"/paper/2607.06553"},"observation_digest":"sha256:f1b031f75435afbacc380a2dafeed9f4ad48ba308a4153ad02a42c7359545455","observation_id":"a266109f-9373-4fb5-9de4-fa378b973723","resolution":{"observed_at":"2026-07-11T00:47:52.865954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06553","last_updated":"2026-07-09T06:33:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T19:22:20.504670Z","submitted_at":"2026-07-07T17:54:28Z","title":"From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":9,"parse_uncertain":0,"unresolved":1,"verified_exact":3,"verified_fuzzy":37},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2607.06553."}