{"as_of":"2026-08-08T02:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:babded6860b8b3392bce99b3371699108c3500629302c74e4fc23cc5eb04b110","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:51:21.788563Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:41:00.298405Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:38:44.066791Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17399","snapshot_observed_at":"2026-07-13T20:08:17.066898Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22744","last_updated":"2026-05-29T00:35:02Z","snapshot_observed_at":"2026-08-03T18:04:48.244219Z","submitted_at":"2026-03-24T03:16:32Z","title":"LH-Bench: Skill-Grounded Evaluation of Long-Horizon Agents on Subjective Enterprise Tasks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T20:08:17.066898Z"},"links":{"cited_paper":"/paper/2505.17399","citing_paper":"/paper/2603.22744"},"observation_digest":"sha256:fb4a82d0d090890d0a934d3eb61b7cb13adc6e9d6ab1603e67818dd179479c7c","observation_id":"f44f3ef9-fadc-4a67-a9a8-b92739647cc3","resolution":{"observed_at":"2026-07-13T20:08:17.066898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"cited_work":{"arxiv_id":"2505.17399","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17399","snapshot_observed_at":"2026-07-03T17:38:44.066791Z","title":"arXiv preprint arXiv:2505.17399 (2025)","venue":null,"work_id":"1ca777f8-b125-459e-931b-e5ad1218a207","year":2025},"citing_paper":{"arxiv_id":"2604.15309","last_updated":"2026-04-16T17:59:49Z","snapshot_observed_at":"2026-07-06T23:02:53.677687Z","submitted_at":"2026-04-16T17:59:49Z","title":"MM-WebAgent: A Hierarchical Multimodal Web Agent for Webpage Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T11:36:04.456245Z"},"links":{"cited_paper":"/paper/2505.17399","citing_paper":"/paper/2604.15309"},"observation_digest":"sha256:900e80bc37435134ebf017a7d5e1b3a20f1b803f81bc9105d3870406a62c53f5","observation_id":"712fc684-d9a3-4ad4-b37c-8883c6b06287","resolution":{"observed_at":"2026-05-10T11:40:19.240484Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"cited_work":{"arxiv_id":"2505.17399","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17399","snapshot_observed_at":"2026-07-03T17:38:44.066791Z","title":"arXiv preprint arXiv:2505.17399 (2025)","venue":null,"work_id":"1ca777f8-b125-459e-931b-e5ad1218a207","year":2025},"citing_paper":{"arxiv_id":"2605.26807","last_updated":"2026-05-26T10:22:56Z","snapshot_observed_at":"2026-08-01T07:41:43.556195Z","submitted_at":"2026-05-26T10:22:56Z","title":"HTMLCure: Turning Browser Experience into State Guided Repair for Interactive HTML","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T15:56:24.222373Z"},"links":{"cited_paper":"/paper/2505.17399","citing_paper":"/paper/2605.26807"},"observation_digest":"sha256:ca79a285e8d59babae9905647786b93efc8ef4bc990ffa8eaa533b19415bb735","observation_id":"194d1a5a-1427-4181-bbf3-abbb5877bf21","resolution":{"observed_at":"2026-06-29T16:03:34.063989Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"cited_work":{"arxiv_id":"2505.17399","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17399","snapshot_observed_at":"2026-07-03T17:38:44.066791Z","title":"arXiv preprint arXiv:2505.17399 (2025)","venue":null,"work_id":"1ca777f8-b125-459e-931b-e5ad1218a207","year":2025},"citing_paper":{"arxiv_id":"2605.30000","last_updated":"2026-05-31T12:00:02Z","snapshot_observed_at":"2026-08-02T18:55:27.003152Z","submitted_at":"2026-05-28T14:30:33Z","title":"Cookie-Bench: Continuous On-screen Key Interaction Evaluation for Web Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T07:24:06.863653Z"},"links":{"cited_paper":"/paper/2505.17399","citing_paper":"/paper/2605.30000"},"observation_digest":"sha256:3d0d797b4d8ade53a5a0b01ffd18a2d6e247ed40152c831c7e9af106d5091e9c","observation_id":"641887d6-c886-44db-aa80-13e1e91556ec","resolution":{"observed_at":"2026-06-29T08:53:16.527879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"cited_work":{"arxiv_id":"2505.17399","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17399","snapshot_observed_at":"2026-07-03T17:38:44.066791Z","title":"arXiv preprint arXiv:2505.17399 (2025)","venue":null,"work_id":"1ca777f8-b125-459e-931b-e5ad1218a207","year":2025},"citing_paper":{"arxiv_id":"2606.15932","last_updated":"2026-06-16T15:28:03Z","snapshot_observed_at":"2026-07-06T23:52:37.922109Z","submitted_at":"2026-06-14T17:21:43Z","title":"Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T03:57:19.028507Z"},"links":{"cited_paper":"/paper/2505.17399","citing_paper":"/paper/2606.15932"},"observation_digest":"sha256:94a9beb58f43297a5f3ec3a8b674750af50770dd71ddf5b37acffd88d4a7e768","observation_id":"b5da9a5b-02e7-47fb-9485-57ee580d3242","resolution":{"observed_at":"2026-07-03T17:38:44.068267Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17399","snapshot_observed_at":"2026-08-05T14:41:00.298405Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03691","last_updated":"2026-08-04T13:59:12Z","snapshot_observed_at":"2026-08-07T23:12:18.732271Z","submitted_at":"2026-08-04T13:59:12Z","title":"Pattern over Pixels: Measuring Pattern Completion Bias in Multimodal Code Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T14:41:00.298405Z"},"links":{"cited_paper":"/paper/2505.17399","citing_paper":"/paper/2608.03691"},"observation_digest":"sha256:beae202d2c79b5dd38bfc6e3c3affd025c3681959a4f2811486d1b0857a6e6ad","observation_id":"410f71d2-ffcb-468e-9f34-1d8511411d8d","resolution":{"observed_at":"2026-08-05T14:41:00.298405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17399/citation-record","integrity":"/paper/2505.17399/integrity","json":"/paper/2505.17399/citation-record.json","paper":"/paper/2505.17399"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:15.063781Z","title":"Iw-bench: Evaluating large multimodal models for converting image-to-web,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.063781Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:96346c94d2af9f40e8a83bbbf5c03884a83a465374357ecc015a33f41254c5e9","observation_id":"7e075b6a-7554-4414-992c-ea74792562c8","resolution":{"observed_at":"2026-08-07T14:51:15.063781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:31.711234Z","title":"Webcode2m: A real-world dataset for code generation from webpage designs,","venue":null,"work_id":"4919bfc3-f7f0-4645-8fa2-e0030a942dfc","year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.154904Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:c972ec2809d93ec1712b30d7145c36d7990566c7bd3acb2eda9fb1b46407c5cf","observation_id":"4e1cd092-dfa5-4dee-ae34-bf5f69fe036c","resolution":{"observed_at":"2026-08-07T14:51:31.849235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13711","last_updated":"2024-09-24T18:38:02Z","snapshot_observed_at":"2026-07-06T19:18:53.582890Z","submitted_at":"2024-09-06T18:44:25Z","title":"WebQuest: A Benchmark for Multimodal QA on Web Page Sequences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13711","snapshot_observed_at":"2026-08-07T14:51:15.242061Z","title":"Webquest: A benchmark for multimodal qa on web page sequences,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.242061Z"},"links":{"cited_paper":"/paper/2409.13711","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:64d42d8fce8ad207bb344eb53b2180c71cfad93e05dcb5a107e2019da8b73c21","observation_id":"33596005-9424-4b19-b4a8-154f70a09e0c","resolution":{"observed_at":"2026-08-07T14:51:15.242061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:31.429088Z","title":"Webqa: Multihop and multimodal qa,","venue":null,"work_id":"ea24f641-3336-4272-89d5-131771264017","year":2022},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.312575Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:83909c0298380f6182fc456967771141b7b6cf702b149851c00fcefb7b4d0eb8","observation_id":"eefdaa24-fb9a-4e75-97e5-d2bb1fb77f54","resolution":{"observed_at":"2026-08-07T14:51:31.558982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08047","last_updated":"2026-05-23T20:19:43Z","snapshot_observed_at":"2026-07-06T20:35:07.465410Z","submitted_at":"2025-02-12T01:06:10Z","title":"WorldGUI: An Interactive Benchmark for Desktop GUI Automation from Any Starting Point","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08047","snapshot_observed_at":"2026-08-07T14:51:15.355250Z","title":"Worldgui: Dynamic testing for comprehensive desktop gui automation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.355250Z"},"links":{"cited_paper":"/paper/2502.08047","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:71ece6469641e69e8e784b089b11f86872823e92adb623b25d171ec352bcaf92","observation_id":"aee9c50f-301c-422c-a0e9-c4ea683ba5fb","resolution":{"observed_at":"2026-08-07T14:51:15.355250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07456","last_updated":"2024-02-15T09:30:48Z","snapshot_observed_at":"2026-08-06T10:13:53.181541Z","submitted_at":"2024-02-12T07:29:22Z","title":"OS-Copilot: Towards Generalist Computer Agents with Self-Improvement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07456","snapshot_observed_at":"2026-08-07T14:51:15.449559Z","title":"Os-copilot: Towards generalist computer agents with self-improvement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.449559Z"},"links":{"cited_paper":"/paper/2402.07456","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:00bbda7538c368a5bba259975d364f0f7db94ba7b34a5147d1a0fe9a6ad92b05","observation_id":"bc856b5b-ca78-4a9d-a8bd-0fe7a188a279","resolution":{"observed_at":"2026-08-07T14:51:15.449559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03186","last_updated":"2024-07-02T17:23:13Z","snapshot_observed_at":"2026-08-01T15:59:13.226787Z","submitted_at":"2024-03-05T18:22:29Z","title":"Cradle: Empowering Foundation Agents Towards General Computer Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03186","snapshot_observed_at":"2026-08-07T14:51:15.538103Z","title":"Cradle: Empowering foundation agents towards general computer control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.538103Z"},"links":{"cited_paper":"/paper/2403.03186","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:3d7b9cd31bd7b134f0a55400cb662894735f6b2e35a7ec570fb83d916cdbea6e","observation_id":"e4dd0061-d5ec-495e-a8dc-0e54006fc424","resolution":{"observed_at":"2026-08-07T14:51:15.538103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11733","last_updated":"2025-01-28T16:58:02Z","snapshot_observed_at":"2026-08-07T18:11:16.595464Z","submitted_at":"2025-01-20T20:35:46Z","title":"Mobile-Agent-E: Self-Evolving Mobile Assistant for Complex Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11733","snapshot_observed_at":"2026-08-07T14:51:15.634130Z","title":"Mobile-agent-e: Self-evolving mobile assistant for complex tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.634130Z"},"links":{"cited_paper":"/paper/2501.11733","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:a01bd6d51c5756b00e63e45914458d273f5493d24f6a46e8fb30d1076fbb90fa","observation_id":"fe2f2f7c-6e10-45c5-9c80-ab28d4e8458f","resolution":{"observed_at":"2026-08-07T14:51:15.634130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01614","last_updated":"2024-03-12T23:14:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-03T08:33:09Z","title":"GPT-4V(ision) is a Generalist Web Agent, if Grounded","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01614","snapshot_observed_at":"2026-08-07T14:51:15.708954Z","title":"Gpt-4v (ision) is a generalist web agent, if grounded,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.708954Z"},"links":{"cited_paper":"/paper/2401.01614","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:5bba25bf3deb926061610351adefd9eaec937fd5e8e75fcde950b91d53fc2d7b","observation_id":"4488054a-7245-40f2-b8e0-d417ff4b4150","resolution":{"observed_at":"2026-08-07T14:51:15.708954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15711","last_updated":"2024-10-21T15:45:31Z","snapshot_observed_at":"2026-08-05T17:32:28.104029Z","submitted_at":"2024-07-22T15:18:45Z","title":"AssistantBench: Can Web Agents Solve Realistic and Time-Consuming Tasks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15711","snapshot_observed_at":"2026-08-07T14:51:15.797668Z","title":"Assistantbench: Can web agents solve realistic and time-consuming tasks?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.797668Z"},"links":{"cited_paper":"/paper/2407.15711","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:045d9df9add0d594b568f31cb3c42315c6963bed727d676622fcc2db817d3f2f","observation_id":"6e5827ed-f7c7-444a-bae6-7a7f31610d8b","resolution":{"observed_at":"2026-08-07T14:51:15.797668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-07T14:51:15.868994Z","title":"Seeclick: Harnessing gui grounding for advanced visual gui agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.868994Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:fab50a93fd6e046fdf426b5026e2e65030530e083a04f1f76214e1142baa608d","observation_id":"e0b6cd34-77f3-4f9a-81ff-29792e4129db","resolution":{"observed_at":"2026-08-07T14:51:15.868994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:15.947449Z","title":"Mind2web: Towards a generalist agent for the web,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:15.947449Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:efb933b934acb6e6aa0aa0f308359185ece62479df8d389ae04a29e1f6adc012","observation_id":"ed58b594-63e5-444c-b8d2-40c9a1e319eb","resolution":{"observed_at":"2026-08-07T14:51:15.947449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04730","last_updated":"2025-01-27T08:29:17Z","snapshot_observed_at":"2026-07-06T20:48:05.131265Z","submitted_at":"2025-01-27T08:29:17Z","title":"WinClick: GUI Grounding with Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04730","snapshot_observed_at":"2026-08-07T14:51:16.035850Z","title":"Winclick: Gui grounding with multi- modal large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.035850Z"},"links":{"cited_paper":"/paper/2503.04730","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:3302c9ac6eb3a7d8d42f4978623b7e21dad1970b2da50053db788be30190e42a","observation_id":"f5499312-7df0-43ae-86fc-b249ea90bfdd","resolution":{"observed_at":"2026-08-07T14:51:16.035850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:31.084067Z","title":"Gui- world: A dataset for gui-oriented multimodal llm-based agents,","venue":null,"work_id":"49a0eeca-411e-420a-be45-a5b4db100162","year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.131290Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:543dd72c08083471f4182941880651ddf16c8216f60f1fd0c614d150940c0231","observation_id":"4bc020e0-1564-41cc-bebd-3731ff1d87e7","resolution":{"observed_at":"2026-08-07T14:51:31.242853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T14:51:16.221918Z","title":"Guicourse: From general vision language models to versatile gui agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.221918Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:abb6eb8f1c80eba4dfdacabf86a50f5e2fab031ee20961c2aeaf9687238d952c","observation_id":"c8ef36cf-cf88-451d-bfd8-dcef585bc133","resolution":{"observed_at":"2026-08-07T14:51:16.221918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.09465","last_updated":"2021-11-08T08:31:44Z","snapshot_observed_at":"2026-07-06T10:34:53.435463Z","submitted_at":"2021-01-23T09:43:44Z","title":"WebSRC: A Dataset for Web-Based Structural Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.09465","snapshot_observed_at":"2026-08-07T14:51:16.307691Z","title":"Websrc: a dataset for web-based structural reading comprehension,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.307691Z"},"links":{"cited_paper":"/paper/2101.09465","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:edab8d8fe0804be7bb349a30e7dc2847961d3b3066f91d204ae4a68d033aef74","observation_id":"7b22a239-9ae0-4095-bb34-fed954fe4da3","resolution":{"observed_at":"2026-08-07T14:51:16.307691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07572","last_updated":"2025-08-10T05:59:20Z","snapshot_observed_at":"2026-08-04T14:46:05.418102Z","submitted_at":"2025-01-13T18:58:07Z","title":"WebWalker: Benchmarking LLMs in Web Traversal","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07572","snapshot_observed_at":"2026-08-07T14:51:16.385377Z","title":"Webwalker: Benchmarking llms in web traversal,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.385377Z"},"links":{"cited_paper":"/paper/2501.07572","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:c65e887bc0620d934151e0a55572d04f80100c5ab58cfd5a85ca8f09488fce5d","observation_id":"4936694c-0f25-4f74-b84e-90d957e77f11","resolution":{"observed_at":"2026-08-07T14:51:16.385377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05444","last_updated":"2025-01-09T18:55:52Z","snapshot_observed_at":"2026-08-07T17:40:59.052312Z","submitted_at":"2025-01-09T18:55:52Z","title":"Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05444","snapshot_observed_at":"2026-08-07T14:51:16.478809Z","title":"Can mllms reason in multimodality? emma: An enhanced multimodal reasoning benchmark,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.478809Z"},"links":{"cited_paper":"/paper/2501.05444","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:b6ef727f68e98931afad8dbd8687870ec843d2be52c36777bdcd88770e472b92","observation_id":"13c6dd49-fa38-4685-86aa-7bee9f02578a","resolution":{"observed_at":"2026-08-07T14:51:16.478809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:30.821639Z","title":"Screen2words: Automatic mobile ui summarization with multimodal learning,","venue":null,"work_id":"1b5c5086-e28f-4c66-8819-f1c1fa375da0","year":2021},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.569496Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:506c524a01045893756908d05935e7e0223dd4102998fbf93147a5a8865015c9","observation_id":"4e530b0b-289e-4da4-9b61-5108cf9ac50f","resolution":{"observed_at":"2026-08-07T14:51:30.961695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05955","last_updated":"2024-04-09T02:29:39Z","snapshot_observed_at":"2026-07-06T17:57:31.912970Z","submitted_at":"2024-04-09T02:29:39Z","title":"VisualWebBench: How Far Have Multimodal LLMs Evolved in Web Page Understanding and Grounding?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05955","snapshot_observed_at":"2026-08-07T14:51:16.682325Z","title":"Visualwebbench: How far have multimodal llms evolved in web page understanding and grounding?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.682325Z"},"links":{"cited_paper":"/paper/2404.05955","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:b0a24779bf842e965d1a382429ef67883380ca0868dbe88900165a656fec1b84","observation_id":"c2c3d76d-d054-49be-a60d-cadda5bc6f84","resolution":{"observed_at":"2026-08-07T14:51:16.682325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03163","last_updated":"2025-02-09T04:22:26Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T17:56:27Z","title":"Design2Code: Benchmarking Multimodal Code Generation for Automated Front-End Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03163","snapshot_observed_at":"2026-08-07T14:51:16.760239Z","title":"Design2code: Benchmarking multimodal code generation for automated front-end engineering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.760239Z"},"links":{"cited_paper":"/paper/2403.03163","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:460f7af25666afcd31bd873c37d453ef64a3aa39c10a8d761d23439260a41ae4","observation_id":"062b531e-b439-4f71-aa23-f1f97d1a4fe2","resolution":{"observed_at":"2026-08-07T14:51:16.760239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20098","last_updated":"2024-11-17T16:11:00Z","snapshot_observed_at":"2026-08-04T02:34:31.877467Z","submitted_at":"2024-06-28T17:59:46Z","title":"Web2Code: A Large-scale Webpage-to-Code Dataset and Evaluation Framework for Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20098","snapshot_observed_at":"2026-08-07T14:51:16.861818Z","title":"Web2code: A large-scale webpage-to-code dataset and evaluation framework for multimodal llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.861818Z"},"links":{"cited_paper":"/paper/2406.20098","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:ad9b52abf7b7c8e0d3d9ee292892ab172dfd6eca6e749472d230e53b89cd2efd","observation_id":"4ed54268-ddfb-4b26-ae0a-307f7854651e","resolution":{"observed_at":"2026-08-07T14:51:16.861818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09029","last_updated":"2024-03-14T01:40:40Z","snapshot_observed_at":"2026-08-07T01:10:55.050491Z","submitted_at":"2024-03-14T01:40:40Z","title":"Unlocking the conversion of Web Screenshots into HTML Code with the WebSight Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09029","snapshot_observed_at":"2026-08-07T14:51:16.976316Z","title":"Unlocking the conversion of web screenshots into html code with the websight dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.976316Z"},"links":{"cited_paper":"/paper/2403.09029","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:31a2f80cc70809018f2c994705d4c4d427bda4af05332edbbf7ed8aebfbaa85a","observation_id":"44d224b1-f8b2-40f6-bd84-fe5bf4513db9","resolution":{"observed_at":"2026-08-07T14:51:16.976316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:30.612876Z","title":"pix2code: Generating code from a graphical user interface screenshot,","venue":null,"work_id":"f545b00c-fcb1-4dbd-9505-c9405275943e","year":2018},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.085830Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:cacb7583174a41fc129f3863e19794abf9383da03b2d1ca4ac3966d19efcccae","observation_id":"e41db3a0-2322-47b9-a308-220d825a36a1","resolution":{"observed_at":"2026-08-07T14:51:30.718234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15310","last_updated":"2024-12-19T15:02:33Z","snapshot_observed_at":"2026-07-06T20:10:29.099784Z","submitted_at":"2024-12-19T15:02:33Z","title":"MRWeb: An Exploration of Generating Multi-Page Resource-Aware Web Code from UI Designs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15310","snapshot_observed_at":"2026-08-07T14:51:17.198985Z","title":"Mrweb: An exploration of gener- ating multi-page resource-aware web code from ui designs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.198985Z"},"links":{"cited_paper":"/paper/2412.15310","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:aac6495f8b1bedbfb812a825065e8cd0ede02a65d518a7e212bdf5449846ad31","observation_id":"1e309d18-f54c-42ad-aa29-8feed60d1237","resolution":{"observed_at":"2026-08-07T14:51:17.198985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:17.282919Z","title":"Interaction2code: How far are we from automatic interactive webpage generation?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.282919Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:fc6e8e7de88d1226b19527c3943941edcdfd22ceb75732a7bc9c9251cc76d580","observation_id":"a7049662-687d-4d5c-92b0-bf0e47bfec66","resolution":{"observed_at":"2026-08-07T14:51:17.282919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05243","last_updated":"2025-06-17T15:06:02Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:47:50Z","title":"Navigating the Digital World as Humans Do: Universal Visual Grounding for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05243","snapshot_observed_at":"2026-08-07T14:51:17.362371Z","title":"Navigating the digital world as humans do: Universal visual grounding for gui agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.362371Z"},"links":{"cited_paper":"/paper/2410.05243","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:7cef47e9aad71b0d8b11eb85d7e2847f3b85e1d77a0a02998f2f75ffe3faafea","observation_id":"3ba3270e-12ce-407a-bd1a-0d6ea3aa71bf","resolution":{"observed_at":"2026-08-07T14:51:17.362371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:30.362300Z","title":"Hello gpt-4o,","venue":null,"work_id":"b4942067-25aa-476b-9aab-1b2e58de7865","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.464454Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:48e3f95719508d56c5bc5decee2b4a38cd0c1578b576f8e86f8a1c5690c6f634","observation_id":"4ac3c5ce-8833-4703-a0bf-eef004c453d9","resolution":{"observed_at":"2026-08-07T14:51:30.469247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00203","last_updated":"2024-08-01T00:00:43Z","snapshot_observed_at":"2026-07-06T18:55:19.894571Z","submitted_at":"2024-08-01T00:00:43Z","title":"OmniParser for Pure Vision Based GUI Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00203","snapshot_observed_at":"2026-08-07T14:51:17.576781Z","title":"Omniparser for pure vision based gui agent,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.576781Z"},"links":{"cited_paper":"/paper/2408.00203","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:755a9fdd030ede6fb961166e987675e42e9d000fb04482d30e8b9061cd21d906","observation_id":"00b666db-8675-43c3-b3de-17e8aa335f37","resolution":{"observed_at":"2026-08-07T14:51:17.576781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:30.145102Z","title":"Common crawl datasets,","venue":null,"work_id":"e8b78e91-db9e-4a47-8cff-da8c0a0ae961","year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.699034Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:fc00bb9850ec0a550857f6706212e711854ab8f70e37b3915a49f267d035e9ec","observation_id":"bf440e27-b60e-49c8-b5ce-3eea4822ea47","resolution":{"observed_at":"2026-08-07T14:51:30.241623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:17.803090Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.803090Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:102958e49e9f1b4dbd3db6c4feff69afb13196eb614fc07a8e2974e1a27c93f4","observation_id":"55d03893-a7fa-409a-a84d-061081f79fd6","resolution":{"observed_at":"2026-08-07T14:51:17.803090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:30.002193Z","title":null,"venue":null,"work_id":"cfb85e80-0ac4-4ed5-a8d9-48125a0579ad","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:17.914639Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:1900f69fb418548d5ee54190e45796b33bd37a17ffde666ccdd685fb0532bf60","observation_id":"d80399e2-2999-44ba-ae6f-0e47a76ac3d9","resolution":{"observed_at":"2026-08-07T14:51:30.083860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:51:18.017730Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.017730Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:defe0d4dea86a016fd4137c36af00c8b62ba2821f0057787a056b6f890e48ba0","observation_id":"9d73f80a-d3f0-4ace-bcc3-b9967346b66d","resolution":{"observed_at":"2026-08-07T14:51:18.017730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T14:51:18.119095Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.119095Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:3617b8b0a6350bfdb4b813f3484431807bfac974005f7cab0f7f58aa710a79ba","observation_id":"917cbe05-127a-47dd-8b36-ba927934ca76","resolution":{"observed_at":"2026-08-07T14:51:18.119095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-07T14:51:18.223323Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.223323Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:eac50ecaffe92df316f16d9416494d6f6fba025839379e48c22046b2c14acf3b","observation_id":"239bc833-9097-451a-a98d-d3e16827e969","resolution":{"observed_at":"2026-08-07T14:51:18.223323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T14:51:18.338920Z","title":"Llava-onevision: Easy visual task transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.338920Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:07b92bc9171962a073ebbd26d5ccad2a0098e2c970d2b35d71247e9fc54f1fa2","observation_id":"609a87a2-ed82-41cd-ba39-d9eec14ba700","resolution":{"observed_at":"2026-08-07T14:51:18.338920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:29.884138Z","title":"Claude 3.7 sonnet and claude code,","venue":null,"work_id":"0ff677cc-2fe2-4442-86bc-e7b7f212fda3","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.413139Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:074540e75c8fa6580e0140c544cf07ab39b146f34bb400cc0628f9b287d7e9d7","observation_id":"edb92f9f-d01b-47c6-842e-8a40a800a945","resolution":{"observed_at":"2026-08-07T14:51:29.941789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:29.755830Z","title":"Gemini 2.5 flash,","venue":null,"work_id":"90331867-91e4-4598-b7db-bf1f87626d15","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.504967Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:980a8ad637702c4e7d3f23f6a45d096cc9056c02dd9d98948d216fac7b3835e7","observation_id":"c7f85011-adc8-4446-8919-fd68d58e82f3","resolution":{"observed_at":"2026-08-07T14:51:29.827413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:29.655718Z","title":"Introducing openai o3 and o4-mini,","venue":null,"work_id":"327eb9e3-535f-4619-b07a-3c7b0039c559","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.574878Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:b896f6a98c1176ddabba538bf5f2398d9dc873ee17506a00c31ea5997cf1b3f9","observation_id":"9ba82203-708c-48d9-949f-3aa211d2f342","resolution":{"observed_at":"2026-08-07T14:51:29.698825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:29.482550Z","title":"Introducing gpt-4.1 in the api,","venue":null,"work_id":"9bb72c97-cc21-4dd3-8ab7-8761c5187773","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.681822Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:7473364fda5f638f5e5feb6dd660a9d403b68f28741987c5024dc3e1e5928eba","observation_id":"32a6d0f4-b9c9-4473-8cd8-c44923794c89","resolution":{"observed_at":"2026-08-07T14:51:29.587173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:29.347239Z","title":"Learning to reason with llms,","venue":null,"work_id":"a9186ef9-0980-4be9-b951-d161ad9b2dda","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.791435Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:32f227b22590c184cf77186a4a097657e3eb66d2cb1c6fb8217ad792ecc27e78","observation_id":"c2f87b70-6445-4385-b0e4-2ea5afca82c6","resolution":{"observed_at":"2026-08-07T14:51:29.419168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:29.140160Z","title":"Gemini 2.5: Our most intelligent ai model,","venue":null,"work_id":"1c9ad188-cb8d-43da-b225-e2e0d3451240","year":2025},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.874320Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:1ca1cbfa61e7c98c0ce97df88de8dbecc54d64c5322771b530570441cb4caa29","observation_id":"70de87a8-dfd2-46a8-aaab-09727735fea1","resolution":{"observed_at":"2026-08-07T14:51:29.232270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:28.988417Z","title":"Experiment with gemini 2.0 flash native image genera- tion,","venue":null,"work_id":"b610593d-24d1-4be6-b71a-3e04368bb632","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:18.970643Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:371fbed68809817b7977aef3c9f84f37ba6464346e0318c45c5bfc2c144710d9","observation_id":"909f35f5-ccd6-465d-bfd6-a259719b6452","resolution":{"observed_at":"2026-08-07T14:51:29.080834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:28.784835Z","title":"Requires aria-expanded attribute toggling and specific dropdown selectors","venue":null,"work_id":"27953069-e40d-4e3b-864c-97bbbef651fc","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.080150Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:7f7de82520315b9a8f5a3e8b36444af2b8afbcc84a3bc9f21b1c6b42cd0ba079","observation_id":"51e1cf82-4cbf-47c7-aa7b-1743a54a6c67","resolution":{"observed_at":"2026-08-07T14:51:28.898011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:28.594756Z","title":"checkbox","venue":null,"work_id":"e7cf650c-f6da-45e3-93e8-eb6fc0feec33","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.177402Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:c8059af29ea04a0fd809641f558c5bb3adfc1b27d66917f1245db804eb1e8af6","observation_id":"9f94a804-b651-4534-afd0-c47d68813ee3","resolution":{"observed_at":"2026-08-07T14:51:28.686124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:28.352167Z","title":null,"venue":null,"work_id":"d486862d-d7a4-4211-863c-1327d8a58b5d","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.269015Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:6f2a74296d1686ff3b3454b5d6f406ca50983a16f3d870417df2ce45b684ec2d","observation_id":"50c862c2-93bf-4885-9dea-8f0a74fa1847","resolution":{"observed_at":"2026-08-07T14:51:28.503873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:28.025218Z","title":"The modal must match specific selectors like .modal or [aria-modal=’true’]","venue":null,"work_id":"3d388b6f-d1b6-4921-8b5f-4daf6f2260a8","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.392064Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:b1d9482603714fa37707ab43460f62134dbdafec37aff222fd1f69e286e7c94f","observation_id":"d543e532-477e-4573-806a-f9e82cbb8777","resolution":{"observed_at":"2026-08-07T14:51:28.188845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:27.683227Z","title":"The tooltip must adhere to specified class names or attributes (e.g., .tooltip, [role=’tooltip’])","venue":null,"work_id":"39afbf17-8715-4a50-a502-52debdcd28c6","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.498059Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:6dca72cb052004acfd23e618ea2c27b120864d1b41f475717a26694731a97f2e","observation_id":"a7eb254a-36e2-425a-ba83-7fdbc55074ac","resolution":{"observed_at":"2026-08-07T14:51:27.851193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:27.418420Z","title":null,"venue":null,"work_id":"6df0f723-4423-43b5-a1ae-c0c3d9887ea5","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.598137Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:b549d98e7f1972f730105f0961d9f5b4f9d98133a5a976bb62de0bb4f4141179","observation_id":"7400c35a-4842-44f2-946e-7092fccd5c5e","resolution":{"observed_at":"2026-08-07T14:51:27.513638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:27.178899Z","title":null,"venue":null,"work_id":"737d1cc8-c5e4-4b9b-8440-cd66165f09a1","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.676518Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:13cc46b6764222595370150f378fafc15af69a72e357eb6d29eb2d0d8a1f3c04","observation_id":"d4b1400b-8d4f-41ae-ae41-23f3982e0365","resolution":{"observed_at":"2026-08-07T14:51:27.286007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:26.881530Z","title":null,"venue":null,"work_id":"ff54bf8a-1c40-479c-b19f-1e02bbcfe65e","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.788599Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:dce072ce71f84a480f40aa8241e27ac1d0f09ac264b8cdc2c3b909af82a0c12a","observation_id":"a7443efb-807c-44b6-bb6f-cac25d601558","resolution":{"observed_at":"2026-08-07T14:51:27.028137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:26.721648Z","title":"underline","venue":null,"work_id":"91b9dfeb-e98a-4eee-be3b-e0b1848684e5","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:19.891794Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:d8ca9058b60fcfd0462ac2152e08e3f78094c89e3758280b0916019815da64c7","observation_id":"03a80b3d-1a2d-4859-9b39-8757d2ffd8b0","resolution":{"observed_at":"2026-08-07T14:51:26.775925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:26.406481Z","title":null,"venue":null,"work_id":"6b1bc2e1-f1c2-4ec6-93a0-166eb35d3f90","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.025926Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:5e406f941b87ee7ce7bddcec96a4bbd8bdbb5dcdccb75e4fa98ce8e8f581dae0","observation_id":"5be33241-084a-4c06-8397-b607cef1e6dd","resolution":{"observed_at":"2026-08-07T14:51:26.512685Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:26.112536Z","title":"It also considers if these reproduced elements are styled identically to the original in terms of appearance (e.g., color, shape, visual effects)","venue":null,"work_id":"1053e18b-3b0e-43d2-8a14-c53bc38233a5","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.119767Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:c7ce3d3d852c77793d32aa76eb7bc5243db01fc93ed9ddbaeb2bb43a30a94724","observation_id":"49c694ba-67f1-4b57-9e53-7091df6c9090","resolution":{"observed_at":"2026-08-07T14:51:26.283477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:25.785982Z","title":"• Score 10: All elements maintain exact proportions and sizes relative to each other and the overall page, as in the original","venue":null,"work_id":"88948b40-6ad2-473b-b2ee-fea67b1d10c4","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.223521Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:032a236fb64b2a13baf48f7897b8702d05b3c98dbb8e5daf6cdd3bb7c9026e11","observation_id":"ebf92e15-5980-41f1-bbed-0d8f4a258e13","resolution":{"observed_at":"2026-08-07T14:51:25.943326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:25.485493Z","title":null,"venue":null,"work_id":"db8d3668-78e8-4d2f-ba93-602a1b7ca247","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.306569Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:6d300e62dddc2ad9761c98be739b2c956d46d1c2aa1251fb5bf03b934e90f8b0","observation_id":"57fae60c-70a6-4cb9-af9b-0eb165f5cbe4","resolution":{"observed_at":"2026-08-07T14:51:25.626395Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:25.126252Z","title":"• Score 10: All elements exhibit perfect alignment and spacing as per the original design","venue":null,"work_id":"3b4ae092-b3ba-43f7-be29-4555d511b426","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.394634Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:4288ec0f24f507d08b9a4bdc0ebbe74d36956ac49140847073e9ece0c4ebe20c","observation_id":"fc34b6aa-bbd5-470d-89ec-5bc8997d5c56","resolution":{"observed_at":"2026-08-07T14:51:25.288132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:24.754780Z","title":null,"venue":null,"work_id":"7daa08e2-c8af-4711-b4a7-b82a25a265f6","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.482308Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:fbf6c4529dc2a400009416b234187bd9d9324524f4c658e9f78df93e639de0c7","observation_id":"5c372f69-d4fc-40a0-9c2c-de47296d8204","resolution":{"observed_at":"2026-08-07T14:51:24.903446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:24.538404Z","title":"• Score 10: All colors, including background, text, and element colors, are identical to the original design","venue":null,"work_id":"869fa9fa-50fa-4ceb-8da8-dfb3381f30bb","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.561793Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:42b8ed29e0346802c128058f0241da1dc9df7b49c715c99abbba2aae8613529e","observation_id":"472d51ce-39cc-43fe-81e5-15165af734a2","resolution":{"observed_at":"2026-08-07T14:51:24.631168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:24.435744Z","title":"look and feel","venue":null,"work_id":"7f64958f-2b57-4173-87a2-7cc861ad4389","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.647450Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:657e975555220f5f12364f60ae67ed6172076c8ddb35582a9d85d430b9e81c24","observation_id":"425cbbe2-f30f-492f-8d38-fab30232d463","resolution":{"observed_at":"2026-08-07T14:51:24.533628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:24.274628Z","title":"• Score 10: All text attributes (font, size, spacing, color, alignment, etc.) are identical to the original","venue":null,"work_id":"24a7c60f-08ba-49cc-8b16-23b2b1eb2b05","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.728077Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:288cf9f6fca7bdc77964b636257b230275fa63e5c2109a2a76470dbfb4d3fc32","observation_id":"5f344569-5271-46bb-8bcf-d3850ecf20c2","resolution":{"observed_at":"2026-08-07T14:51:24.340101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:24.102484Z","title":"• Score 10: All main textual content is identical to the original","venue":null,"work_id":"8feba309-a3ce-4e52-bd87-c67496642593","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.803615Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:61492715cae91eafa79e959ae8b272fb9c4e526f5d32c8a88760f9eb7a55da66","observation_id":"9d30bccd-d6e5-4ac0-9c3b-a3de24f823a0","resolution":{"observed_at":"2026-08-07T14:51:24.202229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:23.963825Z","title":"• Score 10: The generated page perfectly represents the same content, information, and intent as the original","venue":null,"work_id":"6eddfe36-be4d-4312-8c19-1f4178bd29a1","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.884216Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:8a97e96f9bb5d467e704a064208d9ca31364f939c25ec0740b0d8828faf740d3","observation_id":"07e359a3-e05c-4a7f-aae5-e87f94abcc10","resolution":{"observed_at":"2026-08-07T14:51:24.024822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:23.807782Z","title":null,"venue":null,"work_id":"e84d69b9-71f7-472e-985d-05fe1f782ce8","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:20.986283Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:0bc79d875017cd8b15c455eba895a96eadaa7ff63efba176435d6607e3f3af06","observation_id":"6b88f595-43d9-4045-ae1a-d7996f98b227","resolution":{"observed_at":"2026-08-07T14:51:23.886630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:23.675159Z","title":"For each type, corresponding elements are identified and compared","venue":null,"work_id":"f6344d69-0d2a-4528-a60f-1580d7809605","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.053869Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:d730d92256920ec7efda750d4fe6759672ec69bb9f87ba29343e9bef3442093c","observation_id":"8027f343-c761-4ae4-8f7a-30c9bec0f2b0","resolution":{"observed_at":"2026-08-07T14:51:23.734641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:23.527903Z","title":null,"venue":null,"work_id":"009de77e-de92-48da-ab25-c7781dd51a66","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.132809Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:8ef9c61280adfc1a39a159ed563c93e33accb04279b4eafb4abd4938f1adb430","observation_id":"2532c56d-1154-4f14-bffd-38aa6faa25d6","resolution":{"observed_at":"2026-08-07T14:51:23.601418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:23.331764Z","title":"Each property p has a weight wp","venue":null,"work_id":"83cb6228-ac69-4a6a-bd2c-6f3185683fd3","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.210119Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:52668874e5997d743bdc0e54a3e4898fb4a0a1ec8e5c357f1a49a02cb5b0a864","observation_id":"aebfb249-4beb-43fc-8c28-5c75b6985114","resolution":{"observed_at":"2026-08-07T14:51:23.425186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:23.153522Z","title":null,"venue":null,"work_id":"3e8671c1-ab25-4ee5-9962-24f8bf1ae282","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.259853Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:9745f84bd2d5e8f56b4544848380f6228c456052078a2f911df4204fca9ff497","observation_id":"682d2f01-a10b-4b94-8393-d67847e402de","resolution":{"observed_at":"2026-08-07T14:51:23.204907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:23.017616Z","title":null,"venue":null,"work_id":"60548c1b-b1e0-4071-9cd2-8802d1369198","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.318572Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:9cb0f015087f65fe367af9653b100f602faa84196398fd5a0bbef15ac165c80a","observation_id":"f446a07c-d8c5-4551-9653-a46f84835db2","resolution":{"observed_at":"2026-08-07T14:51:23.095180Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:22.879188Z","title":"The average Simimage is calculated over all matched image elements","venue":null,"work_id":"aa950ff8-a72d-43f5-b7d5-758c3777ea51","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.416946Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:b6e20246032aa56afda9c78c7be119b84503312a5d0a218b4699bbce21673324","observation_id":"224aff3f-d7f9-468e-8b20-4b332f852267","resolution":{"observed_at":"2026-08-07T14:51:22.954882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:22.693401Z","title":null,"venue":null,"work_id":"9a7fb129-457d-40e0-9d42-077c61e35066","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.495474Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:3448a2eee131ca46d0c4aebc83a742ce1de2971b34c3d9d402e9af09f153dfe9","observation_id":"bfb8bb42-3185-4515-b975-249614f3156c","resolution":{"observed_at":"2026-08-07T14:51:22.821614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:22.549256Z","title":null,"venue":null,"work_id":"84adcf9e-a880-4b42-8d02-de199fa61890","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.570951Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:4e6469d4fc9498468f5164aacb3fc21f108b4c1074b82f04ca5d751d961c45c0","observation_id":"7fc1fab4-ae12-4ef7-8d4f-c1fdf0732179","resolution":{"observed_at":"2026-08-07T14:51:22.621133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:22.386011Z","title":"Label Webpage","venue":null,"work_id":"d34c63e9-b8b5-4c27-bbe0-386e19820e4e","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.693869Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:3ab7caf21919f866642440a58f0e36af905523b29104bbba8c61b8b09a34722e","observation_id":"3a1879e7-34b9-4483-a893-8c4c8c5a1eb6","resolution":{"observed_at":"2026-08-07T14:51:22.468672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:22.243984Z","title":"Label Webpage","venue":null,"work_id":"f50a3ffe-3cf8-413d-8803-f3055c4b8918","year":null},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:21.788563Z"},"links":{"citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:f25a477f6e29aaa412bcc06fd099f4ff42d0a55bfdfdc96ec2a77bc6162b0caf","observation_id":"fd538807-a8f7-4ed8-8e15-adacb669d134","resolution":{"observed_at":"2026-08-07T14:51:22.304486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:45:38.156584Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 6 inbound Pith citation observations for arXiv:2505.17399."}