{"as_of":"2026-08-18T19:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2266ff708bd7cfbc6e1f077e2938631e960fb33df6e6d558eda69b24997ebae4","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:48:16.471330Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:37:38.153234Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T23:37:38.312068Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"cited_work":{"arxiv_id":"2411.11916","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11916","snapshot_observed_at":"2026-08-15T23:37:38.312068Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","venue":"cs.DB","work_id":"85591c69-525e-48cc-9ff4-f595926c6471","year":2024},"citing_paper":{"arxiv_id":"2505.04670","last_updated":"2025-06-04T12:57:19Z","snapshot_observed_at":"2026-08-18T12:03:33.562507Z","submitted_at":"2025-05-07T08:26:54Z","title":"LLM Code Customization with Visual Results: A Benchmark on TikZ","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:37:38.153234Z"},"links":{"cited_paper":"/paper/2411.11916","citing_paper":"/paper/2505.04670"},"observation_digest":"sha256:4ee9c58eba67510f562725c7fd04c1f5aacf0b51f87a9bc8f822a0dfecd7d557","observation_id":"768e4cfa-6e0f-47cc-8df3-c0027a527070","resolution":{"observed_at":"2026-08-15T23:37:38.318878Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11916/citation-record","integrity":"/paper/2411.11916/integrity","json":"/paper/2411.11916/citation-record.json","paper":"/paper/2411.11916"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.901006Z","title":"Meet yi-coder: A small but mighty llm for code,","venue":null,"work_id":"f7062189-261f-47e8-890b-8702ba596f79","year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.278958Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:5204ab9143fbcc1e13420f0c3beb3a0579f171eccc81858e8200a3d8468321d2","observation_id":"31c6d48f-2ba9-4cbd-bceb-2ea7736a3377","resolution":{"observed_at":"2026-08-12T18:48:16.904444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-12T18:48:16.282839Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.282839Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:78b41deb85357f10ec87a344fa363829b5c94455424d9b2dafc6a709d526974e","observation_id":"3efbbddd-3f97-4fc6-bd2d-8aa8f7a6fb29","resolution":{"observed_at":"2026-08-12T18:48:16.282839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T18:48:16.286831Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.286831Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:91b835bc4abe990f2a8030040852a85db3dacd2bc0352885a9a68a7dd22bb045","observation_id":"83d55cfa-b5b3-440d-b452-8b092078eb07","resolution":{"observed_at":"2026-08-12T18:48:16.286831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.884887Z","title":"A survey of machine learning for big code and naturalness","venue":null,"work_id":"f5e9f073-2ada-48eb-9523-fb4e4a99f355","year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.294304Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:d187e33645b7766f61bde670ed20f9f5260fae1bc2e73f3554b51212d2b71003","observation_id":"13924278-f683-4651-b439-85eb23504cab","resolution":{"observed_at":"2026-08-12T18:48:16.888045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-12T18:48:16.298239Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.298239Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:7fe55f0d0b3e4aa58440f028ad78d14ad3ae0dc30a0ec0cbd47b8fe6ae192482","observation_id":"8bf8a8d9-abea-4564-90f5-c950b8164946","resolution":{"observed_at":"2026-08-12T18:48:16.298239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.876116Z","title":"Au- tomatikz: Text-guided synthesis of scientific vector graphics with tikz","venue":null,"work_id":"cc4fc517-8d0a-4907-a8aa-dc5d42b1679a","year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.302317Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:b92589a60a476450b8db35bbbe69019fe182e58d1987bb3423e7056223d4fa97","observation_id":"ad85e9c2-a480-4e74-9944-bac8a4e97778","resolution":{"observed_at":"2026-08-12T18:48:16.879556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-12T16:46:46.561976Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-12T18:48:16.306160Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.306160Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:36fa5660334f6d623891767290e458c34489d59769456db70f7018db35fddab1","observation_id":"ae731ae6-98d7-4fe5-98bc-50630d7604cc","resolution":{"observed_at":"2026-08-12T18:48:16.306160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.866698Z","title":"A sur- vey on generative diffusion models","venue":null,"work_id":"ffd7c120-54dc-432a-b27b-34a275df2b2d","year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.310374Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:8913e435997baa75d62881f63f4dc4f5dae678e33de0f09d9256dcb4a127d4c1","observation_id":"33551e9e-51f5-4563-a574-035635306cb5","resolution":{"observed_at":"2026-08-12T18:48:16.870160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-12T18:48:16.314145Z","title":"Evalu- ating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.314145Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:51e45d8dc32839a00409d3c9a92f8cc84f8d0687b4d38bfb9132a2d06db892a1","observation_id":"c0a65e84-42d8-48d9-af53-56de21d420fc","resolution":{"observed_at":"2026-08-12T18:48:16.314145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.857032Z","title":"Openbias: Open-set bias detection in text-to-image generative models","venue":null,"work_id":"5c8e4e31-668b-4702-8dae-303a8d53ac4f","year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.318942Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:0e436dd9a89f3ec435e6a21883e0bd1450a354e853582bc081a8746c3e9b6139","observation_id":"4a57770f-35bd-4600-a3d5-5a6efbe642ea","resolution":{"observed_at":"2026-08-12T18:48:16.860329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T18:48:16.322873Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.322873Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:ed58af6e7334b8e3a5a534181c7d8a50f79e6bff39b86ecf3b82237d31f18bf4","observation_id":"66ee9a1c-5817-4de7-96d3-cb3a4fa228f0","resolution":{"observed_at":"2026-08-12T18:48:16.322873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-16T13:08:17.144750Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-12T18:48:16.327244Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.327244Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:2c7a4f8db8b88afe15effafa141546c6292160e7dbb6c191e227cb10f6379628","observation_id":"1f240908-180f-4b3d-bf91-ae95d0941041","resolution":{"observed_at":"2026-08-12T18:48:16.327244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-12T18:48:16.332073Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.332073Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:799adb48f4b1d1c657dec8c2f5596451882cf1fe88371295160535f327137d79","observation_id":"fc2cab4c-ebcc-4125-85dc-c889200ce846","resolution":{"observed_at":"2026-08-12T18:48:16.332073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-12T18:48:16.336195Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.336195Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:ce5cfc40fadf66745d1f59d7b4f95a02746c184076bbff1f025a4898e918be9c","observation_id":"2708b021-4b51-4a2c-98e8-ca811ecb21d4","resolution":{"observed_at":"2026-08-12T18:48:16.336195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.847837Z","title":"A survey on advancements in image-text multimodal models: From general techniques to biomedical implementations","venue":null,"work_id":"2b8ac275-c5ab-4985-8cad-a87799cb2087","year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.340506Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:b32924bfeafe97069612b10ee7964222f8faa9e1e7f3f99cf85edc251003fba1","observation_id":"617fe279-2942-45d2-a4f0-6c88558bb87d","resolution":{"observed_at":"2026-08-12T18:48:16.851170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-18T00:01:15.410179Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-12T18:48:16.344206Z","title":"Cogvlm2: Visual language mod- els for image and video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.344206Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:871c24196fde492a8e435c775487144462816d5833d21ebf4e49a0f1042618ae","observation_id":"10b97a24-666c-4350-bb70-09030d617967","resolution":{"observed_at":"2026-08-12T18:48:16.344206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-12T18:48:16.349213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.349213Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:f69a71197b56718b0bbc41f60675f640d7774b1006115d8d066185cf9d6deb65","observation_id":"bc6155ac-e0a1-4a9d-8c3c-c9a7a1b2559d","resolution":{"observed_at":"2026-08-12T18:48:16.349213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.838646Z","title":"A comprehensive review of the latest ad- vancements in large generative ai models","venue":null,"work_id":"70244183-9eb4-4362-b0a6-ca8f2b7697bc","year":2023},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.353123Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:0bb3928f566f4813dafe1273a748c951ea38ceb1a6ae8539e03eb12549dba2e9","observation_id":"0287d994-3ebb-473a-a7c8-c4727570a669","resolution":{"observed_at":"2026-08-12T18:48:16.842237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-08-13T00:09:23.835117Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-12T18:48:16.357625Z","title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.357625Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:e150a9b6fd17a4b0742d98875d1d6bf032cd196df55b3cf0e7e30bc8251a4425","observation_id":"7c9cf318-76f7-4489-9d61-ade141808f8a","resolution":{"observed_at":"2026-08-12T18:48:16.357625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09486","last_updated":"2024-09-26T09:31:48Z","snapshot_observed_at":"2026-08-16T14:00:58.338487Z","submitted_at":"2024-04-15T06:15:46Z","title":"MMCode: Benchmarking Multimodal Large Language Models for Code Generation with Visually Rich Programming Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09486","snapshot_observed_at":"2026-08-12T18:48:16.361657Z","title":"Mmcode: Evaluating multi-modal code large language models with visually rich programming problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.361657Z"},"links":{"cited_paper":"/paper/2404.09486","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:086d07887fe337e128fc2458ed933c54ae047a663444323e3272c8c71fa14d25","observation_id":"5664a034-6115-451b-ab8f-f9d17a57bcc0","resolution":{"observed_at":"2026-08-12T18:48:16.361657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-12T18:48:16.365460Z","title":"Starcoder: may the source be with you! arXiv preprint arXiv:2305.06161,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.365460Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:4613750c32531cd69fb694218ba71762fd67db0d8aea823c1ba181af342d2de1","observation_id":"f035df18-2be9-4622-8cc9-8081a3e9d870","resolution":{"observed_at":"2026-08-12T18:48:16.365460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.828805Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":"ba158169-0f79-49fb-a4d3-84cab512a719","year":2025},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.369493Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:89dbd9d60ce8f51d5d684b7c5c882a5d7330e98c02271a81a17e9a987f333669","observation_id":"ec1a5a44-6918-4b75-b7fc-669d52e3f38a","resolution":{"observed_at":"2026-08-12T18:48:16.832274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-12T18:48:16.372571Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.372571Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:794b490d46e6f1d5177d286eff5ad60b695cd1d73d846951abea715ab577bacd","observation_id":"83969801-c87c-4964-b61e-f202f0979f00","resolution":{"observed_at":"2026-08-12T18:48:16.372571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-12T18:48:16.375809Z","title":"Deepseek-vl: towards real-world vision- language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.375809Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:90b15462c4ab10c996f38b43c2d2efe09990b1c651ca2ebe60f38e818833fc7d","observation_id":"9ee6eea2-0c3c-47e1-8531-f1d9083469ea","resolution":{"observed_at":"2026-08-12T18:48:16.375809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.819204Z","title":"Wizardcoder: Empowering code large language models with evol-instruct","venue":null,"work_id":"4ce39027-8a86-4ea4-ace0-208793ce7ab7","year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.379301Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:37285d5d5abbd6ca19d3cc45ec515266454623714a2ab7ceab34e4fc4f2be52a","observation_id":"08d19eae-a44f-4876-a69c-0cd5b9dac13a","resolution":{"observed_at":"2026-08-12T18:48:16.822655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10797","last_updated":"2025-02-19T06:00:55Z","snapshot_observed_at":"2026-08-18T11:01:01.238927Z","submitted_at":"2024-06-16T03:45:45Z","title":"STAR: Scale-wise Text-conditioned AutoRegressive image generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10797","snapshot_observed_at":"2026-08-12T18:48:16.382930Z","title":"Star: Scale-wise text-to- image generation via auto-regressive representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.382930Z"},"links":{"cited_paper":"/paper/2406.10797","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:c6462bd7fa97e965b84d62a0631b8f637473f12746b7ed52e609c6ef35082b75","observation_id":"e6fd8585-2fc1-4d98-8b98-c5476fc01cdb","resolution":{"observed_at":"2026-08-12T18:48:16.382930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.807999Z","title":"Text to diagram to symbol: Representational transformations in problem-solving","venue":null,"work_id":"7aca550b-ddfb-4f54-baef-9dc561e17bc8","year":2001},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.386434Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:0d3aaad28dcec8cf616233ace4db7e72772d751bcdc7156fb5dbca0e8859921c","observation_id":"e684564c-7e67-4971-a47d-24a7b87a166c","resolution":{"observed_at":"2026-08-12T18:48:16.812470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.798031Z","title":"Precisecontrol: En- hancing text-to-image diffusion models with fine-grained at- tribute control","venue":null,"work_id":"697ba891-12b6-4e53-932a-3d45fb161cc7","year":2025},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.389963Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:3950da58510c059d959d8dda9f234fad9c02c1e9b8664c485d699d180a0da402","observation_id":"6ae9aa3a-68e5-4f62-9c5c-56cca7da7dac","resolution":{"observed_at":"2026-08-12T18:48:16.801590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.788778Z","title":"Autoact: Automatic agent learning from scratch for qa via self-planning","venue":null,"work_id":"af7def1b-43aa-438d-92b9-b7f27a117b41","year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.393657Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:69ab0ebc8eeb207b902fb7faadb61368fa0119cdad1edfb4fc40ed4cfa271690","observation_id":"b731f477-fdf5-4dae-8f46-6d1fdf4e2052","resolution":{"observed_at":"2026-08-12T18:48:16.791810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.396955Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.396955Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:00a4d864d1396c41eaa3ef815718a7efea5ee3bf575e464d00519977b4fe84d5","observation_id":"346aa67f-a71c-45a5-94ad-52b6ed67ba02","resolution":{"observed_at":"2026-08-12T18:48:16.396955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-12T18:48:16.400660Z","title":"Gemini 1.5: Unlocking multimodal under- standing across millions of tokens of context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.400660Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:215d7458927ca72ef379b0f6cd71c8e4db4afc611943bf351b3093eac75778e7","observation_id":"f3475261-8574-4f8b-828c-ed2d7fe76f0d","resolution":{"observed_at":"2026-08-12T18:48:16.400660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-12T18:48:16.404581Z","title":"Code llama: Open foun- dation models for code","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.404581Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:fde4aee190558fec3fc64937299581773812b8e97fbef42d9c5f1a99584b5eb1","observation_id":"09eb5b24-fa60-4b49-bebc-688cc1621645","resolution":{"observed_at":"2026-08-12T18:48:16.404581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.775025Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"b02a6444-12eb-458e-abcf-49eb0b308c11","year":2022},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.409358Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:3e379cdaad02474158c5effff15af5e3b73eb9089583837a5e1837f81823a7c3","observation_id":"5a580c1e-570c-4b1c-b9a6-456082775baf","resolution":{"observed_at":"2026-08-12T18:48:16.777896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03163","last_updated":"2025-02-09T04:22:26Z","snapshot_observed_at":"2026-08-16T14:12:33.804927Z","submitted_at":"2024-03-05T17:56:27Z","title":"Design2Code: Benchmarking Multimodal Code Generation for Automated Front-End Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03163","snapshot_observed_at":"2026-08-12T18:48:16.413407Z","title":"Design2code: How far are we from automating front-end engineering? arXiv preprint arXiv:2403.03163, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.413407Z"},"links":{"cited_paper":"/paper/2403.03163","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:fb5ecbac4a43fa1d213b9c162883f1310d7cc956990b9064ecbc249a90879a75","observation_id":"74f731f9-89a5-44c5-ad35-3bd296017724","resolution":{"observed_at":"2026-08-12T18:48:16.413407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-12T18:48:16.417823Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.417823Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:bf37131608f15b06b86a5410973c7095ad377b277e829c849bb3f8de05e776c0","observation_id":"4ac76588-7232-4779-a733-8d40dced7b1c","resolution":{"observed_at":"2026-08-12T18:48:16.417823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07990","last_updated":"2024-05-13T17:59:22Z","snapshot_observed_at":"2026-08-16T13:53:04.020766Z","submitted_at":"2024-05-13T17:59:22Z","title":"Plot2Code: A Comprehensive Benchmark for Evaluating Multi-modal Large Language Models in Code Generation from Scientific Plots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07990","snapshot_observed_at":"2026-08-12T18:48:16.422149Z","title":"Plot2code: A comprehensive benchmark for evaluating multi-modal large language models in code generation from scientific plots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.422149Z"},"links":{"cited_paper":"/paper/2405.07990","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:ba58a6ecd2dfc8cfd46205b7b66f29cdd2f1e8a80eed8d76b6932ee403e4c50a","observation_id":"2ee977dd-09b5-4950-a8dc-e02cc20548cb","resolution":{"observed_at":"2026-08-12T18:48:16.422149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.766257Z","title":"Attngan: Fine- grained text to image generation with attentional generative adversarial networks","venue":null,"work_id":"4421d3bc-d7c3-4dbe-9d93-9e7ea2a6f291","year":2018},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.426608Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:cffd136f4a4184cf3444596dbe35ab18344651d1c3683cdba00801c0bbe6664c","observation_id":"733aac14-216c-4450-84a5-bae03f5a7389","resolution":{"observed_at":"2026-08-12T18:48:16.769500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10305","last_updated":"2025-04-17T08:34:42Z","snapshot_observed_at":"2026-08-14T19:59:05.307983Z","submitted_at":"2023-09-19T04:13:22Z","title":"Baichuan 2: Open Large-scale Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10305","snapshot_observed_at":"2026-08-12T18:48:16.432941Z","title":"Baichuan 2: Open large-scale language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.432941Z"},"links":{"cited_paper":"/paper/2309.10305","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:5b728aa1c1f267940097ad603fd7ec2b67e5061d202259a0d0083d99e6c1df0a","observation_id":"cb472f75-c320-435c-903b-61902249c4de","resolution":{"observed_at":"2026-08-12T18:48:16.432941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T18:48:16.437049Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.437049Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:81346c29e3ead833f5eac7a2600e7be57e4511c2e72864775abd21fa198ac0c2","observation_id":"ae585896-7a78-42a1-a35f-468ad3922bed","resolution":{"observed_at":"2026-08-12T18:48:16.437049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11453","last_updated":"2024-03-19T14:44:22Z","snapshot_observed_at":"2026-08-16T14:17:40.361579Z","submitted_at":"2024-02-18T04:28:28Z","title":"MatPlotAgent: Method and Evaluation for LLM-Based Agentic Scientific Data Visualization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11453","snapshot_observed_at":"2026-08-12T18:48:16.441432Z","title":"Matplotagent: Method and evaluation for llm-based agentic scientific data visualization.arXiv preprint arXiv:2402.11453, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.441432Z"},"links":{"cited_paper":"/paper/2402.11453","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:2021b7a2a76bafa4bfa52a02720868b8ae1f057843e28b2023af21bc55379317","observation_id":"a000bd1d-6f89-457e-8299-e053cd9b7560","resolution":{"observed_at":"2026-08-12T18:48:16.441432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T18:48:16.449851Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.449851Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:67a22f4b4fa256ec708e14d43dacdcf217561449f1d62da706a33a87e1bd7b80","observation_id":"7b767930-a0b2-4dd3-a400-57227c833bb9","resolution":{"observed_at":"2026-08-12T18:48:16.449851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.453606Z","title":"Stack- gan: Text to photo-realistic image synthesis with stacked generative adversarial networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.453606Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:576e483602d3bc4211d6eb1569c9593f29a391ab3d7282a056ee2bc28d4d4f30","observation_id":"61c3bf1e-ae26-4bf0-bfbe-5fa4cff217b5","resolution":{"observed_at":"2026-08-12T18:48:16.453606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03320","last_updated":"2024-07-03T17:59:21Z","snapshot_observed_at":"2026-08-14T16:53:05.474750Z","submitted_at":"2024-07-03T17:59:21Z","title":"InternLM-XComposer-2.5: A Versatile Large Vision Language Model Supporting Long-Contextual Input and Output","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03320","snapshot_observed_at":"2026-08-12T18:48:16.457480Z","title":"Internlm-xcomposer-2.5: A versatile large vision language model supporting long-contextual in- put and output","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.457480Z"},"links":{"cited_paper":"/paper/2407.03320","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:beccf5d5856bd4aac450c9d17c8912513929dc05744c2ce028d4645b78e07052","observation_id":"c378e558-1977-4dc3-9b5d-bf308d235307","resolution":{"observed_at":"2026-08-12T18:48:16.457480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.751106Z","title":"Unifying the perspectives of NLP and software engineering: A survey on language models for code","venue":null,"work_id":"a41eb486-a735-4765-a2ac-8848e2b0ce37","year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.462388Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:6418e87e9f93187fd4f1391a99f300d03b1764dbc110fdabc65dc4f272075677","observation_id":"e29ee9a2-ee97-4176-bc71-dac842c13d68","resolution":{"observed_at":"2026-08-12T18:48:16.754498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.740608Z","title":"Codegeex: A pre-trained model for code generation with multilingual benchmarking on humaneval-x","venue":null,"work_id":"dfd575f6-b64f-4c2a-bc48-d217fe847784","year":2023},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.465404Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:47f81fa805c39e13e683c645e677632478158cd06bce369b2c1cdda17f649a99","observation_id":"40a39a88-0d50-4707-9379-8c2504b2c87c","resolution":{"observed_at":"2026-08-12T18:48:16.744526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.728686Z","title":"Vision+ language ap- plications: A survey","venue":null,"work_id":"97ee0364-bbc4-415d-9dd4-8a8dd5b607ff","year":2023},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.468268Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:8ed459e9b4d97cd8a511706d06acf81da9da7c9131f036e54710efeacf6d1387","observation_id":"12252e5e-db55-4089-87a2-3fc54f21e61b","resolution":{"observed_at":"2026-08-12T18:48:16.734004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10972","last_updated":"2024-08-29T17:55:52Z","snapshot_observed_at":"2026-08-16T13:34:02.634292Z","submitted_at":"2024-07-15T17:59:55Z","title":"VGBench: Evaluating Large Language Models on Vector Graphics Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10972","snapshot_observed_at":"2026-08-12T18:48:16.471330Z","title":"Drawing\" pass the expanded instructions to the code agent. For","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.471330Z"},"links":{"cited_paper":"/paper/2407.10972","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:e300ad37cbb50a6ffe03f9b4e4e6abfc52116b7a8b837a42d271805727410c0f","observation_id":"b0ce8616-d685-4970-9810-35debe411886","resolution":{"observed_at":"2026-08-12T18:48:16.471330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:48:16.893086Z","title":null,"venue":null,"work_id":"c32b76b9-5576-427f-9f50-d0e7077aea63","year":null},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.290890Z"},"links":{"citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:d54ef66b347691387a05cd5ad23e0500ca32c819831b6e171be6e1b466ddf235","observation_id":"5206db2f-f14f-4e8e-b023-42ff26f0ede9","resolution":{"observed_at":"2026-08-12T18:48:16.895903Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","latest_version":1,"primary_category":"cs.DB","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":30,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2411.11916."}