{"as_of":"2026-08-10T21:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65434e0909f35b24f6366a52ba24a4cbd59c15d9d9bea15fbef3fa9dad6bf964","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:51:17.233907Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T10:05:29.093803Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T10:07:43.266061Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"cited_work":{"arxiv_id":"2507.19525","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19525","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mmcircuiteval: A comprehensive multimodal circuit- focused benchmark for evaluating llms","venue":null,"work_id":"2c05d24d-bc40-4ad0-b024-d8b850654bb4","year":2025},"citing_paper":{"arxiv_id":"2602.15037","last_updated":"2026-01-29T06:13:44Z","snapshot_observed_at":"2026-08-07T10:11:21.061680Z","submitted_at":"2026-01-29T06:13:44Z","title":"CircuChain: Disentangling Competence and Compliance in LLM Circuit Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T10:05:29.093803Z"},"links":{"cited_paper":"/paper/2507.19525","citing_paper":"/paper/2602.15037"},"observation_digest":"sha256:a6b8e0f6c7ac603d6015c0cf3c46e36b18e847fbe04751c31b3db4478bdb5456","observation_id":"bc087c9e-bd8a-4f97-b410-0ea88f022682","resolution":{"observed_at":"2026-05-16T10:07:43.268039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.19525/citation-record","integrity":"/paper/2507.19525/integrity","json":"/paper/2507.19525/citation-record.json","paper":"/paper/2507.19525"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.00176","last_updated":"2024-04-04T20:18:57Z","snapshot_observed_at":"2026-08-10T16:13:01.343336Z","submitted_at":"2023-10-31T22:35:58Z","title":"ChipNeMo: Domain-Adapted LLMs for Chip Design","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00176","snapshot_observed_at":"2026-08-06T15:51:16.912733Z","title":"Chipnemo: Domain-adapted llms for chip design,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.912733Z"},"links":{"cited_paper":"/paper/2311.00176","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:63277ddc34c1fc3f3646226a6c9b3f442afdbd8145036c4c898635b5115bbe5b","observation_id":"a419aeb3-04f8-4616-8ac4-741362428b3c","resolution":{"observed_at":"2026-08-06T15:51:16.912733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13802","last_updated":"2024-11-22T02:32:09Z","snapshot_observed_at":"2026-08-09T15:55:39.681959Z","submitted_at":"2024-11-21T03:05:38Z","title":"SemiKong: Curating, Training, and Evaluating A Semiconductor Industry-Specific Large Language Model","version":2},"cited_work":{"arxiv_id":"2411.13802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13802","snapshot_observed_at":"2026-08-06T15:51:17.891052Z","title":"SemiKong: Curating, Training, and Evaluating A Semiconductor Industry-Specific Large Language Model","venue":"cs.CL","work_id":"86c949e2-12ef-4f79-964d-d12829a9cde3","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.921758Z"},"links":{"cited_paper":"/paper/2411.13802","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:05e6dc7775c02d8f6d563c5c67233bc6bfef2a0cd46194ac6262900339764d43","observation_id":"109b7cfc-d319-40ae-8bf0-d11fa5b1fcaa","resolution":{"observed_at":"2026-08-06T15:51:17.895784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.216899Z","title":"Openllm-rtl: Open dataset and benchmark for llm-aided design rtl generation,","venue":null,"work_id":"b3a17b69-8435-4478-82bd-7775337f284a","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.929211Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:f095e5e66ae011f5a86a5850ac01651332bdb21c0a47dc4f720ef18b99b802d3","observation_id":"08ade2e4-3b06-4b60-9559-4002daf21789","resolution":{"observed_at":"2026-08-06T15:51:18.221774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.199745Z","title":"Rtllm: An open-source benchmark for design rtl generation with large language model,","venue":null,"work_id":"b8d3b1ea-2170-4e9f-b854-8c9052c62316","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.935433Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:a6f2c67a5a9fa0f0d3769a2e972329326e90e4d689b6d9b6f9f278fc3e574f04","observation_id":"3cac6b90-f9e0-49a8-b66e-d70dcd92e8d5","resolution":{"observed_at":"2026-08-06T15:51:18.205192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.184221Z","title":"Autobench: Automatic testbench generation and evaluation using llms for hdl design,","venue":null,"work_id":"0e9f9557-3efc-4a69-b24e-507ee7a7da6c","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.941944Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:c3e4ff3cb3d73a5b5ca88d5ec0d9d1070afde031362a3ac3e13118cc3f55b014","observation_id":"128a57b8-370b-439e-816d-287ba2eb020c","resolution":{"observed_at":"2026-08-06T15:51:18.189676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.169230Z","title":"Verilogeval: Evaluating large language models for verilog code generation,","venue":null,"work_id":"9d35cd15-5a85-41fa-b29e-9e5b0c91edd7","year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.946817Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:44021b49d8849586b0c58c9399e0367fca83e396e973fd6b8a2dce94d148846b","observation_id":"5497fd4a-983a-4cd8-958f-1edcd8df0bcf","resolution":{"observed_at":"2026-08-06T15:51:18.173671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18297","last_updated":"2025-02-25T15:34:00Z","snapshot_observed_at":"2026-08-07T17:49:48.807611Z","submitted_at":"2025-02-25T15:34:00Z","title":"DeepCircuitX: A Comprehensive Repository-Level Dataset for RTL Code Understanding, Generation, and PPA Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18297","snapshot_observed_at":"2026-08-06T15:51:16.952647Z","title":"Deepcircuitx: A comprehensive repository-level dataset for rtl code understanding, generation, and ppa analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.952647Z"},"links":{"cited_paper":"/paper/2502.18297","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:f010dcfdb02a659949ebd789440ab268e0872d43f48d1e87dc2a313214475ff7","observation_id":"578eb82d-8759-41f0-9146-e68449726ef0","resolution":{"observed_at":"2026-08-06T15:51:16.952647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06676","last_updated":"2024-05-04T21:29:37Z","snapshot_observed_at":"2026-08-07T01:10:56.569281Z","submitted_at":"2024-05-04T21:29:37Z","title":"EDA Corpus: A Large Language Model Dataset for Enhanced Interaction with OpenROAD","version":1},"cited_work":{"arxiv_id":"2405.06676","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.06676","snapshot_observed_at":"2026-08-06T15:51:17.853130Z","title":"EDA Corpus: A Large Language Model Dataset for Enhanced Interaction with OpenROAD","venue":"cs.CL","work_id":"5a79a29c-d5fb-40d6-b780-604a725a8f92","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.958395Z"},"links":{"cited_paper":"/paper/2405.06676","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:8dc03fa3c619e1c1adacd11a71f47c303003bdae7af4bb158066281a9f75fb75","observation_id":"d446026a-cc98-40e6-a88a-01818d6d4fd5","resolution":{"observed_at":"2026-08-06T15:51:17.857997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15353","last_updated":"2024-07-26T08:36:25Z","snapshot_observed_at":"2026-08-03T21:38:52.001342Z","submitted_at":"2024-07-22T03:44:27Z","title":"Customized Retrieval Augmented Generation and Benchmarking for EDA Tool Documentation QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15353","snapshot_observed_at":"2026-08-06T15:51:16.964368Z","title":"Customized retrieval augmented generation and benchmarking for eda tool documentation qa,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.964368Z"},"links":{"cited_paper":"/paper/2407.15353","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:e5931beb19ed97948430135706306e241990a1ac6300052290b0e3fe29455009","observation_id":"addf7d73-a50b-4111-be2a-a180c18ebd65","resolution":{"observed_at":"2026-08-06T15:51:16.964368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07257","last_updated":"2024-05-01T10:43:36Z","snapshot_observed_at":"2026-08-07T05:54:06.933164Z","submitted_at":"2024-03-12T02:26:30Z","title":"The Dawn of AI-Native EDA: Opportunities and Challenges of Large Circuit Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07257","snapshot_observed_at":"2026-08-06T15:51:16.969771Z","title":"The dawn of ai-native eda: Promises and challenges of large circuit models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.969771Z"},"links":{"cited_paper":"/paper/2403.07257","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:65595e048c8c2f9d07ac01275b9712c832fd6e6f4a653a3c4acd02df67b4f724","observation_id":"844bcb60-1ed6-4c4c-83d8-e874fe94597c","resolution":{"observed_at":"2026-08-06T15:51:16.969771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.153846Z","title":"Deepgate: Learning neural representations of logic gates,","venue":null,"work_id":"b9c570ba-6bb9-4b7a-8609-a49356c2b0c9","year":2022},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.975053Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:fe286027c5992987c4aaa530f2aeff5d6b52fe679b7576d96393d61cbd1e6f5e","observation_id":"25ed9432-ebe7-4fb9-8cd6-b3bc9c2ea2ae","resolution":{"observed_at":"2026-08-06T15:51:18.158615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.138235Z","title":"Deepgate2: Functionality-aware circuit representation learning,","venue":null,"work_id":"af9f6d8e-128e-45e5-957e-34bb649867e6","year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.981378Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:c9205fba10b21f8192685a383afc2b6affe8d4cba2fb6e32ba77542aa58a4109","observation_id":"15de77ff-e2be-4554-9368-f4a9344a48fd","resolution":{"observed_at":"2026-08-06T15:51:18.143095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11095","last_updated":"2024-07-15T02:44:21Z","snapshot_observed_at":"2026-07-06T18:46:43.829115Z","submitted_at":"2024-07-15T02:44:21Z","title":"DeepGate3: Towards Scalable Circuit Representation Learning","version":1},"cited_work":{"arxiv_id":"2407.11095","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11095","snapshot_observed_at":"2026-08-06T15:51:17.800446Z","title":"DeepGate3: Towards Scalable Circuit Representation Learning","venue":"cs.LG","work_id":"b69f8038-93d6-47b5-bc9e-9fc275c00032","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.988229Z"},"links":{"cited_paper":"/paper/2407.11095","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:49640b88c7a672ba6fa5f70a0da303159f8e61e8464f776b9d658f48782928cf","observation_id":"ee7fdac5-75a8-4a96-8dbf-e3dde19240ac","resolution":{"observed_at":"2026-08-06T15:51:17.805475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01681","last_updated":"2025-05-20T08:17:48Z","snapshot_observed_at":"2026-08-09T18:30:08.670680Z","submitted_at":"2025-02-02T05:25:34Z","title":"DeepGate4: Efficient and Effective Representation Learning for Circuit Design at Scale","version":3},"cited_work":{"arxiv_id":"2502.01681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01681","snapshot_observed_at":"2026-08-06T15:51:17.775716Z","title":"DeepGate4: Efficient and Effective Representation Learning for Circuit Design at Scale","venue":"cs.LG","work_id":"28b73e5e-d173-4859-a00b-9b8bb7d91602","year":2025},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:16.994747Z"},"links":{"cited_paper":"/paper/2502.01681","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:455c124a4c31ff83a5ecd965ca3210f189e1c0db22395e04fec7aa8ec9ba6776","observation_id":"bf6167ff-96be-4d75-88cb-07bd972987c8","resolution":{"observed_at":"2026-08-06T15:51:17.782618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04887","last_updated":"2024-06-04T19:12:48Z","snapshot_observed_at":"2026-08-05T17:48:12.430235Z","submitted_at":"2023-11-08T18:46:39Z","title":"AutoChip: Automating HDL Generation Using LLM Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04887","snapshot_observed_at":"2026-08-06T15:51:17.000553Z","title":"Au- tochip: Automating hdl generation using llm feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.000553Z"},"links":{"cited_paper":"/paper/2311.04887","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:838bf23f51b03a6ef2f00aae642feccb4ec3a64c68b8e375a0262101a00bb79b","observation_id":"2ee24dd8-da72-4218-9edd-eb7b6fbc3eb1","resolution":{"observed_at":"2026-08-06T15:51:17.000553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.006595Z","title":"Rtl- coder: Fully open-source and efficient llm-assisted rtl code generation technique,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.006595Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:a674065c916fe0595ff60efc4e33022b9b01190fa4a681759a2853b4cb80f143","observation_id":"e524bd91-5f36-4e73-87b7-b743cb198362","resolution":{"observed_at":"2026-08-06T15:51:17.006595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.111955Z","title":"Verigen: A large language model for verilog code generation,","venue":null,"work_id":"cd9a246c-cca4-42f6-a461-b213c2bcb6f4","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.011689Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:4289c3c678b8d4d03adb16285b861f26b80771a2255c90f75d291cb9ec901703","observation_id":"d5e31a20-df2e-4bc7-9ef5-9037bb65b86f","resolution":{"observed_at":"2026-08-06T15:51:18.116952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14739","last_updated":"2024-09-23T06:35:19Z","snapshot_observed_at":"2026-07-06T19:20:14.980387Z","submitted_at":"2024-09-23T06:35:19Z","title":"AmpAgent: An LLM-based Multi-Agent System for Multi-stage Amplifier Schematic Design from Literature for Process and Performance Porting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14739","snapshot_observed_at":"2026-08-06T15:51:17.017168Z","title":"Ampagent: An llm-based multi-agent system for multi-stage amplifier schematic design from literature for process and performance porting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.017168Z"},"links":{"cited_paper":"/paper/2409.14739","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:b9a560f760304ad8069b8fd64823ac0d696d5bb213f99d028b07beff86465477","observation_id":"75256a78-6bea-4ff5-80ec-014340228ea8","resolution":{"observed_at":"2026-08-06T15:51:17.017168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.024063Z","title":"Chateda: A large language model powered autonomous agent for eda,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.024063Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:78090e74e88748a0cb212422b61e56f18b02d06cd80673d48770473f76c6c667","observation_id":"72fe7c05-57aa-4060-bee7-0823bcd74789","resolution":{"observed_at":"2026-08-06T15:51:17.024063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.080882Z","title":"Openroad: Toward a self-driving, open-source digital layout implementation tool chain,","venue":null,"work_id":"377aae9d-b87e-439e-93e8-bfdcabe897ad","year":2019},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.030673Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:17bce0b04e7ada0d97f159496d2b4e8227d05993a6d1589584168689a2f84009","observation_id":"81083eca-4fa3-4f1f-a900-fa7b8b6b9c81","resolution":{"observed_at":"2026-08-06T15:51:18.085480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.039330Z","title":"Chipgpt: How far are we from natural language hardware design,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.039330Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:843e4b1ae7d7432f9c7e14b154e90e1e1d1d65f1ba14cf60e9da46faec285c37","observation_id":"094d4aef-15c0-42ba-8820-73b181ffd74c","resolution":{"observed_at":"2026-08-06T15:51:17.039330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-06T15:51:17.045621Z","title":"Seed-bench: Benchmarking multimodal llms with generative comprehension,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.045621Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:44fcedc9293dfe18b16804cfc6428e40a02b54d7bd935df28a8043aff4bc23f5","observation_id":"ead691cd-84ac-4ba2-846e-7795243e2fb8","resolution":{"observed_at":"2026-08-06T15:51:17.045621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.065261Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi,","venue":null,"work_id":"80773eb3-a537-4146-903b-ad98de24b65d","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.052390Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:acc637b1be5762bc43f8201b504dcb5b68435f584ad1fc86f6c0ff9ed9ba1db2","observation_id":"71178a86-0847-4ee5-84d2-c5027c0159b3","resolution":{"observed_at":"2026-08-06T15:51:18.070119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.050944Z","title":"Mm- bench: Is your multi-modal model an all-around player?","venue":null,"work_id":"3d539e53-a41c-4b0c-8510-f1d031569647","year":2025},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.058059Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:f5a2a3b069f6df7bf0ed47d2f8d288ca062afd1cf8cdbfd3995d3886b4901018","observation_id":"1dfc5907-444a-4fd8-9e26-a0bc3e54681d","resolution":{"observed_at":"2026-08-06T15:51:18.055455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00804","last_updated":"2024-07-26T11:00:08Z","snapshot_observed_at":"2026-08-09T16:52:29.891505Z","submitted_at":"2024-07-26T11:00:08Z","title":"ChipExpert: The Open-Source Integrated-Circuit-Design-Specific Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00804","snapshot_observed_at":"2026-08-06T15:51:17.063404Z","title":"Chipexpert: The open-source integrated-circuit-design-specific large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.063404Z"},"links":{"cited_paper":"/paper/2408.00804","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:5097d32d4c58836d2bc09b033aad093bbe2055dfd4c30eab023dc09486b17e3c","observation_id":"bb92531a-a3e9-4e0f-a306-8f795430904c","resolution":{"observed_at":"2026-08-06T15:51:17.063404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T15:51:17.069313Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.069313Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:6ab8f4dc6dd16cc55b5b2f252331f3dc2e97211b90229d579ab5ce139b5f86b6","observation_id":"cbc7941f-5ab6-42c1-8c04-c5911f47f3e2","resolution":{"observed_at":"2026-08-06T15:51:17.069313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.036444Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation,","venue":null,"work_id":"22138805-fa00-4fbb-8dc7-7530c614dbf9","year":2022},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.078106Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:a67773d7aabc283f1905d3829025eb52916cdeb1490dd1671bdca303c1f9eb6e","observation_id":"3f2a9dc3-c3c6-42fa-abe0-7d28c7d65373","resolution":{"observed_at":"2026-08-06T15:51:18.040918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T15:51:17.093914Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.093914Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:4563f44479fd95846c9eb7b01ec731077072f018cf5ce0b72e20eaa1f1d77a30","observation_id":"ab6d3375-d6ab-48a0-8b36-dc6dce52fc13","resolution":{"observed_at":"2026-08-06T15:51:17.093914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15112","last_updated":"2023-12-14T17:21:39Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:58:20Z","title":"InternLM-XComposer: A Vision-Language Large Model for Advanced Text-image Comprehension and Composition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15112","snapshot_observed_at":"2026-08-06T15:51:17.099887Z","title":"Internlm-xcomposer: A vision- language large model for advanced text-image comprehension and composition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.099887Z"},"links":{"cited_paper":"/paper/2309.15112","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:7ae0478348e57ee4ba98c53c4cf4c9d6bc72da17ca3296e796344300b676e182","observation_id":"4b609da0-9d61-4d75-be1e-dabb843144db","resolution":{"observed_at":"2026-08-06T15:51:17.099887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:18.021725Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":"c017c374-31b9-469f-804a-42f2a8d49421","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.106267Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:63c0d191d8bc97a1692f2af89a669e8c8caf6f45b98f0ea629583b3cc33295b5","observation_id":"e1ebf3e1-1969-457d-8fb5-c122916c0aab","resolution":{"observed_at":"2026-08-06T15:51:18.026078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.111470Z","title":"Instructblip: Towards general-purpose vision- language models with instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.111470Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:d344cbf8e4fbd942a9756d6d86eb11c192efd46634546b7b7d7830bed9c6a307","observation_id":"729b1d09-85f8-46d2-812c-64754912dbbd","resolution":{"observed_at":"2026-08-06T15:51:17.111470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.995542Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"1f9121a5-0484-411e-8e13-6e6bede44da7","year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.116280Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:065419e9513a054e49b8b3ac4187b45c0c8e0aeccbcb384ba75ccf84c68ca466","observation_id":"3db087b0-fa50-4033-9d16-ecdf5aaf34a0","resolution":{"observed_at":"2026-08-06T15:51:18.000768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T15:51:17.121764Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.121764Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:a1ff1a3bd27dccb0da9fa8e5cde82d6ed7cf76257b06c5c14a3ecfeccb77333e","observation_id":"24fa938f-bb6b-47b4-bb43-dd678a955ea0","resolution":{"observed_at":"2026-08-06T15:51:17.121764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-06T15:51:17.128128Z","title":"Minicpm-v: A gpt-4v level mllm on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.128128Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:55b05dc98baaf4ecf88c8c48df847f24834eca328b2810d983e77aed00526fec","observation_id":"f6c0f823-15fa-49da-a62a-7b3c0a3a9398","resolution":{"observed_at":"2026-08-06T15:51:17.128128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.981086Z","title":"Yi: Open foundation models by 01.ai,","venue":null,"work_id":"313c05ac-8938-4012-a8e1-a10285171ccd","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.133324Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:72310723bcab160bc150f2e4bc01418f38f98f818106c0947717b39ecfe27fe1","observation_id":"8a2bb5f9-0d34-4f23-bcf0-7ebf6215c6b6","resolution":{"observed_at":"2026-08-06T15:51:17.985303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-06T15:51:17.139099Z","title":"Kosmos-2: Grounding multimodal large language models to the world,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.139099Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:4bb0e8ac2111e7abd92623aa2e23d44f40614c05463970ea5d66a83f9921135f","observation_id":"cb79e9a6-4927-43e7-a8af-8f321bd31445","resolution":{"observed_at":"2026-08-06T15:51:17.139099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T15:51:17.143992Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.143992Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:929f4febada5d16b06a3e09f77f79df5010b0885702b47f6f7e0e98d8875dd98","observation_id":"731c1bb5-9582-4676-b119-93fabf117ea5","resolution":{"observed_at":"2026-08-06T15:51:17.143992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12387","last_updated":"2024-04-18T17:59:48Z","snapshot_observed_at":"2026-07-06T18:02:19.428801Z","submitted_at":"2024-04-18T17:59:48Z","title":"Reka Core, Flash, and Edge: A Series of Powerful Multimodal Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12387","snapshot_observed_at":"2026-08-06T15:51:17.148602Z","title":"Reka core, flash, and edge: A series of powerful multimodal language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.148602Z"},"links":{"cited_paper":"/paper/2404.12387","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:7570a8a2a33f040441b0e268756e3c24ff5818de3e2c4983bbda15e957c71ba5","observation_id":"3bf026fa-d614-4338-bdd4-9ba4f8da7982","resolution":{"observed_at":"2026-08-06T15:51:17.148602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.965514Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":"f277ba51-2731-44a6-adcb-16c0ac2e357c","year":2022},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.154151Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:60e5591ffdbe0b991eeca5eec56420519571061e7f42eab32eee8b9cfc8387ce","observation_id":"a27ef1f9-599c-4706-abc2-9c6205d59228","resolution":{"observed_at":"2026-08-06T15:51:17.969783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-06T15:51:17.159030Z","title":"Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.159030Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:63b5177ce6f734c4c211ec803d879538fabedb82623f5671f59c5a6e4dcf69b8","observation_id":"3ad89559-04f8-4e8a-ade6-47f2d293a4e5","resolution":{"observed_at":"2026-08-06T15:51:17.159030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-06T15:51:17.164744Z","title":"Deepseek llm: Scaling open-source language models with longtermism,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.164744Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:ca13f627f0fd15733e317ace48408c720b2f04c48590e71b56f3ac6d7984803d","observation_id":"87cb3f12-4f8c-4c7e-9cf9-79080eba7608","resolution":{"observed_at":"2026-08-06T15:51:17.164744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T15:51:17.169647Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.169647Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:004e9edcf94fdcc1e05256ec798e455305e02ab71b96553ab3006f5094976a79","observation_id":"18563847-c589-408f-8929-13531c10b2fb","resolution":{"observed_at":"2026-08-06T15:51:17.169647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-06T15:51:17.174974Z","title":"Deepseek-v2: A strong, econom- ical, and efficient mixture-of-experts language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.174974Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:d69e4f02be9951677056c633b811170ebc25e9ead6117bdf1262d09eee026e90","observation_id":"be387cce-c2e0-495a-b380-dec5915f6754","resolution":{"observed_at":"2026-08-06T15:51:17.174974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T15:51:17.180690Z","title":"Qwen2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.180690Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:b0043ccda5b62f2c164638144fb84e2969cf56f008f1d946718b0146237d775d","observation_id":"eb7b6998-2552-42ad-8b06-cd08ecb5e814","resolution":{"observed_at":"2026-08-06T15:51:17.180690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.186161Z","title":"Internlm: A multilingual language model with progressively enhanced capabilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.186161Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:72511c5d75a5c7c10dd942ed0a4c5e7ada87497db394802c3cab2edd70603b51","observation_id":"011286e8-6a12-4703-b35b-f0bc1f4b1f53","resolution":{"observed_at":"2026-08-06T15:51:17.186161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T15:51:17.190937Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.190937Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:325179fbb25e74f119c099077c0981f03c462c859c268146fffb506ee58a72a3","observation_id":"a4c04907-5961-4cb7-a091-8752e214aba7","resolution":{"observed_at":"2026-08-06T15:51:17.190937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-06T15:51:17.196765Z","title":"Minicpm: Unveiling the potential of small language models with scalable training strategies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.196765Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:3659fbcbc7e0cc75e0a8ad2f680307340780a9609d020868c57b3bf37305e200","observation_id":"71d40203-d16b-431c-b640-effd35a3e47d","resolution":{"observed_at":"2026-08-06T15:51:17.196765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-06T15:51:17.202392Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.202392Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:d1721faf85ade17d82d8171cc90b6172a51158d6bdbb094e3c9121a9431a1af7","observation_id":"ebc3817a-2c46-4dff-a0d0-8969f3d56eb1","resolution":{"observed_at":"2026-08-06T15:51:17.202392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T15:51:17.207829Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.207829Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:811f3ffc8673916e15bdb481b3fce8b4fe7d5ac8e2f38b3a661e3f9e02c0feec","observation_id":"702586f6-6497-4a16-9149-023e470f0276","resolution":{"observed_at":"2026-08-06T15:51:17.207829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T15:51:17.212642Z","title":"Gemini 1.5: Unlocking mul- timodal understanding across millions of tokens of context,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.212642Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:676d18162309a6974759018d6966fc63fc25212fa15584dcd6a3b58a44eff93f","observation_id":"f7d00419-4ff1-4299-92f8-df8e1db749c0","resolution":{"observed_at":"2026-08-06T15:51:17.212642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.939940Z","title":"Introducing the next generation of claude,","venue":null,"work_id":"de6a668f-62af-49af-bcc8-00369fcf44bb","year":2024},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.218440Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:37bbd3e3cc176288304d6eefa60754ab0dc7eec7410d8e856ac41790af56a9b8","observation_id":"c33732ac-dd29-46ce-9cc9-3da01af18351","resolution":{"observed_at":"2026-08-06T15:51:17.944409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-09T10:11:58.541007Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-06T15:51:17.223412Z","title":"Hotpotqa: A dataset for diverse, explain- able multi-hop question answering,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.223412Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:a73af0bacaebe75b05814253063b065fa8aa2f1753a773bde12974ef32203bdb","observation_id":"822042b0-c8c7-4988-a374-0d966cd12b94","resolution":{"observed_at":"2026-08-06T15:51:17.223412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-08-08T11:05:45.903773Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-06T15:51:17.229216Z","title":"Squad: 100,000+ questions for machine comprehension of text,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.229216Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:3fbb615d59ac9c1ae7751f135d3bffe3f5000da8fb8dbb985ebc76d15287c70a","observation_id":"830ec5db-bf2b-411e-9fdf-e356b33cb029","resolution":{"observed_at":"2026-08-06T15:51:17.229216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:17.925056Z","title":"Language models are few-shot learners,","venue":null,"work_id":"16a1fcaa-2889-4741-a425-6095ccb38734","year":1901},"citing_paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:17.233907Z"},"links":{"citing_paper":"/paper/2507.19525"},"observation_digest":"sha256:55a184a8352f3097787bdc0c5fca8bcc18bfb1c43e0723a067e60885624f8289","observation_id":"037edc80-35b4-44b7-93e8-294d2f01ee1e","resolution":{"observed_at":"2026-08-06T15:51:17.929488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.19525","last_updated":"2025-07-20T05:46:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T01:10:18.257426Z","submitted_at":"2025-07-20T05:46:32Z","title":"MMCircuitEval: A Comprehensive Multimodal Circuit-Focused Benchmark for Evaluating LLMs"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":4,"verified_fuzzy":17},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2507.19525."}