{"as_of":"2026-08-08T19:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d11e29fb88db3f406622d7e28357f43fdf30ebc10d1fa2c927259b4162500714","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:46:47.252660Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T19:18:43.558804Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T19:27:18.669942Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2507.12549","last_updated":"2026-04-28T23:40:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-16T18:01:26Z","title":"The Serial Scaling Hypothesis","version":4},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-05-19T04:08:11.344622Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2507.12549"},"observation_digest":"sha256:dbaaee02e71dd35852747dfe1672aed108824e510d77363806d15ab46892598f","observation_id":"2f406b00-1d5c-4b74-9b81-672ae2b611f1","resolution":{"observed_at":"2026-05-19T04:12:02.412715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2602.07064","last_updated":"2026-04-07T13:49:35Z","snapshot_observed_at":"2026-08-03T13:22:02.057620Z","submitted_at":"2026-02-05T14:04:51Z","title":"OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T07:09:46.254851Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2602.07064"},"observation_digest":"sha256:53566715de0ebcc08f193a23733b72bcc6f784dc0292bd62e705dd3f1f582fe5","observation_id":"04f8db6c-c683-4fec-8c61-fa4b0631a96b","resolution":{"observed_at":"2026-05-16T07:10:43.003448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2604.17928","last_updated":"2026-04-20T08:09:01Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:09:01Z","title":"HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-10T05:23:08.478393Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2604.17928"},"observation_digest":"sha256:917a41ef6a8469ab442d0d8ae0c79ad70821e6e7a10b63c1e723cfb5ce50fe14","observation_id":"095c7482-0d13-4dd6-8ba0-4d34e4f0e6bd","resolution":{"observed_at":"2026-05-10T05:25:55.207987Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2604.18936","last_updated":"2026-04-21T00:21:05Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-21T00:21:05Z","title":"Fine-Tuning Small Reasoning Models for Quantum Field Theory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T03:23:18.770963Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2604.18936"},"observation_digest":"sha256:75e0a0e178e09d60f34cd7089c3e4892c896ae228a13a71ceb534e3dcd85b4f2","observation_id":"f4d33857-0e27-44f5-b732-8cdc706cd056","resolution":{"observed_at":"2026-05-11T12:31:05.880212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2607.00276","last_updated":"2026-06-30T23:52:15Z","snapshot_observed_at":"2026-08-08T10:47:33.889635Z","submitted_at":"2026-06-30T23:52:15Z","title":"Testing Frontier Large Language Models' Physics Literacy in Parallel Physical Worlds","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-02T19:18:43.558804Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2607.00276"},"observation_digest":"sha256:929f667ee46b2b32f19ed4a6ed43ce442c97988b123ca0a67e9663d2c528d914","observation_id":"0bd84f15-e67c-4653-b850-3e00f017f2d4","resolution":{"observed_at":"2026-07-02T19:27:18.671496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04766/citation-record","integrity":"/paper/2507.04766/integrity","json":"/paper/2507.04766/citation-record.json","paper":"/paper/2507.04766"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:45.993866Z","title":"Wei Chow, Jiageng Mao, Boyi Li, Daniel Seita, Vitor Guizilini, and Yue Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:45.993866Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:27e501d27a533ecc3755be03760b61dd9f8ee9545b9ed8d1dc7fff528b535fab","observation_id":"366d4e26-50fd-412b-ae7c-30086fc83dfb","resolution":{"observed_at":"2026-08-06T19:46:45.993866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15815","last_updated":"2025-02-19T19:00:00Z","snapshot_observed_at":"2026-08-07T23:28:55.289287Z","submitted_at":"2025-02-19T19:00:00Z","title":"Theoretical Physics Benchmark (TPBench) -- a Dataset and Study of AI Reasoning Capabilities in Theoretical Physics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15815","snapshot_observed_at":"2026-08-06T19:46:46.076892Z","title":"DeepSeek Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.076892Z"},"links":{"cited_paper":"/paper/2502.15815","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:236b4909a3f434259eae22154eeea3dea494b3393c8caf84a9281b95bb2da003","observation_id":"c8b86f07-ca5b-4d9d-8e89-b2ed5c81c600","resolution":{"observed_at":"2026-08-06T19:46:46.076892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.13013","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:47.841102Z","title":"doi: https://doi.org/ 10.1016/j.neucom.2025.130135","venue":null,"work_id":"fdcd6172-c237-4fc9-9f95-d336cdbe3110","year":2025},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.270101Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:c55146fa6a9ce51d45857e7b60ed533d2a284ac15fbbf1d9a5bf10ffcb2517ee","observation_id":"7013b9e3-3921-4428-939c-f4e2f8f6a8e9","resolution":{"observed_at":"2026-08-06T19:46:47.891352Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:48.226647Z","title":"FOLIO: Natural language rea- soning with first-order logic","venue":null,"work_id":"780d341a-33d6-4506-8e31-611219278427","year":2024},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.395337Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:11df3522ef00ab7f6c537fe4f561e25a92519b3707007ff7b511e8731419d276","observation_id":"7a4121c9-67c4-4957-b120-e64d8bf63467","resolution":{"observed_at":"2026-08-06T19:46:48.334150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:46.537021Z","title":"doi: 10.18653/v1/2024.emnlp-main.1229","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.537021Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:84d25ef0ae9124778761a52facb1da897a413417e65c8ffad30c6311650f5aa2","observation_id":"67350f8a-0c2c-48d6-9fa2-dd4b2cf5111d","resolution":{"observed_at":"2026-08-06T19:46:46.537021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:46.747606Z","title":"doi: 10.18653/v1/2024.inlg-main.45","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.747606Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:57b42f282e51106783dfaefdd7150ba92073cefb2c440233b096307effe4c5db","observation_id":"bfab19bc-cc6f-43f7-b089-aa3d61d37328","resolution":{"observed_at":"2026-08-06T19:46:46.747606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15720","last_updated":"2024-06-22T03:32:09Z","snapshot_observed_at":"2026-07-06T18:35:17.953523Z","submitted_at":"2024-06-22T03:32:09Z","title":"Scaling Laws for Fact Memorization of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15720","snapshot_observed_at":"2026-08-06T19:46:46.924233Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.924233Z"},"links":{"cited_paper":"/paper/2406.15720","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:1e2d9e4a95c5fe85e4e911953d06432ca6bd4605094c601d1e0e07269550e980","observation_id":"3b0430dd-2d52-4545-bbce-a5629b15bb01","resolution":{"observed_at":"2026-08-06T19:46:46.924233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23123","last_updated":"2025-03-04T06:22:40Z","snapshot_observed_at":"2026-08-08T11:18:18.405211Z","submitted_at":"2024-10-30T15:31:54Z","title":"On Memorization of Large Language Models in Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23123","snapshot_observed_at":"2026-08-06T19:46:47.076281Z","title":"Xin Xu, Qiyun Xu, Tong Xiao, Tianhao Chen, Yuchen Yan, Jiaxin Zhang, Shizhe Diao, Can Yang, and Yang Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:47.076281Z"},"links":{"cited_paper":"/paper/2410.23123","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:6daafc31db13591e51dfcba3feb838e05ddb64fb5d0893b71ea621789839d886","observation_id":"c671e83f-dfbe-4f54-879e-20e84ffe51d9","resolution":{"observed_at":"2026-08-06T19:46:47.076281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10885","last_updated":"2025-04-15T05:29:31Z","snapshot_observed_at":"2026-08-07T16:05:40.179437Z","submitted_at":"2025-04-15T05:29:31Z","title":"PuzzleBench: A Fully Dynamic Evaluation Framework for Large Multimodal Models on Puzzle Solving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10885","snapshot_observed_at":"2026-08-06T19:46:47.159833Z","title":"Shenghe Zheng, Qianjia Cheng, Junchi Yao, Mengsong Wu, Haonan He, Ning Ding, Yu Cheng, Shuyue Hu, Lei Bai, Dongzhan Zhou, Ganqu Cui, and Peng Ye","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:47.159833Z"},"links":{"cited_paper":"/paper/2504.10885","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:dea6c2af388cc3f2f5c549bce519c85d234439acfe29e4c35d07185face8986c","observation_id":"f9e6973e-1feb-42c8-a658-315215162874","resolution":{"observed_at":"2026-08-06T19:46:47.159833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.00022","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:47.495346Z","title":null,"venue":null,"work_id":"d9e8999a-18a8-427f-8783-55ce26b989ae","year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:47.252660Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:3b76e1ffd7fdf0f2651dabadca054aead1666fcf16801defa6e06f3ab3fd816c","observation_id":"9262265c-c4f4-4c98-af63-dab4f8330d40","resolution":{"observed_at":"2026-08-06T19:46:47.574250Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16074","last_updated":"2025-05-18T14:13:34Z","snapshot_observed_at":"2026-08-07T16:00:09.967849Z","submitted_at":"2025-04-22T17:53:29Z","title":"PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16074","snapshot_observed_at":"2026-08-06T19:46:46.994892Z","title":"Phybench: Holistic evaluation of physical perception and reasoning in large language models, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":1949,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.994892Z"},"links":{"cited_paper":"/paper/2504.16074","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:49f0f071a89aeb33ae84b2deb5005e5496a313b43e02818804eb660095736668","observation_id":"bc12a3de-5e3b-4c8c-9447-ab0a6ee1263d","resolution":{"observed_at":"2026-08-06T19:46:46.994892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T19:46:46.663755Z","title":"Mea- suring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.663755Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:0adb32b9db18b6baf6be563b8c42edf7ef0b85b4e8b11297cdcb9063b37eb1ce","observation_id":"c5971dd2-b937-4500-9f91-8ada7c7b0506","resolution":{"observed_at":"2026-08-06T19:46:46.663755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.05656","last_updated":"2019-08-15T17:58:32Z","snapshot_observed_at":"2026-08-08T13:30:06.897676Z","submitted_at":"2019-08-15T17:58:32Z","title":"PHYRE: A New Benchmark for Physical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.05656","snapshot_observed_at":"2026-08-06T19:46:45.813127Z","title":"Simin Chen, Yiming Chen, Zexin Li, Yifan Jiang, Zhongwei Wan, Yixin He, Dezhi Ran, Tianle Gu, Haizhou Li, Tao Xie, and Baishakhi Ray","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:45.813127Z"},"links":{"cited_paper":"/paper/1908.05656","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:0fb50957538b3d41202acec3d03e97f00064cae4593ec3e2dfb3bed3f6ba3f96","observation_id":"0acbb38f-5b74-4fb7-b294-337de28fb99f","resolution":{"observed_at":"2026-08-06T19:46:45.813127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:48.109295Z","title":null,"venue":null,"work_id":"6862b1a5-1975-4249-82df-f6da7b1f1fc8","year":2007},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.825760Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:8b9476e944ad561401ffe8b101d65e4aba83e0c623214ec06acfb0fbb7afaaca","observation_id":"18446ae8-3f71-4341-b934-4988a13c8564","resolution":{"observed_at":"2026-08-06T19:46:48.147555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14644","last_updated":"2024-06-20T18:07:26Z","snapshot_observed_at":"2026-07-06T18:34:29.513732Z","submitted_at":"2024-06-20T18:07:26Z","title":"Unveiling the Spectrum of Data Contamination in Language Models: A Survey from Detection to Remediation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14644","snapshot_observed_at":"2026-08-06T19:46:46.159536Z","title":"Jingzhe Ding, Yan Cen, and Xinyuan Wei","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.159536Z"},"links":{"cited_paper":"/paper/2406.14644","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:cc86e1591181ea9c0693c843ebe4c282a96bc5ef8f145368bf8139d4e0320413","observation_id":"15023179-5139-48d3-a2d3-5aa25b6eb74e","resolution":{"observed_at":"2026-08-06T19:46:46.159536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:48.428452Z","title":"Have llms advanced enough? a challenging problem solving benchmark for large language models","venue":null,"work_id":"c2b7a0a9-997d-43d9-a40f-7b6aeeacd8a5","year":2023},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:45.710892Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:72c03cd1b8b841792ad27322fd840b5aab2ce2733118d72d8f51e001ff67adc2","observation_id":"f7dd8d17-15c7-4a1e-8ea9-afe81603cae1","resolution":{"observed_at":"2026-08-06T19:46:48.488531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T19:37:42.054760Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 5 inbound Pith citation observations for arXiv:2507.04766."}