{"as_of":"2026-08-18T13:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af1586f174f23197ef4af9e6128d6698b5e1414cc78bd40738acfc553719214b","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:51:21.341349Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T09:45:18.385925Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.08744","doi":"10.48550/arxiv.2505.08744","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2505.08744 , year=","venue":"arXiv (Cornell University)","work_id":"19294706-e5ac-459c-9eb1-5da3832122bc","year":null},"citing_paper":{"arxiv_id":"2606.06526","last_updated":"2026-06-02T20:38:39Z","snapshot_observed_at":"2026-08-15T04:12:23.364666Z","submitted_at":"2026-06-02T20:38:39Z","title":"CrowdMath: A Dataset of Crowdsourced Mathematical Research Discussions","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T09:45:18.385925Z"},"links":{"cited_paper":"/paper/2505.08744","citing_paper":"/paper/2606.06526"},"observation_digest":"sha256:473f01e4930ba21af3606fb6697e32bdd9e8318ad502eb5ec340bf6b1e0bc073","observation_id":"5c7aa15c-feeb-44fa-a3c2-7bafb674320d","resolution":{"observed_at":"2026-07-02T03:46:32.301871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.08744","doi":"10.48550/arxiv.2505.08744","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2505.08744 , year=","venue":"arXiv (Cornell University)","work_id":"19294706-e5ac-459c-9eb1-5da3832122bc","year":null},"citing_paper":{"arxiv_id":"2606.10113","last_updated":"2026-06-08T19:46:00Z","snapshot_observed_at":"2026-08-16T14:13:46.484120Z","submitted_at":"2026-06-08T19:46:00Z","title":"Emotion Profiling in LLM-Based Literary Translation: Systematic Shifts Across MT and Post-Editing","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-27T16:09:08.317910Z"},"links":{"cited_paper":"/paper/2505.08744","citing_paper":"/paper/2606.10113"},"observation_digest":"sha256:2b289b36279305f40d6526ee8fda608eb8f6a1aecafccd9e97cd1e874f51d569","observation_id":"c28464a8-26be-4c94-af5b-35a30cf38bd5","resolution":{"observed_at":"2026-06-27T16:11:02.502588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.08744/citation-record","integrity":"/paper/2505.08744/integrity","json":"/paper/2505.08744/citation-record.json","paper":"/paper/2505.08744"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.524050Z","title":"Counterexamples in Real Analysis","venue":null,"work_id":"5499ef4a-8cc5-41a1-bc71-dfcfecb307c2","year":2004},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.291082Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:9d5ff925799412a6363a6aabd044760b44e28c6f3ad9745d1965432a0062e2ee","observation_id":"07b94738-330a-460b-8a3c-abe63e78e2e6","resolution":{"observed_at":"2026-08-15T21:51:21.527925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T21:51:21.296102Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.296102Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:d7921026a3102e82aae5d156472e5d27ff2546bb225847b005785fdb55cb35dd","observation_id":"03b1ffa7-01f3-41ff-9ea6-d6ac25abcada","resolution":{"observed_at":"2026-08-15T21:51:21.296102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04872","last_updated":"2025-12-23T02:23:47Z","snapshot_observed_at":"2026-08-13T13:45:44.430193Z","submitted_at":"2024-11-07T17:07:35Z","title":"FrontierMath: A Benchmark for Evaluating Advanced Mathematical Reasoning in AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04872","snapshot_observed_at":"2026-08-15T21:51:21.300560Z","title":"A benchmark for evaluating advanced mathematical reasoning in ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.300560Z"},"links":{"cited_paper":"/paper/2411.04872","citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:b41e20daac7081dd3f35139ff8338cf18e5cf8060fa506e08e27f06516069895","observation_id":"979e5bd1-3c6a-4f60-9573-ba7d0b2a1a11","resolution":{"observed_at":"2026-08-15T21:51:21.300560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T21:51:21.304758Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.304758Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:5b2b3260c28bf31046a150a20a939bab4e65a8f7d5efad1973f70a3a0b31d640","observation_id":"e076a5ee-e88e-4890-be4f-2145f48bf88b","resolution":{"observed_at":"2026-08-15T21:51:21.304758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-15T21:51:21.308527Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.308527Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:5a1366264598aef3fa2066d115ad2546d6ef80055c34f6ab169f56eaa9fe1ff2","observation_id":"9780936c-0ab3-4128-ac96-c6b42d4a7b81","resolution":{"observed_at":"2026-08-15T21:51:21.308527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-15T21:51:21.313111Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.313111Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:ce06590e5d31f49158f15a2d4f5161807fc613f60a31ea173600b14b8a39f1b4","observation_id":"7690da8f-5cc7-425e-b58f-771d6de5c9e4","resolution":{"observed_at":"2026-08-15T21:51:21.313111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.317033Z","title":"Aime 2024 dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.317033Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:caf74ab51e810410ed389e6729898f0c6115a675f6a253822fbe60af32397a3f","observation_id":"4f7f3766-cdd2-4412-9a80-13b9463cdabe","resolution":{"observed_at":"2026-08-15T21:51:21.317033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.504850Z","title":"On manifolds homeomorphic to the 7-sphere","venue":null,"work_id":"788c7e51-afd1-4509-bfc7-80295dc62b6c","year":1956},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.321186Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:34f450e9f7f3a2b63928dc14a6cbf70f4090d082ae27451654211be1314c36ce","observation_id":"eb0957be-cb23-46cd-a2e5-4dc409b753e7","resolution":{"observed_at":"2026-08-15T21:51:21.508438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.492895Z","title":"O3 and o4-mini system card, 2025","venue":null,"work_id":"cebafbd2-98e1-4ab9-89b8-5f8b348e03f2","year":2025},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.324522Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:0c2a672d9940a4607bdafc22a35db8c30ca418eaacb4da33419048d16c3c5129","observation_id":"0f0ae241-59d6-4897-883c-b4011385568a","resolution":{"observed_at":"2026-08-15T21:51:21.496563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17169","last_updated":"2024-10-07T03:48:18Z","snapshot_observed_at":"2026-08-16T13:39:56.946061Z","submitted_at":"2024-06-24T23:02:56Z","title":"Multi-LogiEval: Towards Evaluating Multi-Step Logical Reasoning Ability of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17169","snapshot_observed_at":"2026-08-15T21:51:21.327994Z","title":"Multi-logieval: Towards evaluating multi-step logical reasoning ability of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.327994Z"},"links":{"cited_paper":"/paper/2406.17169","citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:740ca261c121a0be76e0d3cb21dbe1405495f64a8d6e8ea4612365e5288e0492","observation_id":"33def663-f585-4cd1-a77b-8c762ccdecdd","resolution":{"observed_at":"2026-08-15T21:51:21.327994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.482173Z","title":"The V alue of Science","venue":null,"work_id":"b80d0998-b1e3-482d-bb29-60fb20d85473","year":1905},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.331732Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:dde6ae2612a16812d36b0a9f82c2ede1665eb57525979bb8b83dad93bbd20936","observation_id":"6f2f3467-345f-4bb0-9b6c-076498c4c52b","resolution":{"observed_at":"2026-08-15T21:51:21.486148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.470162Z","title":"Comparison of three large language models as middle school math tutoring assistants","venue":null,"work_id":"4bda74b1-62d5-48cc-862d-e0e6d9ca9585","year":2024},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.335033Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:694ef9605af93633cfccc50263e4d026177c3454bacd43720ceb7b5697843170","observation_id":"9f94f927-d9ba-4378-8eeb-99381142dc6f","resolution":{"observed_at":"2026-08-15T21:51:21.474120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.458217Z","title":"Trinh, Yuhuai Wu, Quoc V","venue":null,"work_id":"2fe26b1c-2584-4aa9-8aa1-3e756ee1903c","year":2024},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.338015Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:38987ffe7b8f6b4c9a09ced88a8b6ad4011146c98c86d22ab4a9a815ae490a2c","observation_id":"0403dbf8-d42e-42d5-82cc-923d5a4eb6af","resolution":{"observed_at":"2026-08-15T21:51:21.462162Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:51:21.444731Z","title":"Über continuirliche funktionen eines reellen arguments, die für keinen werth des letzteren einen bestimmten differentialquotienten besitzen","venue":null,"work_id":"659d73d5-0915-4087-b873-f28851818ef4","year":null},"citing_paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:51:21.341349Z"},"links":{"citing_paper":"/paper/2505.08744"},"observation_digest":"sha256:4cc0a6160788c3d686613a636b653593b8b7631b239434a8590e3c5fc6b7272a","observation_id":"470fa610-0cb8-42c2-961d-20a5cd940218","resolution":{"observed_at":"2026-08-15T21:51:21.450594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.08744","last_updated":"2025-05-13T16:58:05Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T11:45:09.105031Z","submitted_at":"2025-05-13T16:58:05Z","title":"DeepMath-Creative: A Benchmark for Evaluating Mathematical Creativity of Large Language Models"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 2 inbound Pith citation observations for arXiv:2505.08744."}