{"as_of":"2026-08-05T06:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1cc3ae0453a2a78e1b8bb4787f597992d3adafe32e476397da894acae8b735a","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T02:48:15.074349Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-11T03:05:55.205507Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"cited_work":{"arxiv_id":"2510.05432","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.05432","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","venue":"cs.AI","work_id":"8c9cf624-fa47-4f78-92c8-bcb917bd7f52","year":2025},"citing_paper":{"arxiv_id":"2605.07208","last_updated":"2026-05-08T03:57:34Z","snapshot_observed_at":"2026-07-06T23:19:35.885430Z","submitted_at":"2026-05-08T03:57:34Z","title":"FAME: Forecasting Academic Impact via Continuous-Time Manifold Evolution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T02:48:15.074349Z"},"links":{"cited_paper":"/paper/2510.05432","citing_paper":"/paper/2605.07208"},"observation_digest":"sha256:64cfb7726ddcc279cd55e4c4b19a2895aa863395add94665c30c7666ac62de57","observation_id":"0537282e-f30d-4deb-a9ee-ef9a65f2e6a2","resolution":{"observed_at":"2026-05-11T03:05:55.209103Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.05432/citation-record","integrity":"/paper/2510.05432/integrity","json":"/paper/2510.05432/citation-record.json","paper":"/paper/2510.05432"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901","venue":null,"work_id":"d56db08a-f7ce-4072-a00c-6a725cbf8133","year":1901},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:f9ec47372e0b32ad5b714c0717f5e00dd9753cdb66858c38b7c7c78bbe8e2d62","observation_id":"e0e6b61f-32b9-4429-bce1-7430a7774220","resolution":{"observed_at":"2026-05-18T09:31:12.007180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":"1911.01547","doi":"10.1007/s11432-024-4231-5","metadata_source":"pith","pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"On the Measure of Intelligence","venue":"cs.AI","work_id":"d8980a59-aa48-447b-8852-b7aca2b41b2c","year":2019},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:ee462d35aa0afc04aca58d898247fffacc71c3e829e6c2cf8219a8033a8bfcba","observation_id":"89d4cdaf-50e5-408c-b0b0-e4dee967960d","resolution":{"observed_at":"2026-05-18T09:31:11.237718Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13517","last_updated":"2025-05-13T06:16:23Z","snapshot_observed_at":"2026-07-06T20:54:09.352372Z","submitted_at":"2025-03-14T17:53:03Z","title":"CURIE: Evaluating LLMs On Multitask Scientific Long Context Understanding and Reasoning","version":2},"cited_work":{"arxiv_id":"2503.13517","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.13517","snapshot_observed_at":"2026-07-01T20:56:14.503168Z","title":"Curie: Eval- uating llms on multitask scientific long context understanding and reasoning","venue":null,"work_id":"27706e2a-6eee-43f7-826a-66b79775e7be","year":2025},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2503.13517","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:617d532116f9c4a2c5ce303cea41ddfe1eee67a4b1d8edc155ec557f60ac5557","observation_id":"f8767d78-1f19-4143-b60d-ccc37d77edd3","resolution":{"observed_at":"2026-05-18T09:31:11.201411Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18321","last_updated":"2024-06-26T13:02:35Z","snapshot_observed_at":"2026-07-06T18:37:17.280637Z","submitted_at":"2024-06-26T13:02:35Z","title":"MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data","version":1},"cited_work":{"arxiv_id":"2406.18321","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.18321","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"org/abs/2406.18321","venue":null,"work_id":"2023a0a2-fc70-4ada-8f9b-7b1e5ac05dc4","year":2024},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2406.18321","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:3c5200d12ab48ec5e23939d71f5767076b8b7ce328698c05b8a3d492057ddb7d","observation_id":"a0548e15-3c1f-4b27-a8e8-29d3fe291ca8","resolution":{"observed_at":"2026-05-18T09:31:11.248044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":"2303.16634","doi":"10.48550/arxiv.2303.16634","metadata_source":"pith","pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","venue":"cs.CL","work_id":"6bc7f654-ec90-4d95-b023-416717a28f45","year":2023},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:3d2fe7531831f118bfb75901a7ada8f8d099b32990bcd167c3610ad0ae266cba","observation_id":"3e3f18c2-724b-4cb0-833b-78b453f74951","resolution":{"observed_at":"2026-05-18T09:31:11.221679Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:05.615976+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:05.615976+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Entity-based knowledge conflicts in question answering","venue":null,"work_id":"a1dd4cd7-656d-44b6-adb7-6c6adfe2e85a","year":2021},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:5cfc2e19ea3d7f51b5ff7060f103e67c00604648667485499a0cfb8585e74c3a","observation_id":"aa673644-ee47-4c5a-8833-d4c948f71515","resolution":{"observed_at":"2026-05-18T09:31:12.000419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15240","last_updated":"2025-03-31T17:33:40Z","snapshot_observed_at":"2026-07-06T18:49:46.992782Z","submitted_at":"2024-07-21T18:09:40Z","title":"BIGbench: A Unified Benchmark for Evaluating Multi-dimensional Social Biases in Text-to-Image Models","version":6},"cited_work":{"arxiv_id":"2407.15240","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15240","snapshot_observed_at":"2026-07-04T09:49:44.523965Z","title":"Aman Madaan, Niket Tandon, Prakhar Gupta, Skyler Hallinan, Luyu Gao, Sarah Wiegreffe, Uri Alon, Nouha Dziri, Shrimai Prabhumoye, Yiming Yang, et al","venue":null,"work_id":"1dcc19ee-a63f-40f4-a8fb-d8b9f3bf00da","year":2024},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2407.15240","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:13db0c1082a56b6b93daebd2c7f3a61770409bd8757c7b4575b914ee4ffbe572","observation_id":"6679bc5a-970b-42b4-b066-360504ae336f","resolution":{"observed_at":"2026-05-18T09:31:11.206284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7db908c1-2eb0-4b15-9bde-052b5ec9462c","year":2022},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:665ad3186d3920b562493f977d363dff6622ea3ddda894f160a1168277218458","observation_id":"68557ee4-9c99-4f9c-8079-bcc37189df79","resolution":{"observed_at":"2026-05-18T09:31:12.004057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":"2209.11895","doi":"10.1145/3411763.3451760","metadata_source":"pith","pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In-context Learning and Induction Heads","venue":"cs.LG","work_id":"db2b0911-2758-4a2a-99dc-15b14b91bd5e","year":2022},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:d75eba5137c999797ac62a9b2979e3c351e34bac8b6c10d5cfd53f601a23b178","observation_id":"47d06d17-f112-4a03-b87d-3c9e086379ac","resolution":{"observed_at":"2026-05-18T09:31:11.056757Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02177","last_updated":"2022-01-06T18:43:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-06T18:43:37Z","title":"Grokking: Generalization Beyond Overfitting on Small Algorithmic Datasets","version":1},"cited_work":{"arxiv_id":"2201.02177","doi":"10.1109/tit.2005.851722","metadata_source":"pith","pith_arxiv_id":"2201.02177","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Grokking: Generalization Beyond Overfitting on Small Algorithmic Datasets","venue":"cs.LG","work_id":"a3c30ead-1625-4c18-a9c1-e4928dcd0da6","year":2022},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2201.02177","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:39ea2ce700c134aa7678f5b435cac960fcc735e6fe35cb49f613496879b7dff1","observation_id":"cca66dfa-ebc1-417e-8c22-6c09af738b88","resolution":{"observed_at":"2026-05-18T09:31:11.227224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt programming for large language models: Beyond the few-shot paradigm","venue":null,"work_id":"1c0ae053-f044-42aa-809b-97da5e354b6e","year":2021},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:8ac0f2e3dbb795d6d906d9023d50133620c467c8076635b1780c5964f2ee1a31","observation_id":"be219fc4-03bb-432a-9d62-0976c019161c","resolution":{"observed_at":"2026-05-18T09:31:12.010207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13800","last_updated":"2023-10-20T20:17:09Z","snapshot_observed_at":"2026-07-06T16:36:23.513728Z","submitted_at":"2023-10-20T20:17:09Z","title":"Evaluation Metrics in the Era of GPT-4: Reliably Evaluating Large Language Models on Sequence to Sequence Tasks","version":1},"cited_work":{"arxiv_id":"2310.13800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.13800","snapshot_observed_at":"2026-07-02T08:36:47.714372Z","title":"Evaluation metrics in the era of gpt-4: Reliably evaluating large language models on sequence to sequence tasks.arXiv preprint arXiv:2310.13800","venue":null,"work_id":"cbf45910-bf35-47e3-8da4-fa35500306c7","year":2023},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2310.13800","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:5d4e1552eae232a2bc2f97afbf086fe27177cca25e8ee2a9794262ae6f5f434f","observation_id":"98bd970a-b86f-4b7d-9f79-6dc6f6bf8d7b","resolution":{"observed_at":"2026-05-18T09:31:11.253621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10635","last_updated":"2024-06-28T08:24:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-20T07:01:57Z","title":"SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.10635","doi":"10.48550/arxiv.2307.10635","metadata_source":"pith","pith_arxiv_id":"2307.10635","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models","venue":"cs.CL","work_id":"88ae39fd-4d53-4184-9d82-03e8ac44d797","year":2023},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2307.10635","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:e1d08514b06f301cd1ec2aa6590ede2045d53223f79c0799b18ee2f0e2bebbcb","observation_id":"c38a01d4-0375-4f26-9482-7d42b34410bc","resolution":{"observed_at":"2026-05-18T09:31:11.242556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.354385+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.354385+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":"2501.09686","doi":"10.48550/arxiv.2501.09686","metadata_source":"pith","pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","venue":"cs.AI","work_id":"9b0d5273-2b7c-477e-b49b-2e0edab55456","year":2025},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:4b39d4c318412c10dca7afe264042ffd6324698ef419ed6d31b800e2c8a3c4d9","observation_id":"0faf3c5a-bbc8-48ae-bf7c-831a63c16d12","resolution":{"observed_at":"2026-05-18T09:31:11.232362Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16477","last_updated":"2025-05-22T10:05:48Z","snapshot_observed_at":"2026-07-06T21:28:24.644692Z","submitted_at":"2025-05-22T10:05:48Z","title":"Advancing the Scientific Method with Large Language Models: From Hypothesis to Discovery","version":1},"cited_work":{"arxiv_id":"2505.16477","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16477","snapshot_observed_at":"2026-07-02T03:06:29.178249Z","title":"Advancing the scientific method with large language models: From hypothesis to discovery","venue":null,"work_id":"33fd0199-656d-43e3-93ee-ad5bba7d1e20","year":2025},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2505.16477","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:5135848bbfd0985e8c638b945a0d6599462ed34e5a9b69a276193a269cb91f63","observation_id":"f7da91b1-f1dd-456a-b1ba-5e84fe50dbd7","resolution":{"observed_at":"2026-05-18T09:31:11.211183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03418","last_updated":"2025-05-06T10:53:58Z","snapshot_observed_at":"2026-07-06T21:19:39.582514Z","submitted_at":"2025-05-06T10:53:58Z","title":"Knowledge Augmented Complex Problem Solving with Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2505.03418","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03418","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"APPENDIX A LLM USAGE We have used LLMs to polish the text of the paper and also to conduct literature review","venue":null,"work_id":"85e7ed3b-d05c-47fe-acb7-80de6081ce5d","year":2025},"citing_paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T09:30:16.609270Z"},"links":{"cited_paper":"/paper/2505.03418","citing_paper":"/paper/2510.05432"},"observation_digest":"sha256:a3505b6190612f7b0b530f7f64cf6f6e07b761942325f5f635c880fc9d47752b","observation_id":"0c9e4792-1cae-481e-a328-fc9052fa1a82","resolution":{"observed_at":"2026-05-18T09:31:11.216601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.05432","last_updated":"2026-04-28T12:36:32Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T14:37:21.260009Z","submitted_at":"2025-10-06T22:50:41Z","title":"AInstein: Can LLMs Solve Research Problems From Parametric Memory Alone?"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":1,"verified_exact":8,"verified_fuzzy":3},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 1 inbound Pith citation observation for arXiv:2510.05432."}