{"as_of":"2026-08-08T10:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f62b226796daf9aaa074ed3bfd32818e9fe426cd325e6d59c5b1fa44679f584","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:12:27.279857Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22086/citation-record","integrity":"/paper/2507.22086/integrity","json":"/paper/2507.22086/citation-record.json","paper":"/paper/2507.22086"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T13:12:25.144642Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.144642Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:a21316cdca1224bdd8ee15ca7916ab5dc419a7d5354d658af42aa7b7cde3d3e7","observation_id":"8522e1f7-83b8-4382-8ada-484bc2d8e6fa","resolution":{"observed_at":"2026-08-06T13:12:25.144642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T13:12:25.587220Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.587220Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:1e60c6d54a9cf4c93765161e006e480f0f0784feb89a6eed7e5e7c1b41bed212","observation_id":"ec4ecc15-ae91-4602-96e3-e0e07251f99c","resolution":{"observed_at":"2026-08-06T13:12:25.587220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:29.156380Z","title":"J., Bird, C., Barr, E","venue":null,"work_id":"a2f67c1c-4752-4d54-8fc4-87dabf84777d","year":2018},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.670459Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:9cae5849fa7b1cc9d504b90eb5ff66ebcc0292feadf225a1f88984301882ac80","observation_id":"a2053efd-16bd-41ca-9a2e-829bd07f44ba","resolution":{"observed_at":"2026-08-06T13:12:29.306879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T13:12:25.896581Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.896581Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:604f8077aeb0ecc9f066e23942474cebebba88d61e3636bbdaf5f789d8371d3a","observation_id":"313ae3af-7d69-4a9a-991c-b8d67e535382","resolution":{"observed_at":"2026-08-06T13:12:25.896581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.684207Z","title":null,"venue":null,"work_id":"9fe6d6a3-579e-4252-abc3-b09b6c8c84dd","year":2023},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.149430Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:ebc2e145d815e9da1adc09ab5b2b4cd6dffc8476fbd0e5a2c5279fd7a3f1dcac","observation_id":"3d0ffcb1-2cfd-4476-a5c5-b2a92334c48d","resolution":{"observed_at":"2026-08-06T13:12:28.816108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.439258Z","title":"P., Sabu, S., Wang, J., M","venue":null,"work_id":"b4801ed1-1765-48c5-82c0-9a097ccab981","year":2024},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.369220Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:fd191b38db18533765f6b257ac060cf37245485f8dbb482126e98677cbe270ee","observation_id":"62677a37-6445-43a2-a151-546f381c4141","resolution":{"observed_at":"2026-08-06T13:12:28.579917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:26.467618Z","title":"Repotrans- bench: A real-world benchmark for repository-level code translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.467618Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:bb429cba8c82a329b3197e138caed5113c10c944818f035289b7de8fccf1d61c","observation_id":"b9adfcaf-32a1-4c59-8e7d-4503dcc2fa11","resolution":{"observed_at":"2026-08-06T13:12:26.467618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T13:12:26.605674Z","title":"Yang, A., Yang, B., Zhang, B., Hui, B., Zheng, B., Yu, B., Li, C., Liu, D., Huang, F., Wei, H., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.605674Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:1aee805323f88c7a6ef0e0b2a1c3e463f885cc2dbceef4c6777b070a41d36766","observation_id":"8addf16b-77ef-4ab1-8250-d51afb7b2ac5","resolution":{"observed_at":"2026-08-06T13:12:26.605674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-07-31T19:00:59.311189Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-06T13:12:26.731265Z","title":"Y ., Vu, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.731265Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:0f5cdbf73e741b954880b7fbeec44f14c491984800c7a32dad46edf9c2ba50d6","observation_id":"d619baaa-5ab7-4ab6-94c7-115876ba40bb","resolution":{"observed_at":"2026-08-06T13:12:26.731265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.267783Z","title":null,"venue":null,"work_id":"c7f955d3-5dfb-4d85-800a-0dacd5570e2f","year":2024},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.835649Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:837205954df084d5518661a2cd940b9440206fc397667288feb5aba4ef394bbc","observation_id":"0f4ab164-89c7-4161-bd98-8b34d370b2b0","resolution":{"observed_at":"2026-08-06T13:12:28.329334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.159502Z","title":"The test sets are further split into two test1 and test2 based on the date created to test the data contamination issue","venue":null,"work_id":"dcc82b13-20c4-447e-a31a-57f18bddd817","year":2014},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.928560Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:6c5b4c41cd36479e6d94aaadcfb06fd40aca40359283a9c7be5a5375d38b701a","observation_id":"c42e22cd-197f-4ada-9a83-c266a5426851","resolution":{"observed_at":"2026-08-06T13:12:28.216862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.055837Z","title":null,"venue":null,"work_id":"8b31740f-9347-49c8-8d3f-512b6daf4b53","year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:27.069811Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:90bd9932b627c7f5d876cbe4235398b77a12e092727813be19edc87d3d0ce4a3","observation_id":"8ceb5ea3-078b-43e0-b82f-5fee4bfd689f","resolution":{"observed_at":"2026-08-06T13:12:28.100105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:27.984559Z","title":null,"venue":null,"work_id":"f66cbb19-a9f0-4d78-ae7f-f540ae5efc4c","year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:27.204923Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:88de2fbfccd281bc725ce0580caf78dd7484387fd76abd0be12bc2103b052d0b","observation_id":"ff0cbb13-768b-4a6b-aba0-9004afde136c","resolution":{"observed_at":"2026-08-06T13:12:28.020057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:27.776774Z","title":null,"venue":null,"work_id":"e6f44a70-fbd9-49db-abfa-fb3e076f7063","year":2008},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:27.279857Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:86155cd8ce3317774f5f50b7bc3f748319f3a4bd6abb0734e3f84c13dccc638f","observation_id":"02b0cae8-38ac-489e-be96-ef4b0d8276e4","resolution":{"observed_at":"2026-08-06T13:12:27.881031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10628","last_updated":"2023-10-16T17:51:29Z","snapshot_observed_at":"2026-07-06T16:34:04.003157Z","submitted_at":"2023-10-16T17:51:29Z","title":"Data Contamination Through the Lens of Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10628","snapshot_observed_at":"2026-08-06T13:12:26.242662Z","title":"Data contamination through the lens of time","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.242662Z"},"links":{"cited_paper":"/paper/2310.10628","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:c34a037a3d6108db5721d4a7122fe0e1adf6fee034f914c2e34b776aa92ded3a","observation_id":"f51def23-a51e-4190-9756-42c279a66d77","resolution":{"observed_at":"2026-08-06T13:12:26.242662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-06T13:12:25.780029Z","title":"Monkeytype: A python library that generates static type annotations by collecting run- time types","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.780029Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:259bf9ddc3c23eda7c37bbbe2798896b56d580ce5d04d943e8edbef3b374ccd2","observation_id":"b3b83ac6-b9a9-4554-aea3-49dd60cbc2dc","resolution":{"observed_at":"2026-08-06T13:12:25.780029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.920271Z","title":"Pyright: Static type checker for python","venue":null,"work_id":"bd754a5a-c326-444d-a4ff-57de7e506ac2","year":2021},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.036090Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:b688229c216651c4ab002067607c3c23a173ab287b839de70f63c36238452dfa","observation_id":"46b94a5b-c9e8-470f-bb59-88695b3faaf7","resolution":{"observed_at":"2026-08-06T13:12:29.042908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13161","last_updated":"2024-06-19T02:29:59Z","snapshot_observed_at":"2026-08-07T23:35:20.950522Z","submitted_at":"2024-06-19T02:29:59Z","title":"APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts","version":1},"cited_work":{"arxiv_id":"2406.13161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13161","snapshot_observed_at":"2026-08-06T13:12:27.552196Z","title":"APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts","venue":"cs.AI","work_id":"3561f8c4-1bfb-4968-93f4-58a4b7bec2e9","year":2024},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.496645Z"},"links":{"cited_paper":"/paper/2406.13161","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:9d3fe6f7d6ebabc408dc6e69b66ab43111ad5364d21a868a49d85473b50df216","observation_id":"624e43b7-e775-4632-adfb-fece35d6f95d","resolution":{"observed_at":"2026-08-06T13:12:27.644129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T13:12:25.366886Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.366886Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:57ce303588d141310a4b21db435929ecad0a6799d8329d3dcf29f312f72c38f0","observation_id":"bf30dcd8-a15b-4e87-95b2-92f1631972fc","resolution":{"observed_at":"2026-08-06T13:12:25.366886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:29.433445Z","title":"Brown, T., Mann, B., Ryder, N., Subbiah, M., Kaplan, J","venue":null,"work_id":"b46b804e-59e0-44fb-b7cc-572ad9617466","year":1901},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.258861Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:cd2faf10475713ef146de40cc8283e1ade910821bf360ab94bc8317bf492c6a9","observation_id":"eb5268bc-b9bb-43a4-894c-7d6bd9650e62","resolution":{"observed_at":"2026-08-06T13:12:29.540548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-07T23:35:50.053150Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2507.22086."}