{"as_of":"2026-08-10T12:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55509cd34f6925d04ed8386f802d823bb80440d066d743c35d859e013cd30765","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:49:58.363965Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:43:23.450401Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:19:23.892865Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2605.06184","last_updated":"2026-05-07T13:01:06Z","snapshot_observed_at":"2026-08-08T18:04:17.889207Z","submitted_at":"2026-05-07T13:01:06Z","title":"Teaching LLMs Program Semantics via Symbolic Execution Traces","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T08:56:25.022619Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2605.06184"},"observation_digest":"sha256:a10c33327b00aaff9619b8abd17d27d6a7cfc03e9875833cff52d29299cd5e03","observation_id":"36ac7432-fe0d-4fc0-ae88-941abf859042","resolution":{"observed_at":"2026-05-11T20:26:13.431111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2605.29790","last_updated":"2026-05-28T11:40:16Z","snapshot_observed_at":"2026-08-06T19:17:26.541233Z","submitted_at":"2026-05-28T11:40:16Z","title":"Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T00:05:31.780655Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2605.29790"},"observation_digest":"sha256:8acbfdaebcbb0e74ba693b5c51127782fb18d5a84912b4fc3c221ee6b9c2bff8","observation_id":"2f3bccff-abd0-4bfc-8f9e-235cc02ea999","resolution":{"observed_at":"2026-06-29T00:12:50.100767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2606.19613","last_updated":"2026-06-17T21:36:09Z","snapshot_observed_at":"2026-08-07T13:16:30.354063Z","submitted_at":"2026-06-17T21:36:09Z","title":"StaminaBench: Stress-Testing Coding Agents over 100 Interaction Turns","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T19:47:59.090249Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2606.19613"},"observation_digest":"sha256:cab37cb1806dba59a532a98f6bb33f7b08b6deb104c8fbbe74cec207648b931a","observation_id":"50d8dcb4-9a02-4d1b-9532-237f5fc10dd5","resolution":{"observed_at":"2026-07-04T02:19:23.894455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2606.20607","last_updated":"2026-05-21T23:35:15Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-21T23:35:15Z","title":"LLM4CAD-Editor: An Intent-Aware Large Language Model Framework for Multi-Level Computer-Aided Design Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T15:33:46.125268Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2606.20607"},"observation_digest":"sha256:6b6199159611a9b59ef9b371c12d89559cba05b09ec7c9f0047fbebc54d7b0b6","observation_id":"33cea02d-7582-4710-bc45-154befe7621f","resolution":{"observed_at":"2026-06-30T15:34:47.857778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-08-06T16:45:20.185074Z","title":"arXiv preprint (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04783","last_updated":"2026-08-06T09:16:21Z","snapshot_observed_at":"2026-08-10T05:43:05.331687Z","submitted_at":"2026-08-05T12:49:36Z","title":"RepoProbe: Benchmarking Architecture-Aware Repository Comprehension with Checklists","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.185074Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2608.04783"},"observation_digest":"sha256:2a960027548670956dd5db662b087171b22ee96063e84d242b98f60d652c616c","observation_id":"0533a6b0-74ee-4240-9432-ce915d1fde6d","resolution":{"observed_at":"2026-08-06T16:45:20.185074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-08-08T17:43:23.450401Z","title":"arXiv preprint (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04783","last_updated":"2026-08-06T09:16:21Z","snapshot_observed_at":"2026-08-10T05:43:05.331687Z","submitted_at":"2026-08-05T12:49:36Z","title":"RepoProbe: Benchmarking Architecture-Aware Repository Comprehension with Checklists","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T17:43:23.450401Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2608.04783"},"observation_digest":"sha256:4360e192e6a807e634571c604611ca445748726d77a2511a03d912e1a7763e1c","observation_id":"766a219c-b512-493a-88dd-24965e3e3de0","resolution":{"observed_at":"2026-08-08T17:43:23.450401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09614/citation-record","integrity":"/paper/2509.09614/integrity","json":"/paper/2509.09614/citation-record.json","paper":"/paper/2509.09614"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.338747Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.338747Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:5fc16ae15a9550c8d6c626435b1eda738db957c9e3644bb5280ae8a2599df0d6","observation_id":"31972309-3f8b-451f-95fb-dd90fe48eaf4","resolution":{"observed_at":"2026-08-04T18:49:58.338747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.341602Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.341602Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:ff5743ee2b4fece98c1b7ee4cedc6ce7b7e6644d3b4e6ad9c0e22ba8d75d0bb8","observation_id":"ea22d1db-4028-4a29-bc75-6c222f76bd34","resolution":{"observed_at":"2026-08-04T18:49:58.341602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.332193Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.332193Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:36053d1f1605fadeaebf869ca9c1e5a47605a42cd2c95ed0fd049fac5ada3236","observation_id":"5820baf9-d8c7-448a-bdda-ba8a5989d429","resolution":{"observed_at":"2026-08-04T18:49:58.332193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.335170Z","title":"\"\" def __init__(self): self._subscribers = \\{\\} self._async_subscribers = \\{\\} def subscribe(self, event_type: Type[Event], handler: EventHandler):","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.335170Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:130051e5d2a47311b7889eabeeb1bdc8c380e17e91cb84b3ad72747a2103c814","observation_id":"87554561-0d91-41dc-89d0-91cf9cc53b0a","resolution":{"observed_at":"2026-08-04T18:49:58.335170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.319394Z","title":"APPS provides 10,000 problems from coding compe- titions, while LiveCodeBench offers contamination-free evaluation with problems collected from ongoing contests","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.319394Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:f29d1b06396e7a895f5bee34c3ad9545a045a515bb067e0ace1a99b5817271bd","observation_id":"32b045b8-b3fb-44f7-a6e1-c607363c9379","resolution":{"observed_at":"2026-08-04T18:49:58.319394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.322473Z","title":"While domain-specific, these benchmarks still primarily evaluate isolated function or script generation rather than comprehensive software development capabilities","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.322473Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:78ff734bd046ad4e02c7f21da4611d40f4c44168caa606b7e888e94459f1aa56","observation_id":"a814b9c7-4c01-4532-b0ef-41260f5112be","resolution":{"observed_at":"2026-08-04T18:49:58.322473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.325923Z","title":"LongICLBench (An et al., 2024) evaluates in-context learning capabilities at extreme lengths, while LongAlign (Bai et al., 2024a) addresses instruction following in long contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.325923Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:ef69f3ee0985d114c7ad5a10a5fbe5c96b8b2ac1f1c0bb60c9607c7f0fefb86c","observation_id":"2dba29e3-50f2-41fb-a81f-770d684cb2e8","resolution":{"observed_at":"2026-08-04T18:49:58.325923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.344904Z","title":"id\": \"java_api_graphql_easy_007_feature_implementation_expert_01","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.344904Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:7639dd93dfd735058aa3e79913a2d95c2505ad90944d869319433d1f85d5005a","observation_id":"02347c3b-1dad-466a-af39-59e4d75759cf","resolution":{"observed_at":"2026-08-04T18:49:58.344904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.348184Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.348184Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:30ee2f4b10cae528f64a1608fd7868aea3c00374acfe7f60fad8f5568f501588","observation_id":"94a9b891-e205-4e93-bcad-286cc5e62bfd","resolution":{"observed_at":"2026-08-04T18:49:58.348184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.351595Z","title":"GPT-4o\": \\{","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.351595Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:202ddcb82e08d14e244261f467201e2437ec51fc0c4a2285bd69a377490cc5a5","observation_id":"8b2af64e-2b9a-4db6-ad1c-6a30f3bfe3a3","resolution":{"observed_at":"2026-08-04T18:49:58.351595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.354651Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.354651Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:0195b4c6286b956bd233bd20aea31d98b2435a0a57c9d60d27861df3ed72dad3","observation_id":"1152389c-f47e-45c2-a503-f4d0739036f1","resolution":{"observed_at":"2026-08-04T18:49:58.354651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.357809Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.357809Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:5751e868de4ae2bc480db0c92ac2db40b78fd5ab0de53ec302bb9f671f121d7a","observation_id":"8f7081cd-3520-40e3-ba44-29964d933cec","resolution":{"observed_at":"2026-08-04T18:49:58.357809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.360736Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.360736Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:99a8ec433b37cb6c86f2b8bf18d7c3e09f3c2d44f1c7b4f6b8dadff8777f143b","observation_id":"d67603e4-9bd2-453f-81cd-f1b033d84f20","resolution":{"observed_at":"2026-08-04T18:49:58.360736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.363965Z","title":"approach","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.363965Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:bd71f5ab31c19c0125bb931fa1ec6bc66ce83273679058b2f03f18e6bc0d4f01","observation_id":"a832a7d4-8487-4c5c-9768-2933db128c07","resolution":{"observed_at":"2026-08-04T18:49:58.363965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02060","last_updated":"2024-06-12T02:46:16Z","snapshot_observed_at":"2026-08-10T10:58:49.985741Z","submitted_at":"2024-04-02T15:59:11Z","title":"Long-context LLMs Struggle with Long In-context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02060","snapshot_observed_at":"2026-08-04T18:49:58.304178Z","title":"Zetian An, Chanakya Chen, Weiyan Zheng, Hendrik Geissler, Yiyang Qian, Peiyi Wang, Shuohang Chen, Tianyu Wang, Zhenguo Wu, and William Yang Wang","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.304178Z"},"links":{"cited_paper":"/paper/2404.02060","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:d11a6a964fbd57de64c5caf6920cb15d1ac73876aa88a4dc03f634acf674a61e","observation_id":"82bdb0c9-8baf-4baf-a895-7bfd9ded53c8","resolution":{"observed_at":"2026-08-04T18:49:58.304178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-04T18:49:58.308701Z","title":"InarXiv preprint arXiv:2203.13474","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.308701Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:4b9529ad4377c47d2785bf21cf46443967980f4960ca8222736cdeede23f1f2e","observation_id":"3ebd0d67-0c64-4c58-b5c5-3616d57863e9","resolution":{"observed_at":"2026-08-04T18:49:58.308701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10007","last_updated":"2023-05-24T06:56:45Z","snapshot_observed_at":"2026-08-08T15:03:11.388057Z","submitted_at":"2022-12-20T05:48:09Z","title":"CoCoMIC: Code Completion By Jointly Modeling In-file and Cross-file Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10007","snapshot_observed_at":"2026-08-04T18:49:58.312286Z","title":"InIEEE/ACM International Conference on Computer-Aided Design","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.312286Z"},"links":{"cited_paper":"/paper/2212.10007","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:8ee4223ab6d53fdccb5a360635a691e315a5501050b13469b3c6234d9398cf8d","observation_id":"ae4eccc4-520f-40c7-9b76-c1efa36ec6dc","resolution":{"observed_at":"2026-08-04T18:49:58.312286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15296","last_updated":"2024-08-27T10:51:51Z","snapshot_observed_at":"2026-07-06T19:06:45.969497Z","submitted_at":"2024-08-27T10:51:51Z","title":"Feature Representations for Automatic Meerkat Vocalization Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15296","snapshot_observed_at":"2026-08-04T18:49:58.315651Z","title":"InarXiv preprint arXiv:2408.15296","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.315651Z"},"links":{"cited_paper":"/paper/2408.15296","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:638e401241551c707daa700419f7ef4b80923ac9410051e93b29b288c364e868","observation_id":"5420b973-b513-4a44-9930-615871ecb629","resolution":{"observed_at":"2026-08-04T18:49:58.315651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.328653Z","title":"unique_id","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.328653Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:b5ab099064f7b1fa5e7c7e20d3010d5a33c98ab940d7292637a059c48df617d3","observation_id":"afe80bab-3d70-478d-92a0-7d3725f73b08","resolution":{"observed_at":"2026-08-04T18:49:58.328653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-10T10:59:03.873720Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 6 inbound Pith citation observations for arXiv:2509.09614."}