{"as_of":"2026-08-05T15:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1506af09b7455da3cc9035ada883cc8909528c0ecdf3584c802b19d9391c6a55","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T12:56:31.874981Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T09:19:43.810135Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"cited_work":{"arxiv_id":"2512.04111","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.04111","snapshot_observed_at":"2026-07-04T09:19:43.810135Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","venue":"cs.SE","work_id":"590976f3-2aa5-4ec4-8446-3016116379bb","year":2025},"citing_paper":{"arxiv_id":"2604.17883","last_updated":"2026-04-20T06:53:32Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T06:53:32Z","title":"Scaling Human-AI Coding Collaboration Requires a Governable Consensus Layer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T04:45:08.128109Z"},"links":{"cited_paper":"/paper/2512.04111","citing_paper":"/paper/2604.17883"},"observation_digest":"sha256:b5694d3795c6794f6fa3ed97ac725e2e49e3c4792e7d253fc149c838fa419607","observation_id":"a1f6ada2-e99d-4466-9966-69486ce7983c","resolution":{"observed_at":"2026-05-20T00:00:29.292917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"cited_work":{"arxiv_id":"2512.04111","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.04111","snapshot_observed_at":"2026-07-04T09:19:43.810135Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","venue":"cs.SE","work_id":"590976f3-2aa5-4ec4-8446-3016116379bb","year":2025},"citing_paper":{"arxiv_id":"2606.22484","last_updated":"2026-07-04T08:01:50Z","snapshot_observed_at":"2026-07-12T12:56:31.380007Z","submitted_at":"2026-06-21T13:08:35Z","title":"Governed AI-Assisted Engineering: Graduated Human Oversight for Agentic Code Generation in Regulated Domains","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T10:12:32.934372Z"},"links":{"cited_paper":"/paper/2512.04111","citing_paper":"/paper/2606.22484"},"observation_digest":"sha256:775b05b4f0f3639c4b1cbcdfb5b92400ae7b68bd7c77e80b55c690dbffe3d95e","observation_id":"977a8018-ba7c-4296-bf60-04e5fbc434a4","resolution":{"observed_at":"2026-07-04T09:19:43.811393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.04111","snapshot_observed_at":"2026-07-12T12:56:31.874981Z","title":"CentaurEval: Benchmarking human-in-the-loop value in agen- tic coding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22484","last_updated":"2026-07-04T08:01:50Z","snapshot_observed_at":"2026-07-12T12:56:31.380007Z","submitted_at":"2026-06-21T13:08:35Z","title":"Governed AI-Assisted Engineering: Graduated Human Oversight for Agentic Code Generation in Regulated Domains","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T12:56:31.874981Z"},"links":{"cited_paper":"/paper/2512.04111","citing_paper":"/paper/2606.22484"},"observation_digest":"sha256:02aac0ed176fdd2e1e07a30d48e35cc918b0d6691f7bb156fc069cd51c4c5570","observation_id":"ba60c06b-6a1b-4584-8360-44721b86c61e","resolution":{"observed_at":"2026-07-12T12:56:31.874981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"cited_work":{"arxiv_id":"2512.04111","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.04111","snapshot_observed_at":"2026-07-04T09:19:43.810135Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","venue":"cs.SE","work_id":"590976f3-2aa5-4ec4-8446-3016116379bb","year":2025},"citing_paper":{"arxiv_id":"2606.30651","last_updated":"2026-06-16T01:12:47Z","snapshot_observed_at":"2026-08-04T15:26:08.743440Z","submitted_at":"2026-06-16T01:12:47Z","title":"Can Physician Expertise Improve Machine Learning Identification of Delirium?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T07:36:46.796512Z"},"links":{"cited_paper":"/paper/2512.04111","citing_paper":"/paper/2606.30651"},"observation_digest":"sha256:0912867c67799511e02e94c54184de06b9deef1fb39dc9a4a870e0067c56405c","observation_id":"5c27620d-f522-47e7-9a17-47e8faa08162","resolution":{"observed_at":"2026-07-01T08:05:31.871438Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.04111/citation-record","integrity":"/paper/2512.04111/integrity","json":"/paper/2512.04111/citation-record.json","paper":"/paper/2512.04111"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.00083","last_updated":"2025-09-30T03:34:50Z","snapshot_observed_at":"2026-07-06T22:05:57.485783Z","submitted_at":"2025-07-31T18:17:36Z","title":"A Survey on Code Generation with LLM-based Agents","version":2},"cited_work":{"arxiv_id":"2508.00083","doi":"10.1007/s41233-023-00059-2","metadata_source":"pith","pith_arxiv_id":"2508.00083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on Code Generation with LLM-based Agents","venue":"cs.SE","work_id":"d958445f-408f-4ff3-bd9a-decd431c419a","year":2025},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2508.00083","citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:fb00ed75ca2c85a26ab214950341d2c0070ffbb77c4aff184e9e33d009b9bce6","observation_id":"bc716f9c-95b2-4bf2-81bb-60b85a51be45","resolution":{"observed_at":"2026-05-22T12:01:30.185005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4ee82217-07d6-451d-b2fc-88657f10f84c","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:ab1d62b38b9fbf7ca0170f4e1b5f0b6ac42164258f84a273265ba32b6f18972a","observation_id":"f6a6b280-4ce0-4340-9161-5cbe6d9aebe5","resolution":{"observed_at":"2026-05-22T12:01:30.538626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a8524075-9b69-4ceb-9eed-0004b025f0b1","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:588b2053411e12cd0f45dd888e05e4aca2450be51526dce7cc405ecd395afa79","observation_id":"727b2f22-8e6f-4254-a44a-546fcfb69389","resolution":{"observed_at":"2026-05-22T12:01:30.459700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"template_id","venue":null,"work_id":"715a789a-b58f-4407-a66c-55b27959b5a7","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:692d09aace001868f2f341ece746ebe519ece56abd73ce1b01c2ea2a51aafd0d","observation_id":"d172b346-7f2a-4f77-b58b-3639a7e11126","resolution":{"observed_at":"2026-05-22T12:01:30.664494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f2f7c7ca-bfaa-46f2-bfc8-ccc2d89a1568","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:6f8fedaa7e0685a379cdf6dc99e38c745efce0f23992fe982b59edf68fd4ec87","observation_id":"e7766b4c-66a1-46fa-974d-2f877e4df244","resolution":{"observed_at":"2026-05-22T12:01:30.498313Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"643a2483-b712-4734-a912-e4a957ea10d6","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:01fa12cb1f6decfbbdbfa1bbd48c806b08a5d41231eff9343ad40cdea6d5222f","observation_id":"531f3703-9ba4-4116-a679-990b86d29f15","resolution":{"observed_at":"2026-05-22T12:01:30.547638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bc3c7bb9-75ba-47ef-b988-81744ed447c5","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:c8c2ff32c9f1c1928c737e28a95d94e5c7e78240a79fcb37ab67590ac40d1595","observation_id":"20f2e322-a46d-4cfe-814e-ba0e03d2f930","resolution":{"observed_at":"2026-05-22T12:01:30.616396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c5e039dd-bafa-472b-8d2f-33e8ffe6a51f","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:d979e7a5f9212c1bd928f2d4aa9f51b66de4fad165f129be1b109a0b70e137a4","observation_id":"e8109cef-34c1-438f-80ba-512b2af34c73","resolution":{"observed_at":"2026-05-22T12:01:30.637194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3bf20464-e21e-4977-a33a-d304cd60bea7","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:bbd08a35b3cc1b5def66cdb51f90d7a75934db37c1a0004d943315388d8a5541","observation_id":"f7bb50cf-f170-48ee-b86d-41455a2c3a3c","resolution":{"observed_at":"2026-05-22T12:01:30.494660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fcaf5e13-73e8-45bb-8016-9319b2c88d3c","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:307f1fc6c66e10b6ea3aab1c16078d6e84bd158887204c302b6eb1c2269f2c6f","observation_id":"60b88688-3b95-4f50-a60e-4c98eed64f61","resolution":{"observed_at":"2026-05-22T12:01:30.451082Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"step\": 1","venue":null,"work_id":"8b1e1294-a3a0-4a7b-ab71-2edc06ddd4c5","year":2022},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:0539b71c621555790f5adce46e730f7b5b76ddd4ca7905733c0effd8dd98e260","observation_id":"50df3e6a-3e24-4d6c-8478-7836deb5dc77","resolution":{"observed_at":"2026-05-22T12:01:30.415361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"68fbde52-867f-4917-9959-481eb285360e","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:30d4668e49f94e861fd53e717862690626d575475e0cd45044745be4446bbb33","observation_id":"c60c4fe3-661c-4048-af29-86f7cd64fe82","resolution":{"observed_at":"2026-05-22T12:01:30.633224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"10 minutes) to provide basic information, educational background, and technical experience","venue":null,"work_id":"27f83822-a16c-496b-af2f-e333af249aea","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:3c06c3dd9fe4dcbff6595c2925f6cf5e633dfa3a41f7fc071ad618e23bf65aa3","observation_id":"bd31da55-6c7b-4661-a5c9-40c2cb34eb7a","resolution":{"observed_at":"2026-05-22T12:01:30.526180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"You may experience some stress or frustration","venue":null,"work_id":"59cdc85c-e37f-4377-8f77-4b3978cebb11","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:4b1af806ce3477e4a5eebe1ea037878b36b43157ac2442d14b923fd58ad436b2","observation_id":"2b781f80-a9d3-44ea-aac4-bb2e0fb19f01","resolution":{"observed_at":"2026-05-22T12:01:30.652577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Payment will be made via one of the following methods: Amazon Gift Card, PayPal, Zelle, Alipay, or WeChat","venue":null,"work_id":"e329d309-31c2-4d99-8ab0-489a76cedbd6","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:7a93303798401b79c9e761c451d9744715ea34f6d7ea02ed855453f2e8ee2184","observation_id":"57046f15-7f39-481c-a5a8-845fd938b6db","resolution":{"observed_at":"2026-05-22T12:01:30.530433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•Anonymous Access:To ensure your anonymity, you will not use your personal GitHub account","venue":null,"work_id":"9e97b448-c6fc-4c60-b3a8-dd0a21a14d8f","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:b8a9564ccd3804bdc7c89979f5bf4a6d304790bb0eefb74eca8b4979caa497bf","observation_id":"b814d7f7-abec-41d7-ab0d-734e51bd7bd3","resolution":{"observed_at":"2026-05-22T12:01:30.517487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"You may withdraw at any time without penalty","venue":null,"work_id":"399d0088-972a-475e-a9ab-e14859db466e","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:c50e41b35bd5b20ad34b48072d889398ed4b5445ac387343accca3be4ad85116","observation_id":"b4d32bd5-c262-4cfe-8af8-d8676d0f4281","resolution":{"observed_at":"2026-05-22T12:01:30.648381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"27b00326-d18e-44c8-8f4e-a769ee068ceb","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:3250c9656eb93b5fddbc91b7a9aa45d667314877ccc880d779b20cef6154f99d","observation_id":"0c95c709-38ab-4128-90fe-ff6e7adea7d1","resolution":{"observed_at":"2026-05-22T12:01:30.476902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12d83014-560c-4047-89ff-ed8e30bd0f3e","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:cc61b1fce9a93eff372692ef295766b92ddd7499edaaca556031786dad50b950","observation_id":"e81dd665-52b2-4938-a459-6a966dbfe350","resolution":{"observed_at":"2026-05-22T12:01:30.464263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3720aac6-e726-4f60-872b-b0f670cbcce5","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:ae1cd9734dcdef86b2c5c5d65551026e562e0dc85efc73dfdb55345228c5de83","observation_id":"d1a99d92-04f5-4d2c-9b3a-35a31bb53c84","resolution":{"observed_at":"2026-05-22T12:01:30.468714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b848b86a-7499-492a-8479-b74217c8abc4","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:32614c654776e4adb41a25634224935c3dc36372cfd7fa9d22754269cc9ee187","observation_id":"a6a1e6d6-7c62-4b1c-af61-2385ef45eb89","resolution":{"observed_at":"2026-05-22T12:01:30.473046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b8353d68-b65d-4b9d-bfb7-c29dc97a0a30","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:350736110e6773d7361bf20dc0cd203dd545c1a231fa8fa06c23368799e0ef39","observation_id":"6ad0df5b-b7af-4395-bc14-40ea46564e2b","resolution":{"observed_at":"2026-05-22T12:01:30.423977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Work in progress","venue":null,"work_id":"2db0eeeb-245e-4976-9811-439990af1efe","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:bec901eca37644bbce849910c8576c691de2ed5495da012d86c8f6e62fc3dacf","observation_id":"11d51ca6-cd33-4dbe-aabc-c6416041f513","resolution":{"observed_at":"2026-05-22T12:01:30.442706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"40f81b51-1bdc-4163-9457-54a43d7ebbff","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:9cc99f065a9bdcbe63282e4fec799d6a9eebd730b83fd67b98768ec0a8fa9634","observation_id":"7b868b9c-ad6f-4a92-814b-7eda17de042e","resolution":{"observed_at":"2026-05-22T12:01:30.588813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7abe60c9-072f-498e-8ae6-81ff68fa37e6","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:c47946f8468152b5898e245eb212fc2b7fe872ae141a8684509dd3ac71640ae2","observation_id":"3d912a94-fbf6-4976-8d52-45cf1c31dac8","resolution":{"observed_at":"2026-05-22T12:01:30.551809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"288d1ca8-92f0-4670-8935-84757ba00382","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:916eae55c9127588bac57e729a2ed8f69ae7a04634e70127c8138bd8704e1c28","observation_id":"0755008a-9f1e-4ba5-af05-867ccaecc9cf","resolution":{"observed_at":"2026-05-22T12:01:30.481093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"40834d6b-78a5-4bca-9492-a7550459728e","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:d5ab29d4d08c533e877149105cda4af2c76c8c0d4b9cae6f7be937f2efd7ffa5","observation_id":"d1133dd3-d0b8-47da-be73-1901066ea030","resolution":{"observed_at":"2026-05-22T12:01:30.455160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"47087abb-77c7-4c1a-8e44-20d73a37971b","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:cbdd9029e8b6536e3a8a441ce2109a2b6c73c75e55cbf430c3a4efb6cdf3d627","observation_id":"c2e575c9-7e1c-435f-93a3-07308acb2638","resolution":{"observed_at":"2026-05-22T12:01:30.419425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"09cae9bf-3dd3-4016-974b-a762b454ff46","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:dd6f849385690249aae88bcc17b12bca2ff1a24ac675d05e8b6a8cd250175f58","observation_id":"80861e45-bbe0-452a-916d-f98466ac7c6a","resolution":{"observed_at":"2026-05-22T12:01:30.621072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a8cb5b8c-71e4-4e89-8dff-a248ca9c8962","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:e5702a93a51a9b1e0b4c78ae563b1dc16ed238dbaeb4392a683e364a299b7bbf","observation_id":"85d4b0dc-7712-4132-b908-a36932d6513d","resolution":{"observed_at":"2026-05-22T12:01:30.513710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3cf08360-a194-49d7-ab50-ccc4d8afa994","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:f2ce99d776e7380153dffeb7849f867653ed6582705cb8075a2d22aee8a646e6","observation_id":"8f6e73bd-d706-4538-9e6e-024e7649aab3","resolution":{"observed_at":"2026-05-22T12:01:30.644471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c1119472-9981-46da-9f05-5012c3be64a6","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:b683a03c93b732937427e6824329254234179189e179a800b323e3c73cad03c6","observation_id":"597765d3-9cd8-47e4-a94e-7c7a85ec4247","resolution":{"observed_at":"2026-05-22T12:01:30.564658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24f8423f-1131-4fd6-beab-84ec4073e899","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:59decccf14fefe2fd7d121d5f8920f9b50bbcce801243a2a8084e370d74ec5d0","observation_id":"5f4a0f27-a1a2-40c3-a9ca-bde9920c462c","resolution":{"observed_at":"2026-05-22T12:01:30.629146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ec34d498-4003-4201-8e3b-3bf65bc26848","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:6dc6ff1095dac5c4c57afe1bfec6c5cd9405469301fa17b0af70382781c21068","observation_id":"78864a52-add0-4905-adb7-470311c8592b","resolution":{"observed_at":"2026-05-22T12:01:30.446719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e8a0c4f9-1bf8-42ce-a75e-43c6991db33d","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:328a8718c60ef981fbfbc9ab10ed2f33b5b409ab6a327de3fcad8028c15a4e2b","observation_id":"625192d2-ddfd-4d56-897a-4a3dd4419e4d","resolution":{"observed_at":"2026-05-22T12:01:30.556051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"20e54e65-b888-4333-95ab-bce69cd47c48","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:d80fe10f9d1fe2b778d63db56e251009db7d7591f9871a2c32ee681b2f53db8e","observation_id":"f002e3ce-e26d-4a0a-934a-d8119f0cc4cb","resolution":{"observed_at":"2026-05-22T12:01:30.506307Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Work in progress","venue":null,"work_id":"449248d8-313d-4590-a4e3-7ab7e03ded3b","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:ac189335d5775bab96402f057b94f0df9c797a4329f51011369ed564444b6803","observation_id":"85315a87-db8a-4a13-89a0-5b58e5b0e5ff","resolution":{"observed_at":"2026-05-22T12:01:30.502590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b5467507-4163-448c-a655-ea98571f12f3","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:1bc0da61a6f179547f4e80c9f10c35da8a5c80e27938a771d62cdb7c5e0bd303","observation_id":"98f2ed2d-e522-4f56-ba39-070246e32c92","resolution":{"observed_at":"2026-05-22T12:01:30.640882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PART1: OVERALLEXPERIENCE& USABILITY","venue":null,"work_id":"a8a59812-1acc-4508-8233-6f2c8eb47829","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:6c2b1070e2e4fb45ba0b05a09da5c836297b30c82f7b6300c3c78f1fda5a7305","observation_id":"262eea90-67ba-41e8-8981-c97bc536a195","resolution":{"observed_at":"2026-05-22T12:01:30.625083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• The instructions in the README.md for each task were clear","venue":null,"work_id":"6dfeb7c0-e868-4819-bfa0-2645c03753e3","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:261010a52961af718751389cf69418385dbdbeebf31c81d27fdc10c7174432b0","observation_id":"bdeb3cba-9ca6-47c6-8496-e70934bf5739","resolution":{"observed_at":"2026-05-22T12:01:30.428592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HUMAN-AI)","venue":null,"work_id":"447c8fb0-c93f-4c3f-8dda-6f0e53a79fab","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:4cdfeed2030cb561b482069eeb807a462e602fb8e3ebcd7addcf6bcc62eeba35","observation_id":"c23d4e11-9ca1-44fc-89f7-ed6dcd618e31","resolution":{"observed_at":"2026-05-22T12:01:30.568757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"238d1736-f264-447a-b460-eb23725d9c91","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:d27f4dcf7a20e2b95f0ccb32b1a4dd47f64dfac0d7817dc48781fd08b27acdec","observation_id":"1ec19318-1ffc-4bab-afde-1d3d62bc1246","resolution":{"observed_at":"2026-05-22T12:01:30.509774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"219102c1-1827-47af-bcff-58492ed0b646","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:03eab880776a813655676296e95e0a678e6294115fcc48dfbfe314ec89f4344b","observation_id":"ad9c084a-5e3a-4ec4-9126-d68493765481","resolution":{"observed_at":"2026-05-22T12:01:30.660467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c4c969fc-29f6-48c0-b290-047cd8aa7f66","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:a93452b8cdf9983ed542ff3691eb8291df7aa47749502a9def815fc950c8e665","observation_id":"2010734f-6ab5-4e30-b86e-89c1e8a8db92","resolution":{"observed_at":"2026-05-22T12:01:30.534563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1e502196-eed1-4c58-93f1-6401cd9f9d73","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:8930020bc053a37535faeb84172d561864709fce218fd6a9fb011655afcdc091","observation_id":"9f7ab7e5-6aaa-40eb-ac71-6f2dceb8cb8e","resolution":{"observed_at":"2026-05-22T12:01:30.487027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• I felt the explanations from the AI assistant were reliable","venue":null,"work_id":"9a2393b5-be34-4ca4-9876-7430b02f66cf","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:f0989111595939f1906431a25b73ed9eb3f85d33e3ffd4f7799fddd532010408","observation_id":"cf6d87cc-a7b9-4682-914e-49d21b634b63","resolution":{"observed_at":"2026-05-22T12:01:30.577229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• My strategy for Human-Only tasks was affected by my experience in Human-AI tasks","venue":null,"work_id":"3f6b0dce-1ff1-4c8c-b5b6-87d67806d5d3","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:aed162bd21ba00eb310ef1f83d1ae7c016be128c95908147316af1ed2710890f","observation_id":"93e2285e-9232-4772-960e-ee25ab825dbe","resolution":{"observed_at":"2026-05-22T12:01:30.572880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"(Open-ended response) PART4: TASK& EVALUATIONFEEDBACK","venue":null,"work_id":"30f9eefe-0bb0-402d-8ba9-b2d5698f211a","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:a55d1fd76e2aa6597feb8129b53fbe0fb54a12f1f722d9a35e505f6ca1d7d028","observation_id":"03e2bd15-8519-4360-b64e-c5e3d3f49844","resolution":{"observed_at":"2026-05-22T12:01:30.543576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0fd3c971-ee3b-40b3-a1bc-a8be3614f7c5","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:57d832349840e60b90a5fc11bb875e1d14be9fbc128125fb996cde8aece832e5","observation_id":"1d80eecf-1d5b-464d-ad32-aaa2a4169288","resolution":{"observed_at":"2026-05-22T12:01:30.560374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"–TheEfficiency Metricsaccurately reflected my effort","venue":null,"work_id":"d04b6279-4a5c-4def-8c0d-a4c8678dafe1","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:58650816ac1763f39c5d135bf6e9d86cc4c520587162762bb00b4e85b13231e7","observation_id":"9075faa2-18aa-4624-bc38-8d547fb33627","resolution":{"observed_at":"2026-05-22T12:01:30.438152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"(Open-ended response) PART5: FINALOPEN-ENDEDFEEDBACK","venue":null,"work_id":"39e30350-55a0-44ed-bdf5-944e2da4c4c0","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:bfa1890901b848b13f6d431d62430e64d3643d33f04a1a34f0c4e9643c449e4d","observation_id":"02ff2597-53a8-4109-9163-e5f70709b9a0","resolution":{"observed_at":"2026-05-22T12:01:30.656703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"45d56238-fa29-4667-af8d-9e6bdd76e65a","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:0ba98068071cfa795b2b7da212c02d90ba88c57422d16f5b0103a895f9f8e2cb","observation_id":"02630a0d-0192-4211-b537-0bd21ff4f666","resolution":{"observed_at":"2026-05-22T12:01:30.490778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"836825a7-1735-4651-ad5d-b2057278b74b","year":null},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:ef549946c5d4b186f8a5d90b71777378a38a0a690e21ce30114330bd40975c3a","observation_id":"dd6d8615-92f4-45f9-953f-97868a50d7d4","resolution":{"observed_at":"2026-05-22T12:01:30.521502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Easy” tasks are nearly as low as those for “Hard","venue":null,"work_id":"8c2928db-9128-4205-8e20-1017db7b4fed","year":2010},"citing_paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T11:59:51.072166Z"},"links":{"citing_paper":"/paper/2512.04111"},"observation_digest":"sha256:3b7a7445779b17c5bc290ad1ef053b3bac0b5f96d3a2f08b9f4d85f508f8c586","observation_id":"071190c4-0439-48b0-aa69-de7043d3d1b2","resolution":{"observed_at":"2026-05-22T12:01:30.433477Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.04111","last_updated":"2026-05-21T16:22:06Z","latest_version":3,"primary_category":"cs.SE","snapshot_observed_at":"2026-07-06T22:37:41.555068Z","submitted_at":"2025-11-30T21:44:44Z","title":"CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 4 inbound Pith citation observations for arXiv:2512.04111."}