{"as_of":"2026-08-15T21:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f0ac7b07a8d28add1ed0e1de98766da0c2ffa432b27f610b4435fd93c5d317c","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T11:33:01.976659Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.15151/citation-record","integrity":"/paper/2604.15151/integrity","json":"/paper/2604.15151/citation-record.json","paper":"/paper/2604.15151"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swe-rebench: An automated pipeline for task collection and decontaminated evaluation of software engineering agents","venue":null,"work_id":"60e91a5e-d046-4bfb-8cc1-32d6f13e29ac","year":2025},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:ffa66c67a1aff1f20b1cdf7b65782f4058939a005573332e7af29d8d3c94c122","observation_id":"8181e67f-9347-4597-b35a-d129c10f78b5","resolution":{"observed_at":"2026-05-19T13:57:20.537514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finance agent benchmark: Benchmarking llms on real-world financial research tasks","venue":null,"work_id":"63c47b95-9cf3-4426-be2c-106085c322be","year":2025},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:664a70952111227818169fa7e1b5a16a7d122b26f4cecde1a33c498194b81131","observation_id":"4ab29d60-07a5-41fa-aa95-909960570f32","resolution":{"observed_at":"2026-05-19T13:57:20.554355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finagentbench: A benchmark dataset for agentic retrieval in financial question answering","venue":null,"work_id":"cfa90036-22c8-4420-bdbf-347b3d390524","year":2025},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:c4a28e1a0f4458b5dff59fe204bff803f63395bd5d65505c28ffd7ea2249ea61","observation_id":"25f60a6f-3b31-48c0-a180-26c333628c2f","resolution":{"observed_at":"2026-05-19T13:57:20.552522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on LLM-as-a-judge","venue":null,"work_id":"66a0f671-6253-4e7d-a8cd-2e350143b42f","year":2024},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:2eb10832be0e003b50ff8e0f2cfdbbb967f51876ab6f1d086eedc629474b1348","observation_id":"86be3f85-8a6d-4388-ab8f-2e829b0d2b77","resolution":{"observed_at":"2026-05-19T13:57:20.539304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Financebench: A new benchmark for financial question answering","venue":null,"work_id":"20c29553-f0af-4d00-b40a-af5e770f4f1f","year":2023},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:a5ad44980248ff5326bc60123acec06d54add151e16cfec9c39bb3262a9f6aad","observation_id":"14b8ba2f-89ec-4aa6-927f-2421ff4d4c18","resolution":{"observed_at":"2026-05-19T13:57:20.546659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Livecodebench: Holistic and contamination-free evaluation of large language models for code","venue":null,"work_id":"41e72107-9af5-49f6-a942-9c052597f077","year":2024},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:783f63c518c2b57dacf78931a7244f44f77e03531cbff6c6f19921d6dec7d254","observation_id":"64d87908-f55b-4baa-827d-b2a16de76415","resolution":{"observed_at":"2026-05-19T13:57:20.543176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jimenez et al","venue":null,"work_id":"f04ba86d-66ee-4ca4-9426-d1e785aa755e","year":2023},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:963f4a41dc7d694a3b1abc6fece4e61061c0bee1761e61d9dffb006408f1c5bc","observation_id":"c30faa27-8454-47e4-bc8c-a4b5b2ef43ce","resolution":{"observed_at":"2026-05-19T13:57:20.544835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fin-r1: A large language model for financial reasoning through reinforce- ment learning","venue":null,"work_id":"dae3c944-0cf3-4501-af68-3cec475fc95e","year":2025},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:d912fb03d88accfe6982c981a06c37b4e477035af12f92194e9dc34620fed262","observation_id":"dd4d40bd-a8a7-4b4d-a4e4-bde5a3be2cc3","resolution":{"observed_at":"2026-05-19T13:57:20.531578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Merrill et al","venue":null,"work_id":"d0090b9e-f0d2-466e-847b-430783909f0a","year":2026},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:3433c436ea29335272a53d894656577219702e9c41e3bed24649032509cf5158","observation_id":"0952186a-4f5e-4760-9a0f-70ab78a52170","resolution":{"observed_at":"2026-05-19T13:57:20.550300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fino1: On the transferability of reasoning-enhanced llms and reinforce- ment learning to finance","venue":null,"work_id":"f1965cf6-6548-41d4-b71e-9b79b243bc05","year":2025},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:7c5de8522023585cf3eac58d9cb651300debf2c89913a82309dddcc1be6508d1","observation_id":"24fe33f5-1339-41f2-ae36-ab3c58a749a3","resolution":{"observed_at":"2026-05-19T13:57:20.548595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantconnect LEAN documentation.https://www.quantconnect.com/d ocs/","venue":null,"work_id":"8c33aab3-342e-4948-b8ca-18652b8c73a2","year":2026},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:7a9a2d16acbc88b346349fd916f2732e2e1c0965ff9896f217242f15fc3a269e","observation_id":"728a2838-8fdc-48fe-a1a0-9c31077527f7","resolution":{"observed_at":"2026-05-19T13:57:20.529753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Backtrader.https://www.backtrader.com/","venue":null,"work_id":"503acd8b-b4e2-48ac-b4ba-81b114d2a15d","year":2015},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:07d2281d0523694b2aede3dbb7c49ce4c9e125506d45c9870af7b7c492980ced","observation_id":"f339ff9c-b37a-4436-b75e-f6ff630f7060","resolution":{"observed_at":"2026-05-19T13:57:20.535562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixiu: A large language model, instruction data and evaluation benchmark for finance","venue":null,"work_id":"4a6489c3-06e9-46b6-bad2-0ff2abf5e1d9","year":2023},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:cb60aac5e895d871aafa4f2e9bc5f11a49e62e90426c29262b320fc603d001dc","observation_id":"61928b12-eb9b-4b77-a98a-a805cc371ff4","resolution":{"observed_at":"2026-05-19T13:57:20.525814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finben: A holistic financial benchmark for large language models","venue":null,"work_id":"25283508-e129-4d18-b93c-2d6a23ab5279","year":2024},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:3b1b86649c676faeecb167512ab2175c3dd824661cafed96fe4ae541f84736c9","observation_id":"ef8317c5-7366-4cab-aae9-7b2eb45623e4","resolution":{"observed_at":"2026-05-19T13:57:20.527871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Judging LLM-as-a-judge with MT-bench and chatbot arena","venue":null,"work_id":"e4097dd1-3cca-4d60-8f15-91b9487bea1f","year":2023},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:b280b5aa176f0817f9113e7ddc62a5867bd18db9c630616202253ee38a1acd72","observation_id":"27f132f8-556c-4b64-ba77-b90ab4dbbd61","resolution":{"observed_at":"2026-05-19T13:57:20.541322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zipline documentation.https://zipline.ml4trading.io/","venue":null,"work_id":"483cac72-8b79-4da5-a720-402dd5555a52","year":2026},"citing_paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T11:33:01.976659Z"},"links":{"citing_paper":"/paper/2604.15151"},"observation_digest":"sha256:3266a43a735f1f17e48bdb2db55dd9fbb322e86dd6d925707cf97a1a10b87960","observation_id":"668f6e72-613c-4219-9e63-4492b823d1ef","resolution":{"observed_at":"2026-05-19T13:57:20.533601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.15151","last_updated":"2026-04-16T15:31:42Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:31:42Z","title":"QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2604.15151."}