{"as_of":"2026-08-09T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76e02cea8ddd1c5836a61e9f5b42ffc0cee1856285a7c1b62ac046f8806deb7f","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:39:34.850226Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04077/citation-record","integrity":"/paper/2608.04077/integrity","json":"/paper/2608.04077/citation-record.json","paper":"/paper/2608.04077"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-08T00:39:34.692929Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.692929Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:5985d9c48ef52a8591a8c65db2274b432dca2f3c8489cf8caf8fc66017e24254","observation_id":"0e0489e4-4def-4311-89a1-b690d341cb8c","resolution":{"observed_at":"2026-08-08T00:39:34.692929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.781738Z","title":"A.; and Terry, M","venue":null,"work_id":"1885107c-81d2-45ee-8643-69310ecfba2d","year":1952},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.697760Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:504710f7b94085d0c588ce90cff7875ed00da41cd2fe82f33e0b9b9d51c0398a","observation_id":"ff28b7f4-c0a7-4882-ad26-d0f5c327341b","resolution":{"observed_at":"2026-08-08T00:39:35.785146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15205","last_updated":"2023-10-25T05:56:13Z","snapshot_observed_at":"2026-08-08T06:50:25.334894Z","submitted_at":"2023-10-23T11:33:41Z","title":"DISC-FinLLM: A Chinese Financial Large Language Model based on Multiple Experts Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15205","snapshot_observed_at":"2026-08-08T00:39:34.701168Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.701168Z"},"links":{"cited_paper":"/paper/2310.15205","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:c904c7246d67f953d94b95a2f0b2d7447ca34767cfc10ba4c792aef5629824bc","observation_id":"e5fbf2a1-d75e-486b-8828-2b3768a59c10","resolution":{"observed_at":"2026-08-08T00:39:34.701168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.772501Z","title":"N.; Li, T.; Li, D.; Zhu, B.; Zhang, H.; Jordan, M","venue":null,"work_id":"15dd10e5-82d2-4c34-a895-c9fccc3b61cd","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.703990Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:3abe40ba52849efb31ae1edd4e1ab56158674b7da881da37a610d1e412a7cc05","observation_id":"292d2183-e124-4e8b-9926-67cdb67e7ef9","resolution":{"observed_at":"2026-08-08T00:39:35.775289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.764469Z","title":null,"venue":null,"work_id":"ee8c5108-c8d2-4f83-bd49-c5586d806db6","year":1960},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.706593Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:3a6bd2850f92d60484efc582e3fa219c7c57ed21ba932b5a434daacd096f368b","observation_id":"715481de-f1aa-4784-9716-0375167468ba","resolution":{"observed_at":"2026-08-08T00:39:35.767171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.00536","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.587337Z","title":null,"venue":null,"work_id":"8f9bda87-f94e-4360-9311-979fe300f3d0","year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.710181Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:ce96fb6b18dcb6a8237c50699c1e75f7f4ba9936f5866a3aa9dbcc3e1572e12d","observation_id":"205a2af6-4d1f-450b-a694-701186f1ceb7","resolution":{"observed_at":"2026-08-08T00:39:35.591321Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.756798Z","title":"E.; R \\'e , C.; Chilton, A.; Narayana, A.; Chohlas-Wood, A.; Peters, A.; Waldon, B.; Rockmore, D","venue":null,"work_id":"23d5a542-2a1e-4771-af5c-7b086ef364e8","year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.712947Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:38d2bad410e420738baf66d3b1f1d7c7353bed7275e70639c1f6d9d338f66396","observation_id":"9ef16854-2f69-480b-b599-fe7f05b64e5b","resolution":{"observed_at":"2026-08-08T00:39:35.759686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09975","last_updated":"2024-12-08T06:34:31Z","snapshot_observed_at":"2026-08-07T21:24:18.345623Z","submitted_at":"2023-08-19T10:38:00Z","title":"FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09975","snapshot_observed_at":"2026-08-08T00:39:34.715710Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.715710Z"},"links":{"cited_paper":"/paper/2308.09975","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:697b47e66c20b83f73b1f91f90d0caf97b5a3cabdfd214b6aff25b8e664e187f","observation_id":"3dcb4e1f-1932-4953-8c32-5dc31fcccc48","resolution":{"observed_at":"2026-08-08T00:39:34.715710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.719154Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.719154Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:9d6a858d0e199c84b060867807289984f5023df605576acb17fec94823a23510","observation_id":"9ad630f9-9cd5-44a8-a45f-06550b4afa92","resolution":{"observed_at":"2026-08-08T00:39:34.719154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11944","last_updated":"2023-11-20T17:28:02Z","snapshot_observed_at":"2026-07-06T16:50:06.095609Z","submitted_at":"2023-11-20T17:28:02Z","title":"FinanceBench: A New Benchmark for Financial Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11944","snapshot_observed_at":"2026-08-08T00:39:34.722411Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.722411Z"},"links":{"cited_paper":"/paper/2311.11944","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:2f20ebb709c303d1a8910864333fd551531067aaab1b63a2a6137f2248922a09","observation_id":"82722c69-3480-4d5e-89a3-fa737e5c1de5","resolution":{"observed_at":"2026-08-08T00:39:34.722411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.745506Z","title":"E.; Yang, J.; Wettig, A.; Yao, S.; Pei, K.; Press, O.; and Narasimhan, K","venue":null,"work_id":"271e60c4-9686-4c26-8d33-a44d3907ad21","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.725837Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:86caa4f8be6e092b9ff36e4247855f6fc039b3d29f055d4056309dc58098c4c4","observation_id":"43397b8a-7e53-494a-83ad-ebd2ccb9a496","resolution":{"observed_at":"2026-08-08T00:39:35.748658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13081","last_updated":"2020-09-28T05:07:51Z","snapshot_observed_at":"2026-08-06T03:17:52.286711Z","submitted_at":"2020-09-28T05:07:51Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13081","snapshot_observed_at":"2026-08-08T00:39:34.729453Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.729453Z"},"links":{"cited_paper":"/paper/2009.13081","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:760b0edc909ea320349415c6575acd6139ec4bdca5e27554d8da24a27bda749e","observation_id":"c3727f3e-79cd-4e4f-af44-ff5d5e9f5e04","resolution":{"observed_at":"2026-08-08T00:39:34.729453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.737456Z","title":null,"venue":null,"work_id":"016cb3c8-40e8-48d3-a87c-6b322e9546d7","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.733674Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:08aea604203831a34485ff78cea4edaf01caa2685953d516a4523da39337bc0e","observation_id":"37f84774-50fb-457a-b2b2-7dfaa74d9b33","resolution":{"observed_at":"2026-08-08T00:39:35.740711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-02T18:11:57.036767Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-08T00:39:34.737024Z","title":"Y.; Ramamurthy, R.; Sheng, Y.; Coste, T.; Nandwani, Y.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.737024Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:efcd81760fe3d3688b97c14ef9ec877edb71eb86a06be6075d80355d3ce268ca","observation_id":"fec3250d-6c14-44e8-aec2-606e17cdbf85","resolution":{"observed_at":"2026-08-08T00:39:34.737024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05812","last_updated":"2024-05-21T08:37:05Z","snapshot_observed_at":"2026-07-06T16:45:32.248661Z","submitted_at":"2023-11-10T01:12:03Z","title":"CFBenchmark: Chinese Financial Assistant Benchmark for Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05812","snapshot_observed_at":"2026-08-08T00:39:34.741055Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.741055Z"},"links":{"cited_paper":"/paper/2311.05812","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:65dfb2b0fa6e9693030151fcc96eb59895aada2e9c3f5e844933c4ad860cdd49","observation_id":"2dfb6c3b-3496-4058-a2d0-7fc9d6b18843","resolution":{"observed_at":"2026-08-08T00:39:34.741055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.745767Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.745767Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:825fe7cdc2ad571d490e2e8860e0788fd2977a665afca90335ad384db9158bc1","observation_id":"b91c7869-32d7-4f27-9cd2-585456c72a57","resolution":{"observed_at":"2026-08-08T00:39:34.745767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23454","last_updated":"2026-05-25T06:33:52Z","snapshot_observed_at":"2026-07-06T23:33:39.204744Z","submitted_at":"2026-05-22T10:09:28Z","title":"ARES: Automated Rubric Synthesis for Scalable LLM Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2605.23454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.23454","snapshot_observed_at":"2026-08-08T00:39:35.428414Z","title":"ARES: Automated Rubric Synthesis for Scalable LLM Reinforcement Learning","venue":"cs.CL","work_id":"07effbfa-f45c-4861-bea2-75c38cd10b05","year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.748768Z"},"links":{"cited_paper":"/paper/2605.23454","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:809bcdbd3852b1857d7393ab4fbe7b30e8ae9586f5787120cebe6b7466a991ad","observation_id":"680c13f9-7a68-4ed1-8936-1974e04d9c9c","resolution":{"observed_at":"2026-08-08T00:39:35.432825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.26329","last_updated":"2026-05-25T21:07:02Z","snapshot_observed_at":"2026-08-02T00:37:42.834250Z","submitted_at":"2026-05-25T21:07:02Z","title":"JobBench: Aligning Agent Work With Human Will","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.26329","snapshot_observed_at":"2026-08-08T00:39:34.752504Z","title":"W.; Ramasubramanian, B.; Niu, L.; Yue, X.; and Poovendran, R","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.752504Z"},"links":{"cited_paper":"/paper/2605.26329","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:936ad700d5f618690e4b9bc4482d6b966fec8df0942cb9a0890e014d42f2f4f5","observation_id":"41fee5ac-b157-482e-aa9a-8150980958ec","resolution":{"observed_at":"2026-08-08T00:39:34.752504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.730593Z","title":null,"venue":null,"work_id":"77dd1005-7996-44fd-af86-ec3bc8941d74","year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.756993Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:df4d0363f022838b0baa20886c222e8d1c3cab690ce8057903207f9e49ff8353","observation_id":"8eed73fb-c9a4-42e9-b4ce-fbf3a853ffdd","resolution":{"observed_at":"2026-08-08T00:39:35.733076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.721166Z","title":"Y.; Deng, Y.; Chandu, K.; Brahman, F.; Bhagavatula, C.; and Choi, Y","venue":null,"work_id":"b8d0590d-d128-4c49-9c85-60f53aed257a","year":2025},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.760575Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:6aed24f222b4c396ace952c560be622d75e15e48cad0d1aea64fd88cc94a2776","observation_id":"31e9824c-c8ef-4403-bb60-113d4d9226ec","resolution":{"observed_at":"2026-08-08T00:39:35.724302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.765278Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.765278Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:b5654072cdea7208fbdc6d4241d2d91aa2c0ae95d596db4b8832aad8556d6663","observation_id":"cf680bf0-6096-43d9-9e00-a943cae13ef3","resolution":{"observed_at":"2026-08-08T00:39:34.765278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.712431Z","title":null,"venue":null,"work_id":"54b0b2ad-ffad-47bd-9ed1-3ff7d2e52f8c","year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.768687Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:2b16cf55d46ddf24e9cade29e2c234dc284d5d557267acaa9a250689296c4338","observation_id":"b2ea64d1-7ae5-4b21-a539-d14d4e553fec","resolution":{"observed_at":"2026-08-08T00:39:35.716019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-08T00:39:34.772089Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.772089Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:55c2048ad0e992afbde87924e1f0b12ce8df9ee2b38cb2743a9bf24fb87317af","observation_id":"81cf1719-acc9-4d98-acbd-df68591dabf3","resolution":{"observed_at":"2026-08-08T00:39:34.772089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.703996Z","title":null,"venue":null,"work_id":"06a7a21f-a7c1-4d0d-b634-a81622438a21","year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.775217Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:d1ae102729d531e1f80c29181e384e1a147bfc174eb56a166652ba495c1edde2","observation_id":"bdd8ea85-1aa0-410a-9251-d3d142ddec80","resolution":{"observed_at":"2026-08-08T00:39:35.707601Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.12252","last_updated":"2026-07-15T01:47:03Z","snapshot_observed_at":"2026-08-08T16:09:21.570257Z","submitted_at":"2026-07-14T01:31:20Z","title":"FinResearchBench II: A Deep Research Benchmark with Consensus-Derived Gold Rubrics for Distinguishing Financial Report Quality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.12252","snapshot_observed_at":"2026-08-08T00:39:34.778096Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.778096Z"},"links":{"cited_paper":"/paper/2607.12252","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:d8169f58b9ef2e26eae0faf26c465d86d3887418a4f0fa31820dc8abcc68759b","observation_id":"9b3690fa-dd86-4197-a962-8c27a9431167","resolution":{"observed_at":"2026-08-08T00:39:34.778096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.696315Z","title":null,"venue":null,"work_id":"3c1d8d8f-a98c-4c13-893a-3d7aea194b71","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.782085Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:df21e2999afca1d81712edca4600eec93717a94d245eda9f616a0d73e9e012e1","observation_id":"c1246f93-9f84-41db-b992-c951877e8222","resolution":{"observed_at":"2026-08-08T00:39:35.699142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.689294Z","title":null,"venue":null,"work_id":"f5b25dad-9849-472e-9b89-1cc33c063603","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.784771Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:f12fec0e9c02dc1d1f5f8c321289d2d16c11a9db229815846ed3a7df3a8071cf","observation_id":"3038f6ce-47d4-42b2-8b90-f7921749749c","resolution":{"observed_at":"2026-08-08T00:39:35.691815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T00:39:34.787813Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.787813Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:c728779fc998c0207f1555806a32155bf4e178b7d3a3809774fc5ad7170ebfba","observation_id":"3d34ca5f-c1e0-454d-9ae9-f11d1ebe5fba","resolution":{"observed_at":"2026-08-08T00:39:34.787813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.680555Z","title":"L.; Mishkin, P.; Zhang, C.; Agarwal, S.; Slama, K.; Ray, A.; et al","venue":null,"work_id":"5771f065-aeae-49b3-a96f-df1b1ec976dd","year":2022},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.790805Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:bcd5f68e6a76bca63d40dd7f7cce6ea24d9c8f1ba5b8213eb05f8289f00edc21","observation_id":"555ecf1d-a730-4e56-91ba-934108541986","resolution":{"observed_at":"2026-08-08T00:39:35.683610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.04374","last_updated":"2025-10-05T21:36:43Z","snapshot_observed_at":"2026-07-06T22:31:44.964774Z","submitted_at":"2025-10-05T21:36:43Z","title":"GDPval: Evaluating AI Model Performance on Real-World Economically Valuable Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.04374","snapshot_observed_at":"2026-08-08T00:39:34.793186Z","title":"P.; Aljubeh, M.; Thacker, P.; Fauconnet, L.; Kim, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.793186Z"},"links":{"cited_paper":"/paper/2510.04374","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:8dd4e539e042d96896c22784c24ad25bcefdc4bd248593a89c24d9f3c7d8baa9","observation_id":"77965a63-7f2f-4934-883d-dbd1bbc416a3","resolution":{"observed_at":"2026-08-08T00:39:34.793186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.796664Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.796664Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:a5ff51410daff36d8a6ac41b95bd6b7bfa245d8a6c17ff584c9477e1e5b61b7a","observation_id":"2ba8720e-de77-441d-bc25-0bb5612bbbaa","resolution":{"observed_at":"2026-08-08T00:39:34.796664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.668941Z","title":"L.; Stickland, A","venue":null,"work_id":"bf0d60c6-cc29-40fd-b53b-e714b4f35c9b","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.799748Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:b1f5928824d490572b01cafc6b8fad20d603742066b417757f91808e76ca1d43","observation_id":"e1975965-a9ce-4382-af5d-568ceb3cc374","resolution":{"observed_at":"2026-08-08T00:39:35.671807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.659554Z","title":"S.; Chawla, K.; Eidnani, D.; Shah, A.; Du, W.; Chava, S.; Raman, N.; Smiley, C.; Chen, J.; and Yang, D","venue":null,"work_id":"8c034785-03a1-4e44-a0da-f53fba128c4d","year":2022},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.802371Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:31db2d5980fcfddbdf29aa980105f27ad321ca99b3c5765984b502c7236306ae","observation_id":"ef025533-8f6e-40f5-8f6d-d8f3d3a31e42","resolution":{"observed_at":"2026-08-08T00:39:35.662462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.805634Z","title":"F.; Qiu, X.; Whitehouse, C.; Alazraki, L.; Goel, S.; Barbieri, F.; Willi, T.; Mathur, A.; and Leontiadis, I","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.805634Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:daa5b5f552810844058126148e431694e071cec13ce236a00ecb880591bef3c7","observation_id":"18828a47-4c2e-4f53-b9fe-e21e2de1e0bf","resolution":{"observed_at":"2026-08-08T00:39:34.805634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-08T00:39:34.809274Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.809274Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:793f5c35484aade4b3def974062935951f2ae270b392a148279907cc7e3e374f","observation_id":"2d9b5fde-e5b8-4b90-a9de-e53d3588eb76","resolution":{"observed_at":"2026-08-08T00:39:34.809274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.812234Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.812234Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:62b58728249a2b3505ad063823906767920b717de1177f801daa896abbb943a9","observation_id":"eaf13a77-dd98-40bb-a2d9-b349356bf4b4","resolution":{"observed_at":"2026-08-08T00:39:34.812234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.649550Z","title":"R.; Zhang, S.; Sun, Y.; and Wang, W","venue":null,"work_id":"587f09f4-65dd-4d07-ae69-29a25b02c926","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.814612Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:6f29210704e8e052d41774d50e46012c571dbdb4cffdec8c44ec8cb9a6107705","observation_id":"c240abeb-97cf-457e-9f62-0faf239c4e3a","resolution":{"observed_at":"2026-08-08T00:39:35.652830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.641176Z","title":null,"venue":null,"work_id":"1568c26d-4b4a-4da3-b5fc-83975dac46c2","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.818031Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:645b3b89823d1e1183101c06c22dc7249a765d132f7fdba42b16d09dcc614fea","observation_id":"994903cb-0052-4517-bc69-44ce23c6314d","resolution":{"observed_at":"2026-08-08T00:39:35.644264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-08T00:39:34.821009Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.821009Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:eb1b36d2b41b11a36f74c1b76101bcebaa71d0244ccd64890a4ee11a8e629564","observation_id":"0fb0c3e0-5527-4f5f-9a73-0914d091ade0","resolution":{"observed_at":"2026-08-08T00:39:34.821009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.823780Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.823780Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:91b6c8e21a58d61ceaf1fed655f72d34eeb03d0f2bdbfbbb253cdfedcd360e4d","observation_id":"0694b070-9be6-4301-bf50-1b91f6d33db8","resolution":{"observed_at":"2026-08-08T00:39:34.823780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.634091Z","title":null,"venue":null,"work_id":"20bbea24-79df-4a06-9c81-4994c5e8f5fe","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.826266Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:9146d8a9590c5f2727887ffbb70d21855396a1a00d87acedfc4a1694fd42737f","observation_id":"29850e5e-9dfc-47d3-81c9-da242a46b030","resolution":{"observed_at":"2026-08-08T00:39:35.636713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.627017Z","title":null,"venue":null,"work_id":"6ff61711-c4d9-4968-a0e9-35da46bfeff3","year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.828757Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:2b652f04b4724a9144bca9dcfa6d6a6e59f8c2019f7005de7b9d7ed67e7945bb","observation_id":"520d8522-0943-466a-8dfe-a5182b9142b1","resolution":{"observed_at":"2026-08-08T00:39:35.629569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.618193Z","title":"J.; Cheng, Z.; Shin, D.; Lei, F.; et al","venue":null,"work_id":"dda824bb-677f-4b21-aa4e-d25e851cc380","year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.831495Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:52b9dd81eaa39a7e85e5ef8cf4aa7a330612bd26476871c1a0e543d72f15c651","observation_id":"96c4e350-66c7-4c5e-87f5-fc76ddad77ec","resolution":{"observed_at":"2026-08-08T00:39:35.621353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14161","last_updated":"2025-09-10T08:35:19Z","snapshot_observed_at":"2026-08-01T16:27:28.241667Z","submitted_at":"2024-12-18T18:55:40Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14161","snapshot_observed_at":"2026-08-08T00:39:34.834018Z","title":"F.; Li, Y.; Zhu, B.; Bisk, Y.; and Neubig, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.834018Z"},"links":{"cited_paper":"/paper/2412.14161","citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:792830cb74290a68bb5aeb05a28f935e0c638f3525ae69b26a875f3742dbb794","observation_id":"2bbe066f-1684-466d-9b35-57fe113b1f3b","resolution":{"observed_at":"2026-08-08T00:39:34.834018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.836759Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.836759Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:8a2b1050b14e09c07ba1ce19268aa8b91f05a83a7b49518f0999124b9323770c","observation_id":"5614d325-e0e8-413b-bb38-f520a481b47b","resolution":{"observed_at":"2026-08-08T00:39:34.836759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.839268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.839268Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:357cbfbd0bf62fdbfece46a09d356ab062cf881d5374236e69e80e0ec5fdcc3e","observation_id":"55fabdb5-d135-4096-96fd-b7aa4720107c","resolution":{"observed_at":"2026-08-08T00:39:34.839268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.841766Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.841766Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:5838bb92f6b56f711f47c04ac5c9af5ef36eca6799afa266bdcb51738b5d050e","observation_id":"2729b7a3-2b0c-43b9-9a03-93ffc16555c0","resolution":{"observed_at":"2026-08-08T00:39:34.841766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:35.610579Z","title":"P.; Zhang, H.; Gonzalez, J","venue":null,"work_id":"ff5c39a9-5576-4637-b347-a6fecc2e0587","year":2023},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.844682Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:6130aae66a29c99adcc9715d1c690604eaca1fed85fd12a4db46c849309ff14c","observation_id":"5d682386-6df6-4e0c-9e19-d3180f0d3798","resolution":{"observed_at":"2026-08-08T00:39:35.613211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.11685","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.936841Z","title":null,"venue":null,"work_id":"a3e9c916-b297-419c-9677-51fb87a6e2c5","year":2026},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.847515Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:ed1873a328db0939d9c98c67e6e85214366edd3cad3ae063aa4397688762d260","observation_id":"2351c981-e091-4280-9b88-18fdaca87113","resolution":{"observed_at":"2026-08-08T00:39:34.942147Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:39:34.850226Z","title":"F.; Zhu, H.; Zhou, X.; Lo, R.; Sridhar, A.; Cheng, X.; Ou, T.; Bisk, Y.; Fried, D.; Alon, U.; and Neubig, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T00:39:34.850226Z"},"links":{"citing_paper":"/paper/2608.04077"},"observation_digest":"sha256:7586e602bdbda5f4497bae41e7c83ce4de8bc670af2fd561e05e0f27298a3195","observation_id":"323f78cf-7f11-45ea-8cd1-d91a038ad57a","resolution":{"observed_at":"2026-08-08T00:39:34.850226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04077","last_updated":"2026-08-04T18:00:00Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T23:10:58.133136Z","submitted_at":"2026-08-04T18:00:00Z","title":"FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":3,"verified_fuzzy":11},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2608.04077."}