{"as_of":"2026-08-13T10:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:11824074f6b580a19bdb494ee031da7e5783ef611a11ade8d2149a5f87fd6837","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:29:51.438319Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.21580/citation-record","integrity":"/paper/2506.21580/integrity","json":"/paper/2506.21580/citation-record.json","paper":"/paper/2506.21580"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:00.532124Z","title":"Constitutional politics/constitutional law","venue":null,"work_id":"505bea63-6ead-4023-94e9-d5932391f1bb","year":1989},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.108987Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:6e9e7e0194c56787cf4ff28ef746fdb4b5202e0369132a4128ea63ef09ddc2e9","observation_id":"57d9105c-a7bb-42ed-a074-13114f9674ee","resolution":{"observed_at":"2026-08-07T00:30:00.611307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:00.341101Z","title":"Llama 3: Open research and development in large-scale language models","venue":null,"work_id":"b74e42a8-271b-4568-a362-51e099a92ee8","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.168101Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:b43a632f8a4a7c398a75f0609455cfa2855bda1fd5d8257a3c32e32bb815855e","observation_id":"46dc4dee-6c34-46b2-bfee-a04620bba793","resolution":{"observed_at":"2026-08-07T00:30:00.445021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:00.150215Z","title":"Mistral: Lightweight and e￿cient open-source language model","venue":null,"work_id":"1954030c-849f-49d0-ab18-84b6f4fcd341","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.317114Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:9a91de7a6687fa8e034ba3fa12e5f41af2aee92393715a2682629209f8179003","observation_id":"d648273a-a8d8-41b5-8503-209d4c652deb","resolution":{"observed_at":"2026-08-07T00:30:00.228820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:59.982827Z","title":"lii legal information institute","venue":null,"work_id":"1186faec-3216-4f11-9be6-9f4d0b491d3e","year":null},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.439330Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:91e9aa8c90635342abd8b5314db5968ac08e1be37bf2586c78322a3b29be0995","observation_id":"9bd7ff00-5259-4ca3-ae96-a8e6ab44baaa","resolution":{"observed_at":"2026-08-07T00:30:00.053064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:59.786205Z","title":"Evaluating irrationality in large language models and open research questions","venue":null,"work_id":"294a9ffa-0f06-471f-ba17-9816a95a4c3c","year":2024},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.553599Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:e8a736cde254c8644a0a335bbdeaef3c96f2490bbdc5f2a296967616c218c772","observation_id":"a2fe1c37-81bb-4791-9094-6d74fa6ed6d3","resolution":{"observed_at":"2026-08-07T00:29:59.873789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:59.525017Z","title":"Claude 2: An ai assistant with a focus on safety and reliability","venue":null,"work_id":"3a542e19-5b1c-4c97-8c8e-94ca6b5355bf","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.668129Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:8686f60ead75c318559a8acd36293e572713b3a2ca3b4736b5d3977126bcc849","observation_id":"0e2b3af9-ce70-479d-a84a-8187ea094bd2","resolution":{"observed_at":"2026-08-07T00:29:59.660251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:59.341789Z","title":"The impact of cognitive biases on professionals’ decision- making: A review","venue":null,"work_id":"ddb5711a-e556-4378-b0c7-dd01b11db1a6","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.806173Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:97e1bfe64c57a03305dda7f9b3c4896b23436d751e1e92a39ad1abdfa3eb1672","observation_id":"ac08b8c4-c741-44ce-ab6c-deb70fb0dcce","resolution":{"observed_at":"2026-08-07T00:29:59.433156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:59.119225Z","title":"Barbri Simulated MBE","venue":null,"work_id":"d7789200-2fc9-41bb-93b3-2b1816889cc2","year":2024},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.888034Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:6691f55baf168fd273f50d5045f3fa337625622b37d330d3173cdbef790d43cd","observation_id":"daf3cbd9-04c2-4dd1-9c52-983bfc155010","resolution":{"observed_at":"2026-08-07T00:29:59.207709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:58.866811Z","title":"Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell","venue":null,"work_id":"e900d12c-1d21-4d2f-8c9f-a92c2af38ec1","year":2021},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.938316Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:9607422840e111f033bac26d5f39e1183f1e8e1cbfc91b3ebc48d277f5e6934b","observation_id":"ee05d2dc-571c-4c8e-8594-6cddeeb90169","resolution":{"observed_at":"2026-08-07T00:29:58.982861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:58.677514Z","title":"Pearson correla- tion coe￿cient","venue":null,"work_id":"48f1438f-09a6-4aee-9b5b-693237dc5a30","year":2009},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:44.988190Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:cfd62f1a446436f419ae0c7c625072acc9a807a9e26259a933b83432185fee6a","observation_id":"c693aa03-b272-47c2-8000-88cf05937c73","resolution":{"observed_at":"2026-08-07T00:29:58.777857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:58.527741Z","title":"Using cognitive psychology to understand gpt-3","venue":null,"work_id":"1cdaf416-5424-420a-95d5-ae39403b22e0","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.038366Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:bd9a2f66a4ff0e80d61ed92a24bd76742cfcd5422f70106f0791ee0f346c2da0","observation_id":"c5aaeacf-3639-4847-a4b3-e0b71a3e39f5","resolution":{"observed_at":"2026-08-07T00:29:58.585000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T00:29:45.103419Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.103419Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:a5ef816650a70bf0a11bc116d40e04bc98df313d1260e32899450641f77b877c","observation_id":"f89373f3-9fe0-4bbf-8f2c-0a4b6556879b","resolution":{"observed_at":"2026-08-07T00:29:45.103419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:58.372013Z","title":"Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared Kaplan, Prafulla Dhariwal, and Dario Amodei","venue":null,"work_id":"8f7157f9-fdcf-47fd-887e-46e5fcf57669","year":1901},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.155352Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:1a7bd617df846010f6ef777f1c157903a15534c2eb643b52a53b43249c0370bc","observation_id":"d70365ff-27d7-496f-9dd1-ba875c8a93b7","resolution":{"observed_at":"2026-08-07T00:29:58.444766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-07T00:29:45.234588Z","title":"Sparks of arti￿cial general intelligence: Early experiments with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.234588Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:a9f2840ce411d25bc56414a42b3c83844118830651880ad8c5b7d78120e8ada9","observation_id":"96890647-9d15-44a3-b94a-d5819eb159ca","resolution":{"observed_at":"2026-08-07T00:29:45.234588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:58.226913Z","title":"Understanding the relationship between rationality and intelligence: a latent-variable approach","venue":null,"work_id":"d151db6f-468b-42d9-bfd9-36834a44b501","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.300715Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:5aad87ab77158122867285d92ce38b301b920f24abda141e81b4ccdffbf1c8d0","observation_id":"1f7e7e16-716f-4db1-9b95-994651f52a2b","resolution":{"observed_at":"2026-08-07T00:29:58.299586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-07T00:29:45.481302Z","title":"The Measure of Intelligence","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.481302Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:c8efd768c8380f36c1361599387c4e5d910037563d71af39edb5f4b1c1a30f51","observation_id":"d30c566a-07e8-4b6a-a884-dfa82c86a27c","resolution":{"observed_at":"2026-08-07T00:29:45.481302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:58.088685Z","title":"Better than rational: Evolutionary psychology and the invisible hand","venue":null,"work_id":"baf9e6eb-3547-4cb6-a941-14cb50ed5bde","year":1994},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.706879Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:ab73af2ccace82ed8012fd6b7676c4b07dc9f6e04da04696956820346181a985","observation_id":"c4f8ac64-fe89-46a7-a5cc-c8c78c119d87","resolution":{"observed_at":"2026-08-07T00:29:58.168969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:57.919344Z","title":"Lampinen, Stephanie C","venue":null,"work_id":"50cd3335-9876-4cd9-b9fa-e1ebb2954750","year":2024},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:45.880901Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:cb258077d472e8695e124a2012d23d33e3e132e7e55f36d693055b02a66e7002","observation_id":"e6200f81-cdcc-46b7-a754-60b66e01d77d","resolution":{"observed_at":"2026-08-07T00:29:58.000362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:57.744679Z","title":"Gemini 1: Advancing ai capabilities through competitive benchmarks","venue":null,"work_id":"760bd431-8a32-4d44-9f5e-08673c54aeb7","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.096716Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:412b9505b66a9ebf16366b49a41385257d4b2d76ed6ba23c1a310aac4addf44e","observation_id":"dae117c0-81a6-44de-a6dc-0f0379460ea5","resolution":{"observed_at":"2026-08-07T00:29:57.829782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-13T03:10:58.738032Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-07T00:29:46.198423Z","title":"Towards a rigorous science of interpretable machine learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.198423Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:747be2bfa88bdf579ae06fcf3e785ecbe1ad9359a9578015066719044aeaf5cb","observation_id":"fb91eb76-9630-4e48-8d4f-60bdd3aacda5","resolution":{"observed_at":"2026-08-07T00:29:46.198423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:57.536278Z","title":null,"venue":null,"work_id":"b999b9ed-8bcc-4afe-a0b2-286cc804e826","year":2008},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.317709Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:774da9e5f62db7fdc1a92934de73e57c02cd1171992d08d2d42a88a6ef4ddfdf","observation_id":"f5d612ed-73fd-4875-951b-ff3dd8326cce","resolution":{"observed_at":"2026-08-07T00:29:57.655257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:57.376179Z","title":"meaning","venue":null,"work_id":"7d2b0528-997e-49be-992e-e6aa37603b4b","year":1967},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.427185Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:3abb004d0619111c6a11bbf7f8a853fcbf3f125f6db9ae5648b46c5042a0d619","observation_id":"fdeb2c22-afcd-4c6f-9d7b-a27cfece3cf7","resolution":{"observed_at":"2026-08-07T00:29:57.446460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:57.133777Z","title":"Language models do hard arithmetic tasks easily and hardly do easy arithmetic tasks, 2024","venue":null,"work_id":"757f4c36-9732-4449-9fba-ea88af16ed73","year":2024},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.510272Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:9bc2637e9bdba7c5151f7158dfaa9b89deba7e935b688513f718343fe1452d75","observation_id":"598984d3-7686-4c61-b2fb-3bfcbfe31665","resolution":{"observed_at":"2026-08-07T00:29:57.254952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:56.980491Z","title":"Fast and frugal heuristics: The tools of bounded rationality","venue":null,"work_id":"5531aa7b-ad46-4d32-bcf1-7e299843dc1f","year":2004},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.602022Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:19d9afabf499e5f6ade1b4d03c8e368787f2e6a2755b1eb11c111eadf85cc419","observation_id":"3dbc5265-2636-446e-beba-4386990ddaaa","resolution":{"observed_at":"2026-08-07T00:29:57.063828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:46.690652Z","title":"A survey on large language models: Applications, challenges, limitations, and practical usage","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.690652Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:d035eb1623a96bfa2ef1a5fca6a1fb6fcd4bb5f74a28167cd18f49ed6d413f39","observation_id":"26f408cc-bdc5-48f8-886f-2139f9af38d1","resolution":{"observed_at":"2026-08-07T00:29:46.690652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:56.780036Z","title":"Machine psychology: Toward understanding ai cognitive processes through human-centric frameworks","venue":null,"work_id":"2d57e3c2-4f03-434a-82a8-900ad786cb15","year":2020},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.845135Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:20911def5b54571c103eba7dc735e2973864a289dc14fca1c1c3930906b3e2e6","observation_id":"b5701c44-7985-46ea-89e2-d1a96cd2cbf9","resolution":{"observed_at":"2026-08-07T00:29:56.880119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:56.553499Z","title":null,"venue":null,"work_id":"ec658d3c-f584-4fde-8a9d-c66a583a8090","year":2024},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:46.980612Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:76638a628bf6c67fc52074ee962c1d20095aed7f03d90549df39ea6d276de278","observation_id":"46c765b7-dae5-4ede-9c3b-e47671608b30","resolution":{"observed_at":"2026-08-07T00:29:56.665075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:56.339645Z","title":"Criminal Law & Procedure","venue":null,"work_id":"02c5adb4-aa2e-4a22-9e58-c0856c3e2a7b","year":2004},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:47.089708Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:37a6945f7715ee29606279f8aa7572f99cbc00c31d6562ed9eb9d8c9e0ad5b61","observation_id":"bac1a98f-c270-421a-82c7-f868bad9015f","resolution":{"observed_at":"2026-08-07T00:29:56.431881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:56.128933Z","title":"The weirdest people in the world? Behavioral and Brain Sciences , 33(2-3):61–83, 2010","venue":null,"work_id":"f88842b9-05e7-485a-958a-8895ebc439ca","year":2010},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:47.230581Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:aea56485d0c279329e27d66221553b585b989a94f18e05b15af74ff26e5cb0b7","observation_id":"5c45f825-cb6e-469a-92cd-0f128d6a0b23","resolution":{"observed_at":"2026-08-07T00:29:56.239436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:55.964939Z","title":"Real property and real property security: The well-being of the law, 1965","venue":null,"work_id":"5b4d6a44-89d8-4a6c-b5a7-8c4d80738258","year":1965},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:47.349811Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:a9685be4c33131818a019cada7a79d6e87d449d48b35f870c0bffb4e62e3158f","observation_id":"8eb211a4-1051-4bf3-9f98-89568f94979c","resolution":{"observed_at":"2026-08-07T00:29:56.030846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T00:29:47.597141Z","title":"Training compute- optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:47.597141Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:1ec2568d394ff6aa375d4e4f33e4b27b856793e51f4aeab5209c5d57267839d1","observation_id":"d3e64318-4bd2-4f01-9304-cd578e7f81c7","resolution":{"observed_at":"2026-08-07T00:29:47.597141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:55.769158Z","title":"Some observations on the law of evidence","venue":null,"work_id":"ecf18892-64fb-436e-89d6-3b9b076a510a","year":1928},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:47.730571Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:6eef73c17b11589e0a7d6f5454575be1941c56886d1582b0423563ef5a8b24fc","observation_id":"1a85633d-a487-4192-aead-6004d1ef190c","resolution":{"observed_at":"2026-08-07T00:29:55.866095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:55.591421Z","title":"Thinking, Fast and Slow","venue":null,"work_id":"82c5c234-4b76-49aa-a425-cb946d55de20","year":2011},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:47.896106Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:224cceede87e0c9d35258923f05e0a02aa5aff8628598ea32cfb20770a9f25c9","observation_id":"0fe3b683-1da6-418e-ba3a-aa0a28cbd666","resolution":{"observed_at":"2026-08-07T00:29:55.652586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:55.424470Z","title":"Judgment under uncertainty: Heuristics and biases","venue":null,"work_id":"fd500768-9ad7-4366-b0be-c1e29fd7fb0f","year":1982},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:47.992783Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:e0d10145310e7b416de0cf4963d96cdeb0a1073cfcb2ec79550d6f736d8f16d5","observation_id":"d40d1214-9723-413a-919e-1585a7cd3a2a","resolution":{"observed_at":"2026-08-07T00:29:55.488441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T00:29:48.093875Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.093875Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:2b5f4ac5717a56575e6af5fe56af6291607aefe56804f2602f63706f604c4c3b","observation_id":"4c6c1a86-ff50-4662-a9ca-046fecd22cf6","resolution":{"observed_at":"2026-08-07T00:29:48.093875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:55.290847Z","title":"Building machines that learn and think like people","venue":null,"work_id":"7c070f2b-a500-4bcf-b827-aa7e822432fd","year":2017},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.202019Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:301bc22dabdf9cd3bc7f8c46e1e8d691b41bc7de1ebeb9ac2d86f95a43d92ac6","observation_id":"d1ff1f33-e2eb-41ea-a59f-15a1a9d98ff4","resolution":{"observed_at":"2026-08-07T00:29:55.343830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-07T00:29:48.278185Z","title":"Holistic evaluation of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.278185Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:6db52d9f7f893bbe2b5d4fc01a36c81efbab2155cf6568eee7dec1a672abce7d","observation_id":"e4365fa1-c857-42c8-b687-24f496d5e057","resolution":{"observed_at":"2026-08-07T00:29:48.278185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:55.244695Z","title":"Cognitive psychology tasks to assess rationality in llms","venue":null,"work_id":"d3c5d051-918d-4111-a884-d1f6eebaef83","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.366079Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:7687ba12788b9d4d57c594d5c613838280992ea9cfcd1fb1586054e96dc62ed2","observation_id":"fa2d16df-e981-4a61-9e38-8c858453629e","resolution":{"observed_at":"2026-08-07T00:29:55.270542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:55.215000Z","title":"(ir) rationality and cognitive biases in large language models","venue":null,"work_id":"1a7258f1-659d-43c5-ab72-0a9dc02132ed","year":2024},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.477577Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:54e48209d08508a40959af3d2592f1d74ca4d30b19000ae61c320929bfd4b786","observation_id":"d09d88e9-577a-44d4-b3f0-ba695666c430","resolution":{"observed_at":"2026-08-07T00:29:55.227533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.09768","last_updated":"2020-10-05T12:03:19Z","snapshot_observed_at":"2026-08-06T18:58:11.089379Z","submitted_at":"2020-01-13T10:32:16Z","title":"Artificial Intelligence, Values and Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.09768","snapshot_observed_at":"2026-08-07T00:29:48.601997Z","title":"The Next Decade in AI: Four Steps Towards Robust Arti￿cial Intelligence","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.601997Z"},"links":{"cited_paper":"/paper/2001.09768","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:040462759c97286d6efc2f3c26b707007d18a6cd5530b3067ad5e28a4c1c73dd","observation_id":"92c748c1-4f34-42a0-b78b-701f9cd622a7","resolution":{"observed_at":"2026-08-07T00:29:48.601997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.992076Z","title":"Rebooting AI: Building Arti￿cial Intelligence We Can Trust","venue":null,"work_id":"c32540b6-eee2-4ad3-98ad-8bf8b380d8af","year":2022},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.733528Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:3c55879c6bd95654760855393be3e952305a612232168b1b439078d65d007008","observation_id":"8eb2a031-1ee4-483e-addf-69111a94fbbb","resolution":{"observed_at":"2026-08-07T00:29:55.106200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.878738Z","title":null,"venue":null,"work_id":"7a2b4153-1789-4933-9ca7-5a758dba7d34","year":2009},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.840818Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:b9c31c76a0d5c0d3c4dcb6742e49866e0ea46110da4ae4a03c2aaa812b452d16","observation_id":"b3e28750-08da-4256-8a01-54456f976594","resolution":{"observed_at":"2026-08-07T00:29:54.927808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-01T15:23:39.998892Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-08-07T00:29:48.928903Z","title":"Rethinking the role of demonstrations and memory in in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:48.928903Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:3d45d4ab7c5e5573639ca3eae735f5e263949dce1c4a0fa24e141af91af0273c","observation_id":"f7823acd-2c3c-4fee-b41f-4dd1d86b71a4","resolution":{"observed_at":"2026-08-07T00:29:48.928903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.759230Z","title":"Arti￿cial Intelligence: A Guide to Human-Level Thinking","venue":null,"work_id":"f9f2e502-99bf-4850-a663-c3312e991cef","year":2021},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.064248Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:68000c2d65a5ac677bf70fe511f34a8fdd5e8013ccc5e01bdcfb3fd0f5fb0015","observation_id":"a5a4d94c-74f8-4918-a1bb-73fef31b8cf0","resolution":{"observed_at":"2026-08-07T00:29:54.810709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.619376Z","title":"Measuring machine intelligence: A human-centric per- spective","venue":null,"work_id":"bdbc3b55-23a8-4df7-b92f-53b6b12ac10b","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.174379Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:54e1d2182b5a9d605f0d1219a101a287fc7ad36514ae4c5039fb1cd0c8975f1a","observation_id":"afd8184c-c549-4e77-b3f9-92424fe4a540","resolution":{"observed_at":"2026-08-07T00:29:54.691832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.495122Z","title":"Dual process theory of reasoning: Contemporary issues and developmental applications","venue":null,"work_id":"2488283e-b05a-4f55-a441-5bc964ec80bb","year":2020},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.264762Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:018c658a9ac94c76b8b658f603d616ca8a6f9faa6a1446a2bace316e483df91f","observation_id":"c3dbf75e-92e6-4166-816f-233c6dd0d1f9","resolution":{"observed_at":"2026-08-07T00:29:54.555288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.386845Z","title":"Con￿rmation bias: A ubiquitous phenomenon in many guises","venue":null,"work_id":"7ec317d0-2d8e-4a9c-b222-13e158668628","year":1998},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.344037Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:9a2c712df81dbb4006616004dbc9e1498946bab85b522ba16681988f5ebf7089","observation_id":"32fe6850-62a6-4387-8374-ed69174da737","resolution":{"observed_at":"2026-08-07T00:29:54.427120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.266189Z","title":"Culture and systems of thought: holistic versus analytic cognition","venue":null,"work_id":"c0d41075-592d-4174-a2c1-45f9f64db5e9","year":2001},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.441436Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:d1d17240576a8848077ca635a8ae4b88aefdddb8fcde4cf7385e1b8e7a670079","observation_id":"45e04515-c935-465c-9298-49ed5605a40d","resolution":{"observed_at":"2026-08-07T00:29:54.309865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:54.147105Z","title":"Bayesian Rationality: The Probabilistic Approach to Human Reasoning","venue":null,"work_id":"6331bcd0-59ab-4e59-a537-56ecf459cf64","year":2007},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.545920Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:83ba4f5a0a859f9b2196b523675cf7ae438a1175c27923cb6160413287a435df","observation_id":"55302f6a-81be-4a27-b1f4-4dfbb4598691","resolution":{"observed_at":"2026-08-07T00:29:54.210658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.997095Z","title":"Gpt-3.5: A compact and e￿cient language model for diverse applications","venue":null,"work_id":"a4612304-f897-4260-8498-12111abbe7ee","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.652025Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:6ad8ca7ab5a2bef92e56af06122a3259546037f8782668b4a64df1cb598c319a","observation_id":"04f0e0fa-956e-4efc-babd-78e310c932c8","resolution":{"observed_at":"2026-08-07T00:29:54.069858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.894110Z","title":"Gpt-4 technical report","venue":null,"work_id":"9c6e1e75-def2-4c54-a573-39adb0df0b6c","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.777842Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:19b2dce3a6e9ea2b612f5f8ef450e241e90e40e562c0c0a16b89505542cc260b","observation_id":"8ffde375-02ad-4876-9589-2d71c80fd38e","resolution":{"observed_at":"2026-08-07T00:29:53.942638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.787509Z","title":null,"venue":null,"work_id":"790052dd-e775-4e6f-9877-14f27f973b37","year":2017},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.878060Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:9eb1b4539d15e59d9f66a29759d20224c98496976eb5cef4de223ae94ecff2aa","observation_id":"eb920eed-a465-49b4-b0d4-5f68dec322f5","resolution":{"observed_at":"2026-08-07T00:29:53.835974Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.648023Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"ddecb336-2ec7-4e91-99d5-15613fdfe91b","year":2022},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:49.973562Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:ee512353890b2e4da4b254fe0aa01402a70b9f119a299d62469eae177628dc23","observation_id":"450d9f13-fa62-482f-9fe1-15ef63af5013","resolution":{"observed_at":"2026-08-07T00:29:53.699258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.502441Z","title":"Rational choice and the structure of the environment","venue":null,"work_id":"04c0025f-07a3-480e-bbc3-0fbde4ba45b7","year":1956},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.074661Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:0bf69f110003494af816ff3f28dc06f621ef51714ee5682e6e82d0a01fc893d7","observation_id":"910f6aa9-7632-4019-8e33-40f4898aebc9","resolution":{"observed_at":"2026-08-07T00:29:53.546970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.380712Z","title":"Models of bounded rationality: Empirically grounded economic reason, volume 3","venue":null,"work_id":"8f68aef5-d569-4091-b77c-1e96eb2d8ae4","year":1997},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.200627Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:0e1b0c55db1914375c653edae38e92e80083c598486ab38eb10b3490fef5e964","observation_id":"1a3bcb61-99c8-4e63-bd4b-e6d6413a4ba4","resolution":{"observed_at":"2026-08-07T00:29:53.435384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.232101Z","title":"Rationality and the Re￿ective Mind","venue":null,"work_id":"3872cb8e-8602-4799-9a70-79b91d3c84c4","year":2011},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.320201Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:76971aed31a10f2e31633110e67673c90fb8f09d93a54a6f3c39d896c74499d4","observation_id":"9eaf7e23-f76c-4942-ad8e-594bd3975b2d","resolution":{"observed_at":"2026-08-07T00:29:53.312868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:53.077123Z","title":"Stanovich and Richard F","venue":null,"work_id":"d5dfe05c-abf3-4fc6-8bd6-821b8737c6c0","year":2000},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.425361Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:8d1ecc2008498cf25f6eb99d8c020196dfcb8c4fe890ceb7eaf9533e5edc1e09","observation_id":"0d3756ff-38f3-4c04-a80b-1af1f55127ca","resolution":{"observed_at":"2026-08-07T00:29:53.142962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.934585Z","title":"The great rationality debate.Psychological Science, 13(1):94–99, 2002","venue":null,"work_id":"37c55570-21ea-4fe9-989e-4013b36dd9f0","year":2002},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.545440Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:243bd3ad118586fdc2a56d1cb7db53727188ec0daa6361fc9ab1b001fc77d2fa","observation_id":"f0fd36e5-2e5f-4ec5-8507-05840816cd00","resolution":{"observed_at":"2026-08-07T00:29:53.006655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.811019Z","title":"Ecological Ratio- nality: Intelligence in the World","venue":null,"work_id":"146a9948-f2c0-4eac-8274-bb84a7bbbc94","year":2012},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.665309Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:9fe641c94c0070cf5aa388e4f070ea3df27fa49894c8b3a92d65eb7e8f5b2259","observation_id":"72c040f2-e0a9-4a05-95a5-a8988b587cfc","resolution":{"observed_at":"2026-08-07T00:29:52.861792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.674875Z","title":"The psychological foundations of culture","venue":null,"work_id":"5b93c3a7-95b3-4f83-9c59-6ddb94fb86ae","year":1992},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.719404Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:0b37f3740cff0043f5890e73dd065f7ddbf20df7b623d04c537436939cf161a7","observation_id":"ab93ad0d-6860-4936-86df-ae9b082daa20","resolution":{"observed_at":"2026-08-07T00:29:52.756112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.544494Z","title":"Judgment under uncertainty: Heuristics and biases","venue":null,"work_id":"a34068f3-f20f-4e1a-9196-9f64da7ab905","year":1974},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.880285Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:e116cfc04f1503d3f57dce9029b50682961770dd5403913a028d7f38ddac0058","observation_id":"c136ec9b-7798-4ad1-b1af-85d4b1d8c922","resolution":{"observed_at":"2026-08-07T00:29:52.588887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.435020Z","title":"Extensional versus intuitive reasoning: The conjunction fallacy in probability judgment","venue":null,"work_id":"791c68a1-ab5e-4d33-87ff-fd8ad250961d","year":1983},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:50.975137Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:67a63568eae594ab6c4344ae7ff86d743ecb5b3aee77eed963c8c4e7962ad68c","observation_id":"882994d3-1343-46c1-beab-62b81cbcf618","resolution":{"observed_at":"2026-08-07T00:29:52.469863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.322764Z","title":null,"venue":null,"work_id":"228e68cf-d872-4f64-8023-26ea61fe8387","year":1968},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:51.051810Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:d862ee5247c67d6b450952042b0ff2db2169c725f4a38fff930e64c0c17262a8","observation_id":"51da76ff-cd10-4542-8fd3-1b12cac3d4e5","resolution":{"observed_at":"2026-08-07T00:29:52.376941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T00:29:51.147214Z","title":"Chi, Tatsunori Hashimoto, Oriol Vinyals, Percy Liang, Je￿ Dean, and William Fe- dus","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:51.147214Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:c27fe1e43a554392a978bfa38a42946752587546e98198807e57f76d79bb01b2","observation_id":"d4ff70e1-824f-4ea9-984a-5821bad161dc","resolution":{"observed_at":"2026-08-07T00:29:51.147214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.193146Z","title":"Latest version of chatgpt aces bar exam with score nearing 90th percentile","venue":null,"work_id":"86adf7a2-8f53-4fcb-b135-4738d7dc6b3b","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:51.223708Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:0e9e2e3f6fee2863789727bbe57de18f63b5bfa8cbad52b3d449e0336eb42622","observation_id":"fe1fae8e-414d-4fb4-a455-f7bbb589490e","resolution":{"observed_at":"2026-08-07T00:29:52.246836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:52.031985Z","title":"Ai in context: Task-speci￿c reasoning and role adaptation","venue":null,"work_id":"aff1f165-3f92-4f62-b311-609d21f574f4","year":2022},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:51.321046Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:21f7cd52c1dbc99eff872d9e9dfb0a4427b38bd850de61e242b97810c24fe5c4","observation_id":"9dfac648-fc75-4de5-9e0e-325755a60720","resolution":{"observed_at":"2026-08-07T00:29:52.102702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:51.888145Z","title":"Explanation by progressive disclosure: An ai-assisted decision- making framework","venue":null,"work_id":"c90a7d77-425b-499b-a2e8-e5829977828d","year":2021},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:51.390094Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:b595a01600f669f7cda319de102e3cc10d7b3d9474e4fd6c37b697f4da4874c9","observation_id":"ffbafe6b-7d02-4dcf-a8d2-d9efd32b092b","resolution":{"observed_at":"2026-08-07T00:29:51.964261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:29:51.725846Z","title":"Language models exhibit human-like biases: A study on an- choring and framing e￿ects","venue":null,"work_id":"942dac84-521a-410e-bea5-fff7b3807320","year":2023},"citing_paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T00:29:51.438319Z"},"links":{"citing_paper":"/paper/2506.21580"},"observation_digest":"sha256:f20321c1255c107e3d507dacad11e982c7b34a73cb3aa81f19aebe1f39172c86","observation_id":"6d811753-e940-44dc-ac31-015173e41e44","resolution":{"observed_at":"2026-08-07T00:29:51.795364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.21580","last_updated":"2025-06-16T21:20:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T09:17:01.818099Z","submitted_at":"2025-06-16T21:20:08Z","title":"From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":52},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2506.21580."}