{"as_of":"2026-08-05T13:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e247807d73523c104005458f827ad2f1d199a22fb822fc7985d142ffe96ca9b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:28:47.303456Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T18:51:18.126997Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2406.13352","last_updated":"2024-11-24T22:04:23Z","snapshot_observed_at":"2026-07-06T18:33:32.806635Z","submitted_at":"2024-06-19T08:55:56Z","title":"AgentDojo: A Dynamic Environment to Evaluate Prompt Injection Attacks and Defenses for LLM Agents","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T06:35:13.331872Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2406.13352"},"observation_digest":"sha256:21cedd2a04c54a8df9952ce3f053593647cd4951505f991eee85fe65fe0ea7b8","observation_id":"8ed30a97-a648-4d9a-b493-5215ca33d997","resolution":{"observed_at":"2026-05-13T06:35:13.477819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-21T07:24:12.845841Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2503.11926"},"observation_digest":"sha256:d15cd09e9848dcf07e026afd3c151befe24e10a0c67f7f32ddfb71519645a555","observation_id":"7a7409d8-78fb-465c-a08a-030eafdd4c16","resolution":{"observed_at":"2026-05-21T07:24:13.032084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-08-04T09:16:40.238706Z","title":"un- faithfulness","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.16380","last_updated":"2026-06-10T21:26:48Z","snapshot_observed_at":"2026-08-04T09:16:38.686000Z","submitted_at":"2025-10-18T07:34:31Z","title":"MoReBench: Evaluating Procedural and Pluralistic Moral Reasoning in Language Models, More than Outcomes","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T09:16:40.238706Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2510.16380"},"observation_digest":"sha256:cdaa9bc9fbfe7a44a680974c5731d75ef78964a9bdfc5849d620cfd31aa2e53f","observation_id":"e118af3c-f90f-4c3e-8708-0e9d9d41a799","resolution":{"observed_at":"2026-08-04T09:16:40.238706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2512.14917","last_updated":"2026-04-23T22:42:11Z","snapshot_observed_at":"2026-07-31T07:00:51.587326Z","submitted_at":"2025-12-16T21:12:53Z","title":"Evaluating Code Reasoning Abilities of Large Language Models Under Real-World Settings","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T21:23:44.762007Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2512.14917"},"observation_digest":"sha256:51efeda627eef96d2cbe0a2da301f5afef585db83626d0b1cfa7d354cb83a12a","observation_id":"3cdbfb9a-6550-4619-ab3c-e460597eccd6","resolution":{"observed_at":"2026-05-16T21:28:34.185656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2605.02285","last_updated":"2026-05-04T07:19:48Z","snapshot_observed_at":"2026-08-02T21:49:54.214629Z","submitted_at":"2026-05-04T07:19:48Z","title":"Complexity Horizons of Compressed Models in Analog Circuit Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T16:37:05.972866Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2605.02285"},"observation_digest":"sha256:e934fb7c93b92c9ceb633960c859324a9caca02d819e9737d93a4b624359bef8","observation_id":"d9887284-e5bd-42de-8a56-1dc3992d6388","resolution":{"observed_at":"2026-05-11T16:26:10.413487Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2605.09678","last_updated":"2026-05-10T17:55:38Z","snapshot_observed_at":"2026-07-06T23:21:44.900680Z","submitted_at":"2026-05-10T17:55:38Z","title":"Absurd World: A Simple Yet Powerful Method to Absurdify the Real-world for Probing LLM Reasoning Capabilities","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T02:02:06.788056Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2605.09678"},"observation_digest":"sha256:ec83e10cb5c2a39f1756c95aceb51a46de5039415c9a1ea0ae86095ad3b392f0","observation_id":"81f35394-32d5-44e0-9558-e39a8e346078","resolution":{"observed_at":"2026-05-12T07:46:26.123113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2605.13825","last_updated":"2026-05-13T17:50:27Z","snapshot_observed_at":"2026-07-06T23:25:21.032938Z","submitted_at":"2026-05-13T17:50:27Z","title":"History Anchors: How Prior Behavior Steers LLM Decisions Toward Unsafe Actions","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-14T17:53:08.128110Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2605.13825"},"observation_digest":"sha256:b8f5f07cee2f641fbde8e24b1a543aba38563516d1ab3ebc61242840e10b916d","observation_id":"cc9d31cb-c5e8-4bc1-b320-521a5899b68d","resolution":{"observed_at":"2026-05-14T17:57:33.653876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2605.31031","last_updated":"2026-05-29T09:03:30Z","snapshot_observed_at":"2026-07-06T23:40:12.939143Z","submitted_at":"2026-05-29T09:03:30Z","title":"GraphARC: A Comprehensive Benchmark for Graph-Based Abstract Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T22:39:04.557903Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2605.31031"},"observation_digest":"sha256:8c9d46ac7abc8563dd556c2a9c7233eecb8e25306d6d8a06b88c422dd63c7c0b","observation_id":"722c0ed2-3983-484c-8307-d99a164d6d25","resolution":{"observed_at":"2026-06-28T22:42:46.635573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.01923","last_updated":"2026-06-01T08:57:51Z","snapshot_observed_at":"2026-08-01T18:25:17.354139Z","submitted_at":"2026-06-01T08:57:51Z","title":"Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:00.523125Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.01923"},"observation_digest":"sha256:8992a72de71e027750e43ad569173d76fbcdadab4b4808384d88ae0a8f94d803","observation_id":"285602ae-c361-4927-8a19-b4be547df4b2","resolution":{"observed_at":"2026-07-01T23:26:21.635105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.04010","last_updated":"2026-05-29T23:57:21Z","snapshot_observed_at":"2026-07-06T23:44:09.692359Z","submitted_at":"2026-05-29T23:57:21Z","title":"The Variance Brain Foundation Models Forgot: Third-Order Statistics Predict Cognition Where Billion-Parameter Models Fail","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T19:07:34.240009Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.04010"},"observation_digest":"sha256:dfa3504da7f3336b1a73b00dbeab8439f9bad6b6d5bad6f2b3393947e6eea2d2","observation_id":"4ea3e0dd-15ba-4319-8d8e-fb0524bc0f33","resolution":{"observed_at":"2026-06-28T19:12:34.916457Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.04421","last_updated":"2026-06-06T03:16:02Z","snapshot_observed_at":"2026-08-02T07:33:07.595707Z","submitted_at":"2026-06-03T04:06:20Z","title":"Trivium: Temporal Regret as a First-Class Objective for Causal-Memory Controllers","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-28T06:36:29.222547Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.04421"},"observation_digest":"sha256:cd3bd58064491e0fb6618caba23c8eeba7fa949ac09c61d3d25b2f069a3c86b9","observation_id":"9e846436-773d-4e02-8d6e-4d1f41169cdc","resolution":{"observed_at":"2026-07-02T07:56:46.962340Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.05183","last_updated":"2026-04-19T01:26:18Z","snapshot_observed_at":"2026-08-02T20:03:42.880817Z","submitted_at":"2026-04-19T01:26:18Z","title":"The Granularity Gap: A Multi-Dimensional Longitudinal Audit of Sycophancy in Gemini Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-05T18:43:10.949515Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.05183"},"observation_digest":"sha256:124dc249e177763ef5aed0202115b344fa9682861e431d4e9ac0e99c38102186","observation_id":"e7789daa-1c20-42c6-973f-e77661ecd46c","resolution":{"observed_at":"2026-07-05T18:51:18.129206Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.05497","last_updated":"2026-06-03T22:41:11Z","snapshot_observed_at":"2026-08-04T13:44:30.423961Z","submitted_at":"2026-06-03T22:41:11Z","title":"LEVANTE-bench: Multi-Scale Comparison of VLMs to Children Using Cognitive Tasks (or, \"Is Your VLM Smarter Than a 5th Grader?\")","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T06:39:08.246174Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.05497"},"observation_digest":"sha256:4535afbe497960a61edc1b9d5a71dd9b711c4cb1e759ceea0009f53036960f39","observation_id":"5f684e49-b9bc-4789-b72e-862839dbc61a","resolution":{"observed_at":"2026-07-02T07:46:46.455279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.13262","last_updated":"2026-06-11T12:17:18Z","snapshot_observed_at":"2026-08-04T22:05:12.318613Z","submitted_at":"2026-06-11T12:17:18Z","title":"From Verdict to Process: Agentic Reinforcement Learning for Multi-Stage Fact Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T06:47:09.681690Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.13262"},"observation_digest":"sha256:214016308864c5011a2766837c03047ea190631e394b6e3baeb512c8add14dc1","observation_id":"73950eb4-b306-43a1-829c-e24b58f8457f","resolution":{"observed_at":"2026-07-03T14:58:33.400385Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-02T10:16:34.720247Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-25T20:58:53.119386Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:b1097a7576fcb95e0e69fdb83eac0be7d6ee8381c44e79779715b7ae32f902ee","observation_id":"951592dc-74d9-4a91-8109-72cfe45d5af7","resolution":{"observed_at":"2026-07-04T19:50:11.027188Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-08-02T10:16:44.591107Z","title":"arXiv preprint arXiv:2306.09479 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-02T10:16:34.720247Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-02T10:16:44.591107Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:527cba29a0a88b24070eb12064d1f33a4bbb6b58ff20a9a4990c1fe02e2220bd","observation_id":"4f328d89-fadd-4e69-9177-df7dd0ca40be","resolution":{"observed_at":"2026-08-02T10:16:44.591107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":"2306.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-07-05T18:51:18.126997Z","title":"Inverse scaling: When bigger isn’t better","venue":"cs.CL","work_id":"1c008e29-d0ea-4a25-9792-4d3a8eb7d7b4","year":2023},"citing_paper":{"arxiv_id":"2606.29424","last_updated":"2026-06-28T14:39:06Z","snapshot_observed_at":"2026-08-02T07:55:28.979451Z","submitted_at":"2026-06-28T14:39:06Z","title":"EntroRouter: Learning Efficient Model Routing via Entropy Regulation","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-30T07:42:35.962864Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2606.29424"},"observation_digest":"sha256:423db6d75f24d404ee2907dbdd1e825e358993ec41c8e80aaa75778cf986ec55","observation_id":"c1efe193-7930-406e-886c-22de33ccdf41","resolution":{"observed_at":"2026-06-30T07:44:21.602491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-08-01T14:50:59.137848Z","title":"Iman Mirzadeh, Keivan Alizadeh, Hooman Shahrokhi, Oncel Tuzel, Samy Bengio, and Mehrdad Farajtabar","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18642","last_updated":"2026-07-21T02:23:22Z","snapshot_observed_at":"2026-08-05T00:33:06.675723Z","submitted_at":"2026-07-21T02:23:22Z","title":"Spaghetti Architect: A Contamination-Resistant, By-Construction-Labelled, Multi-Language Code Dataset Generator","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:50:59.137848Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2607.18642"},"observation_digest":"sha256:aff5c3d62d2b4b2f51391d1840cf3316a531d77f4d99af688e871c1846642ff9","observation_id":"ab677952-96c7-4650-9ac1-aa5ff5369776","resolution":{"observed_at":"2026-08-01T14:50:59.137848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09479","snapshot_observed_at":"2026-08-05T04:28:47.303456Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02639","last_updated":"2026-07-31T10:58:29Z","snapshot_observed_at":"2026-08-05T12:39:21.001847Z","submitted_at":"2026-07-31T10:58:29Z","title":"Instruction Stacking Collapse: A Benchmark and the Capability-Dependent Value of Prompt Compilation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T04:28:47.303456Z"},"links":{"cited_paper":"/paper/2306.09479","citing_paper":"/paper/2608.02639"},"observation_digest":"sha256:88c923a0a2011c4e154c5f993405bb42440ddabde397756bea545635897c9ed5","observation_id":"7bb0ed5f-2ac5-4089-be19-0124e4760598","resolution":{"observed_at":"2026-08-05T04:28:47.303456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.09479/citation-record","integrity":"/paper/2306.09479/integrity","json":"/paper/2306.09479/citation-record.json","paper":"/paper/2306.09479"},"outbound":[],"paper":{"arxiv_id":"2306.09479","last_updated":"2024-05-13T01:25:12Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T07:23:04.207005Z","submitted_at":"2023-06-15T20:11:23Z","title":"Inverse Scaling: When Bigger Isn't Better"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2306.09479."}