{"as_of":"2026-08-04T06:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b70b33d71c390bfbef3496ae1ced10ad2694d0520f229615ac1a73daef0476ab","coverage":[{"denominator":129,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T12:11:16.326752Z","state":"measured"},{"denominator":200,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":200,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":474,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T00:37:51.312622Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-04T05:22:10.290511Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"reference_index":142,"source":"pdf_text","source_observed_at":"2026-05-10T22:46:39.268353Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2303.18223"},"observation_digest":"sha256:68e16d70c0b53160c0a8978421f43c235642e4c02d3ef5efd3dd9c8450be69a0","observation_id":"1e244709-815a-4d1f-8481-8b604cab05a1","resolution":{"observed_at":"2026-05-10T22:46:40.648135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2402.06922","last_updated":"2026-04-21T14:06:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-10T11:07:24Z","title":"Whispers in the Machine: Confidentiality in Agentic Systems","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-24T03:59:03.972043Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2402.06922"},"observation_digest":"sha256:eb730ac632f67912557c339166d626dfc5befc4c4cba04ed7d917dc9b79f4c79","observation_id":"32ff83e4-f78f-4e18-b19d-c9980754225b","resolution":{"observed_at":"2026-05-24T04:03:53.838129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2405.02079","last_updated":"2025-04-18T11:20:24Z","snapshot_observed_at":"2026-08-03T06:11:43.529044Z","submitted_at":"2024-05-03T13:12:28Z","title":"Argumentative Large Language Models for Explainable and Contestable Claim Verification","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-24T01:17:26.111194Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2405.02079"},"observation_digest":"sha256:05c53a26afd5e123f4e05101fd3bfd20c0327e399bfbac7794c0601210c19935","observation_id":"2a6127cd-66ca-4201-ae5b-b5735270d8ec","resolution":{"observed_at":"2026-05-24T01:18:42.209834Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-07-06T18:18:39.093732Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T12:06:13.697487Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2405.14573"},"observation_digest":"sha256:5ab9dab887046cef795ac1fccb9c78275dc9f5c1026b2c42afafa82ab89b0f76","observation_id":"e745bd77-8f14-4197-a6ef-c329e9535ec7","resolution":{"observed_at":"2026-05-13T12:06:13.825027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T20:53:45.878221Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2406.06592"},"observation_digest":"sha256:b70778f6b58656d43b921d6d3dab759601183ae153624d417e5658e741cdcfe5","observation_id":"174e6b17-e5fa-4ebd-9a14-255faddb1d9f","resolution":{"observed_at":"2026-05-13T20:53:45.911301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-05-16T06:58:36.684583Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2406.08464"},"observation_digest":"sha256:351aa21af3db59b95016826891532a8df2522f1dbf568bb8e1c87da771001a3e","observation_id":"8be4f0bc-3d69-4ada-83d2-2aa6aaa2e597","resolution":{"observed_at":"2026-05-16T06:58:36.891851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T04:48:26.303240Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2406.19314"},"observation_digest":"sha256:9519da51801ec5bbed12a30c9619eb6659eae934faf0aff76dce2ab09e947ae6","observation_id":"be02f13a-0d02-4ccc-8732-5e2257b9a07e","resolution":{"observed_at":"2026-05-15T04:48:26.505807Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2408.15549","last_updated":"2026-04-17T16:47:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-28T05:53:46Z","title":"WildFeedback: Aligning LLMs With In-situ User Interactions And Feedback","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-23T22:37:43.230753Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2408.15549"},"observation_digest":"sha256:7b6625b3e48e01611347e6359c72f1923992891fb868cf67d6bc90986b0acd1e","observation_id":"6f93f34a-0329-433a-a1f0-1ce32328b691","resolution":{"observed_at":"2026-05-23T22:38:32.520374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":146,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:c32471783318759918358091c0a59e2ad05f69ae1c8ad62f4c65d623e7dda884","observation_id":"519611ce-b368-48d8-a7b9-bbbe6d390762","resolution":{"observed_at":"2026-05-23T20:58:26.345381Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.02644","last_updated":"2025-05-30T03:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-03T16:30:47Z","title":"Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents","version":4},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-12T13:36:57.011451Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.02644"},"observation_digest":"sha256:161756b82f8f29286e890ccd876392dd25822f823d18fda86fa0de79e76b81bc","observation_id":"afe5f978-1f1c-47bf-9ecb-63afa31e2cea","resolution":{"observed_at":"2026-05-12T13:36:57.174673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-15T00:42:11.891829Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.05229"},"observation_digest":"sha256:1da6cf08d4581ec1cfb1c7f77cc136818ff702a396dfeefacc38b385d64a7732","observation_id":"ba24866b-1de1-45f4-b234-dd1c535b0a49","resolution":{"observed_at":"2026-05-15T00:42:11.978514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:50.009149Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.10629"},"observation_digest":"sha256:93b057e905b5abe8b73aea3372ad210c9200243f01d393b31bad17391b53638a","observation_id":"d45de892-0290-4721-8029-d3a6fc9a6b2b","resolution":{"observed_at":"2026-05-15T00:56:50.031418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.13846","last_updated":"2026-05-18T05:12:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T17:58:14Z","title":"LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-23T18:31:35.391674Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.13846"},"observation_digest":"sha256:e350630ac3249e1758824fb7b9675ee1d7097ebc00a3d36b1ec757e22d8e4f7e","observation_id":"4ea583d7-0dae-4766-a84e-17d53136cc03","resolution":{"observed_at":"2026-05-23T18:33:19.559825Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T16:18:01.560780Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.18451"},"observation_digest":"sha256:b245787e51c1211c68ba9c87c7d50710fa812279993847dfe93cdd7445ac55e6","observation_id":"994b1759-f09d-451f-8f87-d9fe39ce35dc","resolution":{"observed_at":"2026-05-17T16:18:01.667248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T09:15:07.523565Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.03555"},"observation_digest":"sha256:4d8b374b7f55b0629b0cd343ed7866ee3758a0254f0b27cf36bd793cd70aec27","observation_id":"a63164f1-15cd-445f-aaa1-fafc0f7b91f4","resolution":{"observed_at":"2026-05-15T09:15:07.579671Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.05496","last_updated":"2024-12-07T01:46:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-07T01:46:38Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-17T21:27:16.615071Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.05496"},"observation_digest":"sha256:b166bb644ce72ffec509fc987f1437af1013041f199ad43012d5aae5026e8683","observation_id":"5303309a-0270-4245-a092-956238fd9312","resolution":{"observed_at":"2026-05-17T21:27:16.688665Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:e6a396e99e0a1f6fb3f6a290a3e97c5b79f79cfa52a66cd4c95d22490453cf44","observation_id":"bcc50f09-23f8-4a6a-b9fa-82ed72d81297","resolution":{"observed_at":"2026-05-20T17:46:47.077697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T06:25:00.376073Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.15115"},"observation_digest":"sha256:5e670745932b89b88898c75ec75a2dacba813bfa08497986e07649eaecc2c775","observation_id":"9e27ef05-20e7-47ae-badf-b49b21286739","resolution":{"observed_at":"2026-05-23T06:25:27.909331Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T12:36:50.060335Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.18925"},"observation_digest":"sha256:5298726f672d31cb68f159a9d7557178cb535102ec928a531861d1d71a31e127","observation_id":"563eb4e9-1047-4771-a3c1-b4a00bbdfa69","resolution":{"observed_at":"2026-05-15T12:36:50.299311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:0a6eab46793dd51a04cf1dc1188b56909ed9c65e02b1f0aa5861f14097b3eac2","observation_id":"71174748-c800-4fce-995c-7efa3502db26","resolution":{"observed_at":"2026-05-10T23:38:45.943689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2501.16154","last_updated":"2026-04-14T08:15:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-27T15:48:57Z","title":"AdaMCoT: Rethinking Cross-Lingual Factual Reasoning through Adaptive Multilingual Chain-of-Thought","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T04:55:04.067483Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.16154"},"observation_digest":"sha256:2cacf18730241c20da222b3c22186e2f1c35eb0c0807d444a33e1cc0a712f725","observation_id":"8ffa63df-206e-4e1b-a0fd-c0f119956d0a","resolution":{"observed_at":"2026-05-23T04:55:24.824604Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"reference_index":228,"source":"arxiv_source","source_observed_at":"2026-05-13T17:30:02.803757Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02737"},"observation_digest":"sha256:a2ea85b54654d43436ac5d144dcd84ca91296f5cf9abf0f82fc00b5af31a9b19","observation_id":"4a659738-1bd8-4d72-a3f3-287ef606fce2","resolution":{"observed_at":"2026-05-13T17:30:03.034288Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-05-12T15:39:40.845703Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.05171"},"observation_digest":"sha256:c895af9289b1c538f760c73cd06bfcfa5d193e8a6f739f3790d93ec3fac45d4f","observation_id":"802d48bd-3a5c-4f5d-93c2-034974f8f8a2","resolution":{"observed_at":"2026-05-12T15:39:41.259913Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.14427","last_updated":"2025-04-18T09:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T10:25:13Z","title":"Token-Level Density-Based Uncertainty Quantification Methods for Eliciting Truthfulness of Large Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-23T02:51:16.495409Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.14427"},"observation_digest":"sha256:cdbfa11183f403a76205e68e191a54f7e70d709716d7cd1286eeb31a037da1f9","observation_id":"e4fd7bea-0ee0-482d-9437-a4d96191688d","resolution":{"observed_at":"2026-05-23T02:52:25.988860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.14541","last_updated":"2026-04-30T11:23:52Z","snapshot_observed_at":"2026-07-30T05:01:07.387637Z","submitted_at":"2025-02-20T13:20:19Z","title":"LLM-based User Profile Management for Recommender System","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T02:45:16.107117Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.14541"},"observation_digest":"sha256:940f35ca6d4a79f9b67567787651410d1682ba278b4546e7abf53d1e699718dd","observation_id":"fe68dd09-79e2-4b04-81bd-27d440ebcd3b","resolution":{"observed_at":"2026-05-23T02:45:19.284290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:49:22.279848Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.14786"},"observation_digest":"sha256:cd7c7e1550340e2fd294f940b30d06d8c5c8bfba4b986a8abc22fbe0651e9228","observation_id":"0162e5d8-7a90-48c3-8038-b4d193c14069","resolution":{"observed_at":"2026-05-10T15:49:22.346609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-02T00:32:51.000665Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-11T23:02:51.656353Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.16982"},"observation_digest":"sha256:02030ceb2bc18bcacdd7548f63945c832f16de2e3fbec0f64ccd8a97a13eec09","observation_id":"28e75e17-90e1-45b1-8283-28ba35d04394","resolution":{"observed_at":"2026-05-11T23:02:52.022870Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T22:22:27.455361Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2503.01743"},"observation_digest":"sha256:d0aa2d38ad0334859df1b742055770d17b1bb46b10ff47dd26acb97570441d33","observation_id":"9ac5b64d-3da6-4e3e-8bc4-74ece11226b0","resolution":{"observed_at":"2026-05-11T22:22:28.180304Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T22:18:55.976503Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2503.19786"},"observation_digest":"sha256:e787607ac717bc439a394ca33ef44e9ae2d6fabfd5fdc3164cc7332b830c98bb","observation_id":"120ebf76-ca52-41e5-ab90-dae59b645edc","resolution":{"observed_at":"2026-05-22T22:22:12.281193Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2505.04152","last_updated":"2026-05-13T00:07:07Z","snapshot_observed_at":"2026-07-06T21:20:08.242976Z","submitted_at":"2025-05-07T06:03:37Z","title":"SocialLM: Social Signal Processing of Patient-Provider Communication using LLMs and Contextual Aggregation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T17:04:00.508789Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.04152"},"observation_digest":"sha256:a2df91d37e335b30d62794b6e8b52879a3e1402d2cfa210dce24826757e7ebac","observation_id":"30869206-e568-4897-aa17-12b4058483ac","resolution":{"observed_at":"2026-05-22T17:05:00.340408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2505.12546","last_updated":"2026-07-20T01:54:07Z","snapshot_observed_at":"2026-08-01T15:04:02.570612Z","submitted_at":"2025-05-18T21:06:32Z","title":"Extracting memorized pieces of (copyrighted) books from open-weight language models","version":5},"reference_index":261,"source":"pdf_text","source_observed_at":"2026-05-22T13:59:05.460455Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.12546"},"observation_digest":"sha256:6c5fa732434f5b5c4fe7e10e11b720fbc5bc0e67cc3469d1c8820e037351dea4","observation_id":"8d63b592-81ea-4102-b5a8-5fe758706ef9","resolution":{"observed_at":"2026-05-22T14:01:38.046432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2505.12741","last_updated":"2026-05-31T07:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-19T05:56:06Z","title":"Language Model Networks: Supervision-Efficient Learning through Dense Communication","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T14:50:45.735917Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.12741"},"observation_digest":"sha256:c14a7c494688b859a824bc87899cc0149d01d1408f01bcbf0f1b70a7c753ee48","observation_id":"11682591-c37c-4068-8897-ebfa8739b6c8","resolution":{"observed_at":"2026-05-22T14:51:42.000810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2505.14654","last_updated":"2026-05-20T07:14:52Z","snapshot_observed_at":"2026-07-06T21:27:18.398824Z","submitted_at":"2025-05-20T17:42:34Z","title":"Beyond Words: Multimodal LLM Knows When to Speak","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T13:31:26.532921Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.14654"},"observation_digest":"sha256:a480ab628b2675e0ed021aab99506cb700e5724534d458f84366b9260babf7fe","observation_id":"3f6f8ab6-e359-46a8-bd59-496ab9d4fb5c","resolution":{"observed_at":"2026-05-22T13:31:35.966312Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2505.23912","last_updated":"2026-05-13T21:21:09Z","snapshot_observed_at":"2026-08-02T15:55:45.353476Z","submitted_at":"2025-05-29T18:05:20Z","title":"LoVeC: Reinforcement Learning for Better Verbalized Confidence in Long-Form Generations","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T12:43:51.019983Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.23912"},"observation_digest":"sha256:c8885fa4bce26431913e1444efb076e10684cdf3bf8248f27c2fa0c4e20f340b","observation_id":"21c0c616-ade1-461c-b746-c220c0746c96","resolution":{"observed_at":"2026-05-19T12:47:17.954703Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2506.12382","last_updated":"2026-04-27T08:32:16Z","snapshot_observed_at":"2026-08-02T04:53:57.144183Z","submitted_at":"2025-06-14T07:31:52Z","title":"Exploring the Secondary Risks of Large Language Models","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-19T09:40:58.067398Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.12382"},"observation_digest":"sha256:b97ef1329b4217edd3bad3c5cf6f954335a2aef9e931ba0b29c2a57bff3f205d","observation_id":"696fc91f-87ff-4805-9238-b4064e658d49","resolution":{"observed_at":"2026-05-19T09:42:13.999498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2507.01925","last_updated":"2025-07-02T17:34:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T17:34:52Z","title":"A Survey on Vision-Language-Action Models: An Action Tokenization Perspective","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-17T14:08:34.893876Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.01925"},"observation_digest":"sha256:bd6d0e854d1079789c5564149eb520091a624bdadb564e63605a56eb8e1dfe58","observation_id":"b3b075ea-a2a5-4fe2-ad72-7ec567cdde35","resolution":{"observed_at":"2026-05-17T14:08:35.112073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2507.07847","last_updated":"2026-04-28T06:56:29Z","snapshot_observed_at":"2026-08-02T16:53:30.308493Z","submitted_at":"2025-07-10T15:26:59Z","title":"From Ambiguity to Accuracy: The Transformative Effect of Coreference Resolution on Retrieval-Augmented Generation systems","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T05:30:33.121799Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.07847"},"observation_digest":"sha256:85436bacd7888fe893c6d13545013d87c8aff98ce2f6608a454bf0772f8893d2","observation_id":"7f6cbeaf-36b6-44fa-bb33-d9846610367c","resolution":{"observed_at":"2026-05-19T05:32:05.756159Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2507.13941","last_updated":"2026-01-19T11:46:47Z","snapshot_observed_at":"2026-08-01T11:16:54.740431Z","submitted_at":"2025-07-18T14:13:54Z","title":"Shared representations in brains and models reveal a two-route cortical organization during scene perception","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-19T04:57:27.800179Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.13941"},"observation_digest":"sha256:438fd1148b6a816f887fc66feb21f2176c6684a31ed65fb1e6c857f5515cce39","observation_id":"bd6b257e-9663-42d4-b8d8-a29de28abd98","resolution":{"observed_at":"2026-05-19T05:02:05.256957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2507.20185","last_updated":"2026-04-10T15:33:50Z","snapshot_observed_at":"2026-08-02T08:32:06.487163Z","submitted_at":"2025-07-27T09:04:17Z","title":"SessionIntentBench: A Multi-task Inter-session Intention-shift Modeling Benchmark for E-commerce Customer Behavior Understanding","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-19T02:55:15.547931Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.20185"},"observation_digest":"sha256:f4732ac56cd1bc2e06b680f4822d52509ae000e380e5c5ac852fb630c5200d97","observation_id":"110b9c50-ccc8-400b-87c4-4ce9a9df4d9e","resolution":{"observed_at":"2026-05-19T02:57:00.507435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T17:49:27.926646Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.20534"},"observation_digest":"sha256:7b50dfa26989898a8a35dc89037f513a681222e6eed15ad49a3e46294b469d5e","observation_id":"f51e511d-1828-461a-bc69-c9830d6c9024","resolution":{"observed_at":"2026-05-10T17:49:28.065404Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2507.21934","last_updated":"2026-04-19T21:21:19Z","snapshot_observed_at":"2026-08-02T15:48:27.978355Z","submitted_at":"2025-07-29T15:48:12Z","title":"Culinary Crossroads: A RAG Framework for Enhancing Diversity in Cross-Cultural Recipe Adaptation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T02:20:03.766702Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.21934"},"observation_digest":"sha256:951380e3753e3a6134e64af44eddec78262825211e495abc2bc7c559572aa246","observation_id":"7a3f45ef-3911-4334-8aec-74f4a5569f84","resolution":{"observed_at":"2026-05-19T02:21:59.179005Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2508.18142","last_updated":"2026-04-17T09:19:23Z","snapshot_observed_at":"2026-08-04T03:54:41.963471Z","submitted_at":"2025-08-25T15:51:24Z","title":"Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T21:28:29.868292Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2508.18142"},"observation_digest":"sha256:7a0185d0f44037803a0b82bff5bd36a8586433c07cc8e27d309e69e8a33e90d0","observation_id":"d588504d-756f-497f-819a-65f9cafdae76","resolution":{"observed_at":"2026-05-18T21:31:51.528936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2509.05276","last_updated":"2026-05-08T09:41:26Z","snapshot_observed_at":"2026-07-06T22:24:38.247543Z","submitted_at":"2025-09-05T17:34:00Z","title":"SpikingBrain: Spiking Brain-inspired Large Models","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T18:51:06.243305Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.05276"},"observation_digest":"sha256:81b6bd32e427ba2c8e4e8055213697dd01f283206f12806f60a9dca9edf4c9db","observation_id":"906baafa-d836-408b-b5c9-8182f79e304f","resolution":{"observed_at":"2026-05-18T18:51:45.829709Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2509.17314","last_updated":"2026-07-01T05:02:47Z","snapshot_observed_at":"2026-08-01T05:00:07.031084Z","submitted_at":"2025-09-22T02:34:09Z","title":"Clotho: Measuring Task-Specific Pre-Generation Test Adequacy for LLM Inputs","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T15:28:58.083223Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.17314"},"observation_digest":"sha256:8e771cde666cbebd10201dd04995494fb3494dbff68b724bfc301ff6c500305b","observation_id":"c7fd66f9-6a1c-4aef-ab29-9d110e67e029","resolution":{"observed_at":"2026-05-18T15:31:33.560830Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2509.21637","last_updated":"2026-05-07T23:03:51Z","snapshot_observed_at":"2026-08-02T14:46:32.268900Z","submitted_at":"2025-09-25T21:54:09Z","title":"BoHA: Blockwise Hadamard Product Adaptation for Parameter-Efficient Fine-Tuning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T13:47:15.959308Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.21637"},"observation_digest":"sha256:6f548c4c0af6c2ff748aaa7892a85732ca42e99cd5fe1ace42cea21fd95f8956","observation_id":"79fa7c5a-9ce2-4ed4-b98a-75e9bbbb417b","resolution":{"observed_at":"2026-05-18T13:51:26.021245Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2509.23102","last_updated":"2026-04-06T19:14:12Z","snapshot_observed_at":"2026-08-03T06:33:00.420621Z","submitted_at":"2025-09-27T04:18:33Z","title":"Multiplayer Nash Preference Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T13:09:54.433720Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.23102"},"observation_digest":"sha256:514b9137e7e13b4f1957c815f3d12819e72dfb1fe60814210c419852a36db3cf","observation_id":"5128dbfc-81aa-47b3-8f2c-44cc02513757","resolution":{"observed_at":"2026-05-18T13:11:24.083212Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2509.23542","last_updated":"2026-04-19T04:59:30Z","snapshot_observed_at":"2026-08-03T18:10:00.237919Z","submitted_at":"2025-09-28T00:43:52Z","title":"On the Shelf Life of Fine-Tuned LLM-Judges: Future-Proofing, Backward-Compatibility, and Question Generalization","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-18T12:53:45.767341Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.23542"},"observation_digest":"sha256:3992c8e25f0d5aeea1cdfd2a8bb4892a6034d1542af20c698cd27450cf6b91ae","observation_id":"31f7be94-d513-4489-a5e0-866f3a232c5c","resolution":{"observed_at":"2026-05-18T12:56:24.625635Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2509.24527","last_updated":"2025-09-29T09:42:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T09:42:27Z","title":"Training Agents Inside of Scalable World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T02:05:52.431747Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.24527"},"observation_digest":"sha256:61f55a616f101d48822b03158a1cb9295447c62edd0452940a3053d915fa0724","observation_id":"ec153827-1b7c-4736-b3f0-e16aa29bf224","resolution":{"observed_at":"2026-05-15T02:05:52.558344Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2510.01379","last_updated":"2026-04-19T08:10:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-01T19:07:16Z","title":"Multi-LLM Orchestration for High-Quality Code Generation: Exploiting Complementary Model Strengths","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T10:22:09.037783Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2510.01379"},"observation_digest":"sha256:b355e77e242fcc7b29cc37e536fe18fe7f14f985ba927d35f13974fb3ed492a8","observation_id":"4b32090e-2d38-475e-82df-98661a6f032b","resolution":{"observed_at":"2026-05-18T10:22:33.352813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2510.04309","last_updated":"2026-05-16T04:44:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-05T18:05:28Z","title":"Activation Steering with a Feedback Controller","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T21:50:05.186376Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2510.04309"},"observation_digest":"sha256:f776e9fc710c7fb5c72f202c23e19cd9d20f0363588bc6e24c58a5e547d47b63","observation_id":"10ff02a2-2ceb-47ff-9f86-b3f8b5b64c23","resolution":{"observed_at":"2026-05-21T21:50:41.367051Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2510.06719","last_updated":"2026-05-12T15:11:19Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-08T07:15:50Z","title":"Differentially Private Synthetic Text Generation for Retrieval-Augmented Generation (RAG)","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T09:49:12.493851Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2510.06719"},"observation_digest":"sha256:63da23a3c4607baf312abcf7166cc73f3ab3d1533f92de5eb8cbb71bf3093f87","observation_id":"41036d9a-f999-4bd2-9b86-c945edcbcaa5","resolution":{"observed_at":"2026-05-18T09:51:13.545906Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2510.23636","last_updated":"2026-07-07T08:30:56Z","snapshot_observed_at":"2026-08-02T17:46:18.312961Z","submitted_at":"2025-10-24T12:21:27Z","title":"LLM4Delay: Flight Delay Prediction via Cross-Modality Adaptation of Large Language Models and Aircraft Trajectory Representation","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T04:26:15.232765Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2510.23636"},"observation_digest":"sha256:74382fc81d5a76e80a37df1dfab5a34bad8b90170db1cf4efc0505e2ed232057","observation_id":"84538412-1480-4fe2-8833-8b0eedacfe1c","resolution":{"observed_at":"2026-05-18T04:30:53.681700Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-04T00:37:51.312622Z","title":"mlr.press/v235/tang24k.html","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.00602","last_updated":"2026-06-19T13:51:43Z","snapshot_observed_at":"2026-08-04T00:37:49.955662Z","submitted_at":"2025-11-01T16:08:28Z","title":"OpenSIR: Open-Ended Self-Improving Reasoner","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T00:37:51.312622Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2511.00602"},"observation_digest":"sha256:2e879b222c0027e53ad53aa8dbb0e313b6cdd8e9b8be6d8d20614e1eaeb06895","observation_id":"722f19a2-65e9-4914-a263-c8be39a0af01","resolution":{"observed_at":"2026-08-04T00:37:51.312622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2511.01526","last_updated":"2026-05-19T08:43:37Z","snapshot_observed_at":"2026-07-06T22:34:43.577332Z","submitted_at":"2025-11-03T12:42:25Z","title":"Difficulty-Controllable Cloze Question Distractor Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-21T20:42:45.778028Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2511.01526"},"observation_digest":"sha256:9cbfb8eb8811f0500aaa592a07711fa46d9e868526a5650eead5f1397b7b86af","observation_id":"c3f12a63-8123-4003-be6e-b2562b073d24","resolution":{"observed_at":"2026-05-21T20:44:21.914527Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2511.03092","last_updated":"2026-04-08T21:56:44Z","snapshot_observed_at":"2026-08-02T21:39:50.543195Z","submitted_at":"2025-11-05T00:38:31Z","title":"SnapStream: Efficient Long Sequence Decoding on Dataflow Accelerators","version":6},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T01:59:30.583027Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2511.03092"},"observation_digest":"sha256:691ac68b1567bfedb990689955d31993cf6c51020aa85e4519b76288a11c735b","observation_id":"e09c8e9c-8d95-48f7-ae73-7bea46641f32","resolution":{"observed_at":"2026-05-18T02:00:39.330829Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T20:29:50.754628Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19959","last_updated":"2026-06-02T00:32:45Z","snapshot_observed_at":"2026-08-03T21:43:59.986677Z","submitted_at":"2025-11-25T06:09:21Z","title":"ParaBlock: Communication-Computation Parallel Block Coordinate Federated Learning for Large Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T20:29:50.754628Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2511.19959"},"observation_digest":"sha256:9ad3f8d992536f9d66091606ff9ead655b829c76e2ca3a93257d5661ef862e8f","observation_id":"a9146a2e-7ab6-4fce-8c35-03a220df1386","resolution":{"observed_at":"2026-08-03T20:29:50.754628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2511.20645","last_updated":"2026-04-16T17:04:25Z","snapshot_observed_at":"2026-08-03T04:32:54.764263Z","submitted_at":"2025-11-25T18:59:25Z","title":"PixelDiT: Pixel Diffusion Transformers for Image Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T04:30:07.417197Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2511.20645"},"observation_digest":"sha256:a5ca4fe54e8876a382d204b4b0d15640b82f2913de305519984a66bd4d2c4aac","observation_id":"8ae17341-4623-4059-bf43-64357480ab03","resolution":{"observed_at":"2026-05-17T04:31:31.166267Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T18:48:26.431463Z","title":"Pau Rodríguez, Arno Blaas, Michal Klein, Luca Zappella, Nicholas Apostoloff, Marco Cuturi, and Xavier Suau","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.03661","last_updated":"2026-07-30T09:26:10Z","snapshot_observed_at":"2026-08-03T18:48:21.181760Z","submitted_at":"2025-12-03T10:50:15Z","title":"Dynamically Scaled Activation Steering","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T18:48:26.431463Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.03661"},"observation_digest":"sha256:6d1b3e2b9c2dea4fe14f63ab0b30c9064899447e933f72250a06ef31b38f7fa0","observation_id":"e6257b41-95ed-4ffc-9f7f-5950b6eef707","resolution":{"observed_at":"2026-08-03T18:48:26.431463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T18:48:26.352501Z","title":"Gemma 2: Improving open language models at a practical size.CoRR, abs/2408.00118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.03661","last_updated":"2026-07-30T09:26:10Z","snapshot_observed_at":"2026-08-03T18:48:21.181760Z","submitted_at":"2025-12-03T10:50:15Z","title":"Dynamically Scaled Activation Steering","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T18:48:26.352501Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.03661"},"observation_digest":"sha256:8dd57bf84d16024e305ad39ed13381315b8d51fbc567006000364a5b29139020","observation_id":"71a288a5-6b1f-4f2d-9b8f-1827a8cd1a90","resolution":{"observed_at":"2026-08-03T18:48:26.352501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T18:33:08.505536Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05038","last_updated":"2026-05-29T17:42:38Z","snapshot_observed_at":"2026-08-03T18:32:55.672308Z","submitted_at":"2025-12-04T17:55:55Z","title":"The SuperActivator Mechanism: Transformers Concentrate Reliable Concept Signals in the Tail","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:08.505536Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.05038"},"observation_digest":"sha256:faa2e3c415e5d8b0844fdd33d9f468184478213031bb7b085b081e2828203201","observation_id":"d13fa191-ddd4-4a31-ad90-c8377220b6d4","resolution":{"observed_at":"2026-08-03T18:33:08.505536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T17:56:48.072540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.07540","last_updated":"2026-07-23T03:37:31Z","snapshot_observed_at":"2026-08-03T17:56:41.662955Z","submitted_at":"2025-12-08T13:21:44Z","title":"Minimum Bayes Risk Decoding for Error Span Detection in Reference-Free Automatic Machine Translation Evaluation","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-03T17:56:48.072540Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.07540"},"observation_digest":"sha256:d5b2fdfd75ac5c4c43021d73cf274b1e000225cb6d0143597dca92fcd2068c41","observation_id":"1fddbcb6-da5a-4f8a-9c4a-e6a269766445","resolution":{"observed_at":"2026-08-03T17:56:48.072540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T17:06:57.456402Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10730","last_updated":"2026-07-04T09:34:06Z","snapshot_observed_at":"2026-08-03T17:06:51.372903Z","submitted_at":"2025-12-11T15:16:06Z","title":"IRG-MotionLLM: Interleaving Motion Generation, Assessment and Refinement for Text-to-Motion Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T17:06:57.456402Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.10730"},"observation_digest":"sha256:da190c747e397d42e89f94aab593a750375f4ebdc67383850bf34edfff84584f","observation_id":"5b10e3fd-7ce6-4045-bc81-7b0598e03b9a","resolution":{"observed_at":"2026-08-03T17:06:57.456402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2512.17738","last_updated":"2026-05-29T20:10:42Z","snapshot_observed_at":"2026-08-03T15:15:37.296482Z","submitted_at":"2025-12-19T16:17:23Z","title":"When the Gold Standard Isn't Necessarily Standard: Challenges of Evaluating the Translation of User-Generated Content","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T20:37:44.147361Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.17738"},"observation_digest":"sha256:fe633ebd61bf1ee3004713c373b5802bd0ca3eb5ea540d4549b9dc7acb98664f","observation_id":"67f21661-0fe9-40bf-8db8-18dc7818a49d","resolution":{"observed_at":"2026-05-16T20:38:24.566981Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T15:15:39.212846Z","title":"Transactions of the Association for Computational Linguistics, 9:1460–1474","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17738","last_updated":"2026-05-29T20:10:42Z","snapshot_observed_at":"2026-08-03T15:15:37.296482Z","submitted_at":"2025-12-19T16:17:23Z","title":"When the Gold Standard Isn't Necessarily Standard: Challenges of Evaluating the Translation of User-Generated Content","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T15:15:39.212846Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.17738"},"observation_digest":"sha256:d24fdab4a037a96ee8084c0d1420d36cc8aba4661eb3991c39738b6941cfb953","observation_id":"6e84f8cd-039a-48cf-9bab-36e2cf1765cc","resolution":{"observed_at":"2026-08-03T15:15:39.212846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2512.18073","last_updated":"2026-04-13T16:17:11Z","snapshot_observed_at":"2026-08-03T04:47:14.403390Z","submitted_at":"2025-12-19T21:23:57Z","title":"FPBench: A Comprehensive Benchmark of Multimodal Large Language Models for Fingerprint Analysis","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T20:27:40.572994Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.18073"},"observation_digest":"sha256:56abbf9bf99f1841a76600cf397da3714d8c6fc6557ffa3fd28fb56fb2ba9152","observation_id":"dd6b0793-065a-4ec9-a03c-413111365b88","resolution":{"observed_at":"2026-05-16T20:28:23.882479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T13:53:26.747305Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.22539","last_updated":"2026-07-02T08:55:28Z","snapshot_observed_at":"2026-08-03T13:53:20.780083Z","submitted_at":"2025-12-27T09:40:54Z","title":"VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T13:53:26.747305Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2512.22539"},"observation_digest":"sha256:515fff34354fe122cd942c44cd84a1e63fc70bd0670dac389d02916a05d34b3b","observation_id":"e0db5dce-7359-48c5-a6c6-dfe1b337afe9","resolution":{"observed_at":"2026-08-03T13:53:26.747305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T13:15:38.634791Z","title":"mrl-1.20/","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.00065","last_updated":"2026-05-28T08:57:38Z","snapshot_observed_at":"2026-08-03T13:15:33.561981Z","submitted_at":"2025-12-31T19:00:03Z","title":"When the Same Coefficients Reach Different Places: Asymmetric Realizability in Transplanting Tokenizers across Large Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T13:15:38.634791Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.00065"},"observation_digest":"sha256:03f25ff71b6c421781a3c0d48968294a4da8ec310a8be84f6d9ad8f09b94fb5a","observation_id":"b6f7e503-a702-451f-949b-09bf2c65f056","resolution":{"observed_at":"2026-08-03T13:15:38.634791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2601.05106","last_updated":"2026-05-21T03:21:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-08T16:53:16Z","title":"Token-Level LLM Collaboration via FusionRoute","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T12:25:59.747665Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.05106"},"observation_digest":"sha256:2a3998e9323ec9348a0e4189aabca2b20364d2155e69364d8a31b3bff54e4399","observation_id":"737b6b9b-4007-453a-ba0b-9b840633eacc","resolution":{"observed_at":"2026-05-22T12:26:31.510045Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2601.06394","last_updated":"2026-04-29T19:00:59Z","snapshot_observed_at":"2026-08-02T23:44:38.206631Z","submitted_at":"2026-01-10T02:39:24Z","title":"Context Matters: Peer-Aware Student Behavioral Engagement Measurement via VLM Action Parsing and LLM Sequence Classification","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T15:47:08.925519Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.06394"},"observation_digest":"sha256:ee548a315f99d16093d55b86979cfba90ccabba1776b706f1f6ed1c6fd36758d","observation_id":"e7884228-5b3f-46b8-ada7-2f66f7bc907a","resolution":{"observed_at":"2026-05-16T15:48:03.799303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T11:14:51.832348Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.07155","last_updated":"2026-07-11T08:43:13Z","snapshot_observed_at":"2026-08-03T11:14:50.541582Z","submitted_at":"2026-01-12T02:57:39Z","title":"Stable On-Policy Distillation through Adaptive Target Reformulation","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-03T11:14:51.832348Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.07155"},"observation_digest":"sha256:15a7e9c70c38447a29367e430af6384e960e3f853f61807be02dc3ee1ec6cd40","observation_id":"1bbf4fee-e56f-4fe1-b26c-bfe023151b04","resolution":{"observed_at":"2026-08-03T11:14:51.832348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2601.13262","last_updated":"2026-04-26T01:38:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-19T17:51:00Z","title":"CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T13:20:49.919833Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.13262"},"observation_digest":"sha256:26a7e38bdc52992a9fe38a94cc305083228e023f1675cf548989c6270e134a7e","observation_id":"d15f7316-29c3-438a-87b6-727b232c441e","resolution":{"observed_at":"2026-05-16T13:20:57.513040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T09:37:08.686734Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.13433","last_updated":"2026-05-29T00:45:48Z","snapshot_observed_at":"2026-08-03T09:37:04.326965Z","submitted_at":"2026-01-19T22:37:30Z","title":"Who Endorsed It? Measuring Authority Bias Across Expertise Levels in Language Models","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-03T09:37:08.686734Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.13433"},"observation_digest":"sha256:42966683b756fd201d4a2161675c364007dc3063c924fd050dc2244daab0d662","observation_id":"f20a5797-2078-41c2-9241-cfec20f54c54","resolution":{"observed_at":"2026-08-03T09:37:08.686734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2601.19208","last_updated":"2026-05-12T21:37:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-27T05:22:34Z","title":"How Do Transformers Learn to Associate Tokens: Gradient Leading Terms Bring Mechanistic Interpretability","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T11:20:33.400885Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.19208"},"observation_digest":"sha256:b05aea3a8c25da78d10b4c72a7e555dc44cd437e609e5d24811b7133e24f0cd9","observation_id":"82a60da0-3b46-47a2-b632-d8c20c9359cc","resolution":{"observed_at":"2026-05-16T11:20:52.683125Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2601.20375","last_updated":"2026-05-07T02:38:44Z","snapshot_observed_at":"2026-07-30T12:44:01.703494Z","submitted_at":"2026-01-28T08:37:34Z","title":"LLM-AutoDP: Automatic Data Processing via LLM Agents for Model Fine-tuning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T10:54:22.183741Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.20375"},"observation_digest":"sha256:d129f23cca27e5f3fbfe3d563c1046cbf41dc4e59d8472d5a76311d9fe960fb0","observation_id":"c5bff604-b2df-4860-b6e0-f4a3e22c31d9","resolution":{"observed_at":"2026-05-16T10:57:46.847244Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T06:37:53.551888Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahri- ari, B., Ram ´e, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22580","last_updated":"2026-06-04T11:50:53Z","snapshot_observed_at":"2026-08-03T06:37:49.104766Z","submitted_at":"2026-01-30T05:21:57Z","title":"SpanNorm: Reconciling Training Stability and Performance in Deep Transformers","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T06:37:53.551888Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.22580"},"observation_digest":"sha256:57d89e91e70d3ad199eac2d796a6a60c9ad12ae2aa99e0de23e5c9deff06287e","observation_id":"58e2e5ac-c5cc-49b1-b893-abb46450f71b","resolution":{"observed_at":"2026-08-03T06:37:53.551888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T06:32:49.417303Z","title":"doi: 10.1145/3474381","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.22710","last_updated":"2026-07-02T13:34:49Z","snapshot_observed_at":"2026-08-03T06:32:28.411296Z","submitted_at":"2026-01-30T08:32:32Z","title":"AlienLM: Alienization of Language for API-Boundary Privacy in Black-Box LLMs","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T06:32:49.417303Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2601.22710"},"observation_digest":"sha256:6e552bebd98bb22c966a663b017a63c04dc66cde5b4d42b05d5b739d141be4a7","observation_id":"9250ceb3-116c-41f0-8a31-72f305f3ae0f","resolution":{"observed_at":"2026-08-03T06:32:49.417303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T10:40:46.882802Z","title":"Gemma 2: Improving open language models at a practical size, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-03T10:40:41.669189Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.882802Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:f9ce53521891e888d75217abb44f736ac9a82b186355d68cc1efd4e15d6980b2","observation_id":"d7a9f0f6-951a-4c6c-a1f9-cf09c97b08c6","resolution":{"observed_at":"2026-08-03T10:40:46.882802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T04:23:44.702390Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05233","last_updated":"2026-06-26T06:02:43Z","snapshot_observed_at":"2026-08-03T04:23:39.943263Z","submitted_at":"2026-02-05T02:49:52Z","title":"MobileManiBench: Simplifying Model Verification for Mobile Manipulation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T04:23:44.702390Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.05233"},"observation_digest":"sha256:9b77cfeee031c028199003817c6493d90601fa47bb4427a056784b323c48af37","observation_id":"b1f990a2-b3ed-4f7c-a134-ca6aedc15e02","resolution":{"observed_at":"2026-08-03T04:23:44.702390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T02:40:25.262706Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10016","last_updated":"2026-06-05T23:52:44Z","snapshot_observed_at":"2026-08-03T10:45:51.785116Z","submitted_at":"2026-02-10T17:37:55Z","title":"Kunlun: Establishing Scaling Laws for Massive-Scale Recommendation Systems through Unified Architecture Design","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T02:40:25.262706Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.10016"},"observation_digest":"sha256:7977c5e26e3de14a43f951dcd83ff09fda23c6f1bbac66a500519c6c6217337f","observation_id":"0a2afd9f-8422-4a25-b57f-51b4f6d059f9","resolution":{"observed_at":"2026-08-03T02:40:25.262706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2602.11157","last_updated":"2025-12-08T06:48:17Z","snapshot_observed_at":"2026-08-02T15:55:40.570330Z","submitted_at":"2025-12-08T06:48:17Z","title":"Response-Based Knowledge Distillation for Multilingual Jailbreak Prevention Unwittingly Compromises Safety","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T01:27:16.967080Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.11157"},"observation_digest":"sha256:8fcd5e529e30cec589defc2d4e1d43effcbfdc5cd0db965df438744c9575c76d","observation_id":"b0132654-6327-462c-b158-89fbe20b0533","resolution":{"observed_at":"2026-05-17T01:28:48.745820Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T04:23:23.240320Z","title":"Gemma 2: Improving Open Lan- guage Models at a Practical Size.arXiv preprint arXiv:2408.00118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11201","last_updated":"2026-06-05T15:01:24Z","snapshot_observed_at":"2026-08-04T06:01:52.357308Z","submitted_at":"2026-02-04T21:55:57Z","title":"Mechanistic Evidence for Faithfulness Decay in Chain-of-Thought Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T04:23:23.240320Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.11201"},"observation_digest":"sha256:d40775f1d275659ee9564a4994aedb4ba6b8077d5559c9a9fb78d6cc5cdc8273","observation_id":"818f28fc-2e3d-475a-a009-f7beb0c0171b","resolution":{"observed_at":"2026-08-03T04:23:23.240320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T00:05:26.988043Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahri- ari, B., Ram ´e, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11715","last_updated":"2026-06-16T06:09:33Z","snapshot_observed_at":"2026-08-03T14:08:36.735635Z","submitted_at":"2026-02-12T08:45:13Z","title":"DICE: Diffusion Large Language Models Excel at Generating CUDA Kernels","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T00:05:26.988043Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.11715"},"observation_digest":"sha256:3077e7bbf5915805b99a41a8192e39d9aae1511abc042b12481abbff26811969","observation_id":"b1e10a14-f8a2-46ed-8227-05731aacc094","resolution":{"observed_at":"2026-08-03T00:05:26.988043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T00:02:15.921883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11961","last_updated":"2026-07-20T03:35:38Z","snapshot_observed_at":"2026-08-03T00:02:10.273017Z","submitted_at":"2026-02-12T13:56:02Z","title":"Scaling Model and Data for Multilingual Machine Translation with Open Large Language Models","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-03T00:02:15.921883Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.11961"},"observation_digest":"sha256:d31d902872ab2b6dc81fe920c6f5284528cc943b297d337fb1801d07eaa26027","observation_id":"a7d19947-e5bf-4239-9707-13e02757df66","resolution":{"observed_at":"2026-08-03T00:02:15.921883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-02T23:25:18.372025Z","title":"Jessica Rumbelow and Matthew Watkins","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13940","last_updated":"2026-05-31T19:22:26Z","snapshot_observed_at":"2026-08-02T23:25:16.292905Z","submitted_at":"2026-02-15T00:31:24Z","title":"You Can Learn Tokenization End-to-End with Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:18.372025Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.13940"},"observation_digest":"sha256:aef45b3291989fa2ac0e818972f92f2f3d474bf423540d6b8c5b513403c12b42","observation_id":"d7ad1789-f78f-48e7-b26c-c34c201446e2","resolution":{"observed_at":"2026-08-02T23:25:18.372025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-02T23:25:18.244813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.13940","last_updated":"2026-05-31T19:22:26Z","snapshot_observed_at":"2026-08-02T23:25:16.292905Z","submitted_at":"2026-02-15T00:31:24Z","title":"You Can Learn Tokenization End-to-End with Reinforcement Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:18.244813Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.13940"},"observation_digest":"sha256:857f453212dcd61056a8ed0d67c65c96dcd5bfa5f924699c7d4f034564acbedf","observation_id":"f0dbcba8-3b5f-4f1c-b1b9-4312271d3407","resolution":{"observed_at":"2026-08-02T23:25:18.244813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2602.14812","last_updated":"2026-04-13T13:32:44Z","snapshot_observed_at":"2026-07-06T22:46:03.525588Z","submitted_at":"2026-02-16T15:04:35Z","title":"Physical Commonsense Reasoning for Lower-Resourced Languages and Dialects: a Study on Basque","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T21:49:07.028487Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.14812"},"observation_digest":"sha256:f11474537d2dba7a1eb137010cd4d18f3bf5faaa26d44363b7918512691ffec8","observation_id":"669275cf-92ed-4da8-856b-ba2126dd96ba","resolution":{"observed_at":"2026-05-15T21:50:20.627794Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-02T22:32:05.602566Z","title":"acl-long.756/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.16610","last_updated":"2026-05-28T10:59:59Z","snapshot_observed_at":"2026-08-02T22:32:03.583103Z","submitted_at":"2026-02-18T17:04:02Z","title":"Who can we trust? LLM-as-a-jury for Comparative Assessment","version":2},"reference_index":756,"source":"pdf_text","source_observed_at":"2026-08-02T22:32:05.602566Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.16610"},"observation_digest":"sha256:b53f48c53cdfb5a8edf84718d95be387f2ffb1876aa524f4283b104f807fd520","observation_id":"6c64be8b-24fa-4ec3-95eb-247252d7435d","resolution":{"observed_at":"2026-08-02T22:32:05.602566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2602.16813","last_updated":"2026-05-20T16:23:05Z","snapshot_observed_at":"2026-07-06T22:46:21.571641Z","submitted_at":"2026-02-18T19:23:07Z","title":"Flow Map Language Models: One-step Language Modeling via Continuous Denoising","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-15T21:01:42.916835Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.16813"},"observation_digest":"sha256:85cb505bb829017072960cc90171b6dae43b97f85530dd0aee2415eff569c54d","observation_id":"a97e861a-14c0-4473-b589-7eefa82b8040","resolution":{"observed_at":"2026-05-15T21:10:19.104227Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2602.16813","last_updated":"2026-05-20T16:23:05Z","snapshot_observed_at":"2026-07-06T22:46:21.571641Z","submitted_at":"2026-02-18T19:23:07Z","title":"Flow Map Language Models: One-step Language Modeling via Continuous Denoising","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-21T12:23:49.031978Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.16813"},"observation_digest":"sha256:ce9ec1b6a2dce8838070081146e95ddb0a5e2904d501a67eec76073331d5fc3e","observation_id":"74274927-ccd8-4db4-a37a-c66f3ca5138a","resolution":{"observed_at":"2026-05-21T12:24:10.531844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2602.20816","last_updated":"2026-05-08T01:10:04Z","snapshot_observed_at":"2026-07-06T22:46:53.725781Z","submitted_at":"2026-02-24T11:54:06Z","title":"Don't Ignore the Tail: Decoupling top-K Probabilities for Efficient Language Model Distillation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T20:09:47.931263Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.20816"},"observation_digest":"sha256:8f4cd0b140072af70683ebefe295eb243aded237b743dbdb016c4897aef0fb47","observation_id":"d70dd911-1d32-456a-b42a-6ff5c6fae70c","resolution":{"observed_at":"2026-05-15T20:10:18.013488Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-02T21:12:13.448510Z","title":"Gemma 2: Improving open language models at a practical size,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.21013","last_updated":"2026-05-29T17:02:38Z","snapshot_observed_at":"2026-08-02T21:12:09.620600Z","submitted_at":"2026-02-24T15:30:55Z","title":"Notes-to-Self: Scratchpad Augmented VLAs for Memory Dependent Manipulation Tasks","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T21:12:13.448510Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.21013"},"observation_digest":"sha256:d4aca319b1cf36b9b18085ae581c39bdc05370aee7f63c0b0f30f8d8ccb0ec8b","observation_id":"1a67be30-ec65-4772-a77e-7cf37899df3e","resolution":{"observed_at":"2026-08-02T21:12:13.448510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2603.01059","last_updated":"2026-04-09T00:42:09Z","snapshot_observed_at":"2026-08-02T10:05:40.434546Z","submitted_at":"2026-03-01T11:29:25Z","title":"GroupGPT: A Token-efficient and Privacy-preserving Agentic Framework for Multi-User Chat Assistant","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T18:27:16.527361Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2603.01059"},"observation_digest":"sha256:9eab8cf2fdda02a7a4d8980baa6a4a5bb3f1245cb213c296e9f0d2a7763ea40d","observation_id":"e6667f46-8dcb-44f5-a541-651b836179cf","resolution":{"observed_at":"2026-05-15T18:30:14.486076Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2603.08182","last_updated":"2026-04-29T07:08:05Z","snapshot_observed_at":"2026-07-06T22:48:21.803560Z","submitted_at":"2026-03-09T10:03:17Z","title":"TildeOpen LLM: Leveraging Curriculum Learning to Achieve Equitable Language Representation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T14:56:31.218106Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2603.08182"},"observation_digest":"sha256:b988e10b076277988f56c397e739bade2ef58fa6e8cfc65ec4879c28febd5dab","observation_id":"bf1b2a48-2dfe-4167-954d-c57261edf9d8","resolution":{"observed_at":"2026-05-15T15:00:05.799435Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2603.10477","last_updated":"2026-04-08T07:03:59Z","snapshot_observed_at":"2026-08-03T13:46:05.416163Z","submitted_at":"2026-03-11T07:00:59Z","title":"PEEM: Prompt Engineering Evaluation Metrics for Interpretable Joint Evaluation of Prompts and Responses","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T13:57:41.428695Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2603.10477"},"observation_digest":"sha256:837d527babbc968260515c188f8b4bf3382ad367430ad4f1c9ee37d6dec42010","observation_id":"b42f5fa3-743a-4d57-89ad-2e6f542d8226","resolution":{"observed_at":"2026-05-15T14:00:03.045380Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-02T21:02:28.102146Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.19250","last_updated":"2026-06-02T05:03:01Z","snapshot_observed_at":"2026-08-02T21:02:24.005559Z","submitted_at":"2026-02-25T06:20:36Z","title":"Can Structural Cues Save LLMs? Evaluating Language Models in Massive Document Streams","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T21:02:28.102146Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2603.19250"},"observation_digest":"sha256:46ce871abafc0adeb7c9c38569a0f1977d4b6d0014c7f9897b7ecc9e2995a122","observation_id":"e53bc2b4-1f63-49bc-9cbc-97ff19b5c1c4","resolution":{"observed_at":"2026-08-02T21:02:28.102146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-02T17:31:44.929677Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25112","last_updated":"2026-07-28T22:49:39Z","snapshot_observed_at":"2026-08-03T08:28:54.835536Z","submitted_at":"2026-03-26T07:38:28Z","title":"Do LLMs Know What They Know? Measuring Metacognitive Efficiency with Signal Detection Theory","version":3},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-02T17:31:44.929677Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2603.25112"},"observation_digest":"sha256:a418a0153c372f2f3ad3ac64fc8f29ff8c476f31510f93faabb35ff4480407fd","observation_id":"4170011f-2608-4390-bd99-3929201552e0","resolution":{"observed_at":"2026-08-02T17:31:44.929677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2603.26603","last_updated":"2026-05-20T17:48:34Z","snapshot_observed_at":"2026-07-06T22:50:50.593464Z","submitted_at":"2026-03-27T17:00:25Z","title":"Sustainability Is Not Linear: Quantifying Performance, Energy, and Privacy Trade-offs in On-Device Intelligence","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-21T09:27:34.204972Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2603.26603"},"observation_digest":"sha256:2273062a87a4c54699ab8a04c77705501bc84f197d4016f803d827dec54ad145","observation_id":"0ded0282-75a9-4492-8dca-ccd9403128bb","resolution":{"observed_at":"2026-05-21T09:29:56.925309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2603.27343","last_updated":"2026-05-03T14:03:35Z","snapshot_observed_at":"2026-07-06T22:50:55.897076Z","submitted_at":"2026-03-28T17:25:11Z","title":"WMF-AM: Probing LLM Working Memory via Depth-Parameterized Cumulative State Tracking","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-14T22:01:15.475633Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2603.27343"},"observation_digest":"sha256:61af08804e1d8110e244be6f3b0472e03dc77360814872329c7d736eb62555ad","observation_id":"52a93422-e8a3-4742-8c80-25f23678e11c","resolution":{"observed_at":"2026-05-14T22:03:03.120123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2604.02525","last_updated":"2026-05-07T21:33:53Z","snapshot_observed_at":"2026-07-06T22:51:53.458444Z","submitted_at":"2026-04-02T21:24:15Z","title":"AdaHOP: Fast and Accurate Low-Precision Training via Outlier-Pattern-Aware Rotation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T20:51:39.641700Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2604.02525"},"observation_digest":"sha256:9a9a633f1490a35bdceb40163d0314c39fafe92401fe08ce24f3aa3915fb8c42","observation_id":"ad21d588-9aef-42a6-8dda-80953d98b610","resolution":{"observed_at":"2026-05-13T20:53:15.720184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2604.03260","last_updated":"2026-04-29T02:07:19Z","snapshot_observed_at":"2026-08-01T18:14:45.126825Z","submitted_at":"2026-03-12T14:06:04Z","title":"Why Attend to Everything? Focus is the Key","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-15T11:55:36.701888Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2604.03260"},"observation_digest":"sha256:995fca0e760202a78cb3a361cfb6e905c0091f43cfc323dc1b620424e1732086","observation_id":"4733245d-7a10-41b9-8d0a-06ab850d682d","resolution":{"observed_at":"2026-05-15T11:59:59.655178Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2408.00118/citation-record","integrity":"/paper/2408.00118/integrity","json":"/paper/2408.00118/citation-record.json","paper":"/paper/2408.00118"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agarwal, N","venue":null,"work_id":"a7703167-db43-41f4-a282-4cdc8c584424","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:047a92440aeb80785af0a37403f113b55979495fa381ef69342b76afe91dfcf7","observation_id":"25af42fc-7c75-4f90-9de3-29da6257dc27","resolution":{"observed_at":"2026-05-10T12:11:16.626406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llama 3 model card","venue":null,"work_id":"008d23c2-07d0-4784-a704-56521d627c6b","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:083e9a2cc34c6c47163e66b3d7f558a9fdef00498df1a8ee05ea980703e96c74","observation_id":"940aec53-6b16-4721-94cb-b835917741a5","resolution":{"observed_at":"2026-05-10T12:11:16.631008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Almazrouei, H","venue":null,"work_id":"29ce5015-6493-4cdb-9d40-83551c1d7058","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ae5b342f7ec6b506c684c8480d3ba6d0b6cd5e5c2f2fb93e35311fffb7912648","observation_id":"77e025f9-3c42-4395-a130-43b2a6840998","resolution":{"observed_at":"2026-05-10T12:11:16.633250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Barham, A","venue":null,"work_id":"d3d67d96-f15e-42d9-9361-236a63e80984","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:3f88379c79ce260248e411b4646a31a4485fd3f8e773fe1b5b1e8bf3fd0fcb4a","observation_id":"b8fd7b7f-86bf-495b-90f2-8d1d98e9edef","resolution":{"observed_at":"2026-05-10T12:11:16.635172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chiang, L","venue":null,"work_id":"0a2e0bf3-b2de-4c73-9707-690b4d5f6246","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:001e385aed912fbf53e787617a1fecbed7f6e677723c41464bb23453df723341","observation_id":"5b7ea650-c76e-4394-98b5-1d9aea6a1ea7","resolution":{"observed_at":"2026-05-10T12:11:16.637795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini: A family of highly capable multimodal models","venue":null,"work_id":"bda98422-66a3-4bcb-85f2-3dbf8e50bf6a","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:dfad296c453c749d2eff66278b5dab0c72e7b9a21d0811ca501673a95f405de1","observation_id":"74fd6fc0-7f9e-4051-8c5f-5f5019460d88","resolution":{"observed_at":"2026-05-10T12:11:16.640031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":"7018963c-e01a-459a-ba15-5dbde07949be","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:26472c1bc0cb0b08cbb88a9b43bc7ef8712602e2c6a8480bee0d6de5eb53099d","observation_id":"a19e0f6f-49bd-4790-b293-6e0ff125742c","resolution":{"observed_at":"2026-05-10T12:11:16.642378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":"5109c76b-79ad-41dc-8430-6655aefba5ae","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:006b800fda3869ec6c01083b2bdcce6956efe7d0ca068d3011c5cc9275932ffd","observation_id":"7f543331-2f44-42c4-99b1-f67d2d6a9339","resolution":{"observed_at":"2026-05-10T12:11:16.644587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e2402f1a-5097-4258-a4ae-0f83e6cc0a6f","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:c2a912c8bc2f5cec049318bcfe68bea1b3240d9c1bde93263bd0d5ce06435e2e","observation_id":"087746ad-ffcd-43d5-a87b-108c99461ded","resolution":{"observed_at":"2026-05-10T12:11:16.646841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fe9e6cdb-6368-4ad0-8937-5d59008218cc","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6f8444b00aaf21112e67877cf8913d5067e94a49a7ca5239156948c488236998","observation_id":"63d14a7a-c3d3-400d-a6bd-429a0c18fd7f","resolution":{"observed_at":"2026-05-10T12:11:16.649062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10524","last_updated":"2024-02-16T09:14:49Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T09:14:49Z","title":"LLM Comparator: Visual Analytics for Side-by-Side Evaluation of Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.10524","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.10524","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kahng, I","venue":null,"work_id":"1ae1087d-24cb-4fcf-bd3f-99fe17fc7d6e","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2402.10524","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:2061a181d0b43d7ee13e8946f25a605e26597c7db709effe1d09f331c95885b7","observation_id":"ed8576da-9801-4d39-88fe-af3cddc4cab2","resolution":{"observed_at":"2026-05-10T12:11:16.385993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11671","last_updated":"2024-01-04T18:46:39Z","snapshot_observed_at":"2026-07-06T17:04:54.448866Z","submitted_at":"2023-12-18T19:27:09Z","title":"Evaluating Language-Model Agents on Realistic Autonomous Tasks","version":2},"cited_work":{"arxiv_id":"2312.11671","doi":"10.48550/arxiv.2312.11671","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.11671","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Evaluating language-model agents on realistic autonomous tasks","venue":null,"work_id":"7c45ae0e-510a-4bc0-ab18-ca357a0507c2","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2312.11671","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a70f8885244ea7d058882af66ee116d7dfc3cfc90dbba95cdd3fb858bf12e3d2","observation_id":"616b96ab-7631-4454-8025-141bf720e352","resolution":{"observed_at":"2026-05-10T12:11:16.499532Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:37.750386+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:37.750386+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03315","last_updated":"2024-08-19T20:08:29Z","snapshot_observed_at":"2026-07-06T17:12:22.481744Z","submitted_at":"2024-01-06T22:25:42Z","title":"Malla: Demystifying Real-world Large Language Model Integrated Malicious Services","version":3},"cited_work":{"arxiv_id":"2401.03315","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.03315","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Malla: Demystifying Real-world Large Language Model In- tegrated Malicious Services","venue":null,"work_id":"2782d928-c42d-41b2-a4fb-92dff30193fc","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2401.03315","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:637431cb6aa1ad234bcc2c14d8ed5bc200546f328d2fb2f1e71fdbad043b5ea4","observation_id":"95b9f052-0830-47c2-abb9-c843a7efaaf8","resolution":{"observed_at":"2026-05-10T12:11:16.506166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Personal Communication","venue":null,"work_id":"f5beabdd-64a6-4d50-8898-f7e30a965921","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:950331fe2325dc4edb318caa76b717b73a09b6ca0d4a6edfbcbfaad712ba33a5","observation_id":"cd13ae36-3683-44b3-ab72-909740377178","resolution":{"observed_at":"2026-05-10T12:11:16.651479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06541","last_updated":"2023-10-21T11:49:09Z","snapshot_observed_at":"2026-07-06T14:51:22.788392Z","submitted_at":"2023-02-13T17:34:13Z","title":"Towards Agile Text Classifiers for Everyone","version":2},"cited_work":{"arxiv_id":"2302.06541","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06541","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards agile text classifiers for everyone","venue":null,"work_id":"e7b600c9-d820-4577-a448-a958b4884455","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2302.06541","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:509060fe44f5d7aab43127df5feeebc1641d23a67dfd2d5f696c97110d548a56","observation_id":"9d38056d-d606-4828-a1ae-45813202265b","resolution":{"observed_at":"2026-05-10T12:11:16.393672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13793","last_updated":"2024-04-05T12:26:11Z","snapshot_observed_at":"2026-08-03T18:07:25.978533Z","submitted_at":"2024-03-20T17:54:26Z","title":"Evaluating Frontier Models for Dangerous Capabilities","version":2},"cited_work":{"arxiv_id":"2403.13793","doi":"10.48550/arxiv.2403.13793","metadata_source":"pith","pith_arxiv_id":"2403.13793","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Evaluating frontier models for dangerous capabilities","venue":"cs.LG","work_id":"2f7df923-9116-4ade-9fca-e78987af4e53","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2403.13793","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:093cd1ee90b08d2a5c169cdd5bd4d3cab0246499905fea95c09341517b8cbea7","observation_id":"5e4744a9-9afb-4475-8606-520bfe93d33a","resolution":{"observed_at":"2026-05-10T12:11:16.476742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Radford, J","venue":null,"work_id":"07fb1a81-b55b-4ce5-82a1-fdb30d148e32","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:3964e773fc6b3cefb482c1c44e7c94e6697f574b418156703ac38798bb32beda","observation_id":"2e09a5af-9844-41f3-af18-4fbffc2ffb2a","resolution":{"observed_at":"2026-05-10T12:11:16.653634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eec7e127-6d0f-4c7c-ac89-f3791c64726b","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:811ec4f7a9a462b047cb4bc9e9d495e5754f0a9e19e37e77fc89c77848fae724","observation_id":"dcce3ec5-f3a8-45e0-89d0-95753eae523b","resolution":{"observed_at":"2026-05-10T12:11:16.655942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"48ac1f6a-a05f-4771-8e4d-2854f085fc30","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:f31dc09302f30583f568be854085e0e713194bfd5d635cc691845a613a0bf521","observation_id":"ef240f71-e3b6-4904-a401-3f617529f224","resolution":{"observed_at":"2026-05-10T12:11:16.658225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roberts, H","venue":null,"work_id":"b5a3be0b-26ff-4cd5-80c3-742d6391c955","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9610725093edfd84737e52dc3de5f92022ae8ddf82120f3f353d92bd11478179","observation_id":"eb25ba8c-c80e-435f-ab39-804b44e1c2b3","resolution":{"observed_at":"2026-05-10T12:11:16.660715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:06ff80910308f0be4ef32ccf05785c721d72ee5ac9a170c8dc7873340513e675","observation_id":"5c16d358-cca0-46ce-8ba2-7bc8d01dac6a","resolution":{"observed_at":"2026-05-10T12:11:16.458916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Suzgun, N","venue":null,"work_id":"690c302c-a2f7-40c5-b7ab-4a709f0e7830","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:1bd0ea4cfbf6525f267ce526cde656d078865787d91dbe93de4956fbba01a8ca","observation_id":"1f7755f0-4858-4c1d-a801-bb28689f88d7","resolution":{"observed_at":"2026-05-10T12:11:16.663080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"caed4619-0915-4d65-88fe-e6d213c10833","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a8a73ef4ab0d9e13a1da7a8ce5955177916e76f22c1346b59bc1fecb3d8af61f","observation_id":"bf103e76-a33f-4375-ad3d-83506a411e64","resolution":{"observed_at":"2026-05-10T12:11:16.665323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05122","last_updated":"2020-08-12T06:07:44Z","snapshot_observed_at":"2026-08-02T21:59:17.195799Z","submitted_at":"2020-08-12T06:07:44Z","title":"The Language Interpretability Tool: Extensible, Interactive Visualizations and Analysis for NLP Models","version":1},"cited_work":{"arxiv_id":"2008.05122","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2008.05122","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The language interpretability tool: Extensible, interactive visualiza- tions and analysis for nlp models","venue":null,"work_id":"e3cf7b33-d673-42c4-918a-314e9bb3732f","year":2008},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2008.05122","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:36ff62e8718d4fe2670d95142e8851b33a9043eb6de6688ef7b73b7222b46bfe","observation_id":"1c007b96-6730-4b2b-b2a9-480de912e31d","resolution":{"observed_at":"2026-05-10T12:11:16.502612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Touvron, T","venue":null,"work_id":"52df00ab-8483-4b3a-8cf6-5305694c3ff0","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:5aee5289a69ee860b47bccde7ff34a84c920d9de0dc48359146ffce36eafa534","observation_id":"7b36af60-a665-4225-8289-065b0176f77e","resolution":{"observed_at":"2026-05-10T12:11:16.667830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"grok-1","venue":null,"work_id":"de341b3b-b712-44c7-b124-8afc0b6ea42f","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:55fb180c0336680c920e391b74e62599807d55a42c437e483bdf09d679300b72","observation_id":"3026e579-659b-4350-ab4f-4aa1f50f81e1","resolution":{"observed_at":"2026-05-10T12:11:16.670352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xla: Optimizing compiler for tensorflow","venue":null,"work_id":"5b913984-7156-44e6-887c-d4371e91a2f2","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:45b16edf1e24a36a4b911c3e9860e3079ed0abdd894178a59418ef6a4a4c7caa","observation_id":"501919f0-6f56-45ca-8aa4-a89c7f64aecf","resolution":{"observed_at":"2026-05-10T12:11:16.672576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14898","last_updated":"2023-10-30T17:52:18Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:59:50Z","title":"InterCode: Standardizing and Benchmarking Interactive Coding with Execution Feedback","version":3},"cited_work":{"arxiv_id":"2306.14898","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14898","snapshot_observed_at":"2026-06-29T11:23:20.895534Z","title":"Intercode: Standardizing and benchmarking interactive coding with execution feedback","venue":null,"work_id":"1c47eed5-7e6c-49c9-9060-401622d6c1e4","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2306.14898","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:e8c196e518b81a346fc757385c54880103a1ce628af13052e9ffedc2087b29dc","observation_id":"c7fad0a8-726e-4417-be4f-a7eba076ae48","resolution":{"observed_at":"2026-05-10T12:11:16.397576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09940","last_updated":"2017-01-12T23:55:36Z","snapshot_observed_at":"2026-07-06T05:20:39.825511Z","submitted_at":"2016-11-29T23:22:39Z","title":"Neural Combinatorial Optimization with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1611.09940","doi":"10.48550/arxiv.1611.09940","metadata_source":"pith","pith_arxiv_id":"1611.09940","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Neural Combinatorial Optimization with Reinforcement Learning","venue":"cs.AI","work_id":"86c3352e-7964-488c-9a6a-22803e1cd602","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1611.09940","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:7dcca5ed18098ab7a4244231918eb320d380d23ea21019c6e83e23a2b249365b","observation_id":"8f8a465d-4230-4496-adab-51637e406341","resolution":{"observed_at":"2026-05-10T12:11:16.419147Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concrete problems in","venue":null,"work_id":"ca2d6b8b-08cd-45d0-82a5-71132dd54f31","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:fd26bb5da5efc7fb9ed8739576a87cde330915e3cf4d5b4190ed0058865a4a15","observation_id":"e16a6ce6-3e52-4788-96cd-56d1c7a9394d","resolution":{"observed_at":"2026-05-10T12:11:16.674897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":"2202.07646","doi":"10.48550/arxiv.2202.07646","metadata_source":"pith","pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Quantifying Memorization Across Neural Language Models","venue":"cs.LG","work_id":"35487ec1-b90b-4ace-95bd-1bce30064b2e","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:bd08d5cd92d7f76f3c9c6df9f8e72d324b8e8b79e182bbde3af705c480247f86","observation_id":"e81f3096-2659-4f3d-8a00-8a76f9250c16","resolution":{"observed_at":"2026-05-13T22:04:59.782633Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":"2311.17035","doi":"10.48550/arxiv.2311.17035","metadata_source":"pith","pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Scalable Extraction of Training Data from (Production) Language Models","venue":"cs.LG","work_id":"7ee4de98-0bdd-47ab-abe6-1865cb65b1ae","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:dd11ec65c6f811354eb3493c57b56b232cdf2d238313d5ccc2fa9bac882a62be","observation_id":"38642a91-d54f-4b95-8067-3f1670372518","resolution":{"observed_at":"2026-05-15T19:00:47.082021Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"30th USENIX Security Symposium (USENIX Security 21) , pages=","venue":null,"work_id":"23f94b87-69cd-4613-96c4-8d02e8ad6cce","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:4bc992afb014540193f005c1b204e7f33d7caddf1b76d6d6c91cee7ef6d20a82","observation_id":"08e5c942-7847-455b-9d33-235a29e29771","resolution":{"observed_at":"2026-05-10T12:11:16.677146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17546","last_updated":"2023-09-11T16:58:48Z","snapshot_observed_at":"2026-08-04T04:34:05.607113Z","submitted_at":"2022-10-31T17:57:55Z","title":"Preventing Verbatim Memorization in Language Models Gives a False Sense of Privacy","version":3},"cited_work":{"arxiv_id":"2210.17546","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.17546","snapshot_observed_at":"2026-07-03T01:27:30.902143Z","title":"Ippolito, F","venue":null,"work_id":"c455adb7-ba4c-4537-827c-98625b5b82c3","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2210.17546","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ff462cf07b879d96c593ef90804d54cbe81e062c1cc7bfd49efb5c8721573f4a","observation_id":"6957b76d-db48-4436-828b-c07a5542ca39","resolution":{"observed_at":"2026-05-10T12:11:16.492729Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04662","last_updated":"2023-09-09T02:34:01Z","snapshot_observed_at":"2026-08-02T11:19:37.704634Z","submitted_at":"2023-09-09T02:34:01Z","title":"MADLAD-400: A Multilingual And Document-Level Large Audited Dataset","version":1},"cited_work":{"arxiv_id":"2309.04662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04662","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Choquette-Choo, Katherine Lee, Derrick Xin, Aditya Kusupati, Romi Stella, Ankur Bapna, and Orhan Firat","venue":null,"work_id":"5e31eb8d-5d31-4ec4-92d5-0941720097cc","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2309.04662","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6d57e4a44ba5a7bcff0a0c284c530573849e7507e80e7013fe67d8436f17a87f","observation_id":"99d958ca-fe43-46f7-83de-4e36a0fd134c","resolution":{"observed_at":"2026-05-10T12:11:16.495999Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NeurIPS , year =","venue":null,"work_id":"46a9cdba-e406-4559-b6bc-04c08786daf1","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9c37566f957dc30146bc076dffd3e5f4b4b3206505139507d1bcc8ce59a7655d","observation_id":"a2675556-ffc7-4f0c-a0c3-95e686d48112","resolution":{"observed_at":"2026-05-10T12:11:16.679414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:21:44.431618Z","title":"2023 , eprint=","venue":null,"work_id":"2cfd77f4-17ef-4285-b602-76165f04f2c9","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:4439015643fbd3d67364ef7e43c87ef1f7f5bedc6cf3969862e6cab891eb0128","observation_id":"32cce3e2-4dd8-4c29-b4d2-cddaca795d93","resolution":{"observed_at":"2026-05-10T12:11:16.681553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T07:40:48.021879Z","title":"2022 , eprint=","venue":null,"work_id":"d058fb05-642a-46e9-92ec-918b9350075a","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:860bc760fed121cb8c54dfc040890c805e22033467f3fe5a4419e67f29e08383","observation_id":"b0604a0b-6204-444b-9e2c-911b72e14f22","resolution":{"observed_at":"2026-05-10T12:11:16.683587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02136","last_updated":"2018-10-03T07:32:57Z","snapshot_observed_at":"2026-08-02T06:41:33.803920Z","submitted_at":"2016-10-07T04:06:01Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","version":3},"cited_work":{"arxiv_id":"1610.02136","doi":"10.48550/arxiv.1610.02136","metadata_source":"pith","pith_arxiv_id":"1610.02136","snapshot_observed_at":"2026-07-10T19:27:32.286105Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","venue":"cs.NE","work_id":"010332fc-8aad-4ab2-a1de-1ddd0a3c4b7f","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1610.02136","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:79efa58a057bb5835c0d47efa313f58931e0fd6549f1cd3ebd43cc5226fe96dd","observation_id":"ed18ddde-3f4f-4ac4-9adc-8f908d4b0319","resolution":{"observed_at":"2026-05-12T18:23:45.262282Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:24.594975+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:24.594975+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":"2305.13245","doi":"10.48550/arxiv.2305.13245","metadata_source":"pith","pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","venue":"cs.CL","work_id":"b73ad5b2-e553-4c71-b0c9-67e67ba7b158","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:8640d97c62ae74335ec2aaa15363b9f9d40889b0a862607b69a3808031a6af6b","observation_id":"0c65bfec-1f31-4e47-a055-e2d26b380999","resolution":{"observed_at":"2026-05-11T06:53:59.644169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:181ac7a25371a455c92085c57f322a241dede2227ad7bc42c346d8fe6678e582","observation_id":"b4d8f6dd-a4ad-4c80-b38a-a7c82448d183","resolution":{"observed_at":"2026-05-10T16:01:32.444768Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mastering the game of","venue":null,"work_id":"9fd4a21f-922c-474a-8cbf-44afe2d81f74","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:8ed5be838585c74e4dabb14c473e623a7721bca147cd71e3a3ccf1ac744e20be","observation_id":"234dfa51-a7ff-42fe-ab4f-ae7bb0399b69","resolution":{"observed_at":"2026-05-10T12:11:16.685601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 50th Annual International Symposium on Computer Architecture , pages=","venue":null,"work_id":"1958d684-f3aa-4731-954a-e374cea35e55","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:4a8959ee173433012e021540d2079118b450d5785eebe53a0297b73706b2ce28","observation_id":"6b2cc0df-d176-4651-b560-178f03f10458","resolution":{"observed_at":"2026-05-10T12:11:16.687905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"d3670003-811e-494e-b001-fa07e671cbf5","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d0612c98d872b6d2ad72de2be69dd30532e901066ffc6d529259a4595df69364","observation_id":"9216a802-26ca-4441-97e0-19232b5ac8fb","resolution":{"observed_at":"2026-05-10T12:11:16.690078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-07-06T08:40:06.727297Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":"1911.11641","doi":"10.48550/arxiv.1911.11641","metadata_source":"pith","pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","venue":"cs.CL","work_id":"0d865a62-6376-4606-8d3a-eeb3b6e9ba6d","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9b0297179ca2c47db84c35b30cb7fafb09f3b9427bdaa0ff0d94d9e3a586f721","observation_id":"e5e358ef-9e8a-44c2-838d-06cc71f0f6ea","resolution":{"observed_at":"2026-05-17T14:55:18.098549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":"1904.09728","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-07-08T01:44:26.198243Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","venue":"cs.CL","work_id":"3f93670e-0ae7-40e5-bed5-74c216638dd1","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d96f5fbf2cdb7e8c5881ad14d58487af6a63cce55f165759fbc8bcf65193b9de","observation_id":"2a476dd5-d428-4429-b743-b6cea75a71b1","resolution":{"observed_at":"2026-05-13T12:22:26.192007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":"1905.10044","doi":"10.48550/arxiv.1905.10044","metadata_source":"pith","pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","venue":"cs.CL","work_id":"511eeb84-4b95-46d5-b14f-50da43f4f19f","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:90aff5f40198bae05c7054093209913cf2d0a0b54a9e437c8fcc2476a7863f95","observation_id":"51d1d710-4d57-43b1-b640-ea370ab44197","resolution":{"observed_at":"2026-05-13T09:46:19.833273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/tacl_a_00276","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:46:14.494802Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":"Transactions of the Association for Computational Linguistics","work_id":"45551929-96dc-40f3-9f89-10e76731cc24","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:cb395addb8df1d7a9efb6f30c4273d2d25cc25e513c6103a710baa7465c7199f","observation_id":"cd33e9ad-f1df-4304-8ecf-3fd12fcf32ec","resolution":{"observed_at":"2026-05-10T12:11:16.378030Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-10T22:21:01.890529+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T22:21:01.890529+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-07-11T01:37:42.666395Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:09c106acd9f85d64da3aa28465d9a153fd59d937c946af0bedc7f0920f085d83","observation_id":"a6b9bd1f-a060-490d-88fd-d673099d149a","resolution":{"observed_at":"2026-05-10T12:43:44.770948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T01:08:06.256034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:b8eca3946c5af40ba371440520937ae03cb02693386572c350bf7ad11418c49d","observation_id":"3ff01e58-50d6-45bb-9d85-beb7473494b1","resolution":{"observed_at":"2026-05-10T12:11:16.415038Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:08:02.288369Z","title":null,"venue":null,"work_id":"296b9de5-0258-4b29-832c-3abf245789ad","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:81cbac3d9d0bb91907780229468ff2628457c3ec3d5abebec007a845cdeeb355","observation_id":"2c139ecd-9c16-4049-bcbe-3d41618db13d","resolution":{"observed_at":"2026-05-10T12:11:16.692377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:551e6f2e653a6d6042f54082d09f15caa853ae46ef439b92dd20fdd2c583c517","observation_id":"f11d48cd-60fd-4ece-afcb-dda0532df0b5","resolution":{"observed_at":"2026-05-10T12:11:16.422721Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-11T03:27:46.202228Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:db72d994e8252cf26e30a70bd9cb1b8a73b389862b21830dadd74e705fa7152e","observation_id":"46c9fca2-a6cc-4520-8c86-fd288fbaeef1","resolution":{"observed_at":"2026-05-10T12:11:16.429614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:655d1c1b408691f83aac6eb308adb306e995936ad2cc96f7f1269bb209c2e1c8","observation_id":"8ead0a5e-f2a5-4a06-a710-bd1cd1e33ed9","resolution":{"observed_at":"2026-05-10T12:11:16.436959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-07-06T08:09:59.842324Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":"1907.10641","doi":"10.48550/arxiv.1907.10641","metadata_source":"pith","pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","venue":"cs.CL","work_id":"9587a902-54ad-434e-9cbc-bdfe54b5d3bf","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:2997c77fffa59b625e2809adc5c9e754ead2c36d6cab5b6fa3104c3039e07fc8","observation_id":"4ec7bf5b-f300-4454-a399-5dababc0c52e","resolution":{"observed_at":"2026-05-14T17:20:15.117976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06031","last_updated":"2016-06-20T09:37:17Z","snapshot_observed_at":"2026-07-06T05:00:33.838934Z","submitted_at":"2016-06-20T09:37:17Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","version":1},"cited_work":{"arxiv_id":"1606.06031","doi":null,"metadata_source":"pith","pith_arxiv_id":"1606.06031","snapshot_observed_at":"2026-07-10T15:27:20.134743Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","venue":"cs.CL","work_id":"3775e6d1-2f28-4791-82a9-538c0507512c","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1606.06031","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:2c46638279bed6253b281ff129beb88ea0ac89a7c0ab64a7086ba5d84e7a0a9f","observation_id":"4241c53f-ef2d-49ff-bdea-a311f0685c4e","resolution":{"observed_at":"2026-05-10T12:11:16.451267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":"1705.03551","doi":"10.48550/arxiv.1705.03551","metadata_source":"pith","pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","venue":"cs.CL","work_id":"f20e62ba-6265-4b97-aa8c-ddefaf2f5762","year":2017},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:14e92c124828058dc26b8658bcf269b68aa6cdc0a91abd05a202f05eb2ff92bb","observation_id":"67d00269-6d01-4e7d-a3bc-f99b33695569","resolution":{"observed_at":"2026-05-11T15:00:28.883814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:06:27.880303Z","title":"2023 , eprint=","venue":null,"work_id":"8a1e4cb7-b339-4ab3-a5b3-604af3598ddb","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:bdbf777f40eb42987e78b7e07196d6f5d56c21816d1da4867220314b8aaa68f8","observation_id":"e41bb05e-6735-4b23-8e76-f7ea69b3bdaf","resolution":{"observed_at":"2026-05-10T12:11:16.694858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:16:24.111187Z","title":"2023 , eprint=","venue":null,"work_id":"329bd184-e5b5-42bc-848f-e4d9af020cd5","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9b1983e632f909dad8003af656bbc3afb5969a0f84555c6cf588689304f8b9a8","observation_id":"e4c9c86c-7620-4902-9d4b-c5b797110018","resolution":{"observed_at":"2026-05-10T12:11:16.697527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:36:29.930966Z","title":"2023 , eprint=","venue":null,"work_id":"8222462c-c885-414a-9965-ea8425278550","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ac5abe649287f2d6ef470a03a074d8a2fdccc5de8c669923c91be347efa64ae2","observation_id":"e815344c-cae3-409f-8948-bd2d638c8ce4","resolution":{"observed_at":"2026-05-10T12:11:16.700054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"fd6f1b62-ff0f-442d-acf4-3e47f159b5f0","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:b0bb91ab5094b534a64dc099f2af501ef3a5a75b827ec4d53f87325a43ec1a7c","observation_id":"c90255cd-c6b7-4db0-94d2-9e01d217e070","resolution":{"observed_at":"2026-05-10T12:11:16.702463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":"2309.05463","doi":"10.18653/v1/2025.findings-acl.996","metadata_source":"pith","pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","venue":"cs.CL","work_id":"618db55c-6906-42e3-a4c5-c17088cb1df8","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:dd086325e4cfd687ba3d93f2103588e099519779064153fc0c8fad977c7910d0","observation_id":"3317a70f-69f1-4404-b3dd-3070aad4fdf1","resolution":{"observed_at":"2026-05-14T19:18:01.425637Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:e0efc65bafe7a38635864bd5021978c67460da0b0c747d05581a8e3f97ea5e94","observation_id":"feb83365-ebd2-4eb6-bc8f-2dc51ec62687","resolution":{"observed_at":"2026-05-10T12:11:16.483151Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.3215","last_updated":"2014-12-14T20:59:51Z","snapshot_observed_at":"2026-08-02T03:58:50.109606Z","submitted_at":"2014-09-10T19:55:35Z","title":"Sequence to Sequence Learning with Neural Networks","version":3},"cited_work":{"arxiv_id":"1409.3215","doi":"10.48550/arxiv.1409.3215","metadata_source":"pith","pith_arxiv_id":"1409.3215","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Sequence to Sequence Learning with Neural Networks","venue":"cs.CL","work_id":"b32e3d72-9b05-4275-b9a0-0c77d9ac844d","year":2014},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1409.3215","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:73fa44042b4e0bb816d08499afec71074d16b6e862d652f4d03221a29d28b306","observation_id":"2371c6da-aa0a-4d99-ac42-fbbd2cc85977","resolution":{"observed_at":"2026-05-10T12:11:16.486272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:52:44.965337+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:52:44.965337+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":"1706.03762","doi":"10.1186/s13550-021-00830-6","metadata_source":"pith","pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-07-14T22:52:12.858825Z","title":"Attention Is All You Need","venue":"cs.CL","work_id":"baafb5a2-5272-43bc-932f-09fa9ffe5316","year":2017},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a7f2be754083c4ee838e70e743fe958e59f156e3477c2a5bff57eea3dc661e6a","observation_id":"75292be3-00e0-4f93-9ce1-cc26cae27382","resolution":{"observed_at":"2026-05-10T12:11:16.489289Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:57:47.712205Z","title":"nature , volume=","venue":null,"work_id":"e6b92db6-c2c1-4e28-9c46-8d7bfebba8f1","year":2015},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:5b1545070d530a021be49031ea1a7cf7359a342a117e6111ee2c519fb9a27f0e","observation_id":"f71b5d9c-efbf-4fb5-9381-1f3f873f8010","resolution":{"observed_at":"2026-05-10T12:11:16.705160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"b0c16b33-2a20-4303-b331-85fa5256ae37","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ac1d763257463dfdc32e91b06a6194c4ff42c96408517a89535bf20146505f5d","observation_id":"198f44cc-ba5b-434f-8c88-8a31bb828f03","resolution":{"observed_at":"2026-05-10T12:11:16.707790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":"88999ab5-c29c-4b93-b7ae-b45bcdfc14f0","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:b55b2f7333813b6438035c28213ba37524a92819a3248e8bb8245fe6f2e35483","observation_id":"e44696c4-4014-4b6a-b76c-a7af4e45e443","resolution":{"observed_at":"2026-05-10T12:11:16.710349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2019 , url=","venue":null,"work_id":"3d6c4ae5-24eb-4cda-9462-b5cb8f881348","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:f72756b74178649088257d551b4945e5131c9aa7e12a1200c54de1eea31a4cc1","observation_id":"257dfda7-7ea3-40d9-926a-3d3db5b3835a","resolution":{"observed_at":"2026-05-10T12:11:16.712763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , publisher=","venue":null,"work_id":"541237ff-eed9-4221-b09b-565a42ab50fd","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:8e0803e965d3092c913c3816158d61a44ebcbe6607ca9b43c06e9483a0d639ca","observation_id":"045946fa-abc1-4c3d-a135-e297063db154","resolution":{"observed_at":"2026-05-10T12:11:16.715066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large Scale Distributed Deep Networks , url =","venue":null,"work_id":"f3e4ca9a-674a-4a2b-ba50-bf7c7144e5bb","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:92a9491636c041bfffd9b1b6a10f4d9b0f3261128e15732e0ee6e2d5f0ed86db","observation_id":"c6ab2678-e08a-4ddb-b5eb-9ff9e886bf0d","resolution":{"observed_at":"2026-05-10T12:11:16.717524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient Estimation of Word Representations in Vector Space , booktitle =","venue":null,"work_id":"6f76a975-79dc-4f69-866d-5ab6fa4ea53a","year":2013},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a64ae42b80ee49afa1b6b20761a1120704507d6d0eb784123353afb40b70fbea","observation_id":"b8c0c6c3-c0b5-43cb-8af0-a8da0fb63cd1","resolution":{"observed_at":"2026-05-10T12:11:16.720145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":"1810.04805","doi":"10.1111/jofi.12885","metadata_source":"pith","pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-07-12T02:22:28.232339Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","venue":"cs.CL","work_id":"ed240a10-5b19-406c-baa5-30803f465785","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:5f743565ddfce3188dc5d63d60ca97ebe164a593a3051590ea3c98a4e87b69e4","observation_id":"e669db9c-bf66-44b3-88ff-dcff7f0cf654","resolution":{"observed_at":"2026-05-10T12:11:16.517446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":"1910.10683","doi":"10.18653/v1/2020.acl-main.259","metadata_source":"pith","pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","venue":"cs.LG","work_id":"50e3b368-0243-4726-8186-233869802ad1","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:e03ede5fc1334945e657f29792d509264b24fa8028d089e723d3a4429035ecac","observation_id":"7d5be3e2-0e59-4316-8f60-dcc2b65ba15d","resolution":{"observed_at":"2026-05-12T05:37:56.023799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17189","last_updated":"2022-03-31T17:12:13Z","snapshot_observed_at":"2026-07-06T12:55:23.720351Z","submitted_at":"2022-03-31T17:12:13Z","title":"Scaling Up Models and Data with $\\texttt{t5x}$ and $\\texttt{seqio}$","version":1},"cited_work":{"arxiv_id":"2203.17189","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17189","snapshot_observed_at":"2026-06-30T15:44:48.510903Z","title":"Alexey Romanov and Chaitanya Shivade","venue":null,"work_id":"b4ce3d71-9be2-4401-8618-528a87b188bd","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2203.17189","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a086ebdbd3e67d841a053bd172738c58eff3a03a31dc3fb4fccdb4b928f1c6c6","observation_id":"863817d1-b906-4e25-af65-e89d0c8dbec7","resolution":{"observed_at":"2026-05-10T12:11:16.525059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":"1911.02150","doi":"10.48550/arxiv.1911.02150","metadata_source":"pith","pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-07-11T03:27:46.785958Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","venue":"cs.NE","work_id":"160ea164-b1d4-4adb-8ccb-a4655d8a0bb4","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:e5c14641db03f798c83d7a7f59432d4c20010d825b24ee289537d36808d67f6a","observation_id":"96dac0aa-9252-4980-89de-3657a4753216","resolution":{"observed_at":"2026-05-10T23:50:20.836519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":"2104.09864","doi":"10.48550/arxiv.2104.09864","metadata_source":"pith","pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-07-11T01:27:45.562618Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","venue":"cs.CL","work_id":"4e5eee26-cd04-4c7a-988f-3e6d1a1f0eb9","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9aa8f984bdb53da2a7d71b8a2d5936fe355b9705c3819da05525f81b2689f9ed","observation_id":"1118a66f-ad6c-4cd5-9a95-ac72224fa6a8","resolution":{"observed_at":"2026-05-10T19:37:06.679502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:47.452101+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:47.452101+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:22:42.115670Z","title":"2021 USENIX Annual Technical Conference (USENIX ATC 21) , pages=","venue":null,"work_id":"b9317880-19fa-4bbb-b572-777d32d6167d","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:2fd4ba1ca7e566ad50e82f27e32cb5cf85935ebf33f5d98b4b834619452c9c02","observation_id":"c5680e99-aba0-4baf-a167-2580512d86d1","resolution":{"observed_at":"2026-05-10T12:11:16.722776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-07-11T03:27:46.760869Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:bd5d677d7e8ada8549933d6fefba437f9c290d695c56341868c5ebf635de4287","observation_id":"767947b1-f978-4e22-9b96-46c61d5c479e","resolution":{"observed_at":"2026-05-10T17:05:01.922266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07467","last_updated":"2019-10-16T16:44:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-16T16:44:22Z","title":"Root Mean Square Layer Normalization","version":1},"cited_work":{"arxiv_id":"1910.07467","doi":"10.48550/arxiv.1910.07467","metadata_source":"pith","pith_arxiv_id":"1910.07467","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Root Mean Square Layer Normalization","venue":"cs.LG","work_id":"2e813694-442c-4650-ba76-478100469518","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1910.07467","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:185e66f5bdcdf08826a47cb625c94f6b5068b3c66e1bc0edadf69776145e6058","observation_id":"b8ab7f86-36b2-4f57-9c35-11c876d7a3e4","resolution":{"observed_at":"2026-05-17T18:45:27.296410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06226","last_updated":"2018-08-19T16:49:06Z","snapshot_observed_at":"2026-07-06T06:56:20.935388Z","submitted_at":"2018-08-19T16:49:06Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for Neural Text Processing","version":1},"cited_work":{"arxiv_id":"1808.06226","doi":"10.18653/v1/d18-2012","metadata_source":"doi_reference","pith_arxiv_id":"1808.06226","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Sentencepiece: A simple and language independent subword tokenizer and detokenizer for neural text processing","venue":"cs.CL","work_id":"81a6320b-c2e1-4d74-a03e-9e1ff6bbed8d","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1808.06226","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:567399326b2b48a9da665388a70c523dd295aae595749076115d426553358a19","observation_id":"b1b4d602-fcd7-44ac-9cd7-034e4f792c23","resolution":{"observed_at":"2026-05-12T20:09:07.599904Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-11T12:19:12.876508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T12:19:12.876508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04663","last_updated":"2021-12-23T21:29:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-10T20:54:58Z","title":"GSPMD: General and Scalable Parallelization for ML Computation Graphs","version":2},"cited_work":{"arxiv_id":"2105.04663","doi":"10.48550/arxiv.2105.04663","metadata_source":"pith","pith_arxiv_id":"2105.04663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"GSPMD: General and Scalable Parallelization for ML Computation Graphs","venue":"cs.DC","work_id":"0ab74606-fb17-4ead-898b-8086ae8cb3af","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2105.04663","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:2fc9522e5522f70bde21e79d29ef6a06e40b4a2386a9484b335fd7b600dd92b7","observation_id":"971b8f39-e680-405d-9ff3-9b97ddc8003e","resolution":{"observed_at":"2026-05-18T12:36:36.562059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"a890b0e8-08cb-474b-854c-03f63e2ff049","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ce6b65261842398a824a9caee2ac77bbb821df0ea43e404b0eff20adb7812251","observation_id":"5b7ec271-66cb-4db7-8538-b320d6c0a89f","resolution":{"observed_at":"2026-05-10T12:11:16.725155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":"2305.10403","doi":"10.48550/arxiv.2305.10403","metadata_source":"pith","pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-07-10T13:57:07.008081Z","title":"PaLM 2 Technical Report","venue":"cs.CL","work_id":"905ee9a7-ea61-4a94-bd62-2600cbe3e315","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9a0245e9973593d5799dfbf91e31d01d1292bdf5ff01a5773cff1ea82519b3be","observation_id":"22f50c1e-86cb-4c57-83f5-77f39ecadbf5","resolution":{"observed_at":"2026-05-12T11:59:27.667882Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:31:35.375640Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"7763f188-e71e-4330-b7df-6543ef5c2914","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:f815eda8364287c62e72528ec21ab1b8c9a803a345a472b09dd62863697bad83","observation_id":"76a1cd65-83a1-40c5-889c-10619749c952","resolution":{"observed_at":"2026-05-10T12:11:16.727822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T15:17:22.153922Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"bd577a47-49ef-4f8a-81ca-86cd88b71479","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a50294593160a0422c5d574e355b3f0dd1532a3b61c869be10b68d314e800ef4","observation_id":"47a34f2c-d50d-4e4a-8b4c-0ce69a5fa0af","resolution":{"observed_at":"2026-05-10T12:11:16.730458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T15:16:18.951245Z","title":"The method of paired comparisons , author=","venue":null,"work_id":"5feb0654-e8a0-4d93-967e-9878e00988c5","year":1952},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:4ee4d1a231ba55378e069721fcd760fdae6ec5255f49048330011646683cbb1e","observation_id":"0bbf94bf-8abc-406b-9ece-2d5f815cc1d1","resolution":{"observed_at":"2026-05-10T12:11:16.733100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T15:16:18.847440Z","title":"Machine learning , volume=","venue":null,"work_id":"c1d54d34-8857-4268-be1f-002a7c436d05","year":1992},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:b8ad0816b0bccb7a8f7c1f1f9c2a2cfa130767ee28710a458fd0abb7074a090d","observation_id":"5529a37c-d051-4746-8641-4f254c191e95","resolution":{"observed_at":"2026-05-10T12:11:16.735659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T06:40:46.516450Z","title":"2023 , eprint=","venue":null,"work_id":"5a14d1ee-6ab9-4f20-99aa-8dd95900fdab","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:fe120961a7d367a706b59d7d33696a70b4dac9dfa3c6bedc4641c1921368ef92","observation_id":"2516e220-1471-46f9-a1ba-bfed6f3903ed","resolution":{"observed_at":"2026-05-10T12:11:16.738274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:25:58.161975Z","title":"2022 , eprint=","venue":null,"work_id":"57843bfd-d117-4dd9-9b57-8d42a4f2a8ab","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:e2f13e3df07046838fe2992468a64ef529499bb5e71ec3ceff1972a381278d7c","observation_id":"87d20fb2-2fa3-4bcc-a0f7-24eb9dc8ca51","resolution":{"observed_at":"2026-05-10T12:11:16.740993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , eprint=","venue":null,"work_id":"26be9590-f9cb-49ae-b1fd-303eb95375d2","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:24291117f4ba9f548e7f63f428d0c04f3c6a2224a24b0364a435dc7584b8c4f7","observation_id":"ea616339-c01a-4e18-8a39-34cf61f7d148","resolution":{"observed_at":"2026-05-10T12:11:16.743427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T20:02:56.622302Z","title":"2016 , eprint=","venue":null,"work_id":"c7b2dda5-4b9d-410c-8ed9-98dbc48cd7cc","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:e9b31f7924136be2db09ff99acbe7c6a4b3e59406fbce70e73783641925ac34c","observation_id":"91f88723-cfe3-434f-a6cb-06df568c02fe","resolution":{"observed_at":"2026-05-10T12:11:16.745900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:46:15.077252Z","title":"2019 , eprint=","venue":null,"work_id":"2b686ff3-9be9-434c-bc1f-ae4af592a874","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:1e0167ec6a3fe0a1b814ee20c0da393519d6dc8dec6dd2637d2eec9b4225882e","observation_id":"7fa6d33a-6144-46e1-9192-211e77805e09","resolution":{"observed_at":"2026-05-10T12:11:16.558970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:46.719407Z","title":"2018 , eprint=","venue":null,"work_id":"9880c11f-6c71-4e36-9736-affdf3d20344","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:7275c202eb33054b8f426e49436d76b8d276efd13f9a558c19af8787ee7c433e","observation_id":"51eab50a-72cb-4caa-bc6f-2632de4f35ac","resolution":{"observed_at":"2026-05-10T12:11:16.561895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2201.11903","doi":"10.48550/arxiv.2201.11903","metadata_source":"pith","pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-07-10T21:57:37.821767Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":"cs.CL","work_id":"d1cf6693-a082-403c-ada9-dac7b96341f9","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:da6c1e3a5a7a3840a13cd39367caf26f334e9b5ce2446f3b6af0a74c71995010","observation_id":"814e8297-47ec-4539-911c-2a4e8c7a5016","resolution":{"observed_at":"2026-05-10T12:54:44.857189Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T01:08:13.648188+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"5b9243c8-695b-4011-9306-151067f3d5b6","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:135c5c1553eed47e42352195c6a24382bb7e0ca982d742ad10ee3dcd397d0aae","observation_id":"71fbb77d-9016-476e-9955-7a28475aadb1","resolution":{"observed_at":"2026-05-10T12:11:16.564432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11934","last_updated":"2021-03-11T18:45:13Z","snapshot_observed_at":"2026-07-06T10:07:22.052360Z","submitted_at":"2020-10-22T17:58:14Z","title":"mT5: A massively multilingual pre-trained text-to-text transformer","version":3},"cited_work":{"arxiv_id":"2010.11934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.11934","snapshot_observed_at":"2026-07-08T02:24:27.918351Z","title":"mt5: A massively multilingual pre-trained text-to-text transformer","venue":"cs.CL","work_id":"b93889a5-59f1-47b2-aaf3-29d77a967594","year":2020},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2010.11934","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ec2e17d91ba8f6159181b42072e2a8ac33876fce9d6cffb292d524fb9592e9eb","observation_id":"c35a5125-02bf-4f35-8664-0275955e803f","resolution":{"observed_at":"2026-05-10T12:11:16.433596Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"1bf99847-dedf-4930-9683-195631ade6ff","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:8f6c500b85c1ee5e725e263844fa33b2a12d738726f4806854ff7861ec80c20a","observation_id":"36b0a1c9-28a4-4e3b-a03a-2dda58342e5b","resolution":{"observed_at":"2026-05-10T12:11:16.566923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:42:44.599455Z","title":"NeurIPS , year=","venue":null,"work_id":"94a2c2a8-689c-410b-ae59-f2cd5993fcb2","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a2ac148569f468e6261da403351b8414a16f6a67c67b3ce896ef141099bbe2e4","observation_id":"e02d5a34-6d93-4d01-a705-9121548e9cd3","resolution":{"observed_at":"2026-05-10T12:11:16.569450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":"2112.04359","doi":"10.48550/arxiv.2112.04359","metadata_source":"pith","pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Ethical and social risks of harm from Language Models","venue":"cs.CL","work_id":"b4ce1c45-ef69-445a-a872-dbb785b485e9","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":131,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d1c27fa181916802834a4dbdcdb35b1f09e438ed4a0edbf49ffb19d3987b1731","observation_id":"f0ecb552-6fee-4be8-ae97-6174f93f2183","resolution":{"observed_at":"2026-05-11T18:24:30.556046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":16,"parse_uncertain":0,"unresolved":6,"verified_exact":29,"verified_fuzzy":49},"total_outbound_references":129},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 129 outbound references and 100 inbound Pith citation observations for arXiv:2408.00118."}