{"as_of":"2026-08-05T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c399003349c1ee8fb29f40e1f03900f6feba8ffaf527dcbae5619b426e70592e","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:52:15.907310Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.08734/citation-record","integrity":"/paper/2605.08734/integrity","json":"/paper/2605.08734/citation-record.json","paper":"/paper/2605.08734"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimization algorithms on matrix manifolds","venue":null,"work_id":"4906a76c-343c-41b5-88a0-61eafe330643","year":2009},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:55b0429013e04b195d84144a91a5f457bce9c8eebaff4c4a742026123fe04a3b","observation_id":"6b5ceff0-f0da-4e6a-8fe9-ef8b739be198","resolution":{"observed_at":"2026-05-12T17:46:44.362976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:a96cbf394a57f61616ed3be24db52e450686c7c8bd80004f5fdcf38163c039e5","observation_id":"da2a14e3-6941-4522-a233-773144945e42","resolution":{"observed_at":"2026-05-12T06:51:29.459132Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A preconditioned riemannian gradient descent algorithm for low-rank matrix recovery.SIAM Journal on Matrix Analysis and Applications, 45 (4):2075–2103","venue":null,"work_id":"34697ebc-f913-4024-aa41-29a8bd451858","year":2075},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:70051fb25d2207a1f389155eb107202a217859af71417f6a80d7ed5ef689c5e4","observation_id":"e01fe06b-c3c9-448e-87d0-d661c75ff4b8","resolution":{"observed_at":"2026-05-12T17:46:44.355007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finding low-rank matrix weights in DNNs via riemannian optimization: RAdagrad and RAdamw","venue":null,"work_id":"de7819aa-3539-4aa1-b0b3-ebed6b19d9f7","year":2026},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:e002e212f9fd5cda7b1bf2bce23703292de0e3770a90f9929aecb9f28410bdab","observation_id":"9e11da84-e014-417b-8a9b-bb7bf2dbf2b2","resolution":{"observed_at":"2026-05-12T17:46:44.371652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.12142","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora meets riemannion: Muon optimizer for parametrization-independent low-rank adapters","venue":null,"work_id":"07d7fe2a-9fe1-46af-8df7-9029a0ac178b","year":2025},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:352e562e7cc56066576a82b71894ee45fecbc5b949e7365d6db7a2500eae13e8","observation_id":"65d6162a-0350-458b-a42b-c93be06d548b","resolution":{"observed_at":"2026-05-12T06:51:29.474106Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:3fd0af93e59a4fdad84d6afb8ec302749fbc8277ca509e888156274cd29ddb41","observation_id":"bd3c8e61-e20b-49f1-a694-038e27497af8","resolution":{"observed_at":"2026-05-12T06:51:29.479201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:ce55045af3205dd874231b2900772da3bb428d25ca7ef1bc5ac9d446d738cafc","observation_id":"c32b89be-edb5-4cf5-81b2-3976ac285a6e","resolution":{"observed_at":"2026-05-12T06:51:29.487524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive subgradient methods for online learning and stochastic optimization.Journal of Machine Learning Research, 12(7)","venue":null,"work_id":"bd8633b7-8573-44f8-bc9c-ffafdfa0b6db","year":2011},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:b7fe8f9ca8e203dba8c0cc5674204c6db2f1a83d32a3fc880e360b53707afd7d","observation_id":"dbfdf49a-0d2e-49d2-b2e8-03e72f208d06","resolution":{"observed_at":"2026-05-12T17:46:44.359166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mix-of-show: Decentralized low-rank adaptation for multi-concept customization of diffusion models","venue":null,"work_id":"3af7e4ad-cee8-48db-af5e-6fe6baac290d","year":2023},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:2ed58b607faff591e0707a3c5c93294b5066284ff56e9466da2bfe9641408a4c","observation_id":"7c447234-082b-4b3d-a31d-a7211e93edcd","resolution":{"observed_at":"2026-05-12T17:46:44.304070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shampoo: Preconditioned stochastic tensor optimization","venue":null,"work_id":"728e8192-c2fd-49f0-9c1a-409cda14d2b4","year":2018},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:b2b0396a7074e8ed06389d9d77753afbeafdcbb1805c66e23b314823163c0180","observation_id":"975ff310-8005-4376-9ab4-9eeacec7dbc6","resolution":{"observed_at":"2026-05-12T17:46:44.299849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora+: Efficient low rank adaptation of large models","venue":null,"work_id":"20f1008f-6034-44e8-8797-8c62c5699d0a","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:0b132d1577c7715607e3a4ebfbb772706f23b95e880e4ac652a2f15d0ed7582b","observation_id":"1a134bee-683a-469f-a2e3-117bd16bc2b6","resolution":{"observed_at":"2026-05-12T17:46:44.323876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":"1386a1bb-e90e-450f-a47d-562f6e5b95b6","year":2021},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:92667502caa464f5975a67bac02392812c60c336e6e6bb61954f52519bb816de","observation_id":"0fb18b67-8151-462e-a93d-ea4626d459ff","resolution":{"observed_at":"2026-05-12T17:46:44.287744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"c01273d2-fde3-4a5c-b2e3-cc5a2cd2f341","year":2017},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:444d19f00baeffa8c7664562a4ea979a0468e03cb0addde03f4ff5ba08e55ec4","observation_id":"a84debc3-d8ad-4fb1-b6e3-66574cc89669","resolution":{"observed_at":"2026-05-12T17:46:44.265884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"e29f146f-2953-4169-aecc-0ab14c8b11c9","year":2022},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:8358441593bd09450dc6c7fa74ab5c7ad675db0e9151d64da103cbc457f6c621","observation_id":"a24dca92-fc21-4bf3-be00-2bf3682c6806","resolution":{"observed_at":"2026-05-12T17:46:44.273115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:d57cb9c4525d2e37346c451bf5622e2a719499df45b5f795049cf460c9feb68f","observation_id":"4a9d28b7-8e18-4963-b20e-c94ded610ba2","resolution":{"observed_at":"2026-05-12T06:51:29.453385Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:ddda936e212c36003aa388e4b0fd9cc442145d73adf9cdd123ea7c0996834d88","observation_id":"d489ee30-6e40-4337-a903-c89315d914a2","resolution":{"observed_at":"2026-05-12T06:51:29.440800Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Limitations of the empirical fisher approximation for natural gradient descent.Advances in neural information processing systems, 32","venue":null,"work_id":"25d7485c-258f-4ede-8930-fe1d80041594","year":2019},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:78d7c57ecedd16cb48dcc813357b8506fa6c5ca52d13fafc7c38a32d2593a370","observation_id":"c49a3d93-5868-46ce-b0b6-a744ee143fe7","resolution":{"observed_at":"2026-05-12T17:46:44.291859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:2d0579e4364b102b4ed44496f98b1fc6fdb672ed5b48f93b6e34ca6618732367","observation_id":"ee77174b-716e-4d1c-b723-77cdb804a16f","resolution":{"observed_at":"2026-05-12T06:51:29.448465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:35:48.958149Z","title":"Optimizing neural networks with kronecker-factored approx- imate curvature","venue":null,"work_id":"5f3cc024-e638-40a9-b96c-1b258742c15f","year":2015},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:263ff6cd32f73a406eb76e7faaaa3e52ab40f0ea8fca471cf17a0ac4eee81439","observation_id":"cd0e4b97-321e-440b-a89b-716fc595f9d8","resolution":{"observed_at":"2026-05-12T17:46:44.269569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimizing neural networks with kronecker-factored approx- imate curvature","venue":null,"work_id":"211ab7c3-a763-40c1-97f9-e3635cc4ea75","year":2015},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:ae46df9e812678e7c543716b0968b5b26b39e2c624336d7924835bc9c50b5038","observation_id":"947a8916-c0b9-4e27-9770-0b417cfa4020","resolution":{"observed_at":"2026-05-12T17:46:44.312291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter and memory efficient pretraining via low-rank riemannian optimization","venue":null,"work_id":"8d1c6681-3ec5-43ed-b622-340ee9697dd5","year":2025},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:d50a4064637f392e37de5f343dec14a7c40201c2a0c026aa14e7d4b92d8fc62d","observation_id":"25beead0-720a-430f-b739-6edf3e68d3bf","resolution":{"observed_at":"2026-05-12T17:46:44.295889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A new per- spective on shampoo’s preconditioner","venue":null,"work_id":"5f47bfb4-ddb7-4e2f-a1ac-cb0b71fae53a","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:bbcc7605e6c699254fe7f76ad0dde804178eb3b59160a1f5ca7b724b40c55d71","observation_id":"31697ce4-b020-4d79-8c26-bc0a65fc0140","resolution":{"observed_at":"2026-05-12T17:46:44.331373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dart: Open-domain structured data record to text generation","venue":null,"work_id":"e933655c-73c1-4aff-bcff-1655e8ef039e","year":2021},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:7e6879d6313666c8d0bdd02ebc0b6973582bd08d6313df2bde38f9cf2907b565","observation_id":"4472f219-0240-468a-8c87-6ded88f2d0db","resolution":{"observed_at":"2026-05-12T17:46:44.320030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.09254","last_updated":"2017-07-06T11:51:09Z","snapshot_observed_at":"2026-07-06T05:48:48.685757Z","submitted_at":"2017-06-28T12:38:53Z","title":"The E2E Dataset: New Challenges For End-to-End Generation","version":2},"cited_work":{"arxiv_id":"1706.09254","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.09254","snapshot_observed_at":"2026-07-03T01:27:30.996854Z","title":"The E2E Dataset: New Challenges For End-to-End Generation","venue":"cs.CL","work_id":"eb0bc638-692b-4286-bf32-031d6dc5ca0b","year":2017},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/1706.09254","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:d65e246ed7354feab72ec5b66255f369bd32e6deaca9a5ccbd7d4578e55789f7","observation_id":"6158b829-1346-461e-aec6-61d9403c2331","resolution":{"observed_at":"2026-05-12T06:51:29.493216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":"f6114c05-4805-432a-9ac8-61c3ef602743","year":2019},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:d254431518f0d9e3209d680411010774f7b17235bfe4c93f23b2c42bcdaebacc","observation_id":"b7553c81-bea1-4aa1-9689-555100daee6c","resolution":{"observed_at":"2026-05-12T17:46:44.351090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.5001098","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9","venue":"SSRN Electronic Journal","work_id":"c4602bff-f0d0-48c0-b7b8-adcaec6086b7","year":2019},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:061f594b8edcc78b4e6eaf25c52404ab3dfa08f057fdb469360975ece6f9ac3e","observation_id":"1946c319-8415-411a-9591-43f6e0167561","resolution":{"observed_at":"2026-05-12T17:46:44.276835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"e642661c-a7c9-4501-bd36-2a2cfae5d60a","year":2021},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:4e380d13fd9700457a274fa281340960dee84a10dc60d4eef290e8c4ff9baeeb","observation_id":"4f318497-d167-4a70-9eb4-cb5685850e20","resolution":{"observed_at":"2026-05-12T17:46:44.339594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adafactor: Adaptive learning rates with sublinear memory cost","venue":null,"work_id":"3435a53f-2faa-4156-aeb1-77da84afe04c","year":2018},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:83c0be7d321b2c963c0dcecd9241b347d5ad6a0f2d45a5cd7709be707ed47057","observation_id":"66479fe7-6bf2-4113-acd7-2426e9c728a8","resolution":{"observed_at":"2026-05-12T17:46:44.280858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Low-rank solutions of linear matrix equations via procrustes flow","venue":null,"work_id":"1457c88e-e059-4f03-a315-1cbe0aea14ab","year":2016},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:d40bfcf101c90ce028a2c2449e2efc3515ab05b7c202721821013dca6e7568e8","observation_id":"ed6057d9-24b4-4a76-9ce7-ab421fdfb3bc","resolution":{"observed_at":"2026-05-12T17:46:44.327673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Soap: Improving and stabilizing shampoo using adam for language modeling","venue":null,"work_id":"0c062325-048f-4981-b6c7-be43165b513e","year":2025},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:c448bf6940726195c9b62df7f7dc542484de59fadeaf99073a94dadaf9873152","observation_id":"c2ea3e5c-d5ee-4f30-84d0-ca94e60880d6","resolution":{"observed_at":"2026-05-12T17:46:44.308200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":"1804.07461","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-07-04T09:19:44.134394Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","venue":"cs.CL","work_id":"1bb6fb0c-482d-43cf-94a8-ed18f72a5563","year":2018},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:0abb667356d4a406252e4671ac9851c088f0edce8e006efe77359bfa685571d5","observation_id":"cdf40b23-ffce-4dbe-97d2-54ed88c254c2","resolution":{"observed_at":"2026-05-12T21:24:15.760169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora-ga: Low-rank adaptation with gradient approxi- mation","venue":null,"work_id":"61eec5ac-dbbc-4c32-9cbf-1324ffecef90","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:9a43e2be18e1eaf6049d2b261ec14837f929128a1a02e2995ab8d99b17f4158a","observation_id":"cc4bfb7a-d67e-4708-9d90-b7e54147ac72","resolution":{"observed_at":"2026-05-12T17:46:44.258308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora-pro: Are low-rank adapters properly optimized? InInternational Conference on Learning Representations(ICLR)","venue":null,"work_id":"c2267d9f-d52c-4f2d-a3ea-e9c483c68459","year":2025},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:5472f9108a4b0b1f2bcfc41db37cf979b147f2316caf468c11f49aae0352b295","observation_id":"a3625805-4378-46e8-a881-20d4d47a7fc1","resolution":{"observed_at":"2026-05-12T17:46:44.347290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guarantees of riemannian optimiza- tion for low rank matrix recovery.SIAM Journal on Matrix Analysis and Applications, 37(3): 1198–1222","venue":null,"work_id":"d075fd19-81c0-436c-b19b-76ace9674360","year":2016},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:e15c9b7acb6e14facd56af4465d15c7cc2a10616b5d2b726c01eb3e78f87f6c1","observation_id":"722ab7b6-b02f-41b8-85de-cdd49bdf990f","resolution":{"observed_at":"2026-05-12T17:46:44.335448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:d729c86ce564442fd5f98283fde53e9a2ea80eacc9b6360e17c6698774316612","observation_id":"f7bb7a4b-fdc0-4153-a66c-404cd0e0a0a5","resolution":{"observed_at":"2026-05-12T06:51:29.505180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora done rite: Robust invariant transformation equilibration for lora optimization","venue":null,"work_id":"2555ef11-f730-400f-8f96-85c011972dcd","year":2025},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:e07de4270b4dee3339d49b75c69fed97be25975741c8ddcdade2df7ae556e90f","observation_id":"f0ca6274-7b5c-4ac2-8da6-1c946352d6be","resolution":{"observed_at":"2026-05-12T17:46:44.316100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Riemannian preconditioned lora for fine-tuning foundation models","venue":null,"work_id":"73cb1ad2-6027-4f14-bdf1-f35c9c44c52a","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:9f57746a3ba93a18f28c10c6ec718991487ab5a9d77fc5729e6b4b2eba666b2d","observation_id":"ff05c833-f992-42a6-b13f-eca01e339cfe","resolution":{"observed_at":"2026-05-12T17:46:44.262208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora-one: One-step full gradient could suffice for fine-tuning large language models, provably and efficiently","venue":null,"work_id":"b3bc2977-a355-4734-8112-38ec5e4989f3","year":2025},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:9d91c905f36b7cc5b6b0f83481d51f514dbe325185e88363a4ae58e9196181c0","observation_id":"d1e6387f-7362-4591-8855-a97aee937ea6","resolution":{"observed_at":"2026-05-12T17:46:44.343447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Galore: Memory-efficient llm training by gradient low-rank projection","venue":null,"work_id":"82ba4510-c2bc-4098-8b55-b76211047654","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:9b6b323f8b4bfffc941f513d85231e73f4bcd78861a9b6c8d854cbda9dee8214","observation_id":"4a52e8fe-2392-45fe-acc3-a965fadacf48","resolution":{"observed_at":"2026-05-12T17:46:44.284231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rank 4 (M)","venue":null,"work_id":"08ea5957-b802-48cc-bf73-45175d67ca3e","year":2024},"citing_paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:15.907310Z"},"links":{"citing_paper":"/paper/2605.08734"},"observation_digest":"sha256:da2e1f9bfebf6e814ac75393f9f04a6945ae28a7c58441c64a1b140774e0a8c2","observation_id":"91d9bdb7-5c05-4df7-ab91-be45c3bc291a","resolution":{"observed_at":"2026-05-12T17:46:44.366917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08734","last_updated":"2026-05-09T06:37:44Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:37:44Z","title":"AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":10,"verified_fuzzy":30},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2605.08734."}