{"as_of":"2026-08-08T08:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca77ed65536c8737868e147b0b7e42322e980052a6ec96f7f3eb7fe9cefecde1","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:25:29.332228Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T09:00:50.315383Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:19:47.216056Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"cited_work":{"arxiv_id":"2506.14280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14280","snapshot_observed_at":"2026-07-04T10:19:47.216056Z","title":"Improving LoRA with Variational Learning.arXiv preprint arXiv:2506.14280","venue":null,"work_id":"506f8bea-bc60-4b8f-8832-1fb612e83714","year":2022},"citing_paper":{"arxiv_id":"2505.09591","last_updated":"2026-04-13T11:55:58Z","snapshot_observed_at":"2026-07-06T21:23:57.084147Z","submitted_at":"2025-05-14T17:40:22Z","title":"Variational Visual Question Answering for Uncertainty-Aware Selective Prediction","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T15:29:59.372173Z"},"links":{"cited_paper":"/paper/2506.14280","citing_paper":"/paper/2505.09591"},"observation_digest":"sha256:0bea555ec7877bd2801f455b2f0dc627f267342c6096e7593493195646377b49","observation_id":"d211204b-78a3-479f-a4ac-b64760ce5723","resolution":{"observed_at":"2026-05-22T15:31:44.818828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"cited_work":{"arxiv_id":"2506.14280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14280","snapshot_observed_at":"2026-07-04T10:19:47.216056Z","title":"Improving LoRA with Variational Learning.arXiv preprint arXiv:2506.14280","venue":null,"work_id":"506f8bea-bc60-4b8f-8832-1fb612e83714","year":2022},"citing_paper":{"arxiv_id":"2606.23357","last_updated":"2026-07-09T05:20:17Z","snapshot_observed_at":"2026-08-03T19:43:15.453339Z","submitted_at":"2026-06-22T13:56:59Z","title":"SOAP-Bubbles: Structured Weight Uncertainty for Neural Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T09:00:50.315383Z"},"links":{"cited_paper":"/paper/2506.14280","citing_paper":"/paper/2606.23357"},"observation_digest":"sha256:3a550e4a899e08ce001bef46292a8a2dd8d0aaa9c6ad2520653076e8b7a013b2","observation_id":"e8eff5b2-29a8-4b09-ae04-15eff84003cc","resolution":{"observed_at":"2026-07-04T10:19:47.217412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.14280/citation-record","integrity":"/paper/2506.14280/integrity","json":"/paper/2506.14280/citation-record.json","paper":"/paper/2506.14280"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.226970Z","title":"Stop measuring calibration when humans disagree","venue":null,"work_id":"2cefd8a9-5af3-4618-9ad3-e8ad6c60dff3","year":2022},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.099994Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:74ec062834a8a98ab755718ee6b1db88fdc73eec3c0ac6be5a75d1c9ff82bc99","observation_id":"6b3da705-d471-42eb-92c0-8e05f2151e05","resolution":{"observed_at":"2026-08-07T00:25:30.231706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.211719Z","title":"BitFit: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":"7c1ea409-c8a2-4198-ad7b-8873f392cc32","year":2022},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.105282Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:bb1920f001cbbcad5a82aec2a04c77b1f604bedc717ea4e739abaa4e22481577","observation_id":"58c484c4-c21f-4f18-a086-c31faa8584dc","resolution":{"observed_at":"2026-08-07T00:25:30.216470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T00:25:29.109933Z","title":"LoRA learns less and forgets less.arXiv:2405.09673, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.109933Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:b75ceec839a05bff8fc338699b2411568bc1372c3f98ec5c5a289a09dd0cbd10","observation_id":"14426df0-6280-47e0-a207-c0cedd8e3f42","resolution":{"observed_at":"2026-08-07T00:25:29.109933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.196575Z","title":"Weight uncertainty in neural network","venue":null,"work_id":"27e8006d-7507-4885-a204-741c8ee21f2f","year":2015},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.114529Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:b5d199b9d70e3f04665e21b6cb0ef81138c2d9c70e6d36d0d138a47cabb33f95","observation_id":"a3457a43-e7d7-44e2-b797-7ea3e941780b","resolution":{"observed_at":"2026-08-07T00:25:30.200861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10673","last_updated":"2025-01-11T13:11:03Z","snapshot_observed_at":"2026-07-06T19:16:18.894092Z","submitted_at":"2024-09-16T19:14:35Z","title":"A Bayesian Interpretation of Adaptive Low-Rank Adaptation","version":2},"cited_work":{"arxiv_id":"2409.10673","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10673","snapshot_observed_at":"2026-08-07T00:25:29.497071Z","title":"A Bayesian Interpretation of Adaptive Low-Rank Adaptation","venue":"cs.LG","work_id":"0d76d0d6-9f3e-444d-88b6-6488d68c89d0","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.118574Z"},"links":{"cited_paper":"/paper/2409.10673","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:9ff3d06c351f9d54e2c5d8de36d00e80aab367e5856fc11fda2b3edef7f9688c","observation_id":"91c25571-1a12-4de7-a057-0ea560460770","resolution":{"observed_at":"2026-08-07T00:25:29.503979Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.181380Z","title":"BoolQ: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"6f4e5503-5c28-4712-a78f-cb12bc94172c","year":2019},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.122799Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:9ecd73fbc5153a2b7d87223a1f3184280456ca6ec387a4b0f50992ada695469a","observation_id":"9a0a1ebb-ada5-445b-959f-9bfe5b647ebd","resolution":{"observed_at":"2026-08-07T00:25:30.185897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T00:25:29.127431Z","title":"Think you have solved question answering? try ARC, the AI2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.127431Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:58f619b719dba31e87aad6a3234e0b2b54459c5a403d1660d0f04b912023887d","observation_id":"36f1f6a0-e93f-4663-b5fb-5025c130fc9d","resolution":{"observed_at":"2026-08-07T00:25:29.127431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:25:29.131646Z","title":"Training verifiers to solve math word problems.arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.131646Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:f219fedf05f3f633669bcc6f9d4c55335f0cc3fa6c916045c9c4ae6a8fd52298","observation_id":"602c26ef-ea1d-40e2-b4c6-9b35060458be","resolution":{"observed_at":"2026-08-07T00:25:29.131646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.165469Z","title":"Uncertainty-aware decoding with minimum Bayes risk","venue":null,"work_id":"849c4c02-aee3-423e-bfe4-e35099488adf","year":2025},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.135731Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:4692a1d0d49cdc33dbe9f4c29a38c287fb11f03d0aa6c775d3d51f311c672858","observation_id":"390e371a-a2d1-4407-b688-a15bf328220b","resolution":{"observed_at":"2026-08-07T00:25:30.170376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.150898Z","title":"QLoRA: Efficient finetuning of quantized LLMs","venue":null,"work_id":"f78c7650-e862-4ec5-8946-c05c935d46a6","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.139728Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:cc5b5a39d0292876963c924ca2bf1b23ff74c56438dfc65b2d2488cd2650d976","observation_id":"e1fda1a3-2cb8-48ce-8493-0ad8ca6140b6","resolution":{"observed_at":"2026-08-07T00:25:30.155101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.135873Z","title":"Shaving weights with Occam’s razor: Bayesian sparsification for neural networks using the marginal likelihood","venue":null,"work_id":"d4a9b9e0-67f1-4f28-85a2-d29903b96d95","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.144312Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:98eb8aa6987786d3e7beb75e3f21d371a87f07a28a8c7c989b9542f3a1d085f4","observation_id":"d7fa154b-c410-46ea-b3fb-90ab5d0a50c4","resolution":{"observed_at":"2026-08-07T00:25:30.140988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.120097Z","title":"Sparse low-rank adaptation of pre-trained language models","venue":null,"work_id":"fb3eefbe-98b7-460a-9d66-1b8fb3136d0b","year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.148976Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:78bf2c37bffcaab944b3c595fde14d30bced79332e11550ae0dc2e5b907356d5","observation_id":"f0504c87-0eac-4ce2-beef-7d50ee9cb4c2","resolution":{"observed_at":"2026-08-07T00:25:30.124769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T00:25:29.152895Z","title":"The Llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.152895Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:6c71884a93dbe6b2ac5eb96ffce8ed7e4078af15bf4519f2bfe968c65ce4556c","observation_id":"6f0349e3-5e1d-46de-bd61-373f499ca5db","resolution":{"observed_at":"2026-08-07T00:25:29.152895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.103911Z","title":"Practical variational inference for neural networks","venue":null,"work_id":"96ad0476-4f94-4a9d-bea7-a8bbe315dbf9","year":2011},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.157020Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:021197d50b684316ef2c7a9165594f69925f22b285ceb9a84af7c539172e6aab","observation_id":"8f0a47b2-1cf1-4a0c-b37a-e8a5d9a1ff17","resolution":{"observed_at":"2026-08-07T00:25:30.109354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.089355Z","title":"The safe Bayesian - learning the learning rate via the mixability gap","venue":null,"work_id":"61450340-40b0-489b-b8bb-68d0b9f34a43","year":2012},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.160774Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:8e9cc76f170110850bafcc46b3bdbe63364641176be310d552a7760dc0cf0f7a","observation_id":"885d12a3-ae6c-4041-9379-db87b4d7c990","resolution":{"observed_at":"2026-08-07T00:25:30.093600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.074616Z","title":"DeBERTa: Decoding-enhanced BERT with disentangled attention","venue":null,"work_id":"15e002dc-239b-4171-b488-fc734764727b","year":2021},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.165272Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:f24f69653b389aaf965a765674f57a85f1b04352f5fc867c97dbfaa7dedbd12e","observation_id":"43707d77-5f29-4886-8c3d-dcfc5f3fdd07","resolution":{"observed_at":"2026-08-07T00:25:30.079213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.058678Z","title":"SparseAdapter: An easy approach for improving the parameter-efficiency of adapters","venue":null,"work_id":"18de1554-bc5c-420c-a9b3-b945ff5af0ef","year":2022},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.169127Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:1edcb7e53d1fcf3782b4143b5c1431fcfc29aea4df9120a1d9040d0b3dfe6e60","observation_id":"e918ddc4-cd08-43d7-a507-a19c62c8ce60","resolution":{"observed_at":"2026-08-07T00:25:30.063915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.172974Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.172974Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:d32b4ce642748bdcca3e07c572a0f6afdd1eeb23d1b927fb34412a48a897492a","observation_id":"caa998e5-a75f-4f77-811d-acc56ea5957a","resolution":{"observed_at":"2026-08-07T00:25:29.172974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.033144Z","title":"Parameter-efficient transfer learning for NLP","venue":null,"work_id":"e73b8160-1466-416e-a2a9-e977f792140f","year":2019},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.177055Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:b82533157337057ce32afdcbc3893687a187209ea3a6f9f877829b440e6afa21","observation_id":"d34cd46a-a379-4276-991a-a181e5b3f24d","resolution":{"observed_at":"2026-08-07T00:25:30.038491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.181019Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.181019Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:16addf7c96d823bbd10e34702f6bc0a3e93e0e78b2ac14d6d3524569e03f1416","observation_id":"8c996251-5cdf-4fab-b0ea-79a19fcce51c","resolution":{"observed_at":"2026-08-07T00:25:29.181019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:30.004541Z","title":"Improving predictions of Bayesian neural nets via local linearization","venue":null,"work_id":"a633368e-eb4f-414b-aa77-af59dc460f6f","year":2021},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.184793Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:6df2f6a75033d7ccd4d0f8d89d4b9281b09937dcd5abe3b722c927f2965adad7","observation_id":"1068b262-ee3b-491e-93f4-04f4e708745d","resolution":{"observed_at":"2026-08-07T00:25:30.009267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.989337Z","title":"VeRA: Vector-based random matrix adaptation","venue":null,"work_id":"ee0370fa-210d-41b6-9517-ff9d269d7a8c","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.188574Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:6e9bf61697d62cb3bceb9f3cf36b8c131a955e67c67f2812a50ff756139a0970","observation_id":"2208dcc4-62c4-4502-ba39-3b73a00d3446","resolution":{"observed_at":"2026-08-07T00:25:29.993862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.974680Z","title":"Optimal brain damage","venue":null,"work_id":"6d31952f-736d-444b-b5fe-4cddefa58a18","year":1989},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.192422Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:5c3c5c97f82ca4653b04a23ef2704e5a8205e6108092e7c3d17789dd57b4dc9b","observation_id":"d9695b21-d584-45eb-9991-8cbb51027614","resolution":{"observed_at":"2026-08-07T00:25:29.978638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14396","last_updated":"2025-05-24T12:19:58Z","snapshot_observed_at":"2026-07-06T19:19:24.759288Z","submitted_at":"2024-09-22T11:24:10Z","title":"Flat-LoRA: Low-Rank Adaptation over a Flat Loss Landscape","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14396","snapshot_observed_at":"2026-08-07T00:25:29.196199Z","title":"Flat-LoRA: Low-rank adaption over a flat loss landscape.arXiv:2409.14396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.196199Z"},"links":{"cited_paper":"/paper/2409.14396","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:625ee0478f5b45f015011ac41aae5a49b2b8885bc336721448ab9d6578adc35b","observation_id":"4b8c8797-c967-4302-985e-39f25c8c08e0","resolution":{"observed_at":"2026-08-07T00:25:29.196199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.200628Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.200628Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:291412415112bb302903989720fcdb7f8c01dfa5ce589586ab79122a3ab6755b","observation_id":"b67813c7-a7e0-4c94-936a-08ccaf8ce762","resolution":{"observed_at":"2026-08-07T00:25:29.200628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.949211Z","title":"LoftQ: LoRA-fine-tuning-aware quantization for large language models","venue":null,"work_id":"ce06ad10-482b-4c68-90e1-9a092ad9355e","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.204498Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:69f4bb40488c7c909e670d1269794b9da7b8326de5b0b96f1eb29313a5fff415","observation_id":"fd451574-c404-4fdc-9f9b-cc2112ec902c","resolution":{"observed_at":"2026-08-07T00:25:29.954356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.934570Z","title":"ReLoRA: High-rank training through low-rank updates","venue":null,"work_id":"59479e44-58c6-4407-99e6-3d5724f07ccd","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.208602Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:287f8409e71d343a4fb7d094849c5b7530a0cc8b1ff64f353c249c5fe440d99f","observation_id":"62d79341-215b-44a3-9896-55a3a32c1014","resolution":{"observed_at":"2026-08-07T00:25:29.939354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.919935Z","title":"PAC-tuning: Fine- tuning pre-trained language models with PAC-driven perturbed gradient descent","venue":null,"work_id":"a0acf3f0-015d-4fb2-88a6-e6474aa674a3","year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.212336Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:8a5a912c8ddb8bb985a86e0cb46192c1d0715ac1ec1b42fd86ccdbd7caa7be1f","observation_id":"946918ef-8022-40cb-93eb-828c753a2186","resolution":{"observed_at":"2026-08-07T00:25:29.924767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.216325Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.216325Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:68f7bc3b48503ed1d7a89b7c1fc25bb47f2aa2edf0bd2ccfa75fe514a6754a24","observation_id":"e4d83b86-b7e7-4e4d-b9f1-130c9de1d2dc","resolution":{"observed_at":"2026-08-07T00:25:29.216325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.894273Z","title":"A practical Bayesian framework for backpropagation networks.Neural Computation, 4(3):448–472, 1992","venue":null,"work_id":"df340e02-5497-4ec3-a68e-1767f0fa6879","year":1992},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.220052Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:a5c210f89c3f3ca95b7e43dd497c0066fc125217e1a214c405fc19206afd1e77","observation_id":"90815848-f2e5-419e-8427-c7cceb005f55","resolution":{"observed_at":"2026-08-07T00:25:29.898944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.879374Z","title":"PEFT: State-of-the-art parameter-efficient fine-tuning methods","venue":null,"work_id":"6da7d7a4-0957-47fc-bd03-0f58cf10d3e7","year":2022},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.223752Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:6e2cb079c756138700903398ca6f0b8a647036007f659d97c9c5605f1ca1d539","observation_id":"0cd344cc-59e1-456b-99c4-8e52de1b5d60","resolution":{"observed_at":"2026-08-07T00:25:29.884479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.865250Z","title":"Optimizing neural networks with Kronecker-factored approximate curvature","venue":null,"work_id":"e01b7bd1-ad94-42de-b97d-22dc985ac60c","year":2015},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.227305Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:cf8510884dc97f38446b132625dbee819d24cf71465120b74cbaddc546b92822","observation_id":"fab6502d-a449-4776-8b4b-2042c1ad502f","resolution":{"observed_at":"2026-08-07T00:25:29.869600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.851241Z","title":"Can a suit of armor conduct electricity? A new dataset for open book question answering","venue":null,"work_id":"d7803cb9-7ef2-478c-9608-ddef02b9638c","year":2018},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.231454Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:641eef89aa028fd0fb082401f83402056e13f18c8c314fe258be36c77cc00ec6","observation_id":"0ce8cd33-eeda-4662-9a9d-db59977cb1d7","resolution":{"observed_at":"2026-08-07T00:25:29.855641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.837222Z","title":"Gaussian stochastic weight averaging for Bayesian low-rank adaptation of large language models","venue":null,"work_id":"20df3d3d-f77e-47e1-a680-d3b61850e807","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.234961Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:cfa251cc085a75760ef138c4002563efcfbf42a15916f0673654a39b7e596113","observation_id":"4193f3eb-e563-41aa-b127-bdc87451a1f1","resolution":{"observed_at":"2026-08-07T00:25:29.841637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.822836Z","title":"MAD-X: An adapter-based framework for multi-task cross-lingual transfer","venue":null,"work_id":"0e8b8326-ce31-487f-8d49-d08dab2935d4","year":2020},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.238808Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:733b7e69c49775a01a2c6d839efe8541b74617033905208812d2413542dac30f","observation_id":"bc2bf0f9-65bf-432c-8605-fc5d7448da73","resolution":{"observed_at":"2026-08-07T00:25:29.827335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.807650Z","title":"Adapters: A unified library for parameter- efficient and modular transfer learning","venue":null,"work_id":"ffbcdc93-e2c8-43f0-a2b6-49f93dfb3d6b","year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.242444Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:54f778dc71e6ab739c4d815447685cd9c17b2b0c2ebb2dd9db5f5a137c9f017e","observation_id":"0c0ae5c8-d62e-4596-bce1-aad7ce26898f","resolution":{"observed_at":"2026-08-07T00:25:29.812960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-01T07:33:26.380394Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-07T00:25:29.246224Z","title":"CodeBLEU: a method for automatic evaluation of code synthesis","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.246224Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:2d6113fe46c3c143b418353acb1d731e3e08aad091a8cf759b17572c6a2d9323","observation_id":"f347a1da-ea79-4a0b-826c-54f82b7eef2a","resolution":{"observed_at":"2026-08-07T00:25:29.246224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.793280Z","title":"A scalable Laplace approximation for neural networks","venue":null,"work_id":"f7806ff8-d9ed-432b-bd22-30a99bdcb47b","year":2018},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.250410Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:18952f484cde507b75d88418d4af2217c22630d492b1f45225b9c039785d3651","observation_id":"e8781e06-31f0-48b7-89bf-cf10bb12dc08","resolution":{"observed_at":"2026-08-07T00:25:29.797996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.779038Z","title":"AdapterDrop: On the efficiency of adapters in transformers","venue":null,"work_id":"aca26afe-c9a9-4c25-a3e3-d54c6189bf4d","year":2021},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.254057Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:b0b6b283e9770043b2f22c6f517549608bfdb2f98e267d2d80e3498875cab2d9","observation_id":"13f0d611-9561-4c56-9246-b84275000764","resolution":{"observed_at":"2026-08-07T00:25:29.783281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.765417Z","title":"WinoGrande: An adversarial Winograd schema challenge at scale.Communications of the ACM, 2021","venue":null,"work_id":"32743bc9-79a9-4ac7-9009-80eb82020267","year":2021},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.257927Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:56c383fea22179fb7f881907ac540d127b73a59c57cf2ac03e9481087c8e19fe","observation_id":"99e1b380-fec2-42cb-8e0f-4c2e5a37b35f","resolution":{"observed_at":"2026-08-07T00:25:29.769495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.750983Z","title":"Variational learning is effective for large deep networks","venue":null,"work_id":"5d93da01-3278-4016-b3fa-2af4633063d2","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.261541Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:23f214c17f14fbd611417d9bc1aa3741620122f53e29d6b07d5353faf4a3533c","observation_id":"b14bc861-ab3a-427a-b44d-c3bdec6d78b7","resolution":{"observed_at":"2026-08-07T00:25:29.755625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T00:25:29.265033Z","title":"Qwen2.5 technical report.arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.265033Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:87a9d6fd006ecee1ec80e148a7f9fa80b96c219b33c8cba31c92fc4cfc1ed6e0","observation_id":"a38cc89f-f3b4-4334-9636-dc1019253326","resolution":{"observed_at":"2026-08-07T00:25:29.265033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.735296Z","title":"DyLoRA: Parameter-efficient tuning of pre-trained models using dynamic search-free low-rank adaptation","venue":null,"work_id":"92b1b8e4-5902-40ab-8bf4-4f0cfa1cd186","year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.269229Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:8a5e2441c150c89ebbbf512343a86b9dd7ce98862e12b2c9f8d2c355ac6c7d7f","observation_id":"861e8892-36d8-444b-ad66-504c425ef040","resolution":{"observed_at":"2026-08-07T00:25:29.740162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.721878Z","title":"Low-rank variational Bayes correction to the Laplace method.J","venue":null,"work_id":"f3e54d89-42f4-4f65-a912-08cba1b439d0","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.272973Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:21f17b7e8db07c3824e769bb61ce66187e8299177bd6e62caae4f7a924e75088","observation_id":"5c66d683-d364-4bf8-880e-1477a73fe9f1","resolution":{"observed_at":"2026-08-07T00:25:29.726131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.708342Z","title":"Attention is all you need","venue":null,"work_id":"4e17cc83-4da5-436d-a8fd-f59e9559b610","year":2017},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.277004Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:492ee9a3285a1bd1b9ab8587adba2ace836761ffb75f8fa8533343d1144c01c2","observation_id":"7a0495a6-6699-4916-984c-3f3889760069","resolution":{"observed_at":"2026-08-07T00:25:29.712637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.694466Z","title":null,"venue":null,"work_id":"f0e733d0-649d-47f5-be55-21e4047c1e0c","year":2019},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.280998Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:820882da1a134f9c1ca253310ce42756a1df12fcefe1d1ef9a3c85fbdaf75644","observation_id":"828ee94a-e4de-489a-aab8-7152a114aeeb","resolution":{"observed_at":"2026-08-07T00:25:29.698776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.679168Z","title":"LoRA ensembles for large language model fine-tuning, 2023","venue":null,"work_id":"6424bc93-811c-4e87-b521-3b0896d3d1f9","year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.284758Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:e913aff120de71364199254256c367dd0ea556ada786d45655fd249fa0b41891","observation_id":"50e598d1-ec09-4b6e-a718-9db0435e8114","resolution":{"observed_at":"2026-08-07T00:25:29.684144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.665502Z","title":"BLoB: Bayesian low-rank adaptation by backpropagation for large language models","venue":null,"work_id":"c3715113-ef19-4de8-9b75-068eabb3936a","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.288414Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:a8b5ed906fd374c69abc04bd9e09c27e92f6280fbc2a5f66a31f31fe38c288ea","observation_id":"7e81976f-031d-43c6-9568-83e372f7bdb0","resolution":{"observed_at":"2026-08-07T00:25:29.669699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.651481Z","title":"Flipout: Efficient pseudo-independent weight perturbations on mini-batches","venue":null,"work_id":"1831261d-2177-424b-abc3-26af5113cd85","year":2018},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.292427Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:d8a231e3ae3b6386a5a172c6ea10af9bf6b6c9e31cf6b3c6365ce73a92dc0477","observation_id":"7ec8add5-bb00-4423-9e66-bcdb672f265d","resolution":{"observed_at":"2026-08-07T00:25:29.655776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.636116Z","title":"QA-LoRA: Quantization-aware low-rank adaptation of large language models","venue":null,"work_id":"ff9d5e5c-8c05-44d1-b508-c46496548107","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.296356Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:f41e6459c9b375c89f9bcde17de4346e4b63d99bd72d139ce2bf5ca4ae985363","observation_id":"90df9c00-cf89-44f1-8543-020f7cd836e9","resolution":{"observed_at":"2026-08-07T00:25:29.640819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.621885Z","title":"Bayesian low-rank adaptation for large language models","venue":null,"work_id":"ab574ed7-6096-4e12-b73f-7f06861b2637","year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.300504Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:efa2c468adb3c5717595c89b0f7974020b36fa22fd7858b532de74ae1427cc75","observation_id":"899a76d2-cb5a-4ea0-8d00-9ae27413d051","resolution":{"observed_at":"2026-08-07T00:25:29.626524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.607426Z","title":"Learning to mine aligned code and natural language pairs from Stack Overflow","venue":null,"work_id":"77c59041-3a24-4002-9aac-49b2902e0e52","year":2018},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.304281Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:4649534390f83a4cf2ef09e8e1c76d72406206bcad6f9891767f7d1dcd648c64","observation_id":"8224c14f-81da-40f0-9ea0-407bd04b10ad","resolution":{"observed_at":"2026-08-07T00:25:29.611550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.592029Z","title":"Optimal information processing and Bayes’s theorem.The American Statistician, 42(4): 278–280, 1988","venue":null,"work_id":"9e27c40c-d395-4987-af77-84cffcc34bd9","year":1988},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.308368Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:3f308a4911be543d884ce5c46e7da48eab64294ce4e56a7e48f6f04f8f5b0650","observation_id":"82294ea9-1903-4cc5-907d-eaa28701bd5b","resolution":{"observed_at":"2026-08-07T00:25:29.596625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-07-06T16:03:14.694457Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-08-07T00:25:29.312251Z","title":"LoRA-FA: Memory-efficient low-rank adaptation for large language models fine-tuning.arXiv:2308.03303, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.312251Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:b76acb75e21b2c7d9ad9122444adeaf4559777b7e7ab906c59b80c1d39334b43","observation_id":"86159505-56da-466d-b389-dda41e029302","resolution":{"observed_at":"2026-08-07T00:25:29.312251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.577228Z","title":"Adaptive budget allocation for parameter-efficient fine-tuning","venue":null,"work_id":"d3b7480e-d740-4b3a-99dc-b571ba51a665","year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.316367Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:3fd29fd605a8936f497323e2162378e9532a20ea29f5252e0c3e8b4075e16ca4","observation_id":"9160d823-5b5f-4b4b-9d3b-b0722f69a28a","resolution":{"observed_at":"2026-08-07T00:25:29.581734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.562288Z","title":"From ε-entropy to KL-entropy: Analysis of minimum information complexity density estimation.The Annals of Statistics, 2006","venue":null,"work_id":"83e7c243-837a-4c28-a619-43a88b2af41c","year":2006},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.320161Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:f92a15c1c2f8923189e223e4391d198aa3a472c4a7d59718e6a3fe99f2e84e94","observation_id":"00f2be46-7cec-4668-87e4-d8b29a15dee6","resolution":{"observed_at":"2026-08-07T00:25:29.567063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15300","last_updated":"2024-08-27T14:41:14Z","snapshot_observed_at":"2026-08-07T05:38:13.866669Z","submitted_at":"2024-08-27T14:41:14Z","title":"GIFT-SW: Gaussian noise Injected Fine-Tuning of Salient Weights for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15300","snapshot_observed_at":"2026-08-07T00:25:29.324004Z","title":"GIFT-SW: Gaussian noise injected fine-tuning of salient weights for LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.324004Z"},"links":{"cited_paper":"/paper/2408.15300","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:7d936c7689c45cc89609432c363bce866166fc819a2c436693950efa653c1f1b","observation_id":"c7005290-dc20-4d64-b071-9661a2aa3008","resolution":{"observed_at":"2026-08-07T00:25:29.324004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.548109Z","title":"True\"/\"False","venue":null,"work_id":"e484b96d-16b5-41c9-8993-086a95c8681f","year":2023},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.327872Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:26f33dbe18d94a5984b6ef6c1b5efedd2f27522650a420162a5e9b8f789f0653","observation_id":"e55ae8a3-9b2f-4268-91bd-f30c36331644","resolution":{"observed_at":"2026-08-07T00:25:29.552336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.533009Z","title":"For full-parameter and LoRA finetuning, we pick1×10 −4 and5×10 −4, respectively","venue":null,"work_id":"dfce676d-08e4-4cb3-ad96-42f7a22859d1","year":null},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.332228Z"},"links":{"citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:a3a2528ca8c69772bb56003809f664ad5f172601cbc586a397ba092335ecbdf5","observation_id":"89e5c1ad-c9be-4996-b647-7f0aba80de15","resolution":{"observed_at":"2026-08-07T00:25:29.538004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 2 inbound Pith citation observations for arXiv:2506.14280."}