{"as_of":"2026-08-16T15:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:452dddb54efc73dea8fda802ba259748a67dacf2a537d0dc4082146072cfc766","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:38:17.037405Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:07:30.821966Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12392","snapshot_observed_at":"2026-08-04T16:07:30.821966Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.16679","last_updated":"2025-09-20T13:11:28Z","snapshot_observed_at":"2026-08-15T19:34:29.390362Z","submitted_at":"2025-09-20T13:11:28Z","title":"Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:30.821966Z"},"links":{"cited_paper":"/paper/2505.12392","citing_paper":"/paper/2509.16679"},"observation_digest":"sha256:a770c954464de88f18cff184d78a0b699d5212ca6012aa75f37f9c1a3a96c976","observation_id":"8fb8a73f-287e-4ea6-a7d3-064619ab26af","resolution":{"observed_at":"2026-08-04T16:07:30.821966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12392","snapshot_observed_at":"2026-08-04T12:41:42.525028Z","title":"Slot: Sample-specific language model optimization at test-time.arXiv preprint arXiv:2505.12392,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02919","last_updated":"2026-05-29T16:16:27Z","snapshot_observed_at":"2026-08-16T00:02:01.126285Z","submitted_at":"2025-10-03T11:46:04Z","title":"Self-Reflective Generation at Test Time","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T12:41:42.525028Z"},"links":{"cited_paper":"/paper/2505.12392","citing_paper":"/paper/2510.02919"},"observation_digest":"sha256:beb2a12727a01fb19d00e64c1eb5621d7bdf836f66aa2b9d5c0029a0ba969ef0","observation_id":"eac35b3f-19ea-4b2f-b0b4-0324713cec3c","resolution":{"observed_at":"2026-08-04T12:41:42.525028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"cited_work":{"arxiv_id":"2505.12392","doi":"10.48550/arxiv.2505.12392","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12392","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Slot: Sample-specific language model optimization at test-time","venue":"ArXiv.org","work_id":"5bbe3557-8d8b-4be3-83df-764450029609","year":2025},"citing_paper":{"arxiv_id":"2604.06262","last_updated":"2026-04-07T01:59:40Z","snapshot_observed_at":"2026-08-10T22:30:04.524915Z","submitted_at":"2026-04-07T01:59:40Z","title":"From Exposure to Internalization: Dual-Stream Calibration for In-context Clinical Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T19:19:15.053725Z"},"links":{"cited_paper":"/paper/2505.12392","citing_paper":"/paper/2604.06262"},"observation_digest":"sha256:b9adf6ea0d518479bc5d0b4bfed1c17060afce763bf06645b3c259f455551ea8","observation_id":"b3c2337d-b6b2-40a8-8e46-7a20d768bf08","resolution":{"observed_at":"2026-05-10T23:10:50.521245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"cited_work":{"arxiv_id":"2505.12392","doi":"10.48550/arxiv.2505.12392","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12392","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Slot: Sample-specific language model optimization at test-time","venue":"ArXiv.org","work_id":"5bbe3557-8d8b-4be3-83df-764450029609","year":2025},"citing_paper":{"arxiv_id":"2605.08186","last_updated":"2026-05-05T12:00:06Z","snapshot_observed_at":"2026-08-02T05:15:18.309649Z","submitted_at":"2026-05-05T12:00:06Z","title":"Rethinking Entropy Minimization in Test-Time Adaptation for Autoregressive Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T00:48:47.213681Z"},"links":{"cited_paper":"/paper/2505.12392","citing_paper":"/paper/2605.08186"},"observation_digest":"sha256:e1ad46c8011b02187fb2f11dd7519b1ec25ca60a3de8374be5b568be4ca72bfd","observation_id":"d68e740f-b228-4c32-bb1b-63e1ccb1f9e1","resolution":{"observed_at":"2026-05-12T00:51:14.022947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"cited_work":{"arxiv_id":"2505.12392","doi":"10.48550/arxiv.2505.12392","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12392","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Slot: Sample-specific language model optimization at test-time","venue":"ArXiv.org","work_id":"5bbe3557-8d8b-4be3-83df-764450029609","year":2025},"citing_paper":{"arxiv_id":"2605.20189","last_updated":"2026-03-23T07:18:02Z","snapshot_observed_at":"2026-08-14T00:47:50.404836Z","submitted_at":"2026-03-23T07:18:02Z","title":"SOLAR: A Self-Optimizing Open-Ended Autonomous Agent for Lifelong Learning and Continual Adaptation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T11:21:30.867480Z"},"links":{"cited_paper":"/paper/2505.12392","citing_paper":"/paper/2605.20189"},"observation_digest":"sha256:4e6a3a9dd244135fe67f5b5adc75a9389fce6f90e3103ade9355fb27c3a65471","observation_id":"dc5440c8-50dc-43f8-9f09-d48e2557360d","resolution":{"observed_at":"2026-05-21T11:24:08.699295Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"cited_work":{"arxiv_id":"2505.12392","doi":"10.48550/arxiv.2505.12392","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12392","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Slot: Sample-specific language model optimization at test-time","venue":"ArXiv.org","work_id":"5bbe3557-8d8b-4be3-83df-764450029609","year":2025},"citing_paper":{"arxiv_id":"2606.18089","last_updated":"2026-07-05T17:40:26Z","snapshot_observed_at":"2026-07-12T13:34:39.011240Z","submitted_at":"2026-06-16T15:55:28Z","title":"From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-27T01:13:11.483599Z"},"links":{"cited_paper":"/paper/2505.12392","citing_paper":"/paper/2606.18089"},"observation_digest":"sha256:43c8598baf1d9e6c1801ceca2f16f8a2ec0ee4044088b4b161e394e2fbd3700f","observation_id":"e802226d-8ba5-45de-8ab2-7db931ba651c","resolution":{"observed_at":"2026-07-03T20:38:55.966851Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.12392/citation-record","integrity":"/paper/2505.12392/integrity","json":"/paper/2505.12392/citation-record.json","paper":"/paper/2505.12392"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.07279","last_updated":"2025-03-25T03:36:21Z","snapshot_observed_at":"2026-08-16T13:01:03.265718Z","submitted_at":"2024-11-11T18:59:45Z","title":"The Surprising Effectiveness of Test-Time Training for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07279","snapshot_observed_at":"2026-08-15T20:38:16.862667Z","title":"The surprising effectiveness of test-time training for few-shot learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.862667Z"},"links":{"cited_paper":"/paper/2411.07279","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:7c42fe6aad5c352193d46c6e0b81a8b39bdb194f301c487c2c0535799ce887f6","observation_id":"986b9a51-ba5a-442c-b056-75302ff2b13e","resolution":{"observed_at":"2026-08-15T20:38:16.862667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T20:38:16.868055Z","title":"Qwen technical report.arXiv preprint arXiv:2309.16609, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.868055Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:d3cecec784c1bde84dd34ec7bb8b5d0f15e6ad8dc3e7594b75bce941987740dd","observation_id":"7573b81f-ef2f-46f0-b8d6-928fc77b82b8","resolution":{"observed_at":"2026-08-15T20:38:16.868055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T20:38:16.872974Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.872974Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:9a010e3b8808ea5f25992e2553332b446eeb583366eba15f4cb422fda6a66f3d","observation_id":"38bd0204-7d45-41d6-a50e-f718c2400647","resolution":{"observed_at":"2026-08-15T20:38:16.872974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T20:38:16.877288Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.877288Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:6db4f7471548e13c8c98867cfd9d0641f5f25feba9389f6cb5dbaacd52e6a0e1","observation_id":"c6cc15dd-cc75-419f-8a0a-0ca998016cba","resolution":{"observed_at":"2026-08-15T20:38:16.877288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04707","last_updated":"2024-10-07T02:52:30Z","snapshot_observed_at":"2026-08-16T13:12:04.336691Z","submitted_at":"2024-10-07T02:52:30Z","title":"Learning How Hard to Think: Input-Adaptive Allocation of LM Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04707","snapshot_observed_at":"2026-08-15T20:38:16.881661Z","title":"Learning how hard to think: Input-adaptive allocation of lm computation.arXiv preprint arXiv:2410.04707, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.881661Z"},"links":{"cited_paper":"/paper/2410.04707","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:3f0743ad3863cc4ac49a44878618ff890288e7f004f4c6b1272c64b96594ea68","observation_id":"73273f8b-7451-4c14-bdc0-6fc91be149bf","resolution":{"observed_at":"2026-08-15T20:38:16.881661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:17.506464Z","title":"Test-time training can close the natural distribution shift performance gap in deep learning based compressed sensing","venue":null,"work_id":"8192848a-453f-4a2d-85bb-641eeedbf81b","year":2022},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.885975Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:17cc32e86731d6c69ff1d3b9875d99149175dbfe430d5a0ec3b9359f693ad984","observation_id":"c3eef4c6-626b-4496-bec7-3d797728c6bc","resolution":{"observed_at":"2026-08-15T20:38:17.510693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:16.890188Z","title":"Test-time training with masked autoencoders.Advances in Neural Information Processing Systems, 35:29374–29385, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.890188Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:04ec588afac43b19fea7d6ac83d62096680cd0e6925f9717a70750eef10244c5","observation_id":"c13331ff-6287-4d59-8acc-3f7f42a7a7ec","resolution":{"observed_at":"2026-08-15T20:38:16.890188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T20:38:16.894534Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.894534Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:eb667512bcc0844b5a5462afa5399ab7b22b5d1de52c8951d1c1f38b567bcff2","observation_id":"de5708aa-45a5-40a7-87d8-b6d6520f7581","resolution":{"observed_at":"2026-08-15T20:38:16.894534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:38:16.898650Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.898650Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:045fb4202352cb0e306d2da49ef418e9ebdf3c37d9ad46ba9b33f0605936c568","observation_id":"d08dbc8e-943e-4908-a970-5bbd07da5d4c","resolution":{"observed_at":"2026-08-15T20:38:16.898650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-15T20:38:16.903127Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.903127Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:2a9855ebbc506ae2118825125436817c1b9e8451d8acc37313578453f8f18bf6","observation_id":"04b713be-57c2-414f-bd5c-c2d525023b2a","resolution":{"observed_at":"2026-08-15T20:38:16.903127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:16.907495Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.907495Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:71934d159fc7be10324716c5353a4c5267f516526dcd12b55bd88ce23aba4590","observation_id":"050b98c3-b7a7-4a8b-bada-11457ac3ce3e","resolution":{"observed_at":"2026-08-15T20:38:16.907495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:16.911973Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.911973Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:ba24502adf37dce9eb7057e9c02f4e5558dd980ad787eb1953f2c157736b9d66","observation_id":"341ac7c5-d098-4b84-b1aa-7a438fe5725d","resolution":{"observed_at":"2026-08-15T20:38:16.911973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:16.916224Z","title":"C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models.Advances in Neural Information Processing Systems, 36:62991–63010, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.916224Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:ed19475023d3d4ab2153a4ae725fdd87112fcec8ba58af8eb58830219cda55bb","observation_id":"d3980604-bdb2-4681-9c7d-0dc3fdbac35e","resolution":{"observed_at":"2026-08-15T20:38:16.916224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02497","last_updated":"2025-06-29T06:49:52Z","snapshot_observed_at":"2026-08-16T12:59:41.505302Z","submitted_at":"2025-01-05T10:24:20Z","title":"A Survey of Test-Time Compute: From Intuitive Inference to Deliberate Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02497","snapshot_observed_at":"2026-08-15T20:38:16.920727Z","title":"Test-time com- puting: from system-1 thinking to system-2 thinking.arXiv preprint arXiv:2501.02497, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.920727Z"},"links":{"cited_paper":"/paper/2501.02497","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:2243367368b6fc81ac6d342a855c716296e83b0926fa736e736edffeed58c5a8","observation_id":"e7d67827-d582-48df-b1f9-7d6f4ef54b2c","resolution":{"observed_at":"2026-08-15T20:38:16.920727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:17.462537Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"8021d324-9733-4777-b74f-fc8dde4e2218","year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.925003Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:89c7e22ec3b601ee99d1a7a10105cdeea4f1f3962240a69fb473c22fbb922b10","observation_id":"fe6deb32-b237-471c-a812-1e017f76f086","resolution":{"observed_at":"2026-08-15T20:38:17.466594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-15T20:38:16.929184Z","title":"The power of scale for parameter-efficient prompt tuning.arXiv preprint arXiv:2104.08691, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.929184Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:687d378830f3719dc040297f48ba67080ccae1b435cd6f9b2fcda3a0ad7bd9d6","observation_id":"52d4ba75-e817-4553-ad86-78f8dd9a3b45","resolution":{"observed_at":"2026-08-15T20:38:16.929184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-08-12T12:37:28.207761Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-15T20:38:16.933344Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.933344Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:71158e4fd70ee0fd74eef32789f267509656dd79c20fbe9c501f15a80ba84014","observation_id":"8a7e0f14-ebde-48ff-be69-7d0b1c2def29","resolution":{"observed_at":"2026-08-15T20:38:16.933344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10069","last_updated":"2025-04-27T08:55:07Z","snapshot_observed_at":"2026-08-13T02:10:59.760183Z","submitted_at":"2025-01-17T09:42:48Z","title":"A Survey on LLM Test-Time Compute via Search: Tasks, LLM Profiling, Search Algorithms, and Relevant Frameworks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10069","snapshot_observed_at":"2026-08-15T20:38:16.937355Z","title":"A survey on llm test-time compute via search: Tasks, llm profiling, search algo- rithms, and relevant frameworks.arXiv preprint arXiv:2501.10069, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.937355Z"},"links":{"cited_paper":"/paper/2501.10069","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:c6cabd34a2c8423d637155c33fdf1e9139b1d0562deab60941cdc32cb84b1819","observation_id":"02772e5a-6f2f-4b64-95a9-e3ef28d7b969","resolution":{"observed_at":"2026-08-15T20:38:16.937355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-15T02:15:11.844567Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-15T20:38:16.941819Z","title":"Can 1b llm surpass 405b llm? rethinking compute-optimal test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.941819Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:eb9ff00573db9e4b8863e5f710be6c65a2d66843c667cf041801e98bed944aab","observation_id":"7ca01e10-82d6-4c5b-bc2c-171388286475","resolution":{"observed_at":"2026-08-15T20:38:16.941819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-14T08:27:33.738990Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-15T20:38:16.946128Z","title":"P-tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks.arXiv preprint arXiv:2110.07602, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.946128Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:35f080a9a46d55c1de5c1b11bd45575581adeb2102113606286f7f1cf0a0094f","observation_id":"e84261a0-1bfe-46af-906c-ab656e6e042d","resolution":{"observed_at":"2026-08-15T20:38:16.946128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:16.950336Z","title":"Ttt++: When does self-supervised test-time training fail or thrive?Advances in Neural Information Processing Systems, 34:21808–21820, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.950336Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:142cf5b9bdcce53942a68c64cd4cf25461ce2c0b2d63c4206bdcfce7f90f72d4","observation_id":"feedad1f-a017-45ea-b62b-ffe4e02c4fe2","resolution":{"observed_at":"2026-08-15T20:38:16.950336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T20:38:16.954211Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.954211Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:a4e1f43e7990957ff914019122e9591d7d47938412c9e91d720643f0fc6256fa","observation_id":"3bdb711e-f310-4e16-8474-8d909e164ffe","resolution":{"observed_at":"2026-08-15T20:38:16.954211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-15T20:38:16.958199Z","title":"Language models are few-shot learners.arXiv preprint arXiv:2005.14165, 1:3, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.958199Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:b8acec623dc2a0e6790675a5770b0d8be34d869b5ccae44aa62b9cf0e3a1e77f","observation_id":"33c4cd93-3ea7-403c-8d5c-fc70557544d2","resolution":{"observed_at":"2026-08-15T20:38:16.958199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02725","last_updated":"2024-10-03T17:47:29Z","snapshot_observed_at":"2026-08-16T13:12:51.954649Z","submitted_at":"2024-10-03T17:47:29Z","title":"Adaptive Inference-Time Compute: LLMs Can Predict if They Can Do Better, Even Mid-Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02725","snapshot_observed_at":"2026-08-15T20:38:16.962058Z","title":"Adaptive inference-time compute: Llms can predict if they can do better, even mid-generation.arXiv preprint arXiv:2410.02725, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.962058Z"},"links":{"cited_paper":"/paper/2410.02725","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:83ab241a4e466b2ae2b9f7b3a480e6fe85ce42d1e5fe46dc1d3f8d482c2829e2","observation_id":"e752f4b3-7b39-4de7-b8c4-3264b7c11ae7","resolution":{"observed_at":"2026-08-15T20:38:16.962058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-16T04:47:34.593789Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-08-15T20:38:16.965914Z","title":"Rethinking the role of demonstrations: What makes in-context learning work?arXiv preprint arXiv:2202.12837, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.965914Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:70f93454a9ceafd74b6b8059ab4a7122598195a667df14679f8bcfe8c805881f","observation_id":"c6303c76-ab54-481f-a432-3ae39a21d958","resolution":{"observed_at":"2026-08-15T20:38:16.965914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08225","last_updated":"2024-08-05T00:54:02Z","snapshot_observed_at":"2026-08-16T14:19:06.274757Z","submitted_at":"2024-02-13T05:33:35Z","title":"Improving Black-box Robustness with In-Context Rewriting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08225","snapshot_observed_at":"2026-08-15T20:38:16.970305Z","title":"Improving black-box robustness with in-context rewriting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.970305Z"},"links":{"cited_paper":"/paper/2402.08225","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:44c2b07a0efa2eba7868614eda7740af3621fbe97643f28524de44fef29c8ec6","observation_id":"09d81cfd-dc9a-43bd-baa1-17059074609d","resolution":{"observed_at":"2026-08-15T20:38:16.970305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:17.443265Z","title":"Tttflow: Unsupervised test-time training with normalizing flow","venue":null,"work_id":"cfacc7b3-5dd4-4754-9f6c-a794c0b8306c","year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.974689Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:3413928512e8bb8ff0350db76889e6a07a5e2125179a02b5001f3cd7422f0f52","observation_id":"088ed9d4-eccb-4cf5-b1f0-49a5e60867f7","resolution":{"observed_at":"2026-08-15T20:38:17.447277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:16.978638Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.978638Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:873d3d654a2a7d7b070236e2e025fe32db872452a7551ff9fa1ec3582d9e69ae","observation_id":"4653fa01-6f0f-4a58-89f0-457f52d14f08","resolution":{"observed_at":"2026-08-15T20:38:16.978638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:17.422776Z","title":"Towards real-world test-time adaptation: Tri-net self-training with balanced normalization","venue":null,"work_id":"73ee1d62-b8ba-4ab8-b3ae-196318ed7209","year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.982354Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:12407b8e79521349110f70e43e700063b63902ffe42b184aab1b1ef4303ebeb1","observation_id":"60f8ee74-291c-4823-9140-bfc16300c2c4","resolution":{"observed_at":"2026-08-15T20:38:17.427328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-15T20:38:16.986205Z","title":"Stop overthinking: A survey on efficient reasoning for large language models.arXiv preprint arXiv:2503.16419, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.986205Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:30dbb7554b8c87054ca13817e02a2be96cce349a552fdf0547b49a1602f580de","observation_id":"434269cb-6a58-4f86-ae91-c49652ab7c27","resolution":{"observed_at":"2026-08-15T20:38:16.986205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13807","last_updated":"2024-01-07T22:32:39Z","snapshot_observed_at":"2026-08-16T14:50:15.802298Z","submitted_at":"2023-10-20T20:42:00Z","title":"Learning to (Learn at Test Time)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13807","snapshot_observed_at":"2026-08-15T20:38:16.990116Z","title":"Learning to (learn at test time).arXiv preprint arXiv:2310.13807, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.990116Z"},"links":{"cited_paper":"/paper/2310.13807","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:c5f445450f6580715c923483908f17d243a372048d6668c35ba7307800ffb485","observation_id":"5dd43cf7-598d-4a59-8e54-d04d7a48a18f","resolution":{"observed_at":"2026-08-15T20:38:16.990116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:17.409319Z","title":"Test- time training with self-supervision for generalization under distribution shifts","venue":null,"work_id":"63744cda-0076-44cd-80f2-76b63574b11e","year":2020},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.994116Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:e7ad252784e139c54003e50c880773f841137583b6c3f389f1c2c81a2e87c687","observation_id":"2985d54d-e242-4666-bfa3-b984451a513b","resolution":{"observed_at":"2026-08-15T20:38:17.413863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-08-16T06:30:33.794820Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-15T20:38:16.998243Z","title":"Tent: Fully test-time adaptation by entropy minimization.arXiv preprint arXiv:2006.10726, 2020","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:16.998243Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:cb1c9bbbc1970047f3a67817c4a907dda01543a3adc6fd6d92ffde3890211cbc","observation_id":"4045d2b4-f3dc-4d6e-a4cf-40acf894e090","resolution":{"observed_at":"2026-08-15T20:38:16.998243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-15T20:38:17.002426Z","title":"Self-consistency improves chain of thought reasoning in lan- guage models.arXiv preprint arXiv:2203.11171, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.002426Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:4ba5b7d5e9b3e21d0f6e235e1e4f92feeee79609a27d24de0a24238a1deba539","observation_id":"fbf0a411-64df-460b-acae-f9d75d19d280","resolution":{"observed_at":"2026-08-15T20:38:17.002426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03687","last_updated":"2024-11-06T06:13:57Z","snapshot_observed_at":"2026-08-16T13:02:32.451439Z","submitted_at":"2024-11-06T06:13:57Z","title":"Beyond Model Adaptation at Test Time: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03687","snapshot_observed_at":"2026-08-15T20:38:17.006489Z","title":"Beyond model adaptation at test time: A survey.arXiv preprint arXiv:2411.03687, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.006489Z"},"links":{"cited_paper":"/paper/2411.03687","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:f36cc8adf8fbd63a12b2fe03406a3a6e634235c3090e94ba7324f3c494c5d1c9","observation_id":"4407432e-bcf3-4586-93c4-dda52f9fc7bd","resolution":{"observed_at":"2026-08-15T20:38:17.006489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:17.393404Z","title":"Stta: enhanced text classification via selective test-time augmentation.PeerJ Computer Science, 9:e1757, 2023","venue":null,"work_id":"beae2f68-210d-40c5-89b8-b3a1a7693dfb","year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.011778Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:6695d8900f1b5eb9fc4b5ac33d472b30c607065457b03919460c4d5aec06b0ba","observation_id":"f7738cbe-275b-4833-83e5-26a53ddc0209","resolution":{"observed_at":"2026-08-15T20:38:17.399769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T20:38:17.016069Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.016069Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:31f34723aaa997ad106aeb3239c2349bd105eb1ee34b57a080003e3f77adc956","observation_id":"fc4348f3-88b0-4e4d-886f-8fc7fc2a73ca","resolution":{"observed_at":"2026-08-15T20:38:17.016069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-14T16:00:41.902820Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-15T20:38:17.020163Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.020163Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:ca791279bd49503b9b52a690722a1c0867b145e87b5bb43ecd4e91ae41b701a8","observation_id":"e3b0f746-0e29-4d0a-9b41-948f4c0e9bd4","resolution":{"observed_at":"2026-08-15T20:38:17.020163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:38:17.024323Z","title":"Tree of thoughts: Deliberate problem solving with large language models.Ad- vances in neural information processing systems, 36:11809–11822, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.024323Z"},"links":{"citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:b13b163602e4199db342a4b681efe8a2692a3fd96a96751e3a61b248b012cdb1","observation_id":"a45991d6-62c8-4263-b08a-3f53a23d45be","resolution":{"observed_at":"2026-08-15T20:38:17.024323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04550","last_updated":"2025-03-06T15:36:06Z","snapshot_observed_at":"2026-08-16T12:52:27.619570Z","submitted_at":"2025-03-06T15:36:06Z","title":"Benchmarking Reasoning Robustness in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04550","snapshot_observed_at":"2026-08-15T20:38:17.028835Z","title":"Benchmarking reasoning robustness in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.028835Z"},"links":{"cited_paper":"/paper/2503.04550","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:736fac8f41f24cb2c9318dceaaa686ca8b1464f4b8e2d871c4a85239b590e691","observation_id":"0c2265a9-7a01-4b92-a256-86071c0e2f5f","resolution":{"observed_at":"2026-08-15T20:38:17.028835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03536","last_updated":"2023-06-06T09:35:29Z","snapshot_observed_at":"2026-08-16T15:26:14.559079Z","submitted_at":"2023-06-06T09:35:29Z","title":"On Pitfalls of Test-Time Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03536","snapshot_observed_at":"2026-08-15T20:38:17.033229Z","title":"On pitfalls of test-time adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.033229Z"},"links":{"cited_paper":"/paper/2306.03536","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:4a0b1b55d9bacd8f86d6dacf8d90c20f68806cb583cf1485b45629af4308933c","observation_id":"d4d6e143-130f-4034-b844-af8d5a89411e","resolution":{"observed_at":"2026-08-15T20:38:17.033229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16084","last_updated":"2025-06-30T15:59:26Z","snapshot_observed_at":"2026-08-15T13:55:17.887932Z","submitted_at":"2025-04-22T17:59:56Z","title":"TTRL: Test-Time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16084","snapshot_observed_at":"2026-08-15T20:38:17.037405Z","title":"p r o m p t _ o n l y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:17.037405Z"},"links":{"cited_paper":"/paper/2504.16084","citing_paper":"/paper/2505.12392"},"observation_digest":"sha256:bfba372ff3c232788ee557d2580769323f3d7a7041806a4f9cd0c84ea6e07aba","observation_id":"3bad336c-8c0b-465e-88e6-291adcbcccc7","resolution":{"observed_at":"2026-08-15T20:38:17.037405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12392","last_updated":"2025-05-26T05:28:49Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T20:32:29.034522Z","submitted_at":"2025-05-18T12:37:56Z","title":"SLOT: Sample-specific Language Model Optimization at Test-time"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 6 inbound Pith citation observations for arXiv:2505.12392."}