{"as_of":"2026-08-07T22:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cece1ed06917152907183fe154a393d2bb649ff876eb87942849c88ad978b57f","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:30:14.998791Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10855/citation-record","integrity":"/paper/2507.10855/integrity","json":"/paper/2507.10855/citation-record.json","paper":"/paper/2507.10855"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.910699Z","title":"Decomposing and interpreting image representations via text in vits beyond CLIP","venue":null,"work_id":"192174f3-e9f3-4d06-ae56-5038f8a88ffe","year":null},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.760717Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:1ed30c91c1b5945701c706bc40b32b72e57dc6ba85c1cc2aecf28cfcbf0f0e10","observation_id":"9511c46e-1fea-4a3b-adb3-c6a4f55fc39f","resolution":{"observed_at":"2026-08-06T17:30:15.914536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.900009Z","title":"A fast iterative shrinkage- thresholding algorithm for linear inverse problems","venue":null,"work_id":"5582d102-0917-40fe-9a01-e88f30128497","year":2009},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.765244Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:0a4d5134f0dbd374452ee5dac7d8bd2bda1d3de82f00fc20b7f2791b32013185","observation_id":"e9828c74-1039-4500-be17-5d60b142e616","resolution":{"observed_at":"2026-08-06T17:30:15.903991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-06T17:30:14.769287Z","title":"Long- former: The long-document transformer","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.769287Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:4688ee52697d83edcdaeba31f5d890901702eb66ef49f8a4363d5f82ad579bb1","observation_id":"8b962cc0-b80a-4cc0-940d-2ff011c390ad","resolution":{"observed_at":"2026-08-06T17:30:14.769287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.888756Z","title":"Rep- resentation learning: A review and new perspectives","venue":null,"work_id":"bb686264-1084-43a9-b60f-61c629b7fe23","year":2013},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.773856Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:82ecf88328406f5c67de222b5d0b700505214bb4d6a5005a0bb08f2e7c06bbfc","observation_id":"e633657a-3ad1-42fe-8421-9782d655f17a","resolution":{"observed_at":"2026-08-06T17:30:15.893284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.877580Z","title":"Towards monosemanticity: De- composing language models with dictionary learning","venue":null,"work_id":"74bb2eb6-a844-420c-ac2b-83e666fbf7ab","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.777447Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:d1a16f4691bac86a1150211c8fb5df6ad768f2a05237ee100b4403341622fe9c","observation_id":"af27c774-498a-4188-a472-b857cabd314b","resolution":{"observed_at":"2026-08-06T17:30:15.881287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.866472Z","title":"Compressive sampling","venue":null,"work_id":"c194f184-9934-4a66-949f-c200486d1026","year":2006},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.781358Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:4c13e10c0fa815e1f7981e7121c1fdacab6bca984de34be93b17dc59f2f56a43","observation_id":"5c1f3671-1906-4e2f-9f36-d72a314c457e","resolution":{"observed_at":"2026-08-06T17:30:15.870181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.855073Z","title":"Pixart- σ: Weak-to-strong training of dif- fusion transformer for 4k text-to-image generation","venue":null,"work_id":"0eda1bb0-c180-4081-9e2f-09cdecac1793","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.785501Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:41893032bfb462c2a280c2de1b3a7987d72eb2410a76f1594cb9f00ecf687722","observation_id":"aa4eea79-b944-4551-90e3-cc858248af19","resolution":{"observed_at":"2026-08-06T17:30:15.859440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.843950Z","title":"Large convolutional model tuning via filter subspace","venue":null,"work_id":"51b30be2-bd61-4a8c-a82c-d0661d0e5d8e","year":2025},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.790524Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:f1ab4aa183ae4a54014ddacc7f725845e9cc2804c1d717f619690034f6ddd5af","observation_id":"096e96c4-dabc-4ba2-8170-74f55abbc1b2","resolution":{"observed_at":"2026-08-06T17:30:15.847854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.01818","last_updated":"2020-10-11T17:07:57Z","snapshot_observed_at":"2026-07-06T09:44:36.129510Z","submitted_at":"2020-08-04T20:34:59Z","title":"Graph Convolution with Low-rank Learnable Local Filters","version":2},"cited_work":{"arxiv_id":"2008.01818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.01818","snapshot_observed_at":"2026-08-06T17:30:15.347792Z","title":"Graph Convolution with Low-rank Learnable Local Filters","venue":"stat.ML","work_id":"ffd265be-f3e2-42be-ae3c-b582c3866c63","year":2020},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.795434Z"},"links":{"cited_paper":"/paper/2008.01818","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:6868a356fa806331faeb13ae1ae7d1088bf5df24ebd5a46bd3076f8c616455f2","observation_id":"d69b7fec-a966-4382-8b22-dfebd119467e","resolution":{"observed_at":"2026-08-06T17:30:15.352149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-06T08:05:35.311510Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-06T17:30:14.800598Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.800598Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:5f98cb3a7b8ada2329e2b56fba4ab9a456467265d5a79806add92d7c8a268c5e","observation_id":"3ce6576a-d060-42a4-9d2f-853414c06544","resolution":{"observed_at":"2026-08-06T17:30:14.800598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.833502Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":"02b290ca-38bc-45d2-bd30-a3b3b4595c6f","year":2021},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.805605Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:89e0ddae77c5629d92e13232e9df46f74d79a58c61de82c908658b72d064ddaa","observation_id":"e8b053f3-b16f-4d1f-85f3-65e9c598153d","resolution":{"observed_at":"2026-08-06T17:30:15.837289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.823030Z","title":"Transcoders enable fine-grained interpretable circuit analy- sis for language models","venue":null,"work_id":"3de98707-cda1-4b4c-a04b-7f0ea22b9fcd","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.810458Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:1bfb7bcf950d51f69565c8ea4ba2e19b26c3891c838f2489a5faeacd358c40a6","observation_id":"e733b948-10e0-42db-a9fa-084f9ae63278","resolution":{"observed_at":"2026-08-06T17:30:15.827010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02410","last_updated":"2023-07-02T22:58:51Z","snapshot_observed_at":"2026-08-07T04:20:01.212078Z","submitted_at":"2022-10-05T17:32:16Z","title":"The Vendi Score: A Diversity Evaluation Metric for Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02410","snapshot_observed_at":"2026-08-06T17:30:14.814750Z","title":"The vendi score: A diversity evaluation metric for machine learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.814750Z"},"links":{"cited_paper":"/paper/2210.02410","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:804e6c406ad1a9a5719856817499d715e02180072c3142f6e66c5589f6635b6e","observation_id":"7f56e7ad-4ed9-49fd-879a-daa117a23228","resolution":{"observed_at":"2026-08-06T17:30:14.814750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.812185Z","title":"Svdiff: Compact param- eter space for diffusion fine-tuning","venue":null,"work_id":"eeacf89c-a421-419c-854a-3db6a124dca9","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.819040Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:80479861729698db08aad562786f0d342f2be3c3e99837af34600dfff4b00dff","observation_id":"1a028349-fa93-4346-92c9-f99bbf7d92ae","resolution":{"observed_at":"2026-08-06T17:30:15.816138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.801566Z","title":"Conceptexpress: Harnessing diffusion models for single-image unsupervised concept extraction","venue":null,"work_id":"a5061517-9755-419e-9554-3407ab286fcd","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.823427Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:8a0893e535c3316763446e58d7253181251186e5178d3a9142e3674b41e691d3","observation_id":"7de6e6f4-2ea0-4c63-b085-3349a69f266c","resolution":{"observed_at":"2026-08-06T17:30:15.805367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.789356Z","title":"Lora: Low- rank adaptation of large language models","venue":null,"work_id":"2fe654b6-69bb-4e4e-b82c-3424f3f6fb7e","year":2021},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.827441Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:7bd3bc13325c1be3504d60133db1cb3ec58a0bc82622bb476ef885960b14bb2f","observation_id":"3a2ce792-89af-4915-befe-4a32437de344","resolution":{"observed_at":"2026-08-06T17:30:15.793795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06633","last_updated":"2025-04-02T14:16:22Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:44:47Z","title":"SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation","version":2},"cited_work":{"arxiv_id":"2409.06633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.06633","snapshot_observed_at":"2026-08-06T17:30:15.306698Z","title":"SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation","venue":"cs.CV","work_id":"94384e52-0ad6-49a6-95d5-3699fb9ad7f0","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.830860Z"},"links":{"cited_paper":"/paper/2409.06633","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:37809b77787b8062ef0c5a1512f82c047340ab54e8c3db08531dcb6b01938801","observation_id":"6243c206-58f7-4441-873e-e681dc3c66d9","resolution":{"observed_at":"2026-08-06T17:30:15.310873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.777839Z","title":"Text embed- ding is not all you need: Attention control for text-to-image semantic alignment with text self-attention maps","venue":null,"work_id":"7ff3a862-9830-43da-981c-73fd8dfeb098","year":2025},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.835088Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:bc13ffb7ca297e037bff9245470cbbf8a7534725038ce9fc698848f5647272fd","observation_id":"d56e6243-efed-47b1-91b9-b4f6a5e88808","resolution":{"observed_at":"2026-08-06T17:30:15.782104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10058","last_updated":"2024-10-14T00:53:59Z","snapshot_observed_at":"2026-07-06T19:32:46.742766Z","submitted_at":"2024-10-14T00:53:59Z","title":"Learning to Customize Text-to-Image Diffusion In Diverse Context","version":1},"cited_work":{"arxiv_id":"2410.10058","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.10058","snapshot_observed_at":"2026-08-06T17:30:15.288530Z","title":"Learning to Customize Text-to-Image Diffusion In Diverse Context","venue":"cs.CV","work_id":"e887592b-56b7-421c-a16e-e86e9bd66262","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.838687Z"},"links":{"cited_paper":"/paper/2410.10058","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:e209e769db0ca5d3f4721b6cea90bbc7ab0d01d96d0664bdefc6a5e9cecf4ee3","observation_id":"30ca9e2b-c1cb-4e00-8ac2-9606dd80a881","resolution":{"observed_at":"2026-08-06T17:30:15.293353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.765368Z","title":"An introduction to variational autoencoders","venue":null,"work_id":"9f0ceee4-ff78-43d8-9954-d8b17d639a7f","year":2019},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.842850Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:f91240f17ac0228a000a1f0cfcf212a2f824501a4fd4453d1f93625ce7a03a49","observation_id":"3835d217-b7bd-41d3-8148-244890f980a7","resolution":{"observed_at":"2026-08-06T17:30:15.769840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:14.846620Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.846620Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:b1b7db5271cdbba5099bc79b29ef37bd6004218c4e35a74b1123c8b5d7c25003","observation_id":"a66c29ff-09fc-40b2-ab90-2e6810ee15d6","resolution":{"observed_at":"2026-08-06T17:30:14.846620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.745949Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"8bdbc6e7-fceb-4890-a07a-8a2e71b66c9c","year":null},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.850785Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:df0caa06f4826d2842786a093068872dda8eedd3b5c055de22408c7593ff5fa1","observation_id":"ad84e6bb-dc24-44e0-a49a-789dcff9a340","resolution":{"observed_at":"2026-08-06T17:30:15.749955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20766","last_updated":"2025-02-28T06:34:53Z","snapshot_observed_at":"2026-08-07T17:40:46.337382Z","submitted_at":"2025-02-28T06:34:53Z","title":"FlexPrefill: A Context-Aware Sparse Attention Mechanism for Efficient Long-Sequence Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20766","snapshot_observed_at":"2026-08-06T17:30:14.855194Z","title":"Flexprefill: A context-aware sparse attention mech- anism for efficient long-sequence inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.855194Z"},"links":{"cited_paper":"/paper/2502.20766","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:e90848c475c90b3178ab516ae0c2693bda211866072b63b15c64e5d9f0739725","observation_id":"da99d513-7753-4c4a-9aec-2bf4bf27ee7d","resolution":{"observed_at":"2026-08-06T17:30:14.855194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-06T17:30:14.859810Z","title":"Dora: Weight-decomposed low-rank adaptation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.859810Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:27bbb08289842050dc63068234e632f239624875d91732f13a203e4181b83b8c","observation_id":"a0c2c29f-1e56-4d25-85f1-c33a7507450e","resolution":{"observed_at":"2026-08-06T17:30:14.859810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00723","last_updated":"2025-03-20T21:26:06Z","snapshot_observed_at":"2026-08-07T17:36:31.638572Z","submitted_at":"2025-03-02T04:11:03Z","title":"Re-Imagining Multimodal Instruction Tuning: A Representation View","version":3},"cited_work":{"arxiv_id":"2503.00723","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.00723","snapshot_observed_at":"2026-08-06T17:30:15.247415Z","title":"Re-Imagining Multimodal Instruction Tuning: A Representation View","venue":"cs.LG","work_id":"fa417d44-661b-4c26-8834-be4a7977c819","year":2025},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.864435Z"},"links":{"cited_paper":"/paper/2503.00723","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:df2dda3f163f53ecfe5020474949947f15666bf324303d2a3d7741ecd76a032a","observation_id":"4b1c59e3-0870-4802-8836-45fd52964225","resolution":{"observed_at":"2026-08-06T17:30:15.251852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02047","last_updated":"2023-08-07T06:21:31Z","snapshot_observed_at":"2026-07-06T15:50:26.113234Z","submitted_at":"2023-07-05T06:05:36Z","title":"CAME: Confidence-guided Adaptive Memory Efficient Optimization","version":2},"cited_work":{"arxiv_id":"2307.02047","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.02047","snapshot_observed_at":"2026-08-06T17:30:15.223380Z","title":"CAME: Confidence-guided Adaptive Memory Efficient Optimization","venue":"cs.CL","work_id":"c58d72e4-e2d5-44d3-90d5-2666c94c3dc6","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.868394Z"},"links":{"cited_paper":"/paper/2307.02047","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:b37d6954d7db3e8c185060414bd32c656bf0560065c3c9c4d0ae22b5f2891463","observation_id":"73856219-331c-496e-bcdb-fb41f05e0c1f","resolution":{"observed_at":"2026-08-06T17:30:15.228311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.734487Z","title":"Supervised dictionary learning","venue":null,"work_id":"931d6fb1-2a6e-43e9-a777-65987302cbea","year":2008},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.872276Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:9ea5eb74cb554716823727680a513b6b3f96d9b588016cce661254926653f8ab","observation_id":"d70aca7b-cc9b-47dd-a216-6d314df84f84","resolution":{"observed_at":"2026-08-06T17:30:15.738523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19647","snapshot_observed_at":"2026-08-06T17:30:14.876081Z","title":"Sparse feature cir- cuits: Discovering and editing interpretable causal graphs in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.876081Z"},"links":{"cited_paper":"/paper/2403.19647","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:00f16c61e9c9ba651c3c407f2fcb7000fad6017f18a7eb05c8152b674733dac1","observation_id":"bb28413e-c0a7-476d-a41b-ae3380648e15","resolution":{"observed_at":"2026-08-06T17:30:14.876081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.725010Z","title":"Con- tinual learning with filter atom swapping","venue":null,"work_id":"8af9ab2d-8d7d-4a70-9bdc-47a38926bf90","year":2021},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.880418Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:1ba55f4dad7201f8442c795afaf72e8f4452e399ac1e03d648d4fc55bf020c36","observation_id":"9e79c806-f05c-446c-90c1-3fbdd0f7001d","resolution":{"observed_at":"2026-08-06T17:30:15.728267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.714281Z","title":"Spatiotemporal joint filter decomposition in 3d convolutional neural networks","venue":null,"work_id":"68e68f43-4154-4554-9683-7eac08188f1c","year":2021},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.884423Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:b50fb1aedf9723e66d88c37a5d22c59dd294feb0c75c6de2c65e8524b8887f93","observation_id":"d9a52c6a-4468-409f-8888-94d639654a8a","resolution":{"observed_at":"2026-08-06T17:30:15.718494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.703259Z","title":"Training diffusion models towards diverse image generation with reinforcement learning","venue":null,"work_id":"bfc540fa-f7ed-4bda-92e1-9f69700c025a","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.888677Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:f8e884d03ee59e7dcbb9b1e42c83b936a631dd7c183680e8042d4ab4616fa103","observation_id":"ad1d9996-b7bf-4c0c-9e6f-f041426bb985","resolution":{"observed_at":"2026-08-06T17:30:15.706928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03190","last_updated":"2025-03-03T04:11:46Z","snapshot_observed_at":"2026-07-06T19:27:29.609371Z","submitted_at":"2024-10-04T07:05:16Z","title":"Tuning Timestep-Distilled Diffusion Model Using Pairwise Sample Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03190","snapshot_observed_at":"2026-08-06T17:30:14.892909Z","title":"Tuning timestep- distilled diffusion model using pairwise sample optimiza- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.892909Z"},"links":{"cited_paper":"/paper/2410.03190","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:f58d89e7c1725678c5e5a20e1d7e4425335903dde6691dd9a82f780162e24532","observation_id":"a2cac26c-8e79-4f7d-9e21-ecd4ccb78517","resolution":{"observed_at":"2026-08-06T17:30:14.892909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.690716Z","title":"Coeff-tuning: A graph filter subspace view for tuning attention-based large models","venue":null,"work_id":"344eb199-93c9-4751-bf7f-14cdc2328a56","year":2025},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.897163Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:a45999b09d9811f02ec10e79325e1c96786d71305e6aebb025a87a701ebc8fe3","observation_id":"047baf86-a9dc-4380-b604-eefe4fe28c9d","resolution":{"observed_at":"2026-08-06T17:30:15.695264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.679195Z","title":"Emergence of simple- cell receptive field properties by learning a sparse code for natural images","venue":null,"work_id":"fca9c693-fe43-48ed-ae13-916291e02814","year":1996},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.900927Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:7e1db2b6a54bed455723e4663396fc3caf5e6e080ae1b2cf93d67d743be9cfa1","observation_id":"4226990e-0c4e-420d-bfd4-4b963543249b","resolution":{"observed_at":"2026-08-06T17:30:15.683911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T17:30:14.904940Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.904940Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:a57115ec3e4c880c7dc56610cc9323fac4ac217df587c89d99d522c65a82315f","observation_id":"00d3af64-ebc0-49a5-9126-3751ca30ec2f","resolution":{"observed_at":"2026-08-06T17:30:14.904940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02147","last_updated":"2025-02-01T16:45:14Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T02:12:03Z","title":"Efficient Source-Free Time-Series Adaptation via Parameter Subspace Disentanglement","version":2},"cited_work":{"arxiv_id":"2410.02147","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02147","snapshot_observed_at":"2026-08-06T17:30:15.167910Z","title":"Efficient Source-Free Time-Series Adaptation via Parameter Subspace Disentanglement","venue":"cs.LG","work_id":"13ccc186-89c7-49de-8f10-25422ddb7649","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.909776Z"},"links":{"cited_paper":"/paper/2410.02147","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:bcd0ef16d75829aff8f2f9f3cc68da6361a688d503694f7c95760cd098e156c6","observation_id":"129da327-983e-4cae-894e-57db7ff3ddf4","resolution":{"observed_at":"2026-08-06T17:30:15.173147Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.564769Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"d6d33722-05ca-41b4-8fe1-611484771438","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.914154Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:876a79e58f0b080dc076fa2358bc95f1a4366aab9ef394c74d3b8922433f7ef5","observation_id":"82d6a9a0-8b77-4e86-b3d9-e90d4894b5a9","resolution":{"observed_at":"2026-08-06T17:30:15.569159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02078","last_updated":"2024-10-02T22:57:47Z","snapshot_observed_at":"2026-07-06T19:26:38.002071Z","submitted_at":"2024-10-02T22:57:47Z","title":"Posterior sampling via Langevin dynamics based on generative priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02078","snapshot_observed_at":"2026-08-06T17:30:14.917980Z","title":"Posterior sampling via langevin dynamics based on generative priors.arXiv preprint arXiv:2410.02078, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.917980Z"},"links":{"cited_paper":"/paper/2410.02078","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:7f77af98089ad48dab10359b6d4f9decb21a7fe290f1847072ec33dc1fbe98b8","observation_id":"08d02a7f-6875-4edd-a70e-3a8a6c5bbcd4","resolution":{"observed_at":"2026-08-06T17:30:14.917980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.553271Z","title":"Dcfnet: Deep neural network with decomposed convolutional filters","venue":null,"work_id":"c8b92b2a-d865-4b26-8589-ecac555fb81f","year":2018},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.921851Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:188d14b565295b693cd6582dae6df6bf6fc54b2ba9f3666931d32fe97b826391","observation_id":"9d05a825-ac72-4027-9e9a-4b07fed1450b","resolution":{"observed_at":"2026-08-06T17:30:15.557582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.542140Z","title":"Controlling text-to-image diffusion by orthogo- nal finetuning","venue":null,"work_id":"f7a6783b-82e7-47a0-b29f-12fd0f72db8a","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.926623Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:7e9b93540ada01ece4e29e6c55e37d151d77dad68a2e4b70de0b975d04dfd945","observation_id":"0dbe1858-2f38-4fc6-adc9-797e0d1c4f37","resolution":{"observed_at":"2026-08-06T17:30:15.546721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.530575Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"0d6a5fcd-6911-4eb5-853a-b73ae487adc0","year":2021},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.930569Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:40c1bddee95d14782a5ef832f6100a59951c128269ee6f14bf0fde855d8c989c","observation_id":"ace7e34a-7272-4691-b644-997b24177ea2","resolution":{"observed_at":"2026-08-06T17:30:15.534676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.518965Z","title":"Unveiling and mitigating mem- orization in text-to-image diffusion models through cross at- tention","venue":null,"work_id":"fc87d693-4899-4646-9724-5b0e53799013","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.934714Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:58864ddebe02f0176fb5fd7ae5a30783cdf16cffd901c2e01b133ec31a96c5fd","observation_id":"876665a2-20a8-42e7-8e31-45eaa8af2c1d","resolution":{"observed_at":"2026-08-06T17:30:15.522994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:14.938952Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.938952Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:4aa653f09e66b084420da738c294ba513396036cc692597c6ee0182d528c5ce2","observation_id":"b318066c-1caa-4b6d-89c2-7b4135f8deb3","resolution":{"observed_at":"2026-08-06T17:30:14.938952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.501776Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"06d3c424-525e-4848-b775-f86c6c4a08cb","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.943156Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:7ad8ad8196f8e772e7e2ba46c2cefa067310a1b71ae386ff723d5682774a890a","observation_id":"eae68459-335e-42c9-9f79-2dd68d48081f","resolution":{"observed_at":"2026-08-06T17:30:15.505290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:14.947269Z","title":"Unpacking sdxl turbo: Interpreting text-to-image models with sparse au- toencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.947269Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:549414b9a764bac8d4d26a42ec379bf828b662a745c03df1d5a3dbf3a5324c5e","observation_id":"f54b1b02-f063-4457-903f-236c4c0922c6","resolution":{"observed_at":"2026-08-06T17:30:14.947269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.490706Z","title":"Sparse sinkhorn attention","venue":null,"work_id":"19afa7d3-c14c-48d1-a3a6-8384b42339b1","year":2020},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.951564Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:ecc9100c80a27a90ad29d8e3c9122d96e2c18be36947b62150d3ad33a561f158","observation_id":"29c649b9-94a5-4f6a-a97d-e665b6fa74cc","resolution":{"observed_at":"2026-08-06T17:30:15.494150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01659","last_updated":"2025-02-07T13:44:24Z","snapshot_observed_at":"2026-07-06T20:30:26.881629Z","submitted_at":"2025-01-31T22:05:00Z","title":"Longer Attention Span: Increasing Transformer Context Length with Sparse Graph Processing Techniques","version":2},"cited_work":{"arxiv_id":"2502.01659","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01659","snapshot_observed_at":"2026-08-06T17:30:15.054198Z","title":"Longer Attention Span: Increasing Transformer Context Length with Sparse Graph Processing Techniques","venue":"cs.LG","work_id":"c39bb327-b93d-444f-8f57-cf9bbd4c08d0","year":2025},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.955831Z"},"links":{"cited_paper":"/paper/2502.01659","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:a011f377a8c2838c30e41403c3633288db0cbd336769e839d90dae8b544bbcaa","observation_id":"68793c4a-d8bc-43c8-b927-4c223eb6b933","resolution":{"observed_at":"2026-08-06T17:30:15.058609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.478380Z","title":"Attention is all you need","venue":null,"work_id":"d1aa877a-c319-4657-9d83-36af522532a8","year":2017},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.959840Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:ea769ebfa8bfd66b0fb2b9dabb0faf8485932f31f3b3e6f88c21d595d4edbe4b","observation_id":"dad8f7eb-841b-43dd-87e0-f4984279b962","resolution":{"observed_at":"2026-08-06T17:30:15.482518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11286","last_updated":"2020-02-24T19:35:47Z","snapshot_observed_at":"2026-07-06T08:24:23.463202Z","submitted_at":"2019-09-25T04:37:38Z","title":"Stochastic Conditional Generative Networks with Basis Decomposition","version":2},"cited_work":{"arxiv_id":"1909.11286","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.11286","snapshot_observed_at":"2026-08-06T17:30:15.033775Z","title":"Stochastic Conditional Generative Networks with Basis Decomposition","venue":"cs.CV","work_id":"a2878599-53cd-4d74-a066-943ef170f5aa","year":2019},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.963651Z"},"links":{"cited_paper":"/paper/1909.11286","citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:17bff0f8efea89371284571a56605517940c2f799766a8df92ae2ca75d8a408c","observation_id":"dbcc7baf-124c-4b95-9dd1-785ae1449fe4","resolution":{"observed_at":"2026-08-06T17:30:15.040899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.465816Z","title":"Image generation using continuous filter atoms","venue":null,"work_id":"1bfe34e4-8845-442e-b017-7c37134734a1","year":2021},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.967362Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:a2bfa19cb74404201fc8257c8f155a9c3eb52df3d11b7dd5df04a96831eb3a15","observation_id":"8879c03b-fe14-48c9-8b58-fae899a69f9f","resolution":{"observed_at":"2026-08-06T17:30:15.470459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.454044Z","title":"Adaptive convolutions with per-pixel dynamic filter atom","venue":null,"work_id":"2081377f-929a-4189-9017-961156972e57","year":2021},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.970950Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:7aa2093898b434c8e0cb461d3820226cbad67d4219cb1c5e5beb098f2b9c6636","observation_id":"1cde644b-e6fb-42af-8dd7-e72b3aa0e45b","resolution":{"observed_at":"2026-08-06T17:30:15.458829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.443057Z","title":"Advancing parameter efficiency in fine-tuning via representation editing","venue":null,"work_id":"b5f95254-e945-40eb-b7fb-4f7d69bc96d9","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.974721Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:efda73ce4a92a0997470a765c835aaafe2feaafbf46eb0a004de63d3c267e270","observation_id":"5148cfb5-adff-4abc-963d-589070319bdd","resolution":{"observed_at":"2026-08-06T17:30:15.446692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.432258Z","title":"Reft: Representation finetuning for language models","venue":null,"work_id":"659163f3-a4f7-4350-b8f7-817702b44cc3","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.978232Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:39428f79ce6f0e6eaef1cd3635c9346640a2e5154779bebb0f6766649845b671","observation_id":"8b95fe18-a91b-4d50-abd3-f9d3c7096558","resolution":{"observed_at":"2026-08-06T17:30:15.435755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.420679Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":"ef143d9e-0c48-4309-9b6c-3ebd940ef23f","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.981779Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:bed5d0fef81b6b15acee6c911c722fa80a71627c20919cc3f132e5f397960d6a","observation_id":"bba9694a-4656-4932-b54f-0b645d47c6db","resolution":{"observed_at":"2026-08-06T17:30:15.425238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:14.985479Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.985479Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:2ed2491ee8b8d6d065af7c86c4f7434f8cd7331b3a663feaeb8fb5d328e8b4d5","observation_id":"316a5f64-7c05-4e57-bef7-91016736f517","resolution":{"observed_at":"2026-08-06T17:30:14.985479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.400028Z","title":"Enhancing semantic fidelity in text-to-image synthesis: Attention regulation in diffusion models","venue":null,"work_id":"3f986f98-6b8c-40ff-9f4b-203434626f68","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.989372Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:768145cf2bf5b28174dff7f62de0da3fe28f0623eae4d43b36e270d5779d63fb","observation_id":"8bafb27a-d84f-488f-86c2-879c47e3b7a2","resolution":{"observed_at":"2026-08-06T17:30:15.404694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.386628Z","title":"Object- conditioned energy-based attention map alignment in text-to- image diffusion models","venue":null,"work_id":"18a7e189-e24a-4c04-9a1c-9638d6b441a4","year":2024},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.993979Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:f408a9ebddd328d4ab4ed63a26d9f251c1dfd9ac2b24003a1b6b1d25ed91a161","observation_id":"bd515564-5b75-46c1-9d9f-cf33c271640c","resolution":{"observed_at":"2026-08-06T17:30:15.391151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:30:15.374510Z","title":"A grey ⟨V ⟩ wolf plushie","venue":null,"work_id":"e8e2c4f3-807a-4be8-8a67-3d0eab5755c9","year":2023},"citing_paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:14.998791Z"},"links":{"citing_paper":"/paper/2507.10855"},"observation_digest":"sha256:996089edc92deca7257e6463f8473d640bb3fd8eea3634c9414a0e91cfe30cda","observation_id":"a9bd85a6-a7e8-4dd8-88cf-71992dbb7594","resolution":{"observed_at":"2026-08-06T17:30:15.378776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.10855","last_updated":"2025-07-14T23:03:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T04:20:33.932082Z","submitted_at":"2025-07-14T23:03:24Z","title":"Sparse Fine-Tuning of Transformers for Generative Tasks"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":8,"verified_fuzzy":37},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2507.10855."}