{"as_of":"2026-08-05T21:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d31ce6f22475c764b95d3b476b2c40c989c3dc0e8b342f1242c925c6fd1d3ff8","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:33:45.192139Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.08809/citation-record","integrity":"/paper/2605.08809/integrity","json":"/paper/2605.08809/citation-record.json","paper":"/paper/2605.08809"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18619","last_updated":"2024-12-30T03:00:30Z","snapshot_observed_at":"2026-07-06T20:12:54.710203Z","submitted_at":"2024-12-16T05:02:25Z","title":"Next Token Prediction Towards Multimodal Intelligence: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2412.18619","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18619","snapshot_observed_at":"2026-07-04T00:39:16.234771Z","title":"Next token prediction towards multimodal intelligence: A comprehensive survey.arXiv preprint arXiv:2412.18619, 2024a","venue":null,"work_id":"5cdd7b0b-6c98-4848-901b-eab0a5c3f9e6","year":2024},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2412.18619","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:79006376dfd9cec88180c981ac5e2e53ba251f334c11bf3048a5b477e462d779","observation_id":"b0e0be72-5092-499a-9868-616165665746","resolution":{"observed_at":"2026-05-12T07:16:28.852066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.24265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Joint selection for large-scale pre-training data via policy gradient-based mask learning.arXiv preprint arXiv:2512.24265","venue":null,"work_id":"ce522879-f5c2-44d0-b221-8bea665695b3","year":null},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:37cbb7c79a3b7c4095833029093da3db20df4a16fb58c03be16560a67f82a622","observation_id":"54955a1a-11ae-4f2a-9434-07f95f53ab40","resolution":{"observed_at":"2026-05-12T07:16:28.903351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1260860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:47:14.558044Z","title":"He, B., Yin, L., Zhen, H.-L., Liu, S., Wu, H., Zhang, X., Yuan, M., and Ma, C","venue":null,"work_id":"e7e9d443-273d-4722-8ec7-59adb893de0e","year":2024},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:57e9d89cb706eb8230511e471c7c1bc5b58cd6790d906f33e780b8868beb6475","observation_id":"1db87a18-273a-4772-87e1-aa024fc05650","resolution":{"observed_at":"2026-05-12T07:16:28.917670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08821","last_updated":"2022-05-18T12:29:49Z","snapshot_observed_at":"2026-07-06T11:01:05.577957Z","submitted_at":"2021-04-18T11:27:08Z","title":"SimCSE: Simple Contrastive Learning of Sentence Embeddings","version":4},"cited_work":{"arxiv_id":"2104.08821","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.08821","snapshot_observed_at":"2026-07-04T20:00:08.897138Z","title":"SimCSE: Simple Contrastive Learning of Sentence Embeddings","venue":"cs.CL","work_id":"e9fab1e4-f443-4963-9f2a-83f772482c00","year":2021},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2104.08821","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:f1935a506fa2f555fa2cc7f5c952d6edacd46bc918b9964a9351870b8acc6f4f","observation_id":"97faa1aa-aee3-4e3f-a323-d6b70a290b16","resolution":{"observed_at":"2026-05-15T07:48:23.738089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jun Hu, Wenwen Xia, Xiaolu Zhang, Chilin Fu, Weichang Wu, Zhaoxin Huan, Ang Li, Zuoli Tang, and Jun Zhou","venue":null,"work_id":"fb4ac749-7258-404d-9f22-c87d953fb8d4","year":2024},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:9c53a7efce6f374d5bc2463fd11160571974df69cceef05c9e849ca2a19b396b","observation_id":"8a831358-8906-4b57-a731-761465cacc49","resolution":{"observed_at":"2026-05-12T19:11:48.180033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":"2401.04088","doi":"10.48550/arxiv.2401.04088","metadata_source":"pith","pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixtral of Experts","venue":"cs.LG","work_id":"0de8c352-9daa-4e1e-8c7b-3d0dec69f369","year":2024},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:97a9c4ed701108730b54b2dfaf703853da7844c76b1fd4d0adecbba151968d83","observation_id":"8e02469a-04b3-4fc2-ac2e-a3023d04441a","resolution":{"observed_at":"2026-05-12T07:16:28.913257Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17516","last_updated":"2025-02-22T20:55:26Z","snapshot_observed_at":"2026-07-06T20:41:56.035072Z","submitted_at":"2025-02-22T20:55:26Z","title":"A Survey on Mechanistic Interpretability for Multi-Modal Foundation Models","version":1},"cited_work":{"arxiv_id":"2502.17516","doi":"10.48550/arxiv.2502.17516","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.17516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv, ://arxiv.org/abs/2502.17516, arXiv:2502.17516 [cs], doi:10.48550/arXiv.2502.17516","venue":"ArXiv.org","work_id":"0ef62dc6-4be6-4bf5-935b-5a6c737769e7","year":2025},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2502.17516","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:dbdcf04d4b2996d391aa885e38e56a549bde0d89bed617ba42f718180b187eb9","observation_id":"f2855f91-1f3f-48db-b801-98d481d39e39","resolution":{"observed_at":"2026-05-12T07:16:28.897313Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:49.159234+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:49.159234+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.10005","last_updated":"2022-01-24T23:36:20Z","snapshot_observed_at":"2026-07-06T12:30:51.934079Z","submitted_at":"2022-01-24T23:36:20Z","title":"Text and Code Embeddings by Contrastive Pre-Training","version":1},"cited_work":{"arxiv_id":"2201.10005","doi":"10.48550/arxiv.2201.10005","metadata_source":"pith","pith_arxiv_id":"2201.10005","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Text and Code Embeddings by Contrastive Pre-Training","venue":"cs.CL","work_id":"b5a7ebcc-85b7-4a3f-8495-8d4b5220f949","year":2022},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2201.10005","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:25225aec9ebbca01533f59266953175cef7ccd87348f330902d20a1848950352","observation_id":"d09df841-1e59-46a7-9b1c-7307c3208f27","resolution":{"observed_at":"2026-05-15T19:24:12.120554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":"1807.03748","doi":"10.1609/aaai.v36i10.21390","metadata_source":"pith","pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Learning with Contrastive Predictive Coding","venue":"cs.LG","work_id":"7b08a1d4-d565-424e-9c86-6ef244b7b90a","year":2018},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:6ddf12f553ab943dca0756de47b029e2b27f440d3fb6d3592d50d44d4b1fb333","observation_id":"ffe8bed3-18da-4e29-8c19-9f7169094d3a","resolution":{"observed_at":"2026-05-12T07:16:28.820669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:ea87558d0581759c9a06e14c5219fcd0205f72dc6771e1c2fc778e215253c535","observation_id":"61134f1e-7314-4cdf-ad7e-aa4ece46efe2","resolution":{"observed_at":"2026-05-12T07:16:28.892187Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple contrastive learning framework for interactive argument pair identification via argument-context extraction","venue":null,"work_id":"4b92292c-db02-41b4-84ab-dce43e72f94f","year":2022},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:71c85362daf114d28ede7a7cb1d11eb428e066b5e67fd7cf83199310ac47c794","observation_id":"9e249d79-f9f5-475d-98a4-ed5441191f7c","resolution":{"observed_at":"2026-05-12T19:11:48.184269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12876","last_updated":"2026-05-13T04:56:46Z","snapshot_observed_at":"2026-08-01T16:23:25.586402Z","submitted_at":"2025-06-15T15:02:59Z","title":"MaskPro: Linear-Space Probabilistic Learning for Strict (N:M)-Sparsity on LLMs","version":2},"cited_work":{"arxiv_id":"2506.12876","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12876","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maskpro: Linear-space probabilistic learning for strict (n: M)-sparsity on large language models.arXiv preprint arXiv:2506.12876","venue":null,"work_id":"fa290085-42c1-461e-b21c-36d491e25291","year":null},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2506.12876","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:66114e0389350f210434b0de9e846c7f4d075686ccccd9c93baab5e41b6e1a08","observation_id":"1018947d-9799-41ad-96ba-0ab476a704d6","resolution":{"observed_at":"2026-05-14T01:54:43.618312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12591","last_updated":"2025-07-25T09:22:04Z","snapshot_observed_at":"2026-08-02T08:50:26.894882Z","submitted_at":"2024-12-17T06:48:24Z","title":"LLMs are Also Effective Embedding Models: An In-depth Overview","version":2},"cited_work":{"arxiv_id":"2412.12591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12591","snapshot_observed_at":"2026-07-04T20:00:08.922822Z","title":"Llms are also effective embedding models: An in-depth overview.arXiv preprint arXiv:2412.12591","venue":null,"work_id":"3db1f93f-47f8-43c5-ba07-640dbd1ede76","year":2024},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2412.12591","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:fb39964fd3fb8dc4d5195d5e4a241ae8df8be169fd8668d5748fc227961643dc","observation_id":"f2e5d0f5-5471-49db-8328-91c0c4e4ecad","resolution":{"observed_at":"2026-05-12T07:16:28.880514Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:32eec6771c47aee823f025920c85126bea7e0a3a8105ad765433c05d169e4aa0","observation_id":"85cc35bc-1a59-4504-b3bd-f1b842046675","resolution":{"observed_at":"2026-05-12T07:16:28.863749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11034","last_updated":"2026-07-19T05:20:00Z","snapshot_observed_at":"2026-07-23T23:19:59.228975Z","submitted_at":"2025-02-16T08:13:23Z","title":"AdaGC: Enhancing LLM Pretraining Stability via Adaptive Gradient Clipping","version":4},"cited_work":{"arxiv_id":"2502.11034","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.11034","snapshot_observed_at":"2026-06-10T02:11:12.038297Z","title":"Adagc: Improving training stability for large language model pretraining.arXiv preprint arXiv:2502.11034","venue":null,"work_id":"a75a4930-a13c-448c-8f8a-d540438de6ed","year":null},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2502.11034","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:c9c9e700d7688b0dea2f5adacb70175c0bb2ca0b1d7a483b4969ae3b763f4a04","observation_id":"808990e5-6e2e-493a-889d-8d20a7c105c5","resolution":{"observed_at":"2026-06-10T02:11:12.038297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12448","last_updated":"2024-03-19T05:17:47Z","snapshot_observed_at":"2026-07-06T17:46:50.682231Z","submitted_at":"2024-03-19T05:17:47Z","title":"Do Generated Data Always Help Contrastive Learning?","version":1},"cited_work":{"arxiv_id":"2403.12448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12448","snapshot_observed_at":"2026-07-02T22:57:26.185636Z","title":"Do generated data always help contrastive learning?arXiv preprint arXiv:2403.12448","venue":null,"work_id":"e553f6f1-23ca-4687-bedc-ce2d2e06b1cd","year":null},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"cited_paper":"/paper/2403.12448","citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:fc2dea1fafbe5488e8ca73214256bc0ccae9d313d6f53227d23351f0eeb4409d","observation_id":"e1f8b234-50ae-4a35-a057-d5b760ef3c42","resolution":{"observed_at":"2026-05-12T07:16:28.838582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is contrastive learning necessary? a study of data augmentation vs contrastive learning in sequential recommen- dation","venue":null,"work_id":"ccf3a819-8681-4283-bd3e-3d9236f955f8","year":2024},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:827fdd80c10d4e9187642e86b4288114320162ab190575ab96b4cd8f43afda5b","observation_id":"688420ce-fd93-446a-ae48-f658e60628ec","resolution":{"observed_at":"2026-05-12T19:11:48.188493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9fe411cf-4e52-446b-9b8c-5f6b6a0a1633","year":2023},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:a05442d03e21d117e2fab5eaff969a0c5f8f1e0f82225b12a7098cd23232025e","observation_id":"e7fab80f-0bf7-4832-9f40-e7fadc40ed2c","resolution":{"observed_at":"2026-05-12T19:11:48.211340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"735775df-7fd4-4652-b195-8c365963a076","year":2048},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:bd1148c4cc0324992c4baa2dc13df04a806b390d819ef8505ce4a37f83868b11","observation_id":"740bbdbc-b5ea-4b88-ba79-11c904593bca","resolution":{"observed_at":"2026-05-12T19:11:48.192602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e53dd480-1010-4465-bee4-c5eb73551a7b","year":2048},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:453c51db65f005d196b0451d7f7dbb8412b4ea107c219291c3f24b8619434827","observation_id":"3e4bed0a-3173-4bd3-8da4-40e5dfdcdd75","resolution":{"observed_at":"2026-05-12T19:11:48.196449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9ac59f83-63b2-4d0b-96a3-06b5df1f26e2","year":2000},"citing_paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:45.192139Z"},"links":{"citing_paper":"/paper/2605.08809"},"observation_digest":"sha256:6bbc6270cd21e180bfba6dafd6e92d2b4a8aa4fac0040ae93f1155aa001e2e47","observation_id":"e97ad2c6-7ff8-4069-af58-49c27bc94206","resolution":{"observed_at":"2026-05-12T19:11:48.207258Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08809","last_updated":"2026-05-09T08:59:13Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T18:35:09.983848Z","submitted_at":"2026-05-09T08:59:13Z","title":"SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":13,"verified_fuzzy":3},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2605.08809."}