{"as_of":"2026-08-06T13:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c55326881c0b13c527c9dc971c11a424819e4cb60dfd77329bdf8aff0ad087c6","coverage":[{"denominator":108,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T16:53:20.136091Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T00:17:20.154713Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T00:24:22.476307Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.27605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.27605","snapshot_observed_at":"2026-07-08T00:24:22.476307Z","title":"Laguna M.1/XS.2 Technical Report","venue":"cs.AI","work_id":"73a59500-1f41-4708-8f2f-99bc2cf51245","year":2026},"citing_paper":{"arxiv_id":"2606.27715","last_updated":"2026-06-26T04:47:37Z","snapshot_observed_at":"2026-07-29T17:59:55.308854Z","submitted_at":"2026-06-26T04:47:37Z","title":"Aurora: A Leverage-Aware Spectral Optimizer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T05:24:23.795951Z"},"links":{"cited_paper":"/paper/2605.27605","citing_paper":"/paper/2606.27715"},"observation_digest":"sha256:9b516cbac0f4d12264c6aff1779a999a3d2e04ab8429d38975234aeb45544db5","observation_id":"797f6fda-1ea1-49a3-8824-2d77df33ec34","resolution":{"observed_at":"2026-06-29T15:43:33.228173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.27605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.27605","snapshot_observed_at":"2026-07-08T00:24:22.476307Z","title":"Laguna M.1/XS.2 Technical Report","venue":"cs.AI","work_id":"73a59500-1f41-4708-8f2f-99bc2cf51245","year":2026},"citing_paper":{"arxiv_id":"2607.05188","last_updated":"2026-07-06T15:08:26Z","snapshot_observed_at":"2026-08-02T19:33:55.355913Z","submitted_at":"2026-07-06T15:08:26Z","title":"Latent Programming Horizons in Coding Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T00:17:20.154713Z"},"links":{"cited_paper":"/paper/2605.27605","citing_paper":"/paper/2607.05188"},"observation_digest":"sha256:592d510839f6a6d0bf5ed70128954ae5f578e90828555c021e9a7ec1a576cccc","observation_id":"39eb7597-70e1-4760-b9c1-f30f715766c8","resolution":{"observed_at":"2026-07-08T00:24:22.477677Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.27605/citation-record","integrity":"/paper/2605.27605/integrity","json":"/paper/2605.27605/citation-record.json","paper":"/paper/2605.27605"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Abdin, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:95388c98f60a73767b8d4844129696dc53c5d6fcd14d37f79bfedaeffca696d9","observation_id":"af313851-40c7-4e2b-9ed5-7534e5344527","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Back to Basics: Revisiting REINFORCE-Style Optimization for Learning from Human Feedback in LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:1beef34c28dc760d305860fd3c3776835c54f06d467f5db277500e0800753be3","observation_id":"d2bd4297-f15a-4614-84fa-8bff69048f22","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:27823cd8498aa3f864d477679e25f99da92ce24355ec6de0f0c3975059f8a3e7","observation_id":"d87cebf3-ffe4-4df9-95d7-a38499516e3d","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Alvarez, O","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:50e07e9b5744ef655d16b6568273f659fdc6f38bf68418cfe6e97d7b18c442a3","observation_id":"14d17b97-2f33-476d-ae4b-ddb752e49303","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"The Polar Express: Optimal Matrix Sign Methods and their Application to the Muon Algorithm","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:f51444085e5b211069cb1871ec5414af98af853aed0574290421ca6969ed1a34","observation_id":"1a4a3968-e555-48af-b806-e2f773d1ab9f","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Introducing Claude Haiku 4.5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:93d1cbf41baefd5b70f7a2fa76aaaf90b3f27766fac8cdaded4c1b2fb5e29442","observation_id":"f597d247-002e-42b1-9c8e-aa1f1252d7f6","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Introducing Claude Sonnet 4.6","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:b4321051a8a8ba99bf58545c1e5c1755802796e8842e81d6addd02dde30878c0","observation_id":"68022928-9f47-4c52-9f39-b0e6c3919247","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Quantifying infrastructure noise in agentic coding evals","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:a04eaf97236ad7455217bbd08b099e4c5f7fb4e9578396d2d614e36e1dd0f5f6","observation_id":"181c30fe-b118-4aab-8e1c-75da4ea6935f","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"FoundationDB: A Distributed Database Designed for Key-Value Storage","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:d76a176ed5fe350a445fedead908e7505749ac8ca331aecde02d71d83aebc8e3","observation_id":"a3a04cef-db1e-4cbc-8237-2ad342e5fc23","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Optimizing Pre-Training Data Mixtures with Mixtures of Data Expert Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:b237d339ee955909d232b4c253481cd294cbee4e8d323e5024af2b4e43301432","observation_id":"cecab636-a5e9-4e99-8dd6-a93981b68ed2","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Beltagy , M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:e2c33c05e1d800b75dfb8837e93b75f8b40ee907ff4c49b88a5230823d077044","observation_id":"3032a18d-8f0b-4dde-8765-dd67ccd16c61","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:648e532d563bd1cc38799a388aa77a0c7877e29c8a9098877aa236cd449dcad4","observation_id":"9795e802-a1c5-4956-83a3-4297f0a5d8b5","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"MultiPL-E: A Scalable and Polyglot Approach to Benchmarking Neural Code Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:09ee290e90116483a48846729afd2be6e71d25cf6962acf09b0b1c32f946bdfd","observation_id":"0f1762d5-b2a5-4b7f-bb24-2f7b74aa933d","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:0a4238c32843514b0880ba6d854357af98180155e5ae89377ffeba22ad9b6754","observation_id":"389bf2dd-ff78-4077-a19d-ac39ee4f0f64","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:2bcb20b836d3554fd93268fb1275804268af666ed04f0b2da9b3a6ee9b6bb461","observation_id":"34116df5-9f61-4d0d-9937-f525b31e5cbf","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"PaLM: Scaling Language Modeling with Pathways","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:bbeb805139abd1d51cd08b2abd8ed17d5c1316b7fb8439550b9d4222a8358d3b","observation_id":"c9fc5a7c-14e8-43ee-a53f-921cf068e503","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Clark, I","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:a245311aa16752dc7e8ca2fbc343464f3822d4471a96b288fdba6aea30b5b8a5","observation_id":"bf1a4072-2904-4b1a-ba58-a829d44d86c1","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Cobbe, V","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:e067c56f182c5a96e6f64f4229303bff7fc4cda1f4499f77a57ae87361b7d955","observation_id":"937b6827-a13e-4b84-813a-1eccdd42bb6f","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Dagster: The Data Orchestration Platform","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:ce11d4c3a5213cb4c45a267a269f2648c7cc70ea242e64a7eec69f7035b9ad7c","observation_id":"fda47c6f-4e84-4843-8572-75adbec39cac","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:4fc836221355105613bcbf084705d9c7c4a002c87d985f57574c9c1076f7c408","observation_id":"b59aa41f-9763-41d7-b287-20956bfa7dcc","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:6e8c9e3884d43151b2c7f4bdf6fff90df6d56dd988d75345e6c8f7fbcb79578c","observation_id":"3ce3b5be-eaf6-44e2-88cf-17622b8375ac","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:c1e20df58791d2e074008d1fb997b809b96c03216f53c0fbb83cc9de80d62f9a","observation_id":"168b497c-08e4-4eeb-a928-0eceaef75942","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:dacc2389f7bcf29e4f6876f79c5696fabc0e093d68fe7bdf39ea76f510b00785","observation_id":"2d0f5664-62b4-4019-84ac-90fe62ad08d2","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:67cc4dda3f70d8c9939b2bbf9c6f69c92a1d2183e1f87061861cb7d6e04c4a8f","observation_id":"457ae35d-2e20-4da4-9ede-4f48115ad102","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Token Distillation: Attention-Aware Input Embeddings for New Tokens","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:c4fb1dbc2eeb2b80d5b4766889ddde8f0ef6827f2df55155e0bfb0e2bb8103af","observation_id":"d6fbad73-9f34-43d9-ab34-7bb38c51c8a2","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Envoy: An Open Source Edge and Service Proxy","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:a5e40aa87e086566fbe068d54601685f54e4470866596c07bc0cd38e620b1e1f","observation_id":"47e0103f-bffe-4105-903a-04ab17f7974b","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Riviere, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:f6dde09cbaf5c4873686e19fd7bc5b91facacecbf2b0b2130fd2716d3572face","observation_id":"c3f14248-227d-4cd4-bf57-1bc98524ab27","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"GLM-4.7: Mid-Cycle Update to the GLM Coding Series","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:0a5865d728797f5b180608fa21e5ba8c82c98c4e963c3fd6e9c5949627b133f1","observation_id":"4a2c2504-82a7-4710-91c4-0bed0f812ec1","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Gemma 4: Byte for byte, the most capable open models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:0b71ab29efde48b2583095b97dd36988446fd77f34cbb4a0ee07157b5c683b3c","observation_id":"b4a7d6c8-7e2a-4137-a140-fe9bfdf0b9af","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"CRUXEval: A Benchmark for Code Reasoning, Understanding and Execution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:7f4a9d9d925df762e3f5af44c0a8e59308605578a21bcb44bc2a77f9675b7baf","observation_id":"4df62986-0a16-4d3e-aa64-76fb779dc40c","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Gunasekar , Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:75eb0012e441da4108443980ef492b2a6f649a45b5a3c5613ab44b9a54d10f56","observation_id":"a0e14d92-579d-44d4-8fa3-d1230e9977e9","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Measuring Massive Multitask Language Understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:807404cbc292e637aba5258e130e5fea63ddd7ac2dd8defa67d0f8aac5558700","observation_id":"fa8708c4-d4b6-4dcf-a9f0-de4eaf73183d","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:92c48f0b7a163eee2b2280c47f5eae76ef223645004a7f530a228c2d848671fc","observation_id":"afb7a717-c132-43ab-94a3-357671c7bacc","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:a540549af92f2b8c56c4d66a21994c691df5214f0e60211a331e52243aa61ae4","observation_id":"dae67abc-8ec5-4a52-906e-5c5004e7a8b4","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"GPipe: Efficient Training of Giant Neural Networks using Pipeline Parallelism","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:a915fc01a5f68a82b035d364cc1abff4baeb2b756c1f8cc85c17b3443b16f1a6","observation_id":"32514a36-7cd3-414e-a10b-d498e276746e","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Idahl, B","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:113e81a9c84ccdfddd7e51a6c941e88d854e92d7f2d0d41b7ca6265099095a11","observation_id":"2c0e3ee2-0f53-406d-a067-ec166b909c68","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:108c9369646b3c5242182d5aa24c664db8701412ad753875bc258451e91496d1","observation_id":"06d73007-0fc6-4fde-9b15-3837cc02c84b","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:740015a7f655472474aba5d2afe522e477c2d1a3cf65a6db00bd08724938e941","observation_id":"f6f6e1f7-6097-4a31-8c90-2b4d0177e1f1","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Jordan, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:9e36c120ef59f6919b4fa8a2dd470085c0708f05444079cfb8669d525f6fffdb","observation_id":"8f2aa088-1bfe-4736-9921-41bcd212f232","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"GlotLID: Language Identification for Low-Resource Languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:3a1d91d8c4192d034f08e6e9e62324a71c041e5a68d203e569700e91b3d92119","observation_id":"0ebe4ffd-69ab-4e9a-8a7b-7bf4b4b9a258","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Kimi K2: Open Agentic Intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:06c93b36101e632e12768b813a8e86203d4d130f35c982fddc4558e337109eb2","observation_id":"17cfa2c5-e455-42b6-9818-3f1e48731a7c","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Reducing Activation Recomputation in Large Transformer Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:d6492756b6d93cdb661adadb3e2dd5e04eef44e30a0361a528d52bbd1321bdfb","observation_id":"e188ebb1-0bea-4d9f-9b55-ec1200530c56","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:001da23306e17b864107a34c041024946acdcf7ad7e706fe4d73062965bff4ad","observation_id":"e19bdedb-e28c-49f1-bb36-93e520a0697d","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:4391a9707188c569a29712954e1f14f6b94ff10e49ea8d57cdc2a83aeaa6fac8","observation_id":"4c97292a-5ba9-41b4-b466-584401dbbc81","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"DataComp-LM: In search of the next generation of training sets for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:8554b535e0f48169495924c5fdcf056796b7e4f198ae7a06be9461f093229bea","observation_id":"3cb1bc98-02f6-4e27-8545-ce257682d4b6","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"TorchTitan: One-stop PyTorch native solution for production ready LLM pretraining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:5d618722a22f424243cc608d5d3fdd5f495309470da6dc5c26b4bbc00516e82a","observation_id":"bf2fcfae-66b6-4181-b766-0045dcb27412","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"AWQ: Activation-aware Weight Quantization for On-Device LLM Compression and Acceleration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:ea56a25928e1e6e44157ae4e46e9f8d21d3a58ec583422abe93280ea4301dd89","observation_id":"33e15391-b7b5-4227-9d75-a30d09e116db","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Is Y our Code Generated by ChatGPT Really Correct? Rigorous Evaluation of Large Language Models for Code Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:5d947d03dba681a3e35b0a461f17787b182bddfd3ff6472763d8f80b20a920b6","observation_id":"c0694393-059b-4a2c-be7b-81dd1fb290ae","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:7c309b60f51a86f644d6b952f07c8154aada061ffb8ce74622cc60ff6e0c6c8e","observation_id":"36954f66-4e3a-4fa3-9006-64e43736dbea","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"RegMix: Data Mixture as Regression for Language Model Pre-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:30b54682111777e689eaf5540a461def5e1d23bc6d1bcef20516ee20589e666c","observation_id":"425e7853-e5e9-40df-bcba-14764427e791","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"SpinQuant: LLM Quantization with Learned Rotations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:87ec5ad7374f5c392cea81c42b92d4000080f5cd659adf64e6845fd1864451a1","observation_id":"b53d74d0-cc6d-41bf-9d92-86c1499e11ac","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Decoupled Weight Decay Regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:472c148f999dd3c966adea7ab92e535746fb72de5e69bdc4b0bc9007db8e94a8","observation_id":"4adc6ae6-5f8f-4160-883c-d1e2ffc6f464","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Rephrasing the Web: A Recipe for Compute and Data-Efficient Language Modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:4e916ea0a476e3ed653b1ea6f88d79497a6f7c83818872744051a72c9103ab64","observation_id":"5837b823-0c49-4ad8-9454-36001e0b5ced","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"On the SDEs and Scaling Rules for Adaptive Gradient Algorithms","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:1af3ffc78880f56a8256ee63044989d09aa6b169ff294ed7a7b519c2e85c3b58","observation_id":"42c280f8-cc4c-4dc4-bb7b-40857684ded0","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:8f93c0c4ef9ab71789a56a0b9677dcbb633c3fca084a7a4ebb49b125d2683bec","observation_id":"cd5c0481-f96f-400a-883f-744b0ef6fe18","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Mixed Precision Training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:ad2ff66bee2c3790229fa7ab429c3d6c482e6b5c6b4ac081dcf6a9a36a09294d","observation_id":"addfdc5c-63ef-41e2-a872-2a9f5bdf166e","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Devstral 2: Mistral Vibe CLI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:37ad05fa25fab846341aa30d4a2a1b152713dbf8accf582b689ea78cfddd5376","observation_id":"ba31e3ba-4a86-405c-880c-9656c2e74fe8","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Nemotron 3 Nano: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:45a1fee6bc101028f794bdbe5e76f16eba9fb077200e7a269b8557fe184764f6","observation_id":"7b5b6441-2592-478a-8287-da7efd58fae9","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"GPT -5.4 Nano System Card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:2211a71762409db445209c62324591c5961e9eb9491393a38f6d6b0db5391b19","observation_id":"e784e90f-ceb3-41d4-b23e-79e441f83efb","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Introducing SWE-bench Verified","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:5499adb74543bd2936626b2e8fdea3509ca54772a7ca211e6d451647320c1673","observation_id":"462e4306-28b2-4729-8f86-d8248d5bf365","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:1d921350f3a247ce1ed661865857dbe3fe32df37c12c377e9cfa6e3b1fe490c2","observation_id":"b9f2db1b-9543-4852-b96f-b0383f670d32","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:2642e2ac03c3e88437106cb449aa0092bcb5e0126458e16d7da2652dc5f7f7f5","observation_id":"03939716-35e0-4bc6-b66e-c978585dc924","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Post-Training in the Model Factory","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:685b3873614b3fa12562422ae6760dcf4cca19babe4fb42679a3919c63023b59","observation_id":"8e6dfe09-245f-4d2f-8c44-a103c255e5d6","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Through the looking glass of benchmark hacking","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:4056830933bc85cb3908590d3c1b50876427c15ed6206e7a90ab63a9d6883307","observation_id":"c2baf1d7-76ed-4ab9-a4d4-79364de06cfb","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:1066455514d149eedda2b53a8ab66e3bcca9bd76c03bcbb67b0aee927df438e8","observation_id":"cf6b2388-1212-4a38-b4d2-a3a6e7127ae6","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Demons in the Detail: On Implementing Load Balancing Loss for Training Specialized Mixture-of-Expert Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:6ee43613e7d0978b211590e419e24f82ea8bc334267f5643ccf746e793a9abb0","observation_id":"4c9846fa-8f83-447f-bb20-7f9aff2a05c9","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Gated Attention for Large Language Models: Non-linearity , Sparsity , and Attention-Sink-Free","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:b4dabdfba30794023b7d40e73694ecb6d523cc047dfb372684a912fe5d30accb","observation_id":"c49b39f0-215f-41da-9796-333c49b0462c","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Qwen3.5: Accelerating Productivity with Native Multimodal Agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:95c8c159c343046b96daca1907a1faf3fee1351e5898fe31b43ad3933db83076","observation_id":"649062cb-ff49-40c8-a702-522c8a82ee84","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Qwen3.6-35B-A3B: Agentic Coding Power , Now Open to All","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:618a156a279cafb7a977697e79de8342de3679521bdb1520ef3138e4488d7bda","observation_id":"90bd6995-71c4-40bb-989d-2aabaa42fac7","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"LLM Compressor","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:1f187d5214571104e69dbe5e17e5b699ace3d11f4d3f9126a17b4fc6b2bac7a4","observation_id":"f44494bd-ff54-4443-9dde-65fb8778b777","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:3aa955e9677fcda2601ff1c8452b4f7051ebdf4d4f9e959f049617dfd191cdca","observation_id":"c37cdb6b-4acf-45a0-bc0a-9fd83364f5a7","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Efficient Domain Adaptation of Language Models via Adaptive Tokenization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:f63945bc1d485f4bc0f8795d9c204745ce93354376c118c58e7673f521bc26f4","observation_id":"25e88c5b-1591-452e-8bee-9cab5d028959","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Sakaguchi, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:6c222e6c214c1df5eb5ab03ee2d19c91c90eb5c9a1faa1802179b1bd25cd69f4","observation_id":"7f3fec54-fab9-45bb-a433-adce092fde6e","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Sedova, S","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:cd26a97ef59966dced09dc7555755f490d336bcb2631c16a35752abe164300c9","observation_id":"fd9ec69d-181c-46a2-8ca7-a6ec26f9c6e4","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Neural Machine Translation of Rare Words with Subword Units","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:ae10c19b84702e2671f6d9368d18d7f53e36d785ae35a71071f8821a7fc0e62a","observation_id":"5d9858af-b654-4377-a2f5-a53401c25df4","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:ecfdc1a448e295f744ebed961aa0240296a0a2aa74bd23b6ff689afaf1af9000","observation_id":"a705661b-8ed0-4de3-8611-ed25f7e460b8","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:fdaad35b61c6381c322df356d4f6f073845bed8260371710336602a5d480920d","observation_id":"8611b19f-a6d4-4478-86d6-cf66edd657bc","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Shoeybi, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:2fea6266d10a14d890f81a7bd4e5e665735c999630bb23cea35bca3406d05ffc","observation_id":"4f87217b-0518-4a38-8e3c-c5746afe44b3","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:191213ef715f4a2684642fe56a8777d2c3cfb1075b681fe6747f3210c254d74b","observation_id":"a692bb70-21a0-4ad4-ac48-6066f5ab392c","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:3989748f6fc16b1f5519405f16e63463c57d96c797ff1d8510fe55613cca2ef2","observation_id":"33ed5c55-a77f-487a-8d9a-64716d18339c","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"RoFormer: Enhanced transformer with Rotary Position Embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:5675e13df0e94c472d9d443b686215101e5c8593de5853ea0a44dffceb1f6b4d","observation_id":"be1a0c13-b744-4475-9b2b-fe4cb85146b3","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:9c03eb17e584492e44b568ee8ba7c0a1727b4356fa6199e2a9d5494a40d6c832","observation_id":"538bf0d2-e15f-4325-8970-85c5c8b06580","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:b468a03bd8384da1a10e88859b8b8e849c07d2710195418a2974c1f05002280b","observation_id":"e7be02a0-6ef5-49d9-8022-7f17f778e265","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Terminal-Bench 2.0: A Benchmark for AI Agents in Terminal Environments","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:f086939fab8ecdadb7f86377cbaa2080a6e79155e597cf276cc53f4c292eb521","observation_id":"df075a6d-85eb-4f4b-95f1-978c1bceaa0a","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Kubernetes: Production-Grade Container Orchestration","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:d832da3ef1a3db64881514af5682d078e5eda1b12ca308eea3444dda42fc6883","observation_id":"17a7aa29-4883-4521-b50d-464d28c57f95","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"PyTorch: An Open Source Machine Learning Library","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:1b4891586c0f4975153569e7b5f2da850e2a4c5353c6709b493a5c64581f2976","observation_id":"1b87d1a3-7baf-4f5a-b541-fc234946aac6","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Attention is All you Need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:7a12ebbcb3f81ad9200f1218518f111a2ac7086a0e6ca886d0c81de149e631b5","observation_id":"827eff32-ed07-4807-92a0-e446e76e98d7","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"https://volcano.sh","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:5b7bf3537fd1178b2e8c0d58b7345f9e5b5580b408ee4118d40dd584f66ac7ff","observation_id":"73833819-3e5c-4364-960a-005c3848b1c5","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Wang and A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:0cc0ee8413469ccd45e9a5e78c28c07686e5f423483c0c17b83e65fd699375ee","observation_id":"9323e45a-9b61-4631-9a8f-e1ee712c45d5","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:222a8705a720aa20b1303c06a4411c56e480a6e7818fa58c3d6a6a58d7c9a926","observation_id":"b49b98e8-fb45-4a50-b2da-eb087b8507e4","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:513ed21d415007c20f871c23eeb2661c1a7272d6140a25e37a4a8e27f695cafc","observation_id":"5df4c556-e886-46e7-a428-943d464f11cd","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:0f314c495f014dc3010470e66307dab3653837957b47dcc1b74077a3dc2d7e6b","observation_id":"6e73aa97-2912-4529-82f9-1a463a41c37d","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"MiMo: Unlocking the Reasoning Potential of Language Model – From Pretraining to Posttraining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:e8695e8492052d387a3062b5489a29b189051b8e6bacd2164d4e1333ccb92d18","observation_id":"4c4f4a12-49ee-4c1a-9a6b-2a7a091c0af8","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"DoReMi: Optimizing Data Mixtures Speeds Up Language Model Pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:64682a2e10a907596b778522897a0083702da81796be5db11b24049c6e0c665c","observation_id":"8b0f8305-848e-4aea-abcb-c0e4e058b251","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:880325e4527de18bf9f310d3df6f9b03ed6f9acb21f081923e9f80da67f6cde9","observation_id":"4b88eaa4-e9f6-4d1f-93e1-b2cb1554ec39","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"On layer normalization in the transformer architecture","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:ad69beae21af541ef5ee289181cc9d65bbbda2d06b849bbd6db854fec4e92bb6","observation_id":"b20f13af-4ddb-459a-bc87-e4710c5f4482","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"WizardLM: Empowering Large Pre-Trained Language Models to Follow Complex Instructions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:3a4c1cdcf8c021be543ce67392c8494add9dbe0298b3d383071a112a50493ec6","observation_id":"cfd518f4-c1ac-4f1d-8cf2-cf04ab076fec","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:4fc00ff10fa4177330ff7fb4d658b3cda1a6a2ba95ce1034c51580921d6643be","observation_id":"aca9eabc-c77c-4377-84a8-9c501ec22ebe","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:bdfda57b06bf619ec302e442e333a5c22abcaf2c923fc35f8b7d0811ff1600b4","observation_id":"2e4894b4-4455-4bf2-80f7-4fb890f7e73e","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:53:20.136091Z","title":"Large Language Model as Attributed Training Data Generator: A Tale of Diversity and Bias","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-29T16:53:20.136091Z"},"links":{"citing_paper":"/paper/2605.27605"},"observation_digest":"sha256:ff367e535d8e6debf6b63135ca461cf2f93d36de6a2bd0124c684dbf7b29dcbd","observation_id":"ed6a4a2f-3efd-4a92-adef-086892370fd1","resolution":{"observed_at":"2026-06-29T16:53:20.136091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.27605","last_updated":"2026-05-26T19:23:24Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:23:24Z","title":"Laguna M.1/XS.2 Technical Report"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":108},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 100 of 108 outbound references and 2 inbound Pith citation observations for arXiv:2605.27605."}