{"as_of":"2026-08-18T10:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9a42fcab8d8bfc604c2b3269d9c96d4f997f4980c80fec80a94612804e2ca85","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:28:02.005029Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.15527/citation-record","integrity":"/paper/2504.15527/integrity","json":"/paper/2504.15527/citation-record.json","paper":"/paper/2504.15527"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.708662Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.708662Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:3c762784e1c72de0fcb5bc6ce6b1068cfb860c6d4d09ab0db0c34f62aa996467","observation_id":"f11af38c-7920-4971-bd02-4bd6c90b79a9","resolution":{"observed_at":"2026-08-16T11:28:01.708662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.713419Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.713419Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:b2174318ac359056eaac4e9e51e64f5a2aee40d7b335ad0eb5ca75c65a81430d","observation_id":"6ec770de-6023-48ab-8d95-88c34aad7936","resolution":{"observed_at":"2026-08-16T11:28:01.713419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.716597Z","title":"GQA : Training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.716597Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:6954e1522b76dcdc775c9fb354323172c9a4169a904b2c8c8e886125eeaefa22","observation_id":"ad8f6ec2-e909-41b1-8141-7759c6fb630b","resolution":{"observed_at":"2026-08-16T11:28:01.716597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.719840Z","title":"Sea-lion (southeast asian languages in one network): A family of large language models for southeast asia","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.719840Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:269346725296775ff7ddf696c5c570bd70d890dd94fdf3d510ac64ff82c96497","observation_id":"df8ed232-e007-48f1-83fe-fa0e7c11893a","resolution":{"observed_at":"2026-08-16T11:28:01.719840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.722783Z","title":"Claude 3.7 sonnet and claude code","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.722783Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:c538efe460cbd4eb5830db2c2ca68254ca5eda899a2de6b05356dd075886fd63","observation_id":"877fa7f6-c3ca-484a-89f7-ed61797a6569","resolution":{"observed_at":"2026-08-16T11:28:01.722783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15032","last_updated":"2024-05-31T14:47:55Z","snapshot_observed_at":"2026-08-16T13:50:00.081946Z","submitted_at":"2024-05-23T20:10:38Z","title":"Aya 23: Open Weight Releases to Further Multilingual Progress","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15032","snapshot_observed_at":"2026-08-16T11:28:01.725742Z","title":"Aya 23: Open weight releases to further multilingual progress","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.725742Z"},"links":{"cited_paper":"/paper/2405.15032","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:4c1aec60ad1d9f4247bf2de7160f601ae4256b9e9766eeb940cb2f6ec1a01427","observation_id":"79024465-a69f-46ef-8c61-7aabb7fabf21","resolution":{"observed_at":"2026-08-16T11:28:01.725742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16884","last_updated":"2024-07-25T04:30:15Z","snapshot_observed_at":"2026-08-16T15:04:13.433674Z","submitted_at":"2023-08-31T17:43:08Z","title":"The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16884","snapshot_observed_at":"2026-08-16T11:28:01.729249Z","title":"The belebele benchmark: a parallel reading comprehension dataset in 122 language variants","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.729249Z"},"links":{"cited_paper":"/paper/2308.16884","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:4f08da73e5bf89571137ec80517a5d9f8a56d940dc327be75a2f959c6416f1d1","observation_id":"1bac3e2e-1e6b-44b0-9804-bb872246d603","resolution":{"observed_at":"2026-08-16T11:28:01.729249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.732799Z","title":"M 3-embedding: Multi-linguality, multi-functionality, multi-granularity text embeddings through self-knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.732799Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:2d0c3c632a408a6ae25fe4da1b4c198d5c780112a4aa0b5aa1bcaec75253422f","observation_id":"ca0eebc7-3bfd-4958-861c-252b02162371","resolution":{"observed_at":"2026-08-16T11:28:01.732799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-16T15:03:34.468029Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-08-16T11:28:01.736397Z","title":"Benchmarking large language models in retrieval-augmented generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.736397Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:4e43f7d55b23a287c96f52c5bb77f0048b97918d5780f371adb7ee586f20761b","observation_id":"cd90eefe-70be-453e-a45d-96ec56d66a04","resolution":{"observed_at":"2026-08-16T11:28:01.736397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.740155Z","title":"MultilingualSIFT: Multilingual Supervised Instruction Fine-tuning , July 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.740155Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:a2aad7b0ee80ce2a754c5370425bca1ce2a4ea98daec5b369778b6144bec16ef","observation_id":"4bc7f0c9-eed8-4fe5-93a9-b303f3ac5e55","resolution":{"observed_at":"2026-08-16T11:28:01.740155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-12T12:29:44.507445Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-16T11:28:01.743490Z","title":"Brown, Miljan Martic, Shane Legg, and Dario Amodei","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.743490Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:6fca87b1b668489c0876127475c337e2f3a82b04ac46b791a606ad01f0d8c35c","observation_id":"a71dbd91-dca8-4c12-a174-3e9a9c17b3b4","resolution":{"observed_at":"2026-08-16T11:28:01.743490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-08-17T14:44:42.060038Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-16T11:28:01.746974Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.746974Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:180b9869bd3bb7d4b12658d7467fe85f50bd7b14d9b48a8858818e78a5ad46df","observation_id":"98f373a3-0ed8-4875-98e9-bcd5ceebe59a","resolution":{"observed_at":"2026-08-16T11:28:01.746974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-16T11:28:01.750569Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.750569Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:225015765fb895ee92b5237963a2c3ab5edd1dd5709caa0a37876a0ce13246c8","observation_id":"e197fccd-e8cc-445d-8405-3cd8b30a84b6","resolution":{"observed_at":"2026-08-16T11:28:01.750569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T11:28:01.753855Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.753855Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:f0988dfbf142e3178fbda350c201cecfe628e394048c1c0ca4026d042b7de0bf","observation_id":"0b4f1466-b71d-4f8d-996d-2cffd7135010","resolution":{"observed_at":"2026-08-16T11:28:01.753855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.757124Z","title":"Commoncrawl, 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.757124Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:5ed40354809d2b8e9cb49a921af8f2080ea53d33775a19fb7f9ff5ea02da91d4","observation_id":"5a712dfd-3327-4050-a1b0-3c2c316c4237","resolution":{"observed_at":"2026-08-16T11:28:01.757124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02116","last_updated":"2020-04-08T01:02:17Z","snapshot_observed_at":"2026-08-16T12:39:33.749100Z","submitted_at":"2019-11-05T22:42:00Z","title":"Unsupervised Cross-lingual Representation Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02116","snapshot_observed_at":"2026-08-16T11:28:01.760248Z","title":"Unsupervised cross-lingual representation learning at scale","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.760248Z"},"links":{"cited_paper":"/paper/1911.02116","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:4364b587efd8ef1df4d5643c4fe4558f784874d9af86b3b2fc2226d14c2c10db","observation_id":"f4cdeca0-54f9-4143-b7ad-a9457f8d8ee5","resolution":{"observed_at":"2026-08-16T11:28:01.760248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-14T00:28:11.851309Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-16T11:28:01.763286Z","title":"Ultrafeedback: Boosting language models with scaled ai feedback, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.763286Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:a1b7623c776f049095e59b1b530bba2adf99901c67c3745ca727083681cf6860","observation_id":"3006f356-d063-4f6b-b347-86e25dda05fb","resolution":{"observed_at":"2026-08-16T11:28:01.763286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-08-13T15:18:04.411100Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-16T11:28:01.766856Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.766856Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:f6535a8ae8469aeeba0a579cd51bf6a91fdf4f627bd97cdd811ff5b503cea3da","observation_id":"8dd66b3d-8abc-4613-91aa-09ae5a074c9d","resolution":{"observed_at":"2026-08-16T11:28:01.766856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.770172Z","title":"Dauphin, Angela Fan, Michael Auli, and David Grangier","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.770172Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:9ccb61c76c3a1b7c23af9d6d0ac7920058284630088f973fec4a54dd2495f68c","observation_id":"5b1b6e0c-c0ea-41f6-bd23-01be54cf0655","resolution":{"observed_at":"2026-08-16T11:28:01.770172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T11:28:01.773275Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.773275Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:b9b871d51a8794944e5c9ff328eed4bde29d795d61a908940c43e37f994ba307","observation_id":"dbe5983b-e370-44f3-b346-0b68dcb7973e","resolution":{"observed_at":"2026-08-16T11:28:01.773275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-15T18:13:42.319653Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-16T11:28:01.776637Z","title":"Rlhf workflow: From reward modeling to online rlhf, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.776637Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:cf8554880d942c00ffd92fd6f6e1785890e5fd3182b0486b5ad7fb099ebbc0a2","observation_id":"726e7ffb-f7b4-4408-917f-42c1c7ad7c90","resolution":{"observed_at":"2026-08-16T11:28:01.776637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12982","last_updated":"2025-02-18T16:04:57Z","snapshot_observed_at":"2026-08-16T12:57:16.479583Z","submitted_at":"2025-02-18T16:04:57Z","title":"Sailor2: Sailing in South-East Asia with Inclusive Multilingual LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12982","snapshot_observed_at":"2026-08-16T11:28:01.780135Z","title":"Tran, Mike Zhang, Shiqi Chen, Tianyu Pang, Chao Du, Xinyi Wan, Wei Lu, and Min Lin","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.780135Z"},"links":{"cited_paper":"/paper/2502.12982","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:29a0ff8404e8f9f63a3fad5eed9ced1d64ecd22394a32d2f8c2ffe1f6f6b5d11","observation_id":"7a0d9d88-11c6-4361-ba11-09ebbf1a1595","resolution":{"observed_at":"2026-08-16T11:28:01.780135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T11:28:01.783729Z","title":"Alan Schelten","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.783729Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:27db1d60e5e101dc30794371458931c8fca8d8ac9726b8af6f4c792383b1d041","observation_id":"41f1523b-fbed-4e05-b948-1727bb5c723e","resolution":{"observed_at":"2026-08-16T11:28:01.783729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.786957Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.786957Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:4080d395b800b5fcf177d2b383f1fd32cfb00a4eda675ab108f08e5b03699980","observation_id":"280987af-c3fb-4e92-a7d3-19a1dc60241e","resolution":{"observed_at":"2026-08-16T11:28:01.786957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.790061Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.790061Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:5edb82a1df0e23d4e726e507bf151344e230228262fbf08af4c785f3cb17517a","observation_id":"0561f66c-7643-4e7f-a696-c4c450c5547d","resolution":{"observed_at":"2026-08-16T11:28:01.790061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-16T11:28:01.793522Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.793522Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:73abcb5a80e417ac229d12164d3e2df8079a7024c237044f0b03b1fdc5c817c5","observation_id":"c7e49603-e52b-4c9e-9701-513573587841","resolution":{"observed_at":"2026-08-16T11:28:01.793522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T11:28:01.797127Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.797127Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:91a7196db4d821b4b71bc70c933149b0a184b43e4771603f4ddff9ed6c303de4","observation_id":"81db6a99-de88-4f94-b5d5-5c29e321b5fc","resolution":{"observed_at":"2026-08-16T11:28:01.797127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04792","last_updated":"2024-02-29T20:59:17Z","snapshot_observed_at":"2026-08-16T14:20:38.839188Z","submitted_at":"2024-02-07T12:31:13Z","title":"Direct Language Model Alignment from Online AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04792","snapshot_observed_at":"2026-08-16T11:28:01.800466Z","title":"Direct language model alignment from online ai feedback, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.800466Z"},"links":{"cited_paper":"/paper/2402.04792","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:ee11091badceae70ce9071d5ed24d94f583d8e4628fe751cffc28a4f2566378f","observation_id":"87367010-04c8-4fd2-888d-2c78132393f5","resolution":{"observed_at":"2026-08-16T11:28:01.800466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-16T11:28:01.803603Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.803603Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:c190a95489a292a75b980314fb4c8fb51bd0251dd20bfd5e38b3509c47d65cb3","observation_id":"5ea6a54a-2864-45c1-9ed4-1ffcd9641805","resolution":{"observed_at":"2026-08-16T11:28:01.803603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09688","last_updated":"2023-10-19T01:11:26Z","snapshot_observed_at":"2026-08-16T15:15:09.710960Z","submitted_at":"2023-07-19T00:08:49Z","title":"Amazon-M2: A Multilingual Multi-locale Shopping Session Dataset for Recommendation and Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09688","snapshot_observed_at":"2026-08-16T11:28:01.806939Z","title":"Amazon-m2: A multilingual multi-locale shopping session dataset for recommendation and text generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.806939Z"},"links":{"cited_paper":"/paper/2307.09688","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:9ac4318b05f42c7365f9752053c07f8ec026f41b6b2fcb45dc5fed3c3018a595","observation_id":"810f06d4-d65d-4d1e-8f90-36afa70d11b1","resolution":{"observed_at":"2026-08-16T11:28:01.806939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20745","last_updated":"2024-10-31T12:54:46Z","snapshot_observed_at":"2026-08-16T13:05:31.029687Z","submitted_at":"2024-10-28T05:25:47Z","title":"Shopping MMLU: A Massive Multi-Task Online Shopping Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20745","snapshot_observed_at":"2026-08-16T11:28:01.810244Z","title":"Shopping mmlu: A massive multi-task online shopping benchmark for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.810244Z"},"links":{"cited_paper":"/paper/2410.20745","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:638ea8e5638a166007a285757286ba94ffcef365bb4ace5143e926329c112cfb","observation_id":"21822459-475f-4089-bd52-0fecd4cf86af","resolution":{"observed_at":"2026-08-16T11:28:01.810244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.813943Z","title":"T rivia QA : A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.813943Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:fcd39c3a014ffd12995284bf77fc7682a735ed23ff5f50f42f48eab470d118a7","observation_id":"88b2fd3b-ecb5-4783-b301-6c67d4f472a1","resolution":{"observed_at":"2026-08-16T11:28:01.813943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.816665Z","title":"S entence P iece: A simple and language independent subword tokenizer and detokenizer for neural text processing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.816665Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:98df23489f7cfc1748a697bb51c7b591dc2374059f04e7a16083347a3b5542ac","observation_id":"069f23d8-babe-4447-8219-f8b932e16fd7","resolution":{"observed_at":"2026-08-16T11:28:01.816665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-16T11:28:01.820973Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.820973Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:99f6491dcfef1c26ea0724ec6ac6b045d9894184176d85597087293da3c44f98","observation_id":"ebe616d2-d529-4668-ac3b-d68ac288eb2b","resolution":{"observed_at":"2026-08-16T11:28:01.820973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.823946Z","title":"RACE : Large-scale R e A ding comprehension dataset from examinations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.823946Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:9a0aacc8af756b290226d88d9c307cd7c9f38737cd65f11866f6c51db25b0467","observation_id":"411d3ed8-dec3-4e66-9a04-da888c829244","resolution":{"observed_at":"2026-08-16T11:28:01.823946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09597","last_updated":"2023-08-18T14:50:25Z","snapshot_observed_at":"2026-08-16T15:07:31.138000Z","submitted_at":"2023-08-18T14:50:25Z","title":"ChatHaruhi: Reviving Anime Character in Reality via Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09597","snapshot_observed_at":"2026-08-16T11:28:01.827125Z","title":"Chatharuhi: Reviving anime character in reality via large language model, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.827125Z"},"links":{"cited_paper":"/paper/2308.09597","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:55d557b5ef15fc497454060dc9609f600071f4759d236fb58580c858d62a6799","observation_id":"1a839830-4d6e-45d0-b9fc-076a047ce3c0","resolution":{"observed_at":"2026-08-16T11:28:01.827125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.830708Z","title":"Dimakis, Yair Carmon, Achal Dave, Ludwig Schmidt, and Vaishaal Shankar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.830708Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:d322862c6f764b94e977a84337279c3a0c5f8f15aa0ea35644aa43df1c28d851","observation_id":"0a154001-d5a4-474a-8848-2b1e4da8c264","resolution":{"observed_at":"2026-08-16T11:28:01.830708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11794","snapshot_observed_at":"2026-08-16T11:28:01.833914Z","title":"Reinhard Heckel","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.833914Z"},"links":{"cited_paper":"/paper/2406.11794","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:d509bec2b44586879bc4065c3cae627dbefc781b28919564367078337fdd8913","observation_id":"11356dff-2859-4a6f-a5c6-dc320abe0d77","resolution":{"observed_at":"2026-08-16T11:28:01.833914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.961340Z","title":"Numinamath","venue":null,"work_id":"399b4f00-78a6-4f87-adba-c13d8cb6f7bd","year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.837182Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:995decd27be9f7c4f12007c042e23e9552eff445e4acef482e901061f4bc6784","observation_id":"8a6b935f-faa8-4d59-a1b8-2665584333c7","resolution":{"observed_at":"2026-08-16T11:28:02.964449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.950537Z","title":"Numinamath","venue":null,"work_id":"192617c0-fb65-4e2d-b195-47a9a40327c5","year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.840365Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:8ad441287caed915e36ce06fc577a6174b2005e450a8499f52e611192e3d57ed","observation_id":"94d20969-9ad2-4970-9c6e-e06d4747942c","resolution":{"observed_at":"2026-08-16T11:28:02.953905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.937720Z","title":"Awq: Activation-aware weight quantization for llm compression and acceleration","venue":null,"work_id":"792e5b45-5030-4e52-aada-afd3cc2918e4","year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.843546Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:528526cd85a9a4e6ec9d288d54f90dbe1f3da5eb3f9b79452ab32db9e3d951b7","observation_id":"987f4a1d-bcb4-492a-a4b8-43a5285890c8","resolution":{"observed_at":"2026-08-16T11:28:02.942379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10668","last_updated":"2022-11-10T07:01:42Z","snapshot_observed_at":"2026-08-18T01:11:21.919423Z","submitted_at":"2021-12-20T16:52:35Z","title":"Few-shot Learning with Multilingual Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10668","snapshot_observed_at":"2026-08-16T11:28:01.847311Z","title":"Few-shot learning with multilingual language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.847311Z"},"links":{"cited_paper":"/paper/2112.10668","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:02add3a3649886b9f28529c09b54cf5350aa35e69cc7bfe6b6a912a4c6fe10ac","observation_id":"3bd89664-f8ef-4a3e-98e4-3da5bb52d4d9","resolution":{"observed_at":"2026-08-16T11:28:01.847311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-16T11:28:01.850540Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.850540Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:0a5e508e9f9b0ce7b37899df6516af709a330ffdde59ce8d29c1032fdf065c92","observation_id":"cab05922-cc58-478a-b01b-95b052bdadc8","resolution":{"observed_at":"2026-08-16T11:28:01.850540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-16T11:28:01.853857Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.853857Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:be3a2bcff7d72225f6d4faaa9e14ab0ce7a9491d87c024bf01338e284604ae0d","observation_id":"56d1ca3a-763f-40d2-ba9b-051250747c0b","resolution":{"observed_at":"2026-08-16T11:28:01.853857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09220","last_updated":"2024-04-14T11:48:33Z","snapshot_observed_at":"2026-08-16T14:01:06.560168Z","submitted_at":"2024-04-14T11:48:33Z","title":"Compass: Large Multilingual Language Model for South-east Asia","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09220","snapshot_observed_at":"2026-08-16T11:28:01.857050Z","title":"Compass: Large multilingual language model for south-east asia","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.857050Z"},"links":{"cited_paper":"/paper/2404.09220","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:52cc5d35b95ad8e582a4fd3a9a747505976eedaadd7a8c2253565f9388a36683","observation_id":"9ed27733-db1f-4fb1-8700-c5dc88077704","resolution":{"observed_at":"2026-08-16T11:28:01.857050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-14T07:00:02.529732Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-16T11:28:01.860311Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.860311Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:df4651ddcb525e364dc33403f8e086ca333e1cf7be84ae71988739c5122751eb","observation_id":"e7362238-541f-40ba-874f-f7b2105a6972","resolution":{"observed_at":"2026-08-16T11:28:01.860311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.925179Z","title":"Crosslingual generalization through multitask finetuning","venue":null,"work_id":"018b6e6d-caf5-436a-9b08-1e9eb31d1ba7","year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.863732Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:ff93e2431662d0d834cd15faeee5f079f39f9ce1d6f9336f97f3bfc9b45c9fce","observation_id":"4c00c31d-7e88-45a1-89f3-13a12e4bfaea","resolution":{"observed_at":"2026-08-16T11:28:02.929068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-16T11:28:01.866641Z","title":"s1: Simple test-time scaling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.866641Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:40a4955d0b0203ede9f1aa4618251a5459e255235d1d3aa7b14dccc3198049e4","observation_id":"a60911f0-21e7-4630-892d-bc2c7f27454d","resolution":{"observed_at":"2026-08-16T11:28:01.866641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-16T11:28:01.869878Z","title":"MS MARCO: A human generated machine reading comprehension dataset","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.869878Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:fc6b16ce6380040d90dc6491176d6287038ba2d8e9b10926f3f4c3ad746afb5f","observation_id":"91a1f449-da84-4e68-bce6-51ab7d061981","resolution":{"observed_at":"2026-08-16T11:28:01.869878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00738","last_updated":"2024-07-01T05:52:31Z","snapshot_observed_at":"2026-08-16T14:38:24.064753Z","submitted_at":"2023-12-01T17:17:56Z","title":"SeaLLMs -- Large Language Models for Southeast Asia","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00738","snapshot_observed_at":"2026-08-16T11:28:01.873737Z","title":"Seallms - large language models for southeast asia","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.873737Z"},"links":{"cited_paper":"/paper/2312.00738","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:9e113563d67886ba320ccf6c77ae85d2632a41f32e6a85b1d3e5b6bb31f99bda","observation_id":"11e7ea74-599b-4fce-b4fb-44ec0bf44d99","resolution":{"observed_at":"2026-08-16T11:28:01.873737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T11:28:01.877083Z","title":"Murray, Crystal Nam, Valentina Pyatkin, Aman Rangapur, Michael Schmitz, Sam Skjonsberg, David Wadden, Chris Wilhelm, Michael Wilson, Luke S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.877083Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:3934348f13fd63df3441ee05e830319cc6fe466815ca369bf4f8e669e1d2feec","observation_id":"ff8441f6-204c-49f8-96d7-5189c9ed0686","resolution":{"observed_at":"2026-08-16T11:28:01.877083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.912833Z","title":"Learning to reason with llms","venue":null,"work_id":"578bc428-e237-4b84-b26c-227fbf7d4c24","year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.880502Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:6c08758112ec8c2410760d7686c3128119be7cbcdad2964fb5de2386076ea237","observation_id":"f9de8d56-e683-4c49-a0d3-a770c3e52e74","resolution":{"observed_at":"2026-08-16T11:28:02.916926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T11:28:01.883596Z","title":"Shyamal Anadkat","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.883596Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:f48bce705a2ff4eb633a6f95d693c356823abebc1142f881feec26c9366f6625","observation_id":"e3f8e861-b08d-4ed7-bb5d-ea3b78701140","resolution":{"observed_at":"2026-08-16T11:28:01.883596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.900467Z","title":"The fineweb datasets: Decanting the web for the finest text data at scale","venue":null,"work_id":"69c89229-baca-4cdb-81b0-27568e3eaf49","year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.886438Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:8a88c8ab698c30b8dbe69d1542819d323820ca99f61346efb15bcf62854fc9c6","observation_id":"3b31836c-673b-4390-b1d7-b2ac5bbcffe0","resolution":{"observed_at":"2026-08-16T11:28:02.904376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.888448Z","title":"ece LLM : Generalizing large language models for e-commerce from large-scale, high-quality instruction data","venue":null,"work_id":"650b4e7d-9372-4569-9b5a-479747b04db5","year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.889641Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:b21dde0f21f121e298ccecc03d139b9301d05fe8af80e20f9848f0279e517625","observation_id":"44b2f99f-9470-428c-9688-63364f0496e2","resolution":{"observed_at":"2026-08-16T11:28:02.892274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00333","last_updated":"2020-10-26T23:23:58Z","snapshot_observed_at":"2026-08-09T04:56:36.788439Z","submitted_at":"2020-05-01T12:22:33Z","title":"XCOPA: A Multilingual Dataset for Causal Commonsense Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00333","snapshot_observed_at":"2026-08-16T11:28:01.892827Z","title":"Xcopa: A multilingual dataset for causal commonsense reasoning","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.892827Z"},"links":{"cited_paper":"/paper/2005.00333","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:d4d02f1a51394ac9711bcf4fd120a542e37258a39a8a261f5826a5bb749c7664","observation_id":"34518a43-309c-4146-973d-98759a18f40b","resolution":{"observed_at":"2026-08-16T11:28:01.892827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.876918Z","title":"Qwq-32b: Embracing the power of reinforcement learning","venue":null,"work_id":"d8cfbaba-163f-49d7-b58b-2c8a00f1b720","year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.896245Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:597376a1125f32ced224c3e3eac7f9750573b8b74d4c0b327aa8f76468b1f6df","observation_id":"01e77886-e867-4c1b-b6fd-66c1e7780cfe","resolution":{"observed_at":"2026-08-16T11:28:02.880650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-16T11:28:01.899521Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.899521Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:d42d59a2aaeb2708d36464ff743eae62078a6ce6b917616331261a94bef24cd7","observation_id":"e579ebd2-0059-46fa-83e0-2b5757fe7e39","resolution":{"observed_at":"2026-08-16T11:28:01.899521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-08-17T14:32:22.468812Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-16T11:28:01.902920Z","title":"Squad: 100,000+ questions for machine comprehension of text","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.902920Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:11a2a6724cdf5e19664713e3c7bfba0a398da75564b70d381cdd2f15e0405572","observation_id":"b5baa21d-f948-464c-a9e5-c5e80ef264be","resolution":{"observed_at":"2026-08-16T11:28:01.902920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.905883Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.905883Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:cbc7eca2e988d731938abe2085594634dba4f535a782c77d57c53dab8fc8c650","observation_id":"31d12f54-4df2-4cf8-b97d-ad7641aa7fe9","resolution":{"observed_at":"2026-08-16T11:28:01.905883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.908558Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.908558Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:ff01aa860e3926e80624bde92111ff7fc1ad373dec810a371a1b3e78ba7f140a","observation_id":"e24417a7-e5f3-4d46-909e-fba9f840aff4","resolution":{"observed_at":"2026-08-16T11:28:01.908558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.911179Z","title":"Neural machine translation of rare words with subword units","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.911179Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:c554ea4adfa963c4ccdca1925fb1e632be137a9ded9e93709afed8749b89063a","observation_id":"763f14ab-ebef-41f1-9fc7-af1a384a25ae","resolution":{"observed_at":"2026-08-16T11:28:01.911179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-16T11:28:01.914482Z","title":"Shazeer, Azalia Mirhoseini, Krzysztof Maziarz, Andy Davis, Quoc V","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.914482Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:cc3c49fc7c2b228f30fccb86d568d6443d3cbd2797b49047b153e813a9c3cc27","observation_id":"be1cff8a-cd5a-41d2-a259-2c285d13b85a","resolution":{"observed_at":"2026-08-16T11:28:01.914482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02595","last_updated":"2025-05-30T20:49:42Z","snapshot_observed_at":"2026-08-17T14:00:18.538725Z","submitted_at":"2024-12-03T17:28:50Z","title":"Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02595","snapshot_observed_at":"2026-08-16T11:28:01.918014Z","title":"Nemotron-cc: Transforming common crawl into a refined long-horizon pretraining dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.918014Z"},"links":{"cited_paper":"/paper/2412.02595","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:b62f24f428e47948299f5e09da00f451992d7684bc72d2cff05706888c748d2d","observation_id":"fc6b8736-49db-4266-8f7d-86c087150572","resolution":{"observed_at":"2026-08-16T11:28:01.918014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.921460Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.921460Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:cb119aef536721f791071f90a33cbf322609ced03b16abe76781679c8ae0a405","observation_id":"da742dde-35af-4fee-9ba0-16a6b6fcae05","resolution":{"observed_at":"2026-08-16T11:28:01.921460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02265","last_updated":"2024-11-06T09:15:27Z","snapshot_observed_at":"2026-08-16T13:03:06.425740Z","submitted_at":"2024-11-04T16:56:26Z","title":"Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02265","snapshot_observed_at":"2026-08-16T11:28:01.924986Z","title":"Hunyuan-large: An open-source moe model with 52 billion activated parameters by tencent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.924986Z"},"links":{"cited_paper":"/paper/2411.02265","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:5fccb55790e52f7c303353f9e7d31cca1d7582d95d1d2d9112495a29b9fbe831","observation_id":"5bbf98db-1f25-45a7-a16b-cee54e062a5f","resolution":{"observed_at":"2026-08-16T11:28:01.924986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.929212Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.929212Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:ef4866325e0372dfeb199ba2b6b2ea61f4bc020a5daeed6d4fc713f21315862a","observation_id":"818dc081-61a2-48f3-9832-8cf4d4da349d","resolution":{"observed_at":"2026-08-16T11:28:01.929212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.932668Z","title":"N ews QA : A machine comprehension dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.932668Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:f546360328bbc389d553c3e9ecac39eac5122c5f4c08e4222d2d584944451223","observation_id":"4089726e-e1d0-412d-8f22-02d1c46a8d67","resolution":{"observed_at":"2026-08-16T11:28:01.932668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13252","last_updated":"2025-02-18T19:27:53Z","snapshot_observed_at":"2026-08-16T20:15:32.301508Z","submitted_at":"2025-02-18T19:27:53Z","title":"Multilingual Language Model Pretraining using Machine-translated Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13252","snapshot_observed_at":"2026-08-16T11:28:01.935807Z","title":"Multilingual language model pretraining using machine-translated data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.935807Z"},"links":{"cited_paper":"/paper/2502.13252","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:4f909a3c4fe843b8d5223e257aa25e4f6cce0a63d84674b9c85a504e3ab1de18","observation_id":"106ee3de-46cb-46e9-8061-21e18945aa37","resolution":{"observed_at":"2026-08-16T11:28:01.935807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.939883Z","title":"Coser: Coordinating llm-based persona simulation of established roles","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.939883Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:0b1bab363cb58de5f22e2da128639b5845ea4f2bf45a962f5ba4f560f8d0d601","observation_id":"01c51489-a7f5-4de1-bef9-e2cfc419967e","resolution":{"observed_at":"2026-08-16T11:28:01.939883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11456","last_updated":"2024-05-01T14:50:56Z","snapshot_observed_at":"2026-08-17T14:40:56.015819Z","submitted_at":"2023-12-18T18:58:42Z","title":"Iterative Preference Learning from Human Feedback: Bridging Theory and Practice for RLHF under KL-Constraint","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11456","snapshot_observed_at":"2026-08-16T11:28:01.943855Z","title":"Iterative preference learning from human feedback: Bridging theory and practice for rlhf under kl-constraint, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.943855Z"},"links":{"cited_paper":"/paper/2312.11456","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:d5b324a31ad05fc22fa93d738bcafa9de47e07c9c4d0b9ea199bbe44af4a8ece","observation_id":"46dd3eea-b044-4f2e-8363-0e463693948c","resolution":{"observed_at":"2026-08-16T11:28:01.943855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16039","last_updated":"2023-11-14T01:40:13Z","snapshot_observed_at":"2026-08-16T14:57:02.846476Z","submitted_at":"2023-09-27T21:41:49Z","title":"Effective Long-Context Scaling of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16039","snapshot_observed_at":"2026-08-16T11:28:01.947054Z","title":"Effective long-context scaling of foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.947054Z"},"links":{"cited_paper":"/paper/2309.16039","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:368a4eb28533a4456ab52fd8230ff5232153b721511a35b154ba01c69f5835e3","observation_id":"e07c4a97-c7c8-452f-96ee-184321141d9c","resolution":{"observed_at":"2026-08-16T11:28:01.947054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-16T11:28:01.950992Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.950992Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:1186f8d308ce3c809c7a00a175831387630e4885e61f87bb1eb8c57a30b5636e","observation_id":"d4e5f636-37fd-4f08-bb30-bd1e0105dc97","resolution":{"observed_at":"2026-08-16T11:28:01.950992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T11:28:01.954745Z","title":"Bowen Yu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.954745Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:1be3364cc79290366a696694fb255ab9efcb47f0bc8b3763aef6efb94c250efa","observation_id":"b1022630-280a-4836-bb7b-f5824ee38cca","resolution":{"observed_at":"2026-08-16T11:28:01.954745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.958354Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.958354Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:f5bd54cfc0551977a9bc6df6537aa83eb72b49de336e116d009530ab16b55d23","observation_id":"7db8d722-5246-48c8-b52d-2c4b2f2e0e25","resolution":{"observed_at":"2026-08-16T11:28:01.958354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-16T11:28:01.962526Z","title":"Limo: Less is more for reasoning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.962526Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:c8f8f6707e4203108ebece2fd05cbc132de52133ab164cd374e1ce090ff04344","observation_id":"b3cf960b-b0a6-4b6d-a8b1-62bcd14bfa64","resolution":{"observed_at":"2026-08-16T11:28:01.962526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-16T11:28:01.965617Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.965617Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:af01252a4a66c040aa9e3c4bd50269dd9bd1d544f5bafecaed28b7c940a8807c","observation_id":"a433a3a4-d352-4c4c-99cf-b5af2f41a8ca","resolution":{"observed_at":"2026-08-16T11:28:01.965617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.968847Z","title":"Root mean square layer normalization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.968847Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:504bcd2bb355c8044aeee0edd84dbfb1a2a9465d3c97c002d71a101d868717d0","observation_id":"95156191-ad29-4b7a-a96d-561cfaa6945a","resolution":{"observed_at":"2026-08-16T11:28:01.968847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.847479Z","title":"Chinese open instruction generalist: A preliminary release, 2023","venue":null,"work_id":"de32c8f3-189e-441d-b670-ca602d7d4ec0","year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.971353Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:b09ad8dce7c3f22237f0a77400e416c8348f58163964d387e2bbcf7a255a64e7","observation_id":"341c99e9-2358-4c56-a2ea-477e3dfb04f2","resolution":{"observed_at":"2026-08-16T11:28:02.850980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19327","last_updated":"2024-07-10T16:55:47Z","snapshot_observed_at":"2026-08-16T13:48:04.075163Z","submitted_at":"2024-05-29T17:57:16Z","title":"MAP-Neo: Highly Capable and Transparent Bilingual Large Language Model Series","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19327","snapshot_observed_at":"2026-08-16T11:28:01.974063Z","title":"Map-neo: Highly capable and transparent bilingual large language model series","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.974063Z"},"links":{"cited_paper":"/paper/2405.19327","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:d38bad65788b29ea8f71fdff51c4dff80962d29ccf88d63658a65466868109ed","observation_id":"25d589b5-db38-42cc-8e8e-e9f4be43d38f","resolution":{"observed_at":"2026-08-16T11:28:01.974063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06876","last_updated":"2018-04-18T18:51:00Z","snapshot_observed_at":"2026-08-14T19:24:31.474740Z","submitted_at":"2018-04-18T18:51:00Z","title":"Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06876","snapshot_observed_at":"2026-08-16T11:28:01.976716Z","title":"Gender bias in coreference resolution: Evaluation and debiasing methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.976716Z"},"links":{"cited_paper":"/paper/1804.06876","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:1b677f626aecff43618503ad31ba00698489d5b28a0ea2cfd4526230024111fb","observation_id":"a81a2cb4-b08a-4975-8c5d-a4ec7c6257aa","resolution":{"observed_at":"2026-08-16T11:28:01.976716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.979820Z","title":"Trade-offs in large reasoning models: An empirical analysis of deliberative and adaptive reasoning over foundational capabilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.979820Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:ec6d131bbb02862cb4c7ef192633e787ec1724b4cdb09f8ffed84ae0b8874914","observation_id":"5f87b422-b1f3-4201-b25a-c7f05eefa6eb","resolution":{"observed_at":"2026-08-16T11:28:01.979820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11277","last_updated":"2023-09-12T16:28:00Z","snapshot_observed_at":"2026-08-01T19:01:47.393546Z","submitted_at":"2023-04-21T23:52:27Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11277","snapshot_observed_at":"2026-08-16T11:28:01.983081Z","title":"Pytorch fsdp: experiences on scaling fully sharded data parallel","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.983081Z"},"links":{"cited_paper":"/paper/2304.11277","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:a110f9d10723f022280bd83d26112590e2b124475c6da1aa0487a298052449ce","observation_id":"01243f5f-154e-4301-8805-b41d7edc2f69","resolution":{"observed_at":"2026-08-16T11:28:01.983081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08906","last_updated":"2022-04-29T23:24:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-17T21:39:10Z","title":"ST-MoE: Designing Stable and Transferable Sparse Expert Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08906","snapshot_observed_at":"2026-08-16T11:28:01.986592Z","title":"St-moe: Designing stable and transferable sparse expert models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.986592Z"},"links":{"cited_paper":"/paper/2202.08906","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:b550c81a87ac1d19292754ec4caae08bfae473417e08d7fcc2a147080ffe3986","observation_id":"5d248b23-0099-4fa7-868c-d30f5e906434","resolution":{"observed_at":"2026-08-16T11:28:01.986592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.989991Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.989991Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:11f4064a43b2d9aae32626f2e9dc591164a1d3179c87709a9f77e539de89a742","observation_id":"8e705cfb-a3a9-475f-b7bb-e73160bb4879","resolution":{"observed_at":"2026-08-16T11:28:01.989991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:01.993772Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.993772Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:974449e43e1c800e28d1dca05aad16963b60de3784f97680ae5f4f93ce5cca20","observation_id":"c3d56dd1-b9f5-4099-9e6a-2b122bdc4ab7","resolution":{"observed_at":"2026-08-16T11:28:01.993772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.823274Z","title":"Please summarize the following passage in Chinese, using a formal tone, no more than 50 words, and ensuring that the keyword ‘artificial intelligence’ is included","venue":null,"work_id":"3dec3edc-8f96-4743-9dea-dd4641d1d0d8","year":null},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.997075Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:de1b5ef65a597bfbb87c410d51754640700a4fb0e2e19eddc246b686d827f09d","observation_id":"ad4f7f08-3f87-47bc-9eff-8f69bb7c763b","resolution":{"observed_at":"2026-08-16T11:28:02.829229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.001178Z","title":", \" * write output.state after.block = add.period write","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:02.001178Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:cf90ee46cb6c2f184a81757421d00fcfae5992bcd9162b4e71618086a7c5a68f","observation_id":"0fd69cf0-bc15-44e7-bb86-cdf7e0ad2eec","resolution":{"observed_at":"2026-08-16T11:28:02.001178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:28:02.005029Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:02.005029Z"},"links":{"citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:c181dfba1b4d1eeb718e3f651a559eb2785c26e34090675cac777d3ce2a890ab","observation_id":"3496e062-00ab-41dc-b116-a11010a2375e","resolution":{"observed_at":"2026-08-16T11:28:02.005029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":79,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 0 inbound Pith citation observations for arXiv:2504.15527."}