{"as_of":"2026-08-23T19:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6267f0d291eb1f848a370fe31528c9c6dd7113df110c0de486c4250327a7be97","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T05:47:27.775529Z","state":"measured"},{"denominator":195,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":195,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":235,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:15:47.637213Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":44,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2311.16502","last_updated":"2024-06-13T15:02:39Z","snapshot_observed_at":"2026-08-17T13:10:52.611064Z","submitted_at":"2023-11-27T17:33:21Z","title":"MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","version":4},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-15T05:37:41.401736Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2311.16502"},"observation_digest":"sha256:bdd1ad48eb28cfc2e879297cdd253281ce8ac925950af9e5fcc4be34165946a9","observation_id":"4bd1f7e5-bb0d-4595-a789-46d39fd6c663","resolution":{"observed_at":"2026-05-15T05:37:41.724855Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2403.12031","last_updated":"2024-03-28T17:56:28Z","snapshot_observed_at":"2026-08-16T16:38:21.205977Z","submitted_at":"2024-03-18T17:59:04Z","title":"RouterBench: A Benchmark for Multi-LLM Routing System","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-16T10:47:31.006944Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2403.12031"},"observation_digest":"sha256:8edf4f71bb9e48cf774af18de389367bbcdbc0b6c25a1e662bb2334e8f8688d8","observation_id":"527f2313-43da-47fe-9abf-e1ca3e27952c","resolution":{"observed_at":"2026-05-16T10:47:31.139761Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-12T19:41:44.263663Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2403.20330"},"observation_digest":"sha256:d74e8305f8c5632823720e7effdbb3162ba3d27f150b273fb8f4b163f2b25ddb","observation_id":"66521229-13e4-46b8-9f1b-dac5c65c6799","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T18:00:53.389420Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2404.06395"},"observation_digest":"sha256:2393c1fbb66122d818edbeaf15f3306dc0d3e6ba7e9b0b20b302dd8be0d304f3","observation_id":"f320eb5b-020a-4562-84f3-afc366a10c51","resolution":{"observed_at":"2026-05-13T18:00:53.501285Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-18T14:33:16.365411Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T03:55:20.355345Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2404.06654"},"observation_digest":"sha256:e7e9d77de175dc12c2911a29dcc444fbcdbfc9c0ee94c248a30291e11d28a970","observation_id":"40989b32-6885-4a23-bb54-617693c80ad7","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-08-17T14:16:52.244007Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"reference_index":130,"source":"pdf_text","source_observed_at":"2026-05-12T20:58:58.849040Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2404.16821"},"observation_digest":"sha256:2a92aec206f5d282aa4b701df746428d73c4291bb61a444213afe984d3ae0dc5","observation_id":"3fe90b26-9ede-4acd-a9e6-ddd3b99fc2f3","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"reference_index":145,"source":"arxiv_source","source_observed_at":"2026-05-11T05:36:26.207359Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2405.04434"},"observation_digest":"sha256:853f7fdedf8c4948c1af55e3f4e92cbdb8f6620f634de5e52d3d7e0ac75b830b","observation_id":"5b6dee58-c543-422b-89b8-1acdcfda71fa","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-20T16:26:42.002863Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T15:51:04.674346Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2406.01574"},"observation_digest":"sha256:1ea831997b68eb4cc7eff5054f1ffab24228b45cb9edcc2dafac89c44ae2d80f","observation_id":"9247c9ee-d996-4f1e-b553-774a98c2fdfa","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-08-14T16:25:22.654846Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T02:44:53.284345Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2406.07476"},"observation_digest":"sha256:1ce5e9664b2f667a24019408d97cc23320a6bb0e2035061573e1ec9bef1cae4a","observation_id":"3ea15d3a-565e-4683-8818-bb39d0582302","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-08-17T07:39:23.832733Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"reference_index":203,"source":"arxiv_source","source_observed_at":"2026-05-13T10:47:55.934081Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2406.11717"},"observation_digest":"sha256:ce7211f0c5c0d7fda48fee5d50d2ea858c88df981bfd3050233bd63238d92793","observation_id":"3e0b9b03-4f8b-499a-924a-efb92d26ac93","resolution":{"observed_at":"2026-05-13T10:47:56.165790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2406.16860","last_updated":"2024-12-04T17:57:32Z","snapshot_observed_at":"2026-08-20T02:58:52.302783Z","submitted_at":"2024-06-24T17:59:42Z","title":"Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs","version":2},"reference_index":139,"source":"pdf_text","source_observed_at":"2026-05-17T00:05:03.547664Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2406.16860"},"observation_digest":"sha256:dfa4b2f6e2176f09f846f7c033fdc962dd3543b0f9f4e92ab426ca18f65a4970","observation_id":"ec355397-9833-47f5-a0cb-909f246752e5","resolution":{"observed_at":"2026-05-17T00:05:03.806290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2406.17557","last_updated":"2024-10-31T11:37:49Z","snapshot_observed_at":"2026-08-20T16:41:47.138179Z","submitted_at":"2024-06-25T13:50:56Z","title":"The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T04:36:45.363131Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2406.17557"},"observation_digest":"sha256:df23778d12104a4cf1d9944605461c0eb49653db0081da08fafeda2f277d538f","observation_id":"582dde4f-db68-43d1-b69c-bd506d05b62f","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T00:03:55.599967Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2406.20094"},"observation_digest":"sha256:1a1e17e5eaa45a8f4332e6bda6eaaca4e61ab6295a60124fe30374ded7998c76","observation_id":"82e1358a-134e-4c47-93b5-12daca19527d","resolution":{"observed_at":"2026-05-16T00:03:55.795468Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-08-21T07:48:51.700518Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-05-10T21:07:31.387726Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2408.01800"},"observation_digest":"sha256:23057a4edae08c4d2b02af83d5359fa7c114611fd1576dc47dc1b44e0655f133","observation_id":"cf6e328a-8617-4db9-91ff-b2b969be4963","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2409.01143","last_updated":"2026-05-12T22:15:30Z","snapshot_observed_at":"2026-08-02T14:15:27.581253Z","submitted_at":"2024-09-02T10:27:47Z","title":"HexiScale: Facilitating Large Language Model Training over Heterogeneous Hardware","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-23T21:21:03.598124Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2409.01143"},"observation_digest":"sha256:2fbfd1ad77fcc39ae917df36008689ff548ef7264dd853ab74bd628e5001f922","observation_id":"2441fc69-158f-4d83-b2fe-9b5fc86f1bd0","resolution":{"observed_at":"2026-05-23T21:23:27.612193Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2409.02813","last_updated":"2025-05-22T08:22:02Z","snapshot_observed_at":"2026-08-20T22:20:11.069630Z","submitted_at":"2024-09-04T15:31:26Z","title":"MMMU-Pro: A More Robust Multi-discipline Multimodal Understanding Benchmark","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-14T00:51:48.163349Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2409.02813"},"observation_digest":"sha256:66b789ba2cfb3c69e247d47c0d765b03777d3c55f559341caa31c177b342c25e","observation_id":"949bac0b-6251-4029-b218-719c39ff4f54","resolution":{"observed_at":"2026-05-14T00:51:48.463831Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2409.17146","last_updated":"2024-12-05T14:28:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-25T17:59:51Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T01:55:12.501409Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2409.17146"},"observation_digest":"sha256:f8e24e6ca4db7d45530798d35198f5c4372f5fb5849fe2827daffbe0ec178bcb","observation_id":"175d3db8-aadb-45a9-a5b7-84b6d9cb67bd","resolution":{"observed_at":"2026-05-15T01:55:12.558215Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2410.04509","last_updated":"2026-04-20T02:03:24Z","snapshot_observed_at":"2026-08-02T21:14:32.237997Z","submitted_at":"2024-10-06T14:59:09Z","title":"ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-23T20:10:59.264484Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2410.04509"},"observation_digest":"sha256:feb3e512becf774b8ef8c0f1afeccb2d56f3d7219d743f731135d333b7353b55","observation_id":"2bab7c3f-75c0-4163-9282-e0ca44687f23","resolution":{"observed_at":"2026-05-23T20:13:24.686872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2411.05527","last_updated":"2026-05-04T11:38:18Z","snapshot_observed_at":"2026-08-20T17:15:32.484047Z","submitted_at":"2024-11-08T12:35:58Z","title":"How Good is Your Wikipedia? Auditing Data Quality for Low-resource and Multilingual NLP","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-23T17:36:18.451771Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.05527"},"observation_digest":"sha256:a6878ecb9805c1a246f12d03d39052571e52785edf39552c04f9b5b7410111e8","observation_id":"97fd4d77-d185-40fc-a0b4-72e32b580be2","resolution":{"observed_at":"2026-05-23T17:38:15.842263Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T21:15:47.637213Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09003","last_updated":"2025-01-28T03:59:40Z","snapshot_observed_at":"2026-08-13T01:35:24.874459Z","submitted_at":"2024-11-13T20:12:55Z","title":"Refusal in LLMs is an Affine Function","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T21:15:47.637213Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.09003"},"observation_digest":"sha256:6bd0fc428035b555c8d90b587bd689ec79a00f97f9ae1727dd40177538bc0f6e","observation_id":"793f941d-0895-4279-8b16-323dd5553644","resolution":{"observed_at":"2026-08-12T21:15:47.637213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T19:58:04.191611Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10137","last_updated":"2024-11-15T12:23:12Z","snapshot_observed_at":"2026-08-17T23:25:51.203736Z","submitted_at":"2024-11-15T12:23:12Z","title":"Legal Evalutions and Challenges of Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T19:58:04.191611Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.10137"},"observation_digest":"sha256:0fb87e263cbc9a2a3db9f28c58bc80d28626ab9ce5cb38d56117d4b8607a5c42","observation_id":"c68786ab-95ed-4559-8a3c-5e2d0ba94d45","resolution":{"observed_at":"2026-08-12T19:58:04.191611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T19:29:56.289607Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10669","last_updated":"2024-11-16T02:10:14Z","snapshot_observed_at":"2026-08-16T09:46:58.334824Z","submitted_at":"2024-11-16T02:10:14Z","title":"Awaker2.5-VL: Stably Scaling MLLMs with Parameter-Efficient Mixture of Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T19:29:56.289607Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.10669"},"observation_digest":"sha256:d6ecde5f08be0907e2ceea22e1acd5b250b6ca9d23bfcbbf08ff04ce341456ed","observation_id":"34912703-ffe5-4d4a-a149-cbd595da760c","resolution":{"observed_at":"2026-08-12T19:29:56.289607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T19:29:16.210764Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10683","last_updated":"2024-11-16T03:20:39Z","snapshot_observed_at":"2026-08-15T13:27:36.320523Z","submitted_at":"2024-11-16T03:20:39Z","title":"I'm Spartacus, No, I'm Spartacus: Measuring and Understanding LLM Identity Confusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T19:29:16.210764Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.10683"},"observation_digest":"sha256:1e883a4a764928634673e26c441d84f3a234bfb5b290236d5132f903d44a106f","observation_id":"474464ad-8bcd-438b-b0d6-9ba11ea5c8b9","resolution":{"observed_at":"2026-08-12T19:29:16.210764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T18:33:40.690331Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11424","last_updated":"2024-11-18T09:50:54Z","snapshot_observed_at":"2026-08-21T02:55:09.710021Z","submitted_at":"2024-11-18T09:50:54Z","title":"Membership Inference Attack against Long-Context Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:33:40.690331Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.11424"},"observation_digest":"sha256:23f653cf0ba6bfd1040be19b709eb883eeb0db292f9da111834afa91865eb786","observation_id":"17c644b9-54e5-4fe2-9c6a-db9a573818f6","resolution":{"observed_at":"2026-08-12T18:33:40.690331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T18:30:41.617694Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11507","last_updated":"2024-11-18T12:12:33Z","snapshot_observed_at":"2026-08-21T14:59:42.461675Z","submitted_at":"2024-11-18T12:12:33Z","title":"SignEye: Traffic Sign Interpretation from Vehicle First-Person View","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T18:30:41.617694Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.11507"},"observation_digest":"sha256:c623d6c1f04dc1114186325a99f370b16e63a72fa58093dbeb8a774179ae8441","observation_id":"422fc425-340a-42e6-a6f9-1127a2a23398","resolution":{"observed_at":"2026-08-12T18:30:41.617694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T18:48:16.449851Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11916","last_updated":"2024-11-18T02:58:37Z","snapshot_observed_at":"2026-08-14T16:53:45.761753Z","submitted_at":"2024-11-18T02:58:37Z","title":"From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T18:48:16.449851Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.11916"},"observation_digest":"sha256:67a22f4b4fa256ec708e14d43dacdcf217561449f1d62da706a33a87e1bd7b80","observation_id":"7b767930-a0b2-4dd3-a400-57227c833bb9","resolution":{"observed_at":"2026-08-12T18:48:16.449851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2411.12363","last_updated":"2026-04-20T02:56:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-19T09:23:22Z","title":"DGSNA: Dynamic Generative Scene-based Noise Addition method","version":6},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-23T17:43:47.086524Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.12363"},"observation_digest":"sha256:5158b16d6b84f265e06658ebed1690f91f3d5a80eb7d666d7e12f9630ef8feb1","observation_id":"479b4b5f-f070-4fd4-ab30-a99a3aaac85e","resolution":{"observed_at":"2026-05-23T17:45:46.254371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T17:08:42.361273Z","title":"Yi: Openfoundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12915","last_updated":"2025-03-04T18:51:48Z","snapshot_observed_at":"2026-08-16T01:01:16.814303Z","submitted_at":"2024-11-19T22:59:14Z","title":"VILA-M3: Enhancing Vision-Language Models with Medical Expert Knowledge","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T17:08:42.361273Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.12915"},"observation_digest":"sha256:0eef8bd73d3b60bc84dcfc0dbec9ee4bf3c3932fa1f635ce706f761e2ab29196","observation_id":"c57fb592-3de0-4ce7-b594-648ed8209bdd","resolution":{"observed_at":"2026-08-12T17:08:42.361273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T15:16:27.932740Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14522","last_updated":"2025-03-27T15:24:29Z","snapshot_observed_at":"2026-08-16T07:36:40.507887Z","submitted_at":"2024-11-21T18:59:36Z","title":"GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and A Comprehensive Multimodal Dataset Towards General Medical AI","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T15:16:27.932740Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.14522"},"observation_digest":"sha256:a5a0c05e0575d962bdc49ba91406f747c6eeb8472378a59985110b2172fb84ab","observation_id":"0b35edca-080d-4e12-890b-22ac3a091234","resolution":{"observed_at":"2026-08-12T15:16:27.932740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T13:41:49.540438Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16044","last_updated":"2025-09-01T02:39:51Z","snapshot_observed_at":"2026-08-15T05:00:23.895770Z","submitted_at":"2024-11-25T02:15:30Z","title":"ZoomEye: Enhancing Multimodal LLMs with Human-Like Zooming Capabilities through Tree-Based Image Exploration","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T13:41:49.540438Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.16044"},"observation_digest":"sha256:4d261226fb7e9d1405791ae3f288c5e60626e7cf3f213553262c2f52df055665","observation_id":"550bd1ca-ee9f-4f75-9066-f47e86e86eaa","resolution":{"observed_at":"2026-08-12T13:41:49.540438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T12:53:38.703571Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16679","last_updated":"2025-05-31T11:16:44Z","snapshot_observed_at":"2026-08-16T16:36:51.621940Z","submitted_at":"2024-11-25T18:59:30Z","title":"Do Large Language Models Perform Latent Multi-Hop Reasoning without Exploiting Shortcuts?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T12:53:38.703571Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.16679"},"observation_digest":"sha256:286a853a1e0ddd225ba94a119626191bacc0c13bb121087ceb3cf73ffe3ee9e9","observation_id":"a718fa00-1528-4360-83cf-28c345f29d55","resolution":{"observed_at":"2026-08-12T12:53:38.703571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T12:37:38.616627Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17762","last_updated":"2025-07-28T09:54:49Z","snapshot_observed_at":"2026-08-19T20:31:14.326115Z","submitted_at":"2024-11-26T03:33:52Z","title":"MUSE-VL: Modeling Unified VLM through Semantic Discrete Encoding","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T12:37:38.616627Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.17762"},"observation_digest":"sha256:050afd6ac1b382c5426892411f7e7131570fc2dbeb7ca2cf36d0c5024c1795f9","observation_id":"856dc8cb-2354-46ec-8969-d882413e17cc","resolution":{"observed_at":"2026-08-12T12:37:38.616627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T11:57:29.166131Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17794","last_updated":"2024-11-26T17:47:34Z","snapshot_observed_at":"2026-08-21T04:53:17.776327Z","submitted_at":"2024-11-26T17:47:34Z","title":"NEMO: Can Multimodal LLMs Identify Attribute-Modified Objects?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T11:57:29.166131Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.17794"},"observation_digest":"sha256:edb9ab366d61c7908d20251373af1cc01b1ed7fdd633ee1dc283008ac3138999","observation_id":"5a9af856-ff51-4cec-a2a9-398e3f64cbae","resolution":{"observed_at":"2026-08-12T11:57:29.166131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T11:13:42.615837Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18478","last_updated":"2025-06-02T14:26:19Z","snapshot_observed_at":"2026-08-21T04:21:52.295807Z","submitted_at":"2024-11-27T16:19:00Z","title":"Beyond Examples: High-level Automated Reasoning Paradigm in In-Context Learning via MCTS","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T11:13:42.615837Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.18478"},"observation_digest":"sha256:4decf0a07637f8ef7652031658aaaef62c274b411cbcc792bbb1e0fda6e2c707","observation_id":"8c53f23f-b9b8-4ed7-860c-5a660244c433","resolution":{"observed_at":"2026-08-12T11:13:42.615837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T10:12:54.149007Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19478","last_updated":"2024-12-30T06:52:12Z","snapshot_observed_at":"2026-08-22T16:07:13.069895Z","submitted_at":"2024-11-29T05:31:04Z","title":"Zero-Indexing Internet Search Augmented Generation for Large Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:12:54.149007Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.19478"},"observation_digest":"sha256:b0c5644e2ec58a2a047d57d42b6c73078f95f508931d86238a1fa53dad80b51e","observation_id":"44bf408d-746e-472f-8d6f-f9f9589980d0","resolution":{"observed_at":"2026-08-12T10:12:54.149007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T10:09:45.138609Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19504","last_updated":"2026-06-05T23:48:53Z","snapshot_observed_at":"2026-08-15T16:45:55.373094Z","submitted_at":"2024-11-29T06:48:13Z","title":"TQA-Bench: Evaluating LLMs for Multi-Table Question Answering","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:09:45.138609Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.19504"},"observation_digest":"sha256:354bbb92d70c92d30f3cb1c11514692cd03727abce5d4d16159843e87c8964b8","observation_id":"e0ae449b-628e-41de-9ccb-0c444d07d6f6","resolution":{"observed_at":"2026-08-12T10:09:45.138609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T10:08:13.249386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19547","last_updated":"2024-11-29T08:47:04Z","snapshot_observed_at":"2026-08-18T10:05:26.260953Z","submitted_at":"2024-11-29T08:47:04Z","title":"Training Agents with Weakly Supervised Feedback from Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T10:08:13.249386Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2411.19547"},"observation_digest":"sha256:bb7dbe7d51a8f8df56b1a323548cb186069bb360a1a412a583e4f4ea8e7ec1b9","observation_id":"2894738e-c67c-4bff-8d49-7d942bb8df60","resolution":{"observed_at":"2026-08-12T10:08:13.249386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-13T21:19:07.777045Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T08:38:27.946746Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.00131"},"observation_digest":"sha256:bdbc0fa7ec3527396bc62393638788077ac995d90c6962a336c94a4df8930bf6","observation_id":"6553fbeb-7e7e-4905-a0d0-8a312fc7ef82","resolution":{"observed_at":"2026-05-23T08:42:45.235533Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T05:20:05.478461Z","title":"Young, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00535","last_updated":"2025-05-12T10:24:14Z","snapshot_observed_at":"2026-08-15T12:44:44.609531Z","submitted_at":"2024-11-30T16:58:42Z","title":"FullStack Bench: Evaluating LLMs as Full Stack Coders","version":6},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-12T05:20:05.478461Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.00535"},"observation_digest":"sha256:2971a5f2cd9eddc3324ff20e4604e30c1611d527616338d937428004c85b02ec","observation_id":"f13ae7a9-78b3-4431-bb82-45e06f408143","resolution":{"observed_at":"2026-08-12T05:20:05.478461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T04:34:11.980335Z","title":"Yi: Open foundation models by 01.ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01253","last_updated":"2025-01-22T15:09:58Z","snapshot_observed_at":"2026-08-16T16:50:21.438663Z","submitted_at":"2024-12-02T08:22:56Z","title":"Yi-Lightning Technical Report","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T04:34:11.980335Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.01253"},"observation_digest":"sha256:454820ac186c30e27c224d99d1cf25a2c3bc4371f2f869eb72969eb4cdae8cc7","observation_id":"ea03d03c-99a3-493a-82f3-fcfbf5e8af9c","resolution":{"observed_at":"2026-08-12T04:34:11.980335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-12T01:00:10.696787Z","title":"Yi: Open foundation models by 01.ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01798","last_updated":"2025-04-17T02:23:52Z","snapshot_observed_at":"2026-08-19T17:53:27.594726Z","submitted_at":"2024-12-02T18:46:12Z","title":"SEAL: Semantic Attention Learning for Long Video Representation","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T01:00:10.696787Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.01798"},"observation_digest":"sha256:70498bc9b18494bca7ddb3247bb86bc283f06a4ac13d7aea0e3d92a93f087112","observation_id":"a88d3ca5-8d6a-4ba3-afe7-fe033b7a4e31","resolution":{"observed_at":"2026-08-12T01:00:10.696787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T23:15:28.760232Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02674","last_updated":"2025-02-25T16:59:11Z","snapshot_observed_at":"2026-08-14T20:58:55.959220Z","submitted_at":"2024-12-03T18:47:26Z","title":"Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:28.760232Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.02674"},"observation_digest":"sha256:17fb41cd26a86901a8e9dda6aa99d6e0203ba9d53eff3020273df55724ba9941","observation_id":"629bf445-2d55-4cc5-83a5-7cabcce69417","resolution":{"observed_at":"2026-08-11T23:15:28.760232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T22:51:11.807591Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03085","last_updated":"2024-12-04T07:26:44Z","snapshot_observed_at":"2026-08-16T03:54:00.453682Z","submitted_at":"2024-12-04T07:26:44Z","title":"Mimir: Improving Video Diffusion Models for Precise Text Understanding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:51:11.807591Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.03085"},"observation_digest":"sha256:73226cfaeb4311dbd6e6b1d0b08b957ddb1e9fc5f2f7839d0e63b0d28026db6a","observation_id":"f7e04b10-0996-4aa7-9f3e-29316a62060f","resolution":{"observed_at":"2026-08-11T22:51:11.807591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T22:45:29.991518Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03148","last_updated":"2024-12-04T09:14:56Z","snapshot_observed_at":"2026-08-17T15:19:16.863878Z","submitted_at":"2024-12-04T09:14:56Z","title":"Fine-Grained Behavior Simulation with Role-Playing Large Language Model on Social Media","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:29.991518Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.03148"},"observation_digest":"sha256:d4893248a6613bffb95b2925be845a0767474f9823a01f35971e5a949c6c6144","observation_id":"86a93457-3b49-482c-93a3-df9352643e34","resolution":{"observed_at":"2026-08-11T22:45:29.991518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T22:48:23.104877Z","title":"Yi: Open foundation models by 01.ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03187","last_updated":"2025-02-26T11:10:48Z","snapshot_observed_at":"2026-08-19T17:06:18.927542Z","submitted_at":"2024-12-04T10:15:12Z","title":"Weighted-Reward Preference Optimization for Implicit Model Fusion","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T22:48:23.104877Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.03187"},"observation_digest":"sha256:e604e54f5245375d2e891340f279578b71788bf8e4f8b0facab78de80af7a4db","observation_id":"05fdfed6-020a-4d50-a75c-2237f08eba29","resolution":{"observed_at":"2026-08-11T22:48:23.104877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T21:46:44.873313Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04167","last_updated":"2024-12-05T14:03:41Z","snapshot_observed_at":"2026-08-17T23:25:21.200107Z","submitted_at":"2024-12-05T14:03:41Z","title":"Bench-CoE: a Framework for Collaboration of Experts from Benchmark","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T21:46:44.873313Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.04167"},"observation_digest":"sha256:f79147b364502bb6c07522c5a8679e7f39e9ab2e8b50ead3415f50e38d61c870","observation_id":"74bd5c2b-7e7d-4e48-b582-7067b30e6cd3","resolution":{"observed_at":"2026-08-11T21:46:44.873313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T21:30:00.277554Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04447","last_updated":"2025-04-11T07:10:02Z","snapshot_observed_at":"2026-08-14T15:38:54.058153Z","submitted_at":"2024-12-05T18:57:23Z","title":"EgoPlan-Bench2: A Benchmark for Multimodal Large Language Model Planning in Real-World Scenarios","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T21:30:00.277554Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.04447"},"observation_digest":"sha256:18d32fa8e4de3f41c8fb02fdce959d7a50b8e4709fa0eb26becd5d7812bff103","observation_id":"e5e148e9-8647-44da-aa23-b9df4abc48e9","resolution":{"observed_at":"2026-08-11T21:30:00.277554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T21:36:09.396491Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04531","last_updated":"2024-12-05T17:08:19Z","snapshot_observed_at":"2026-08-16T18:02:39.651530Z","submitted_at":"2024-12-05T17:08:19Z","title":"MageBench: Bridging Large Multimodal Models to Agents","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T21:36:09.396491Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.04531"},"observation_digest":"sha256:32aa327fa4abb09d9066d83144a88670d5d0700d34d414b166094633c19d4736","observation_id":"6d169184-9103-4bd1-97cc-a89ed4e17aca","resolution":{"observed_at":"2026-08-11T21:36:09.396491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T21:16:05.175959Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04856","last_updated":"2024-12-06T08:48:49Z","snapshot_observed_at":"2026-08-18T11:55:54.594255Z","submitted_at":"2024-12-06T08:48:49Z","title":"Can Large Language Models Effectively Process and Execute Financial Trading Instructions?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T21:16:05.175959Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.04856"},"observation_digest":"sha256:bda3666c175c5737a1075b2b0563c2eff82d13cc813198c196ad772e4f907ecc","observation_id":"34828d07-ce50-4b03-bbf8-4ab9cc880254","resolution":{"observed_at":"2026-08-11T21:16:05.175959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T20:53:15.335689Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05210","last_updated":"2024-12-06T17:40:38Z","snapshot_observed_at":"2026-08-15T02:44:11.981036Z","submitted_at":"2024-12-06T17:40:38Z","title":"Evaluating and Aligning CodeLLMs on Human Preference","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T20:53:15.335689Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.05210"},"observation_digest":"sha256:f2c3b0577191fa186841362e02cc08b191f51d6f4ddd37ab6415545667e8995d","observation_id":"b7257160-35c0-4dd2-92fa-2dbf36026d4f","resolution":{"observed_at":"2026-08-11T20:53:15.335689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"reference_index":280,"source":"pdf_text","source_observed_at":"2026-05-10T13:23:57.588851Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.05271"},"observation_digest":"sha256:5b2633cc5a83ddc72cb513c9970c3da8fa100c9a776ad825c6a9cb402646f728","observation_id":"090be071-3fa1-4dd5-b683-14ddc5dc2cf7","resolution":{"observed_at":"2026-05-13T05:47:28.044136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T20:17:02.834058Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05934","last_updated":"2025-08-18T03:40:02Z","snapshot_observed_at":"2026-08-16T08:39:17.362388Z","submitted_at":"2024-12-08T13:20:45Z","title":"Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T20:17:02.834058Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.05934"},"observation_digest":"sha256:a227d14c6e21e0289a5fa66725c1e7d243324092ebf6e5daf09fca4aacf3aea3","observation_id":"f91a51a4-da7e-43b2-9df1-2df7828eb279","resolution":{"observed_at":"2026-08-11T20:17:02.834058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T17:33:06.397742Z","title":"arXiv preprint arXiv:2403.04652","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08846","last_updated":"2024-12-12T00:52:11Z","snapshot_observed_at":"2026-08-16T20:13:52.910295Z","submitted_at":"2024-12-12T00:52:11Z","title":"Exploring Large Language Models on Cross-Cultural Values in Connection with Training Methodology","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:33:06.397742Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.08846"},"observation_digest":"sha256:c5298aeb5cca0efd59643e807c75a4f436aa90c83056ebed0dfa98005e5c687c","observation_id":"c2294cb6-7f8c-42f2-b353-697e71938d18","resolution":{"observed_at":"2026-08-11T17:33:06.397742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T15:20:51.849001Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11102","last_updated":"2025-03-25T15:35:29Z","snapshot_observed_at":"2026-08-18T14:05:02.198883Z","submitted_at":"2024-12-15T07:49:31Z","title":"Empowering LLMs to Understand and Generate Complex Vector Graphics","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T15:20:51.849001Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.11102"},"observation_digest":"sha256:56dabebaeb98445053c5a6c67391d719cc912fbeb3fd135095f89983012fd40c","observation_id":"a05a6d7d-c4c3-4c2c-810a-577f80d11ca3","resolution":{"observed_at":"2026-08-11T15:20:51.849001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T13:44:15.303472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12865","last_updated":"2024-12-17T12:49:14Z","snapshot_observed_at":"2026-08-19T12:06:47.256828Z","submitted_at":"2024-12-17T12:49:14Z","title":"Preference-Oriented Supervised Fine-Tuning: Favoring Target Model Over Aligned Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:44:15.303472Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.12865"},"observation_digest":"sha256:8fc442fe1387136fde48610ee4d5ff2b3cbeb88d5d119c975e51b98e15be6dfc","observation_id":"eefbeff9-76e0-44e0-90d5-c7d61323a5ad","resolution":{"observed_at":"2026-08-11T13:44:15.303472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T13:09:46.155027Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13437","last_updated":"2024-12-18T02:15:31Z","snapshot_observed_at":"2026-08-13T15:09:37.690476Z","submitted_at":"2024-12-18T02:15:31Z","title":"Deploying Foundation Model Powered Agent Services: A Survey","version":1},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-08-11T13:09:46.155027Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.13437"},"observation_digest":"sha256:71505e09ff5d77a64fb09be802690e23b40510ff86e54ba0aaa06021220e01e6","observation_id":"3fe92ce8-4802-4e12-814d-15c78f5a1be6","resolution":{"observed_at":"2026-08-11T13:09:46.155027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T13:05:48.135842Z","title":"Advances in Neural Information Processing Systems, 36","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13549","last_updated":"2025-05-24T04:56:32Z","snapshot_observed_at":"2026-08-21T12:52:26.725408Z","submitted_at":"2024-12-18T06:50:39Z","title":"EscapeBench: Towards Advancing Creative Intelligence of Language Model Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T13:05:48.135842Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.13549"},"observation_digest":"sha256:3156d38ab186b09a7af292ef3424fe5a4623ed51509d397f8071a1368789d962","observation_id":"94fbcdd1-2d9f-4da1-939d-9b17f8e07fc7","resolution":{"observed_at":"2026-08-11T13:05:48.135842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T12:47:16.955000Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13845","last_updated":"2025-02-24T03:37:59Z","snapshot_observed_at":"2026-08-17T16:57:34.317634Z","submitted_at":"2024-12-18T13:38:06Z","title":"Do Language Models Understand Time?","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T12:47:16.955000Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.13845"},"observation_digest":"sha256:d4070dd41bb0526e5daad2612da71b75d657e5168e8324590732ee8ba2cfd8c8","observation_id":"1d1ba6df-a28d-411b-9a0d-6ed747c808ec","resolution":{"observed_at":"2026-08-11T12:47:16.955000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2412.14164","last_updated":"2024-12-18T18:58:50Z","snapshot_observed_at":"2026-08-17T07:24:03.168446Z","submitted_at":"2024-12-18T18:58:50Z","title":"MetaMorph: Multimodal Understanding and Generation via Instruction Tuning","version":1},"reference_index":219,"source":"arxiv_source","source_observed_at":"2026-05-17T07:51:12.953777Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.14164"},"observation_digest":"sha256:1b17162b4ab616cc9fe0ccbfb0d1b0635a40c6815a76b2e0fc8c785665106cc3","observation_id":"9fd6ca55-e517-4618-b1d6-0b64a8e59f44","resolution":{"observed_at":"2026-05-17T07:51:13.297166Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2412.14642","last_updated":"2026-05-22T16:03:13Z","snapshot_observed_at":"2026-08-19T11:21:38.941359Z","submitted_at":"2024-12-19T08:51:16Z","title":"Speak-to-Structure: Evaluating LLMs in Open-domain Natural Language-Driven Molecule Generation","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-25T08:12:15.133695Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.14642"},"observation_digest":"sha256:5011fbe78f9be88979d1554e6bef0a997eab6effcc3e797555d53feb21b873bc","observation_id":"16fdb0d9-c51e-4823-a245-c074e0f73289","resolution":{"observed_at":"2026-05-25T08:15:34.007899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-23T06:25:00.376073Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.15115"},"observation_digest":"sha256:df84a8eacd01576c6dbcf92d52efba7c676888738d5458a53d1826cd806a7b9c","observation_id":"9cf2edea-2475-4181-88fc-12694aff65d2","resolution":{"observed_at":"2026-05-23T06:25:27.923861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T11:36:56.388284Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15194","last_updated":"2024-12-19T18:58:04Z","snapshot_observed_at":"2026-08-20T02:22:18.860708Z","submitted_at":"2024-12-19T18:58:04Z","title":"MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T11:36:56.388284Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.15194"},"observation_digest":"sha256:604c76107cd6ab036acf2a5e4707489d1407fc0c5eb7f7e5b3c5253628faf3c5","observation_id":"3bf5126f-538a-4eff-a437-4f85b734d514","resolution":{"observed_at":"2026-08-11T11:36:56.388284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T11:25:14.780280Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15524","last_updated":"2025-03-24T19:31:44Z","snapshot_observed_at":"2026-08-13T13:45:02.194746Z","submitted_at":"2024-12-20T03:26:47Z","title":"HREF: Human Response-Guided Evaluation of Instruction Following in Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T11:25:14.780280Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.15524"},"observation_digest":"sha256:a0fcd2d2f9d849eb5495a90b6444aae384bcfaa7b9a1c2fc2320810f1a646083","observation_id":"3f726c6b-5af5-4628-8a61-c223d586a93e","resolution":{"observed_at":"2026-08-11T11:25:14.780280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T11:20:51.548006Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15594","last_updated":"2024-12-20T06:34:57Z","snapshot_observed_at":"2026-08-11T22:05:42.762390Z","submitted_at":"2024-12-20T06:34:57Z","title":"Template-Driven LLM-Paraphrased Framework for Tabular Math Word Problem Generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T11:20:51.548006Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.15594"},"observation_digest":"sha256:4f38cbbf0a681d8bbd4ab3e27960a64e1c6c7e1ed6c7d4d4bf794e0546014ca9","observation_id":"490a0703-5a46-41b5-94de-abf3f488cb53","resolution":{"observed_at":"2026-08-11T11:20:51.548006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T10:28:37.515194Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16633","last_updated":"2025-08-11T08:29:19Z","snapshot_observed_at":"2026-08-11T10:21:34.147117Z","submitted_at":"2024-12-21T13:58:27Z","title":"POEX: Towards Policy Executable Jailbreak Attacks Against the LLM-based Robots","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:28:37.515194Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.16633"},"observation_digest":"sha256:b116316ec7080a6c4658ca5c2c46ee383fafaf79f62cfe05d9c48e4b57096773","observation_id":"34c5dda1-c9d4-443e-9f28-3b862093a734","resolution":{"observed_at":"2026-08-11T10:28:37.515194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T05:53:01.362978Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17061","last_updated":"2025-05-19T15:18:10Z","snapshot_observed_at":"2026-08-15T02:53:21.438083Z","submitted_at":"2024-12-22T15:16:44Z","title":"Multi-Agent Sampling: Scaling Inference Compute for Data Synthesis with Tree Search-Based Agentic Collaboration","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T05:53:01.362978Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.17061"},"observation_digest":"sha256:fa2eb9aa74419d006f192779a24edfc30424836cbf280d7cfc27f7490942b965","observation_id":"713939e7-c264-44f9-b588-f9a6e567304c","resolution":{"observed_at":"2026-08-11T05:53:01.362978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T05:39:44.503518Z","title":"Standard","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17339","last_updated":"2024-12-23T07:08:14Z","snapshot_observed_at":"2026-08-19T20:14:39.026830Z","submitted_at":"2024-12-23T07:08:14Z","title":"MineAgent: Towards Remote-Sensing Mineral Exploration with Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:39:44.503518Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.17339"},"observation_digest":"sha256:41ab2ffb721e683a69b5c7acf07192d5b208071ecc029de3a0ae1cbcf437cbd2","observation_id":"80691f16-efd6-4a3e-9a6f-9ebc2146cc7b","resolution":{"observed_at":"2026-08-11T05:39:44.503518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T05:13:07.116856Z","title":"AI et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17758","last_updated":"2024-12-23T18:14:36Z","snapshot_observed_at":"2026-08-19T03:58:09.984679Z","submitted_at":"2024-12-23T18:14:36Z","title":"In Case You Missed It: ARC 'Challenge' Is Not That Challenging","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T05:13:07.116856Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.17758"},"observation_digest":"sha256:d3f9c585cf1b4ce7e397019030102ac8019e27a99cd326dd4bc1ca366e5c253e","observation_id":"b39cf780-d195-4180-a36f-bd451f8ae35e","resolution":{"observed_at":"2026-08-11T05:13:07.116856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-11T05:04:52.116742Z","title":"Yi: Open founda- tion models by 01","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18148","last_updated":"2025-06-01T15:06:21Z","snapshot_observed_at":"2026-08-17T08:46:50.230603Z","submitted_at":"2024-12-24T04:04:54Z","title":"Are We in the AI-Generated Text World Already? Quantifying and Monitoring AIGT on Social Media","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T05:04:52.116742Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.18148"},"observation_digest":"sha256:9336c7e8a307f2e0c3a5c6456f10d43e65936b9797d151b08cf047c88b906777","observation_id":"56568f3f-0b00-45ca-bbc7-d31ba1b960bd","resolution":{"observed_at":"2026-08-11T05:04:52.116742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T12:36:50.060335Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.18925"},"observation_digest":"sha256:475c02a1af827a26a25b3895c98e0e82a5b9dedc398dbe3fdbde2cd13d37710e","observation_id":"c8a0aee9-44d1-4a54-b616-1df3423d4429","resolution":{"observed_at":"2026-05-15T12:36:50.201854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2412.20718","last_updated":"2026-04-08T17:39:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-30T05:18:55Z","title":"MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T07:14:27.786918Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.20718"},"observation_digest":"sha256:277bf48b601fd2f0965fa0290201a4deb8c3f3442551f6c259f037e83214d23e","observation_id":"7654b8e9-93bf-48d4-bb68-c047097d402a","resolution":{"observed_at":"2026-05-23T07:15:28.533562Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T23:12:19.068765Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20903","last_updated":"2025-03-04T15:05:02Z","snapshot_observed_at":"2026-08-17T15:19:19.015706Z","submitted_at":"2024-12-30T12:29:02Z","title":"WalkVLM:Aid Visually Impaired People Walking by Vision Language Model","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T23:12:19.068765Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.20903"},"observation_digest":"sha256:4efb9f1df0dbf49153a93900a40de3471ecf54c09d086a17498cb92faecae0e2","observation_id":"87fb6fc1-3a14-40d5-88bb-2e12276bf99d","resolution":{"observed_at":"2026-08-10T23:12:19.068765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T23:09:21.419919Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.21016","last_updated":"2025-03-17T13:42:06Z","snapshot_observed_at":"2026-08-14T23:33:27.849166Z","submitted_at":"2024-12-30T15:33:34Z","title":"Assessing the Robustness of LLM-based NLP Software via Automated Testing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T23:09:21.419919Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2412.21016"},"observation_digest":"sha256:12d25fabe03960d788abeb6583ec69848d6c5981b653eb2d7cf2367f096f3903","observation_id":"ba88e5d4-4337-467b-9f14-0d807046f222","resolution":{"observed_at":"2026-08-10T23:09:21.419919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2501.00321","last_updated":"2025-06-05T02:59:05Z","snapshot_observed_at":"2026-08-12T17:21:52.298102Z","submitted_at":"2024-12-31T07:32:35Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","version":2},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-05-17T20:33:26.613927Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.00321"},"observation_digest":"sha256:e5723982d31087e025dbab7a59acb2a1e343346ad0bf4ec2be8863cb7e12abbc","observation_id":"f2ef72d5-e6fe-4f39-8ffe-81525daa7bbd","resolution":{"observed_at":"2026-05-17T20:33:26.920858Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T22:27:13.672970Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01709","last_updated":"2025-03-18T07:34:44Z","snapshot_observed_at":"2026-08-15T13:36:27.630577Z","submitted_at":"2025-01-03T09:10:34Z","title":"MoVE-KD: Knowledge Distillation for VLMs with Mixture of Visual Encoders","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T22:27:13.672970Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.01709"},"observation_digest":"sha256:fbb712fb4b932e5c1215bfbfef1cda054c8cc194b58321a15639c37125ca09af","observation_id":"99d02520-c2a3-488b-b4a0-cf37515833be","resolution":{"observed_at":"2026-08-10T22:27:13.672970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T22:25:54.528176Z","title":"Yi: Open foundation models by 01.ai, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01830","last_updated":"2025-01-03T14:30:14Z","snapshot_observed_at":"2026-08-18T00:24:19.116153Z","submitted_at":"2025-01-03T14:30:14Z","title":"Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T22:25:54.528176Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.01830"},"observation_digest":"sha256:4585bfd9d7ca1b08208c586e671a4e17d68b43e2a825accb8797d7d950305c12","observation_id":"798bce14-0b0d-4892-adcb-37ed42899ca8","resolution":{"observed_at":"2026-08-10T22:25:54.528176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T22:18:19.288335Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02266","last_updated":"2025-01-04T12:04:46Z","snapshot_observed_at":"2026-08-19T09:52:41.893972Z","submitted_at":"2025-01-04T12:04:46Z","title":"LLMzSz{\\L}: a comprehensive LLM benchmark for Polish","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T22:18:19.288335Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.02266"},"observation_digest":"sha256:89a1c3706f877276a869f592eb635898ce61cb8d601c9c9e72884fe123dbf847","observation_id":"9e57c9be-e5ce-4dea-a8c0-7973a8d4f6cb","resolution":{"observed_at":"2026-08-10T22:18:19.288335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T22:18:51.053783Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02336","last_updated":"2025-01-04T17:01:30Z","snapshot_observed_at":"2026-08-20T08:17:55.023095Z","submitted_at":"2025-01-04T17:01:30Z","title":"AdaSkip: Adaptive Sublayer Skipping for Accelerating Long-Context LLM Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T22:18:51.053783Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.02336"},"observation_digest":"sha256:8c6f70a78133ed12d61318b0ee0c7ed3d0fd63e42a6c829f347575817021fead","observation_id":"5a03ccba-efd8-46fe-9ae4-cc36b50e62dc","resolution":{"observed_at":"2026-08-10T22:18:51.053783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T22:11:04.307213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02635","last_updated":"2025-01-05T19:47:57Z","snapshot_observed_at":"2026-08-12T20:55:30.722391Z","submitted_at":"2025-01-05T19:47:57Z","title":"Interactive Information Need Prediction with Intent and Context","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:11:04.307213Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.02635"},"observation_digest":"sha256:e8752671d13eec17100422c38ac5bb889669517b66e395eb95a9421a28206b8a","observation_id":"359f25d3-9ce5-43a4-8cce-e5ef798ccc26","resolution":{"observed_at":"2026-08-10T22:11:04.307213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T21:56:23.275715Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03458","last_updated":"2025-01-07T01:19:48Z","snapshot_observed_at":"2026-08-19T07:59:21.021163Z","submitted_at":"2025-01-07T01:19:48Z","title":"Activating Associative Disease-Aware Vision Token Memory for LLM-Based X-ray Report Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T21:56:23.275715Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.03458"},"observation_digest":"sha256:05c0a679ea86c8297cc8faa0433773a030198845e9e76c96c68d272b9f5834f1","observation_id":"f74d0065-8633-41f6-892d-8654f45df0c4","resolution":{"observed_at":"2026-08-10T21:56:23.275715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T21:34:35.614146Z","title":"Young, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04568","last_updated":"2025-05-19T14:15:00Z","snapshot_observed_at":"2026-08-15T23:35:40.793951Z","submitted_at":"2025-01-08T15:32:12Z","title":"Feedback-Driven Vision-Language Alignment with Minimal Human Supervision","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-10T21:34:35.614146Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.04568"},"observation_digest":"sha256:392437fd917ff4c7ca822c0e9c37e39031bbb82bfa72c8415e7e6f1af3915f09","observation_id":"c1e6bd2c-81a1-4157-9533-850fd836e371","resolution":{"observed_at":"2026-08-10T21:34:35.614146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T21:31:16.348265Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04670","last_updated":"2025-07-09T08:04:21Z","snapshot_observed_at":"2026-08-14T03:18:34.834807Z","submitted_at":"2025-01-08T18:30:53Z","title":"Are They the Same? Exploring Visual Correspondence Shortcomings of Multimodal LLMs","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-10T21:31:16.348265Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.04670"},"observation_digest":"sha256:d3fa1f32b4f58f875f7426fe2f86ab3ba600e32571ec86c67cc0008a2fb942a0","observation_id":"544897a7-4d45-4c5d-8b9d-c1f9c41dced9","resolution":{"observed_at":"2026-08-10T21:31:16.348265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T21:28:07.342413Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04835","last_updated":"2025-01-08T20:39:45Z","snapshot_observed_at":"2026-08-11T19:33:47.941883Z","submitted_at":"2025-01-08T20:39:45Z","title":"Do Code LLMs Understand Design Patterns?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:28:07.342413Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.04835"},"observation_digest":"sha256:6ae30d498b7140528fd01a353ea613c76c5ad8c2f35e5eddc646c7091bad732b","observation_id":"1cd375c7-9719-4221-82c9-2731ac8c9c22","resolution":{"observed_at":"2026-08-10T21:28:07.342413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T20:54:02.521439Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07124","last_updated":"2025-01-17T09:39:17Z","snapshot_observed_at":"2026-08-14T10:55:02.137567Z","submitted_at":"2025-01-13T08:26:43Z","title":"LLM360 K2: Building a 65B 360-Open-Source Large Language Model from Scratch","version":3},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-08-10T20:54:02.521439Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.07124"},"observation_digest":"sha256:004334e82aea72fe50c575f6052936b0e976fc92385962a82cc307f2bb9ba887","observation_id":"4538c36e-4135-4292-a14d-7ef8eb457aa6","resolution":{"observed_at":"2026-08-10T20:54:02.521439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T20:33:20.525624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08197","last_updated":"2025-01-14T15:22:47Z","snapshot_observed_at":"2026-08-13T06:16:32.798188Z","submitted_at":"2025-01-14T15:22:47Z","title":"OpenCSG Chinese Corpus: A Series of High-quality Chinese Datasets for LLM Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T20:33:20.525624Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.08197"},"observation_digest":"sha256:c547d40989b67febfa0e473a09ff38226a0d01f351fa6259028122cebc18d739","observation_id":"5d44c25e-8b08-4fa3-bb17-38dc9cbe3893","resolution":{"observed_at":"2026-08-10T20:33:20.525624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T20:10:34.745617Z","title":"Yi: Open foundation models by 01.ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09368","last_updated":"2025-08-11T11:28:39Z","snapshot_observed_at":"2026-08-10T21:23:09.138738Z","submitted_at":"2025-01-16T08:27:40Z","title":"Aligning Instruction Tuning with Pre-training","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T20:10:34.745617Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.09368"},"observation_digest":"sha256:cead159e37e0548a8ba39251280e45f97f092c263f8a784eaad9d16dfe8ba3b7","observation_id":"b05a3cfb-2f89-4cb1-bcaf-ea3eb98a9416","resolution":{"observed_at":"2026-08-10T20:10:34.745617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T19:28:29.822205Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10011","last_updated":"2025-01-17T07:48:37Z","snapshot_observed_at":"2026-08-18T12:52:42.418531Z","submitted_at":"2025-01-17T07:48:37Z","title":"Mitigating Hallucinations on Object Attributes using Multiview Images and Negative Instructions","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:29.822205Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.10011"},"observation_digest":"sha256:bd521239ab61b8d3a10f962bf37467a291ac7986d786fa5e6b623a5339fd4814","observation_id":"f7204dca-4d13-43a3-b105-aaf5da2afab2","resolution":{"observed_at":"2026-08-10T19:28:29.822205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T16:58:02.645376Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12735","last_updated":"2025-02-07T02:13:27Z","snapshot_observed_at":"2026-08-17T20:21:27.504758Z","submitted_at":"2025-01-22T09:12:09Z","title":"Online Preference Alignment for Language Models via Count-based Exploration","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T16:58:02.645376Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.12735"},"observation_digest":"sha256:d848e16d6b7d922f8fb67c7e6476bdef37f9a485885c4bbad8621c49f0a4496f","observation_id":"64c656ab-1840-42e8-b787-1f0d1cb7924d","resolution":{"observed_at":"2026-08-10T16:58:02.645376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T14:38:25.998097Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15147","last_updated":"2025-02-23T08:09:48Z","snapshot_observed_at":"2026-08-19T23:40:24.057770Z","submitted_at":"2025-01-25T09:11:15Z","title":"A Causality-aware Paradigm for Evaluating Creativity of Multimodal Large Language Models","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T14:38:25.998097Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.15147"},"observation_digest":"sha256:478fe21b80988f01501af59e671c2ffedc3129cd9b5e99b6641946cb19b694fb","observation_id":"21cd5c21-b140-498b-80c8-40bfc2042ea9","resolution":{"observed_at":"2026-08-10T14:38:25.998097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-10T00:36:46.458321Z","title":"Young, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18128","last_updated":"2025-01-30T04:20:16Z","snapshot_observed_at":"2026-08-19T17:23:58.176195Z","submitted_at":"2025-01-30T04:20:16Z","title":"Unraveling the Capabilities of Language Models in News Summarization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T00:36:46.458321Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2501.18128"},"observation_digest":"sha256:244a96b3950cc9b30067e7835c2a5a666f125bf4e845cd1e7ba9c30fd594412a","observation_id":"83cfa4cb-7d7c-4eeb-8389-9d6c5033ba6b","resolution":{"observed_at":"2026-08-10T00:36:46.458321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-09T19:17:52.179978Z","title":"Young, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00375","last_updated":"2025-02-08T00:07:02Z","snapshot_observed_at":"2026-08-15T20:44:13.774612Z","submitted_at":"2025-02-01T09:28:40Z","title":"Scalable Framework for Classifying AI-Generated Content Across Modalities","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T19:17:52.179978Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.00375"},"observation_digest":"sha256:24be991490737107a016b8a09fb65f6480794fbe4ab81dce712a3ef289be5c8e","observation_id":"2ec9cee2-635f-437b-a554-75489d2ce71e","resolution":{"observed_at":"2026-08-09T19:17:52.179978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-09T16:10:24.906158Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01243","last_updated":"2025-02-03T11:04:51Z","snapshot_observed_at":"2026-08-13T15:01:44.141448Z","submitted_at":"2025-02-03T11:04:51Z","title":"OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T16:10:24.906158Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.01243"},"observation_digest":"sha256:f72011cf3ca5e442f002043cf8ee483266be704990a847237c4a2e4a24245fc2","observation_id":"d0c82835-991b-431f-be27-acdbc325c613","resolution":{"observed_at":"2026-08-09T16:10:24.906158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-14T05:03:05.661970Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"reference_index":247,"source":"arxiv_source","source_observed_at":"2026-05-13T17:30:02.803757Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.02737"},"observation_digest":"sha256:e09cff812615b6f1e70757b407d08ee72caf6dc7747c5f27fa3d8573ed2c2f7e","observation_id":"be500420-1eb0-4d01-8bd1-cd020197bd0e","resolution":{"observed_at":"2026-05-13T17:30:03.065466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-08T22:47:39.354193Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04328","last_updated":"2025-06-02T19:33:24Z","snapshot_observed_at":"2026-08-20T01:50:23.816883Z","submitted_at":"2025-02-06T18:59:55Z","title":"Ola: Pushing the Frontiers of Omni-Modal Language Model","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T22:47:39.354193Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.04328"},"observation_digest":"sha256:ed08450cfe71a024bc24e73f1211774405b6fd576856edd5a34c5d4ceb108cef","observation_id":"4fa3a959-f049-4aa8-8f20-891d7b801c66","resolution":{"observed_at":"2026-08-08T22:47:39.354193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-09T00:54:56.900854Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04394","last_updated":"2025-05-26T11:11:09Z","snapshot_observed_at":"2026-08-15T14:59:40.375202Z","submitted_at":"2025-02-06T04:00:25Z","title":"DECT: Harnessing LLM-assisted Fine-Grained Linguistic Knowledge and Label-Switched and Label-Preserved Data Generation for Diagnosis of Alzheimer's Disease","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T00:54:56.900854Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.04394"},"observation_digest":"sha256:f7ccacd106b1cc45b12e6d5bd0f6383ee6e1eacc0e35d24e35dc3496ed699b28","observation_id":"389fcae2-e4a6-4fb2-8ff3-14b53e5c7832","resolution":{"observed_at":"2026-08-09T00:54:56.900854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-08T21:45:45.484908Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-15T02:02:52.968189Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.484908Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:08e07d68145d9d8f7d39d1a13c49146d88da185004aa9601f91bbf3a47180513","observation_id":"5d3b7035-f87b-412a-b727-b261da42ae26","resolution":{"observed_at":"2026-08-08T21:45:45.484908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-08T14:50:58.703849Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06635","last_updated":"2025-02-13T07:31:55Z","snapshot_observed_at":"2026-08-18T12:57:24.202558Z","submitted_at":"2025-02-10T16:31:37Z","title":"Steel-LLM:From Scratch to Open Source -- A Personal Journey in Building a Chinese-Centric LLM","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T14:50:58.703849Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.06635"},"observation_digest":"sha256:5cc9f2cfcc80a0dee8e2014af5bbf71fc80bf49c040f3b64f40bbad7b839f8c6","observation_id":"a369b45b-8e49-46cf-b6f4-175ba496e2a4","resolution":{"observed_at":"2026-08-08T14:50:58.703849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-08T14:46:29.725457Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06666","last_updated":"2025-02-10T16:52:39Z","snapshot_observed_at":"2026-08-13T02:27:49.966430Z","submitted_at":"2025-02-10T16:52:39Z","title":"Automatic Evaluation of Healthcare LLMs Beyond Question-Answering","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T14:46:29.725457Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.06666"},"observation_digest":"sha256:df09c5eb42ade406cb0fd745d754264baf51f835fe8afd9c8eb6bf74f6cf0a14","observation_id":"6d6a70cd-7650-4683-b5ac-fc082ea71c30","resolution":{"observed_at":"2026-08-08T14:46:29.725457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-08T18:23:05.824654Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06884","last_updated":"2025-02-08T21:30:41Z","snapshot_observed_at":"2026-08-19T23:48:15.873299Z","submitted_at":"2025-02-08T21:30:41Z","title":"Learning Conformal Abstention Policies for Adaptive Risk Management in Large Language and Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T18:23:05.824654Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.06884"},"observation_digest":"sha256:b792cbc077493d7878cd9982255ddcdd65ffeb3e2930525b8a93ce99c5bef071","observation_id":"bb8a50d0-a881-46da-8b71-5588a91ed2ce","resolution":{"observed_at":"2026-08-08T18:23:05.824654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-08T10:14:30.157778Z","title":"arXiv preprint arXiv:2403.04652","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08168","last_updated":"2025-03-04T01:07:55Z","snapshot_observed_at":"2026-08-16T20:13:07.848422Z","submitted_at":"2025-02-12T07:19:36Z","title":"SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T10:14:30.157778Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.08168"},"observation_digest":"sha256:32e7779df6bc99dab95ca494a0904d334d147b3f2498eaa165b89a667f4cbfff","observation_id":"2a472a32-422a-491b-89b2-53790077e6c2","resolution":{"observed_at":"2026-08-08T10:14:30.157778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.04652/citation-record","integrity":"/paper/2403.04652/integrity","json":"/paper/2403.04652/citation-record.json","paper":"/paper/2403.04652"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-08-15T06:28:09.529747Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":"2305.13245","doi":"10.48550/arxiv.2305.13245","metadata_source":"pith","pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","venue":"cs.CL","work_id":"b73ad5b2-e553-4c71-b0c9-67e67ba7b158","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:80bace3792bd099a368cb20d9f34d4dcea2249590305b027c94055e66f3aca5b","observation_id":"a0dbb8a0-7829-4616-bebe-a69e76fbf962","resolution":{"observed_at":"2026-05-13T05:47:27.805102Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:6bfaf15b43276040ffab198b4fc2f3c51e493b8ab76930a11a90a160cc92b199","observation_id":"9d83c2a6-7219-4eb8-a64e-7bf6f82e587c","resolution":{"observed_at":"2026-05-13T05:47:27.808612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen Technical Report","venue":null,"work_id":"1c21f5f5-72d8-4d70-9def-40f6d89c208b","year":null},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:cf84417d9c1287350f50988256ded65e2ff3eede198e0609c3fe23a65645556a","observation_id":"79617f2a-c5d8-41ba-b257-c4f9d3165087","resolution":{"observed_at":"2026-05-13T05:47:27.954986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:4b8fc8ee96bee04be1592b26c22700bee633ecd4f3bd4777d3175c822aa7a3d3","observation_id":"fae47672-343f-4e26-81e1-3432eac03063","resolution":{"observed_at":"2026-05-13T05:47:27.811909Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.101106+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.101106+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":"1911.11641","doi":"10.48550/arxiv.1911.11641","metadata_source":"pith","pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","venue":"cs.CL","work_id":"0d865a62-6376-4606-8d3a-eeb3b6e9ba6d","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:7b2b057e4cbde8a6e981a7b3d2b89f88db3bc674235be7cb3ec8e6f9a2902003","observation_id":"4369031a-871f-4fd1-a604-7d43a04e6879","resolution":{"observed_at":"2026-05-17T14:55:18.098549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are few-shot learners","venue":null,"work_id":"9c06112a-442e-4378-8ea7-f1e22339c0a9","year":1901},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:ca51e8c4c84ad04cad832fb772701ecce59888772de58c6cd3fe7d0a3780fdc6","observation_id":"2fe3e583-882b-462e-b1e7-92d449ae1f79","resolution":{"observed_at":"2026-05-13T05:47:27.961717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12793","last_updated":"2023-11-28T08:52:50Z","snapshot_observed_at":"2026-08-14T06:42:43.375489Z","submitted_at":"2023-11-21T18:58:11Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","version":2},"cited_work":{"arxiv_id":"2311.12793","doi":"10.48550/arxiv.2311.12793","metadata_source":"pith","pith_arxiv_id":"2311.12793","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","venue":"cs.CV","work_id":"90e2b26a-3d27-4567-86b5-929b582a8034","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2311.12793","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:7286a6ffb2afc3bbf3f0d82204399cd59333e470dffaaa266498db758802c532","observation_id":"8d0f0059-2eb1-4828-8bad-7ebbcb69dd83","resolution":{"observed_at":"2026-05-13T17:08:13.182567Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:08.932244+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:08.932244+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:c265f197dc7e3a4f163e9736a7ca6ac584f44ccdb07e019fc65455dedeeb19e9","observation_id":"40cef2d6-289a-462e-bf7e-66a1147d7f6e","resolution":{"observed_at":"2026-05-13T05:47:27.821452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QuAC : Question Answering in Context","venue":null,"work_id":"b9b6ed46-2939-41d5-830c-c66295f49b27","year":2018},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:903a9dc2e542a4170cf40ed831c7580bf743d8c5cc09237ec09203d6ea650d95","observation_id":"a1a1af9b-2338-4a03-b1d4-ef9a7c52b3fc","resolution":{"observed_at":"2026-05-13T05:47:27.967478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-08-18T19:51:48.688199Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":"2210.11416","doi":"10.48550/arxiv.2210.11416","metadata_source":"pith","pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Instruction-Finetuned Language Models","venue":"cs.LG","work_id":"8405abb1-7558-4fdf-af24-f4c52fa77a06","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:8f503ded9432067dbcf829ad2f6156bc490bcada5658fc9d1e6abde27a07e995","observation_id":"7d5b83ac-9ba8-43e4-88e7-99b37fa0c8df","resolution":{"observed_at":"2026-05-13T05:47:27.824323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","venue":null,"work_id":"aa37836e-d3ed-46e1-8cbc-5426e60cce3c","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:71aea2b7f340319c8f9b1b411bb104dbc27b4345f52614e06ef06debe2126f21","observation_id":"f03a1aba-51bb-48a5-a3a2-a7b28c2a3995","resolution":{"observed_at":"2026-05-13T05:47:27.971530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":null,"work_id":"c0ec4d67-5c3c-4c4b-9ef8-ab08521b7da3","year":2018},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:4be8c67bd6d80a675296efe11ac51c9bf1c2f7b6a085f0f9ab62c9ce85f118c8","observation_id":"2ca558dc-f72e-4bc6-aa98-36aac033474b","resolution":{"observed_at":"2026-05-13T05:47:27.973640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:a6d5ef46c106d6462251670c67d8c3e0e53c79719081c9a5b06e404a55054126","observation_id":"058b5832-f394-4c20-8e34-97d0139e8922","resolution":{"observed_at":"2026-05-13T05:47:27.827404Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Redpajama: an open dataset for training large language models","venue":null,"work_id":"19096192-f0a8-47f2-b54b-fb04ea680d9e","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:984335c4042dba4253056872f6587185d453611392a944eed9e88a57347557b1","observation_id":"7b654103-f32e-47c4-a4ba-29dd2ac13e62","resolution":{"observed_at":"2026-05-13T05:47:27.977710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"29f6921f-acaf-4202-afe5-4a4ada44f686","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:c2e7308d21b70ba11bec8d13ee72d24965b7249659c0ad6951f416244798f062","observation_id":"21b30b7a-e4f1-4841-ae7f-c0f1f719031b","resolution":{"observed_at":"2026-05-13T05:47:27.979625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":"8ca73182-5905-4a9d-ae22-f35f228ccdee","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:147e3b8834e3085330dd7de05fdaf9c5d582e693b12ef5e804724f405b9340a2","observation_id":"0a0d82bb-604a-4551-bccf-9e364c1d11f0","resolution":{"observed_at":"2026-05-13T05:47:27.981530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08153","last_updated":"2023-06-02T23:28:17Z","snapshot_observed_at":"2026-08-18T10:18:38.480459Z","submitted_at":"2022-12-15T21:35:46Z","title":"FiDO: Fusion-in-Decoder optimized for stronger performance and faster inference","version":2},"cited_work":{"arxiv_id":"2212.08153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.08153","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FiDO: Fusion-in-Decoder Optimized for Stronger Performance and Faster Inference","venue":null,"work_id":"16f259e9-8f8a-48bb-84b7-cdbc17376d80","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2212.08153","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:d8bf204dd73f6b69ffc1408f436565f3844f487ee08a02900c518d41925fc158","observation_id":"a27fb53c-9786-43b0-acc9-25052947ff99","resolution":{"observed_at":"2026-05-13T05:47:27.830620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f1b51fee-6a62-46c8-96a5-49f448a43bc3","year":2024},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:3a808b97062576923bcee646dd52892fd8ffc46d1a9cacb721c249758721a7e7","observation_id":"408e7d08-2cdf-4e74-a5c3-8ae49da9a97c","resolution":{"observed_at":"2026-05-13T05:47:27.985436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":"2208.07339","doi":"10.18653/v1/2020.findings-emnlp.314","metadata_source":"pith","pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","venue":"cs.LG","work_id":"98201f98-f4e5-4d1c-9ed7-b795e3c8f76c","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:efb05bf2678c129930a60bbc2964279d2a5d955d8e57fa504c87394da82a5b3e","observation_id":"33cf3d9f-5d66-4f3c-8b05-48ba5a71e727","resolution":{"observed_at":"2026-05-13T13:35:36.365299Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-08-18T05:06:04.678949Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":"2305.14233","doi":"10.48550/arxiv.2305.14233","metadata_source":"pith","pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","venue":"cs.CL","work_id":"5b264119-de53-49d1-b7be-d172bf51c834","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:9849ae85908b456c4fab0dd9c2d57dc7511e1648548cb35699a9ec61e49e0296","observation_id":"9cd48f2d-8ba2-44ec-b00e-9a2022d7a761","resolution":{"observed_at":"2026-05-15T17:25:08.436185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:27.379194+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:27.379194+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition","venue":null,"work_id":"c00425e8-aa98-495f-93f5-6b15c1d7b10a","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:d06a3d9b53a6ba7c4bbcf53bf962eb73c2ba173545c64eaa9fdcbc2fef763533","observation_id":"8e692070-853a-4529-b674-ffaa30ced810","resolution":{"observed_at":"2026-05-13T05:47:27.992100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hashimoto","venue":null,"work_id":"3621fb26-3ad9-4c2a-8fd2-769630e8340b","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:5005f544e11056551ce98736ecc1da93e362d627ffe357148cbe7439e4cf5bda","observation_id":"ba0c2bde-c7c8-43c5-9a84-7da308567916","resolution":{"observed_at":"2026-05-13T05:47:27.993923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10171","last_updated":"2024-02-15T18:19:16Z","snapshot_observed_at":"2026-08-21T17:34:39.398716Z","submitted_at":"2024-02-15T18:19:16Z","title":"Data Engineering for Scaling Language Models to 128K Context","version":1},"cited_work":{"arxiv_id":"2402.10171","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10171","snapshot_observed_at":"2026-07-10T20:07:33.537106Z","title":"Data engineering for scaling language models to 128k context.arXiv preprint arXiv:2402.10171","venue":"cs.CL","work_id":"3416cc4a-8e98-4b89-a696-760e86f3c718","year":2024},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2402.10171","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:9b3f43140502c2059ed78c94d423fa4443bdd5c212d59b48a2f11ac91ba6579d","observation_id":"baf6d7cf-8aaf-4064-8e1b-4d447055843d","resolution":{"observed_at":"2026-05-13T05:47:27.840811Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:9b57032e820210d5d420f884e3f41485118a0682473a660bb9041435cf8d7d9d","observation_id":"6b7fe9fd-e873-4c0c-bb54-eb89cb9aa5a2","resolution":{"observed_at":"2026-05-13T05:47:27.843867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-08-16T09:29:21.586810Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":"2209.14375","doi":"10.48550/arxiv.2209.14375","metadata_source":"pith","pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving alignment of dialogue agents via targeted human judgements","venue":"cs.LG","work_id":"6ad5970e-7550-4ae8-a158-7084dec7e3cc","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:1e603e49b17af1b092ca170ad9673d1e92a066966f959ce4e10281fca6e478aa","observation_id":"cc7489fc-2aa1-44da-acba-c1adcab5df13","resolution":{"observed_at":"2026-05-14T17:54:02.323766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-17T17:38:12.779055+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T17:38:12.779055+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering","venue":null,"work_id":"ffd898d1-0a25-4597-a621-9ffa2be168c8","year":2017},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:21a2145b90e3b28e42ff097d320ade4b41dcd4248976b5f6228eae660c49b534","observation_id":"bb5868c3-3364-43a1-8f81-1e9355e2bc15","resolution":{"observed_at":"2026-05-13T05:47:28.002624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vizwiz grand challenge: Answering visual questions from blind people","venue":null,"work_id":"a330c5c4-ec2a-4671-ba28-065193b53233","year":2018},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:f8cf87b109b4725fa63f985cb05c0afdc151fd8e9968f4a923d8b2db4fe9b63d","observation_id":"8ae34be9-71ad-406f-b122-9f8f1fd0114f","resolution":{"observed_at":"2026-05-13T05:47:28.004571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:6fef4c306d8aaae732579ca018d5a8e6ed3e8583a275b04f92d42c3485cc6f69","observation_id":"b57c01bc-4aec-4d88-9ba5-7712f7fcb94f","resolution":{"observed_at":"2026-05-13T05:47:27.850014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-08-21T04:25:41.592030Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:f2928f360345631706e119314ce502a76b03945c786766b06095a6b6c30ee351","observation_id":"3af79dc2-2e12-491e-b03f-fa44142a34a1","resolution":{"observed_at":"2026-05-13T05:47:27.853272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brown, Prafulla Dhariwal, Scott Gray, Chris Hallacy, Benjamin Mann, Alec Radford, Aditya Ramesh, Nick Ryder, Daniel M","venue":null,"work_id":"5d0a4c65-c4f0-434a-af68-2d52c513fb25","year":2020},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:c793cebf77292cf564057f41c559c68521454c93f4ec812cbc26cbd5031914cc","observation_id":"ffd954c0-0b98-49a6-98c4-cb7b1c339c55","resolution":{"observed_at":"2026-05-13T05:47:28.010599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-21T02:12:10.329412Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:33289b8370c53830b12b57ec46a3519afe3dafa4fd0d56d61c59a318808736a8","observation_id":"22adb4d1-4cce-4831-83bc-a2569fe6c6c4","resolution":{"observed_at":"2026-05-13T05:47:27.856225Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08322","last_updated":"2023-11-06T13:24:16Z","snapshot_observed_at":"2026-08-18T15:25:57.481597Z","submitted_at":"2023-05-15T03:20:19Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","version":3},"cited_work":{"arxiv_id":"2305.08322","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.08322","snapshot_observed_at":"2026-07-03T20:48:56.200978Z","title":"C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models","venue":null,"work_id":"61dc95c3-d071-4ec6-9d31-ea0610192fde","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2305.08322","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:c6bf3f7368f9777c137ec513321678c7aa3cc9e0ec7b42961735577b183e0ff4","observation_id":"7d7527ae-bf4a-4dc7-9fa9-4c718d2557fe","resolution":{"observed_at":"2026-05-13T05:47:27.859347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":"be6b4b0a-3623-48af-91af-e78e451629b0","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:2072e943986d62d759e80025a23bca0367ea4f5e98bf4f1acb6284920136ace1","observation_id":"17ba1a3a-e8e5-46f7-8f1b-1988bcb042b3","resolution":{"observed_at":"2026-05-13T05:47:28.016685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openclip, July 2021","venue":null,"work_id":"bebb36fb-9c24-4d32-a9c6-3cffafddfadc","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:1088916514c5a702b4ecb3f2cad49d7fe663289ef9b1a4b1e78b413efee0dc7c","observation_id":"1d402539-ce5c-46a8-bb90-5a1c7e6ea8fc","resolution":{"observed_at":"2026-05-13T05:47:28.018515Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05914","last_updated":"2023-10-10T17:31:00Z","snapshot_observed_at":"2026-08-16T14:53:43.691157Z","submitted_at":"2023-10-09T17:58:34Z","title":"NEFTune: Noisy Embeddings Improve Instruction Finetuning","version":2},"cited_work":{"arxiv_id":"2310.05914","doi":"10.48550/arxiv.2310.05914","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05914","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NEFTune : Noisy Embeddings Improve Instruction Finetuning","venue":"arXiv (Cornell University)","work_id":"a5c7d504-9519-4bd7-b5a7-49460d0384d6","year":2024},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2310.05914","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:16061c5b1fac3b0ab9d68963587989f5531d7602b6caba71e5e4bc2e113733c7","observation_id":"43d792c1-e18d-4696-a274-fe211cd47b07","resolution":{"observed_at":"2026-05-13T05:47:27.862233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset","venue":null,"work_id":"60736644-cb2d-47e5-a2ad-ba29e41a33c4","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:88ec9af5e8424501098192d349a05d97c5e887fa380ca6c64fc722c2d8050fcb","observation_id":"8dfe5b25-974f-48f3-9b10-4d3ae3e9b0d5","resolution":{"observed_at":"2026-05-13T05:47:28.022510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":"4f6c1fff-75e1-4109-85a5-56b751f5ec71","year":2020},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:9a34693f5ba15da079b7a4e80d852489876210354ea39455b94c221bebec629e","observation_id":"1d1df740-5dd9-4261-af39-d16921e3c4a6","resolution":{"observed_at":"2026-05-13T05:47:28.024713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Referitgame: Referring to objects in photographs of natural scenes","venue":null,"work_id":"3a481a51-b457-4215-af63-706d36916e7f","year":2014},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:41f9489dc6561f3fe0a9bc6b78c5fa557d5183650fb6efa0f4553f3822ce2694","observation_id":"017ae0f5-ad7b-4cab-bc5b-76fb21245cf8","resolution":{"observed_at":"2026-05-13T05:47:28.026695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solar 10.7b: Scaling large language models with simple yet effective depth up-scaling","venue":null,"work_id":"063833f4-f754-491f-93cc-4b8281c3d4bb","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:3c5ec954bd79cc8d9882f0bd0ab6c14017f02747e0ad37a5c548c0a1422b1273","observation_id":"db19ad2a-8230-4851-9186-dab4c57063a5","resolution":{"observed_at":"2026-05-13T05:47:28.028437Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual genome: Connecting language and vision using crowdsourced dense image annotations","venue":null,"work_id":"a72cdc52-ebe2-4214-8c4b-ae8f11c198b0","year":2017},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:41846ae20b94a61991922a6c161be12cc3838f7975b5af063c67fad572a975b7","observation_id":"df3a2eb6-da0d-42ae-babf-70a6c420319a","resolution":{"observed_at":"2026-05-13T05:47:28.030145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06226","last_updated":"2018-08-19T16:49:06Z","snapshot_observed_at":"2026-07-06T06:56:20.935388Z","submitted_at":"2018-08-19T16:49:06Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for Neural Text Processing","version":1},"cited_work":{"arxiv_id":"1808.06226","doi":"10.18653/v1/d18-2012","metadata_source":"doi_reference","pith_arxiv_id":"1808.06226","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Sentencepiece: A simple and language independent subword tokenizer and detokenizer for neural text processing","venue":"cs.CL","work_id":"81a6320b-c2e1-4d74-a03e-9e1ff6bbed8d","year":2018},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/1808.06226","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:30f94ed02cc4e8ec469a6dc819140467f98d9ad4aee01d634b78c7648faa744c","observation_id":"92abbc8c-e40f-4bad-9b79-e95e606fa5d8","resolution":{"observed_at":"2026-05-13T05:47:27.865215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-11T12:19:12.876508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T12:19:12.876508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":"2309.06180","doi":"10.18653/v1/2024.emnlp-main.20","metadata_source":"pith","pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","venue":"cs.LG","work_id":"0eb5eca2-2c11-4a77-a25a-18c331a50ed2","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:e2e9c14abed934835b031f4d9583378b54d6f2bc2a20579009da76f0f0675224","observation_id":"e90940b9-37a1-46b0-bbfb-bbd9e07b8577","resolution":{"observed_at":"2026-05-13T05:47:27.868094Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":"2306.09212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-06-29T19:43:55.030793Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","venue":"cs.CL","work_id":"30c9ec62-1af0-4f30-94b4-d1ef163eff71","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:75e500f12b5591c473758e221a60605eacfa147eda41f98914b2dd1965474f5c","observation_id":"f9c88327-88c0-461a-a72c-311d8a9422fb","resolution":{"observed_at":"2026-05-16T21:01:11.049549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.13120","last_updated":"2022-05-21T06:03:54Z","snapshot_observed_at":"2026-08-21T08:30:55.898402Z","submitted_at":"2021-05-26T13:40:58Z","title":"Sequence Parallelism: Long Sequence Training from System Perspective","version":3},"cited_work":{"arxiv_id":"2105.13120","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.13120","snapshot_observed_at":"2026-07-04T09:39:46.806179Z","title":"arXiv preprint arXiv:2105.13120 , year=","venue":null,"work_id":"ed001793-ff39-4794-be7b-212c2a1f4de1","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2105.13120","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:7ce609483b5d2fdbd174f4374425a65a8a0004d7b64b7aa695ec40879740c5b5","observation_id":"664367ad-fd64-46f2-95fe-9a4d17909af8","resolution":{"observed_at":"2026-05-13T05:47:27.874603Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hashimoto","venue":null,"work_id":"885dc18a-4cbf-4307-b726-a7adda854b61","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:3ae51032ca65ed38716c11d100b07921e2e12cbe7062db9faf9b72f1f5e0a915","observation_id":"722f2d67-df20-4425-bba6-e88e7aa2caa3","resolution":{"observed_at":"2026-05-13T05:47:28.039907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chinese llava","venue":null,"work_id":"fbd73419-3924-43da-88ed-fa85fabba8e5","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:09b8a1a7b645dd1a0eb895dd10971365a9d266d95179156a27953360dfe261a4","observation_id":"394b3c85-89d4-4afc-8ace-0bee9a0dbc37","resolution":{"observed_at":"2026-05-13T05:47:28.041562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-08-15T02:35:59.111911Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2310.03744","doi":"10.48550/arxiv.2310.03744","metadata_source":"pith","pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improved Baselines with Visual Instruction Tuning","venue":"cs.CV","work_id":"5baeaa33-5986-44a3-85a4-fcabd6fc1e8d","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:9fee0986453ad1b9438988d9fd567acbadad1a0f5bb639000579023074619886","observation_id":"de29601b-7e17-4358-b3b3-24a1dd73a06d","resolution":{"observed_at":"2026-05-13T05:47:27.877237Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2304.08485","doi":"10.48550/arxiv.2304.08485","metadata_source":"pith","pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual Instruction Tuning","venue":"cs.CV","work_id":"68be622d-a6dc-4a13-82de-e3054a3dc509","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:6d509c40a78302e0f6736d96dc3bce2e28c92b59ea2d6fa46d0276823692f242","observation_id":"36eabc17-67b7-4e69-85fc-adeecc9a48d6","resolution":{"observed_at":"2026-05-13T05:47:27.879715Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:44.742124+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:44.742124+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15685","last_updated":"2024-04-16T02:46:58Z","snapshot_observed_at":"2026-08-18T20:34:13.372074Z","submitted_at":"2023-12-25T10:29:28Z","title":"What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2312.15685","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.15685","snapshot_observed_at":"2026-07-03T08:17:45.507249Z","title":"What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning","venue":null,"work_id":"bf928949-0348-46a2-b106-7fdc5ab7d707","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2312.15685","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:022fff2f8c481057938393f57932c13d545c21a78afb1c92bca5316352e85d5e","observation_id":"39b7a24c-ea35-4a4c-b8cb-0115e76f93b3","resolution":{"observed_at":"2026-05-13T05:47:27.882957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"#instag: Instruction tagging for analyzing supervised fine-tuning of large language models","venue":null,"work_id":"fe018c0c-9e95-4c6d-98ac-ceb971865515","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:03948d97e12c44bc67b8d1b70343390e319e074b29fe2df0b2f71d387484c78f","observation_id":"dddb51c6-e48f-4b14-ab5b-62fa2c70c3b2","resolution":{"observed_at":"2026-05-13T05:47:27.953074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","venue":null,"work_id":"675e9e98-1555-40f5-868f-b2c16fa05a52","year":2018},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:a19d552869942ca3b7c1abb85f416303f5ea17b952e6f2c0195049be4165b705","observation_id":"5e1fb70e-7b90-404f-bcff-c0695552efdb","resolution":{"observed_at":"2026-05-13T05:47:27.957329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ocr-vqa: Visual question answering by reading text in images","venue":null,"work_id":"baf050f8-c816-41e9-8f39-a915d9993a6e","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:6f13c562c78bdd36e4732b25041640041d8cfab5a900c7369dd3f52a48dfa9bc","observation_id":"e4553f09-8e1d-4a65-be5f-1fcce818a81f","resolution":{"observed_at":"2026-05-13T05:47:27.959579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09400","last_updated":"2023-09-17T23:49:10Z","snapshot_observed_at":"2026-08-19T23:22:07.740848Z","submitted_at":"2023-09-17T23:49:10Z","title":"CulturaX: A Cleaned, Enormous, and Multilingual Dataset for Large Language Models in 167 Languages","version":1},"cited_work":{"arxiv_id":"2309.09400","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.09400","snapshot_observed_at":"2026-07-04T13:39:51.301876Z","title":"arXiv preprint arXiv:2309.09400 , year=","venue":null,"work_id":"8ace9395-f797-4723-bb48-457877fc745c","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2309.09400","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:b16e30f8429808d45e7ee1f3a7691fda1aec1d2162d5b82e2097654c45970ee1","observation_id":"ca0e8629-1ad9-4c67-808a-1fe0e87f714d","resolution":{"observed_at":"2026-05-13T05:47:27.886303Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ChatML","venue":null,"work_id":"5707f06a-67d3-48ec-9382-824f1f6f3e6a","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:ce255e7e5acb566bc812021a9679f4134f55e8f2bc248958b81dc721d8fe66aa","observation_id":"13316005-3745-41ec-9b31-c00f550be006","resolution":{"observed_at":"2026-05-13T05:47:27.965606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training Language Models to Follow Instructions with Human Feedback","venue":null,"work_id":"2ad50b6a-08e5-4bf0-937b-85e7f14407d8","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:a0f77c4d9f141492e5c3d914c9e86bc71501566c0080357762a8913558c1118f","observation_id":"0df04795-50a1-4d0d-b623-fb91bc174085","resolution":{"observed_at":"2026-05-13T05:47:27.969486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testing language models on a held-out high school national finals exam","venue":null,"work_id":"272eac7b-e9fe-4d29-9555-c718b7ae2de0","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:ae34c4d7cb45bf50643f2642119a333756d2ad82f4ed0a8d396de8e2efed1856","observation_id":"bc65436d-e382-4a56-b870-b1db090aed4b","resolution":{"observed_at":"2026-05-13T05:47:27.975683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","venue":null,"work_id":"fe205673-79c1-4339-ba7d-7d2964e44f4c","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:e0bcdefea441b8fe52d62446f36b1e5ef12c44ad47d97f84e22aa114e79f30fc","observation_id":"7c71bd78-8f50-4e2b-95ee-6d18dd1d86b1","resolution":{"observed_at":"2026-05-13T05:47:27.983641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficiently Scaling Transformer Inference","venue":null,"work_id":"5a5ca9cb-c9fa-4991-b147-804f1f10efd3","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:97623ee909d060d962100e87cffafb2d0f9bb295199605b0dd20ab4fdf51b9e0","observation_id":"5bbd85e4-054c-43da-9fc2-1bedb5554eb2","resolution":{"observed_at":"2026-05-13T05:47:27.987464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:bc6695e21d9b3e0584895ee5e00d4730d02df6e427684a50da930d17a67c3893","observation_id":"ecfc47b0-0a3a-460f-943c-7e44864bdde7","resolution":{"observed_at":"2026-05-13T05:47:27.889143Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":"2305.18290","doi":"10.48550/arxiv.2305.18290","metadata_source":"pith","pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","venue":"cs.LG","work_id":"62105b61-411f-46e5-970a-bd322c6adbbc","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:6e896a454f0ba3e5e75dc06ff21919495156a0c728a59d8991a50065ebc29f48","observation_id":"3e078a7b-0117-4d27-99cb-0508ca7af9ef","resolution":{"observed_at":"2026-05-13T05:47:27.892176Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:26.462363+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:26.462363+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ZeRO: Memory Opti- mizations Toward Training Trillion Parameter Models","venue":null,"work_id":"09beb548-a9b8-47c4-a49b-ce53241354e8","year":2020},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:6a5aafd7dafd8d43876998ddb45b34bc21a780d8a122e5d48e3d52f11cef8d59","observation_id":"0b90fcc1-e5cc-4108-afc0-b0567f1ad204","resolution":{"observed_at":"2026-05-13T05:47:27.998265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","venue":null,"work_id":"bb91067a-1cb8-4e79-9742-f0892dcdd461","year":2016},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:8cff4de218588fa254956e2093c1b52948ee33c2605101ddadbff4af045a37bd","observation_id":"1d32d981-eaf7-4047-a6f0-84f11a2225fe","resolution":{"observed_at":"2026-05-13T05:47:28.000569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","venue":null,"work_id":"0c5039b0-15ff-4649-b89e-8e2a0b5520a2","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:f8a595e43ee71fa541c978630c86276f3e98064aac1218c8558cf2b6c0cfe3cb","observation_id":"21e76b0d-3c24-40a1-a017-9f5d496573a6","resolution":{"observed_at":"2026-05-13T05:47:28.006543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","venue":null,"work_id":"f56a3cf3-4b19-46e7-a1ce-f64059ff1efc","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:368dc50f047641583f31f14ac7d48ebf6660b79c1008788ad1a5ad1d3d958d4b","observation_id":"2e65316e-f5a3-4f70-9133-7a31b73f9d47","resolution":{"observed_at":"2026-05-13T05:47:28.008561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00448","last_updated":"2025-04-14T10:11:13Z","snapshot_observed_at":"2026-08-16T14:30:39.251880Z","submitted_at":"2023-12-31T10:53:58Z","title":"Beyond Chinchilla-Optimal: Accounting for Inference in Language Model Scaling Laws","version":3},"cited_work":{"arxiv_id":"2401.00448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.00448","snapshot_observed_at":"2026-07-04T20:40:07.770901Z","title":"Beyond chinchilla-optimal: Ac- counting for inference in language model scaling laws","venue":null,"work_id":"9d425a0e-4f3c-4f59-8aaa-7d767450104a","year":2024},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2401.00448","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:659242dd3f74623ded46abbbb7f242b8324f69d7ebbbfc0f2629e464ec342b8d","observation_id":"5e56535c-c3b9-44c4-9cbb-3e9a27f780ac","resolution":{"observed_at":"2026-05-13T05:47:27.895334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are emergent abilities of large language models a mirage? Advances in Neural Information Processing Systems , 36","venue":null,"work_id":"1e3f35f3-54f8-4c75-b28d-db5474cb01b9","year":2024},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:c283b10042f15636e31728dd409004852c1b8684518621675585a3765f671733","observation_id":"a26a0a6f-840b-4991-99b2-8b866c572132","resolution":{"observed_at":"2026-05-13T05:47:28.014618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":"2111.02114","doi":"10.48550/arxiv.2111.02114","metadata_source":"pith","pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","venue":"cs.CV","work_id":"fbf16034-512e-4dd9-a0bd-7ddd23f532a6","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:f22b94165eddb9b5074acb40f5d2b1c0214665274a2339d0afda8316f51a645b","observation_id":"6a78b98f-dead-4b10-9117-9c0fa818c9e6","resolution":{"observed_at":"2026-05-13T05:47:27.898133Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:40.426779+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:40.426779+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":"1911.02150","doi":"10.48550/arxiv.1911.02150","metadata_source":"pith","pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","venue":"cs.NE","work_id":"160ea164-b1d4-4adb-8ccb-a4655d8a0bb4","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:1bb43dfa9159049c01f3a66f569beabd6102055f2ced517d220e55732ecad33f","observation_id":"b8d48b9d-334a-4fc2-8d18-5b69db20471b","resolution":{"observed_at":"2026-05-13T05:47:27.900790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:fbc1c8e6453df9d614e504a32326a151deb5db703a8e5555a9136eabf97c8f63","observation_id":"1012f5ea-68d0-4da6-8d74-298e9d7e74c8","resolution":{"observed_at":"2026-05-13T05:47:27.903486Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Byte Pair Encoding: A Text Compression Scheme That Accelerates Pattern Matching","venue":null,"work_id":"51590148-539a-4995-b5d9-c34b52d95fa6","year":1999},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:68487006f9b9a029a01d19ffbdb9032cd558416ccea09e8ab9007cf1c86a91ef","observation_id":"6b7c737a-8ecd-407f-9b0e-dfcd9822ba6c","resolution":{"observed_at":"2026-05-13T05:47:28.035174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":"1909.08053","doi":"10.48550/arxiv.1909.08053","metadata_source":"pith","pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","venue":"cs.CL","work_id":"c888e6d1-0b1d-43d6-9ef5-f0912a0efa1b","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:b3a8dd92ce11a093dcd25cebff9f57ca5c4a9456c67a1f5b24b3b6457d0c5dfd","observation_id":"e2b0f7d1-b5ba-46c8-9814-668b885c69de","resolution":{"observed_at":"2026-05-13T05:47:27.906266Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Textcaps: a dataset for image captioning with reading comprehension","venue":null,"work_id":"3f1ffde9-e0f0-4636-99e7-796f7825522b","year":2020},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:e0318433d4d682d857f464ecc7249ebfc5e86d4451b08fb2239f638799fc9d3a","observation_id":"b6cc0bcc-cf24-434c-9b84-0540a31999d8","resolution":{"observed_at":"2026-05-13T05:47:28.043307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brown, Adam Santoro, Aditya Gupta, Adrià Garriga-Alonso, Ag- nieszka Kluska, Aitor Lewkowycz, Akshat Agarwal, Alethea Power, Alex Ray, Alex Warstadt, Alexander W","venue":null,"work_id":"2bf1771d-29b0-406e-92a1-dfe62fc1c1ea","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:7d9dc1a0d9262fd0103422fa0c9b07e6fe8167a605d18227a958bc8ef33b09ce","observation_id":"fdc97de7-0308-4492-b415-3aefef354a2e","resolution":{"observed_at":"2026-05-13T05:47:27.948678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-17T06:56:20.644738Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":"2104.09864","doi":"10.48550/arxiv.2104.09864","metadata_source":"pith","pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","venue":"cs.CL","work_id":"4e5eee26-cd04-4c7a-988f-3e6d1a1f0eb9","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:9458a50592e9881997d8dc052d76ddf2e14153a968bb0b10a019ef14bd647676","observation_id":"fdaed6dc-bfc8-4ff8-849d-d8d94ce1015b","resolution":{"observed_at":"2026-05-13T05:47:27.909138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:39.263809+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:39.263809+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-08-21T02:25:44.454471Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":"2210.09261","doi":"10.48550/arxiv.2210.09261","metadata_source":"pith","pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","venue":"cs.CL","work_id":"513eb205-04ca-4722-9a43-a74e8cbe7e85","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:98ebe30e5d6fdaf4bad051d0ccb43ca45cdf957a4079e998451d8c8975a0e7f3","observation_id":"8072bf01-20ef-4a54-8a5f-ed70093276c1","resolution":{"observed_at":"2026-05-13T05:47:27.911955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CommonsenseQA: A Question Answering Challenge Targeting Commonsense Knowledge","venue":null,"work_id":"c5828eb0-f50f-476f-8644-38f4e3a8542b","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:9d5c24767b7af6ff635239909048a26228e3b5d74e7353c18d4867f1ff1837c8","observation_id":"9beaa40f-6a95-43c1-a4ee-b1bddf6d9cbe","resolution":{"observed_at":"2026-05-13T05:47:27.989707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:bea285ae098c60539c88f89157e799d4e1106b5a8d5a286c134e7c43e5c94e3e","observation_id":"5afa7a2b-9cc2-4dd5-a75e-9897d5a0c50d","resolution":{"observed_at":"2026-05-13T05:47:27.914524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":null,"work_id":"30a5cc78-cd63-4f94-bc54-2a12ff7568fb","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:a725e77bab6f0fa81678a46129d49688cd00808b63dbe2901341dcfdfdb4f9a7","observation_id":"5b235c71-fea1-4b93-9b35-7abcd5d19d83","resolution":{"observed_at":"2026-05-13T05:47:28.012590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-08-19T04:42:40.974785Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":"1706.03762","doi":"10.1186/s13550-021-00830-6","metadata_source":"pith","pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention Is All You Need","venue":"cs.CL","work_id":"baafb5a2-5272-43bc-932f-09fa9ffe5316","year":2017},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:64f47d782d90e7bb170da492c40aa7c8f0b3863cef6ec818622e4dfa901afc3a","observation_id":"ffac86c6-698a-4606-8842-9192e64e2f09","resolution":{"observed_at":"2026-05-13T05:47:27.917446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00359","last_updated":"2019-11-15T00:03:54Z","snapshot_observed_at":"2026-08-23T00:25:14.435586Z","submitted_at":"2019-11-01T13:09:28Z","title":"CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data","version":2},"cited_work":{"arxiv_id":"1911.00359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1911.00359","snapshot_observed_at":"2026-06-28T17:02:24.078563Z","title":"Ccnet: Extracting high quality monolingual datasets from web crawl data","venue":null,"work_id":"337d24d8-4930-4d71-8336-b3a9a65537b8","year":2020},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/1911.00359","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:340c902815d6339e616c6a145f3a861e322189f6ca3221a92a15f2432446a9da","observation_id":"0fc3d07e-10cb-4433-b4ff-e7a1743f9cea","resolution":{"observed_at":"2026-05-13T05:47:27.920584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12017","last_updated":"2023-05-30T21:32:11Z","snapshot_observed_at":"2026-08-16T15:59:35.609963Z","submitted_at":"2023-01-27T22:44:18Z","title":"Understanding INT4 Quantization for Transformer Models: Latency Speedup, Composability, and Failure Cases","version":2},"cited_work":{"arxiv_id":"2301.12017","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.12017","snapshot_observed_at":"2026-07-01T15:45:48.753174Z","title":"Understanding int4 quantization for transformer models: Latency speedup, composability, and failure cases","venue":null,"work_id":"3214f97e-3ba9-4705-be1c-1aaef0d07347","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2301.12017","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:de7816a484506059ac971e6654e5ec5f32695958934aa9fc9d2b59c2eee85ab7","observation_id":"a5f95e1d-1a70-40d1-b2b4-357946b8c537","resolution":{"observed_at":"2026-05-13T05:47:27.923565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16039","last_updated":"2023-11-14T01:40:13Z","snapshot_observed_at":"2026-08-20T13:21:39.822808Z","submitted_at":"2023-09-27T21:41:49Z","title":"Effective Long-Context Scaling of Foundation Models","version":3},"cited_work":{"arxiv_id":"2309.16039","doi":"10.48550/arxiv.2309.16039","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.16039","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A., Oguz, B., et al","venue":"arXiv (Cornell University)","work_id":"100ca4eb-be6f-4510-9c7f-bbb24f10d946","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2309.16039","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:0684563e72dc3c980f2a49af06b47edaddc12b64e6183b813f7c6623c0989bfb","observation_id":"de159343-96e4-44b2-b362-1894086c305c","resolution":{"observed_at":"2026-05-13T05:47:27.926738Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":"2304.12244","doi":"10.48550/arxiv.2304.12244","metadata_source":"pith","pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","venue":"cs.CL","work_id":"fc22911b-0900-4ad2-b106-337f13279965","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:efff8902992a8d51c48e90abf6968ac8d82a8c481aadee5d0b497be240ce45a4","observation_id":"a25b119c-9c10-4584-b8e0-b8ee3ca4f3b4","resolution":{"observed_at":"2026-05-13T07:28:25.169141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10305","last_updated":"2025-04-17T08:34:42Z","snapshot_observed_at":"2026-08-14T19:59:05.307983Z","submitted_at":"2023-09-19T04:13:22Z","title":"Baichuan 2: Open Large-scale Language Models","version":4},"cited_work":{"arxiv_id":"2309.10305","doi":"10.48550/arxiv.2309.10305","metadata_source":"pith","pith_arxiv_id":"2309.10305","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Baichuan 2: Open Large-scale Language Models","venue":"cs.CL","work_id":"9ba8f898-3900-4776-b82e-11e767a86ba9","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2309.10305","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:312f35b6e68dd1f4f4332329e40c1a49d1c87ec9660c0a5d20e8f03fb804c32b","observation_id":"b5d8ebc6-8564-4744-ad2b-1366a98d1796","resolution":{"observed_at":"2026-05-13T05:47:27.933467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T16:25:58.81351+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T16:25:58.81351+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From image descriptions to visual denotations: New similarity metrics for semantic inference over event descriptions","venue":null,"work_id":"8c64c78a-8525-4570-a28f-244984e5291e","year":2014},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:872b244c45571c3412fbec4dbf102746ae94e34a18da600ac50b5573ca56edef","observation_id":"ebb803db-71da-4e21-8925-29d6deb62fc5","resolution":{"observed_at":"2026-05-13T05:47:27.995999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orca: A Distributed Serving System for Transformer-Based Generative Models","venue":null,"work_id":"33962809-3024-4427-89fa-c8cdf644ccc4","year":2022},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:dc361d19ed14d8f12534fe5838ad96e315ea83784a501819b3ca51676a6c6ae1","observation_id":"be5f0bb1-e317-4b68-82e9-60b9850e513e","resolution":{"observed_at":"2026-05-13T05:47:28.020451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11193","last_updated":"2024-12-12T05:55:44Z","snapshot_observed_at":"2026-08-21T02:05:26.979512Z","submitted_at":"2023-12-18T13:40:16Z","title":"Training With \"Paraphrasing the Original Text\" Teaches LLM to Better Retrieve in Long-context Tasks","version":10},"cited_work":{"arxiv_id":"2312.11193","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.11193","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Paraphrasing the original text makes high accuracy long-context qa","venue":null,"work_id":"e206ebc7-df6c-46fb-8ba7-d4b1f4bd2d8b","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2312.11193","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:b1827f1d52e87c1fc38787f0979baf63b9e650408ea1f61dd19f7698556dd3b5","observation_id":"dd81c24f-d5cd-4bec-bde2-87cec8536132","resolution":{"observed_at":"2026-05-13T05:47:27.936524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14742","last_updated":"2023-03-26T14:49:37Z","snapshot_observed_at":"2026-08-18T13:39:27.365539Z","submitted_at":"2023-03-26T14:49:37Z","title":"Exploring the Impact of Instruction Data Scaling on Large Language Models: An Empirical Study on Real-World Use Cases","version":1},"cited_work":{"arxiv_id":"2303.14742","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14742","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring the impact of instruction data scaling on large language models: An empirical study on real-world use cases.arXiv preprint arXiv:2303.14742","venue":null,"work_id":"e3490ee0-56f9-4dde-86bb-77502eaf21de","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2303.14742","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:526f44374cebd06cb7746e87617bb670b8559cbf2a6e3e5fcfc7988016c5a1df","observation_id":"e9f25dd6-cf6a-401f-a789-9f0f8f2f59bb","resolution":{"observed_at":"2026-05-13T05:47:27.939685Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","venue":null,"work_id":"fbdda63b-c4e7-4871-95b9-336d3a4fb297","year":2019},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:34247795ae94daa556eea10865b32dc10dcc1529b927d46652f542f5027e9de5","observation_id":"16ad0aa6-bfa3-4c22-90d6-62fd24ae7fd6","resolution":{"observed_at":"2026-05-13T05:47:28.037859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12474","last_updated":"2024-02-24T15:44:21Z","snapshot_observed_at":"2026-08-08T08:58:54.609425Z","submitted_at":"2023-05-21T14:39:28Z","title":"Evaluating the Performance of Large Language Models on GAOKAO Benchmark","version":3},"cited_work":{"arxiv_id":"2305.12474","doi":"10.48550/arxiv.2305.12474","metadata_source":"pith","pith_arxiv_id":"2305.12474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating the Performance of Large Language Models on GAOKAO Benchmark","venue":"cs.CL","work_id":"2eacfa63-8867-4a90-9bcc-52f085f33cef","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2305.12474","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:26b9af0d550158970bca4ea89ebfe0033a84440dac559d31ae68c532289882bf","observation_id":"1cd82ad0-a844-4020-973b-484bf5de6693","resolution":{"observed_at":"2026-05-17T12:28:32.509177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17107","last_updated":"2024-02-02T19:44:14Z","snapshot_observed_at":"2026-08-17T21:31:00.017761Z","submitted_at":"2023-06-29T17:08:16Z","title":"LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding","version":2},"cited_work":{"arxiv_id":"2306.17107","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.17107","snapshot_observed_at":"2026-07-04T15:39:56.491911Z","title":"Llavar: Enhanced visual instruction tuning for text-rich image understanding","venue":null,"work_id":"dd29277b-f960-4169-9950-f29ae3062657","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2306.17107","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:62b1b421f4af2ad044abb1478a1c88fa60f3fe08ef5514bbe323675a7264c048","observation_id":"da761b21-bc1c-4309-9a6b-0202105cea7a","resolution":{"observed_at":"2026-05-13T05:47:27.946357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":"2c8e55e3-5b8e-42c6-8dfc-792960b58808","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:e239c9ea505c65e7998b477e2f9b2508ddb6245a1d7fcf5665cfe8ac13321c47","observation_id":"dcd9718b-7f07-4248-89dc-791f8e6a89ef","resolution":{"observed_at":"2026-05-13T05:47:28.031987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"P Xing, Hao Zhang, Joseph E","venue":null,"work_id":"2eedcea0-e5cc-490c-be7d-72a5ae9c31b0","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:44ca4f1f1b126b10417445e936cab7fd346a73ea0443f01bf151d66bd7c7cd58","observation_id":"b3672111-00a9-428c-b771-2e172977531e","resolution":{"observed_at":"2026-05-13T05:47:28.033541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lima: Less is more for alignment","venue":null,"work_id":"183bc70e-098b-4047-a07f-ee7421212f88","year":2023},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:13fe0b97823980a0eb2c5c8196cbe22e3aab4da613459fd10d7e24e11cbdfd0d","observation_id":"ecd0c350-b2b1-47e6-997b-66c402ca9dc0","resolution":{"observed_at":"2026-05-13T05:47:27.950904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual7w: Grounded question answering in images","venue":null,"work_id":"5f2ef926-1283-46b2-9460-67948cff88ca","year":2016},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:d04a3b61114d02caf26afaf34f9c533d2e73446a8fb1b4e495302b8db026e3b9","observation_id":"d5429822-3708-4a9a-977e-40f29c884378","resolution":{"observed_at":"2026-05-13T05:47:27.963692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":2,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":1,"verified_exact":43,"verified_fuzzy":45},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 100 inbound Pith citation observations for arXiv:2403.04652."}