{"as_of":"2026-08-04T12:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:856f26f91df621ab53e32069106da90d616fad4c59184cee907a70f5474ad6fd","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T19:26:38.134505Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T20:34:28.858967Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T21:36:14.566726Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"cited_work":{"arxiv_id":"2604.03044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.03044","snapshot_observed_at":"2026-07-01T21:36:14.566726Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","venue":"cs.CL","work_id":"513d7fc3-8926-4cde-86db-548bac69e7c4","year":2026},"citing_paper":{"arxiv_id":"2604.18264","last_updated":"2026-04-20T13:37:31Z","snapshot_observed_at":"2026-07-06T23:05:08.728446Z","submitted_at":"2026-04-20T13:37:31Z","title":"Universally Empowering Zeroth-Order Optimization via Adaptive Layer-wise Sampling","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-10T04:51:12.358148Z"},"links":{"cited_paper":"/paper/2604.03044","citing_paper":"/paper/2604.18264"},"observation_digest":"sha256:38ae0fb448a931e3fb39efa4ad61df4651f2b1dc96355caca3081ba56559a506","observation_id":"c8c4e32a-6565-4346-a612-2693255b91d2","resolution":{"observed_at":"2026-05-10T11:30:19.688165Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"cited_work":{"arxiv_id":"2604.03044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.03044","snapshot_observed_at":"2026-07-01T21:36:14.566726Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","venue":"cs.CL","work_id":"513d7fc3-8926-4cde-86db-548bac69e7c4","year":2026},"citing_paper":{"arxiv_id":"2605.05696","last_updated":"2026-05-07T05:36:03Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:36:03Z","title":"Irminsul: MLA-Native Position-Independent Caching for Agentic LLM Serving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T05:37:02.419657Z"},"links":{"cited_paper":"/paper/2604.03044","citing_paper":"/paper/2605.05696"},"observation_digest":"sha256:ba8ab5ec3c52e7826e8a3ba11e390df189bd5be38baa67bea67f291822bd44e1","observation_id":"1a2d61d0-5b94-497a-a259-be904b1c18fd","resolution":{"observed_at":"2026-05-11T21:26:16.415364Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"cited_work":{"arxiv_id":"2604.03044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.03044","snapshot_observed_at":"2026-07-01T21:36:14.566726Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","venue":"cs.CL","work_id":"513d7fc3-8926-4cde-86db-548bac69e7c4","year":2026},"citing_paper":{"arxiv_id":"2606.01065","last_updated":"2026-05-31T07:13:15Z","snapshot_observed_at":"2026-07-06T23:41:39.172310Z","submitted_at":"2026-05-31T07:13:15Z","title":"Leyline: KV Cache Directives for Agentic Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T16:51:08.114092Z"},"links":{"cited_paper":"/paper/2604.03044","citing_paper":"/paper/2606.01065"},"observation_digest":"sha256:f8830634e5baf9a1fc595d966d700bf767615aa5543a9660dbf21efc7dcbfeb8","observation_id":"0d40cc4a-4f5f-44ac-a5f5-2b7cf2996fcc","resolution":{"observed_at":"2026-07-01T21:36:14.568185Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.03044","snapshot_observed_at":"2026-07-30T20:34:28.858967Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26805","last_updated":"2026-07-29T11:47:51Z","snapshot_observed_at":"2026-08-02T16:29:06.828767Z","submitted_at":"2026-07-29T11:47:51Z","title":"MRCoder: An Efficient Context Selecting Approach for Repository-Level Code Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T20:34:28.858967Z"},"links":{"cited_paper":"/paper/2604.03044","citing_paper":"/paper/2607.26805"},"observation_digest":"sha256:a8f159f5ae6cde3d48cc97e89e225ed0988878bf56ccd8a36eef12e295c6f088","observation_id":"c84704a2-18b0-48fb-a694-996c7be275fe","resolution":{"observed_at":"2026-07-30T20:34:28.858967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.03044/citation-record","integrity":"/paper/2604.03044/integrity","json":"/paper/2604.03044/citation-record.json","paper":"/paper/2604.03044"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.05722","last_updated":"2026-06-03T04:35:07Z","snapshot_observed_at":"2026-08-03T23:27:34.692491Z","submitted_at":"2025-11-07T21:29:41Z","title":"OckBench: Measuring the Efficiency of LLM Reasoning","version":3},"cited_work":{"arxiv_id":"2511.05722","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.05722","snapshot_observed_at":"2026-07-04T19:40:07.144621Z","title":"Ockbench: Measuring the efficiency of llm reasoning","venue":"cs.CL","work_id":"f4367694-a1b2-42b5-a4c6-3176572fd0bf","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2511.05722","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:d678fb603a9940ca0861e73b02c259d657a8b5d5b56ae995f929fc3fde63a10b","observation_id":"e83c1682-8d36-4c0a-a63f-31753a58a7cc","resolution":{"observed_at":"2026-06-04T02:07:06.076524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:b72b5a45232c2cbdabfb7957735d7a4ea38ac5a78e4ffcc6af4f37999fa14759","observation_id":"4f66751f-7304-402c-ac92-e7fcbbf8b419","resolution":{"observed_at":"2026-05-13T19:28:09.765071Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":"2405.04434","doi":"10.1145/3593013.3594097","metadata_source":"pith","pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","venue":"cs.CL","work_id":"1e1df141-cac8-47fd-b068-c4c96e51e331","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:dcbdf5297b080c293fc761167cbcf42e50b999a22b95b034bb74a34205b62fc7","observation_id":"93e4d977-8e23-4a82-877d-cf763e0a796a","resolution":{"observed_at":"2026-05-13T19:28:09.760926Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glm-4.5: Agentic, reasoning, and coding (arc) foundation models","venue":null,"work_id":"aa602fa1-71a4-4c31-bb1d-759b33b33da6","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:282820f915d6d2724c3cfb0b233915418e50c2700992474772bb0f544ff621df","observation_id":"b2eb55c2-bba2-45a9-9d74-28cb90a250d1","resolution":{"observed_at":"2026-05-13T19:28:10.545411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3-30b-a3b-instruct-2507, July 2026","venue":null,"work_id":"2285dfad-8cd0-4790-b46e-a64192cf69cf","year":2026},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:816202e8a8140b24ca3ec7889a858a085e8434d7e891a4e2ae11b4ef3ac53b71","observation_id":"ff979b09-f5cf-44db-8f4b-3bfb5f548407","resolution":{"observed_at":"2026-05-13T19:28:10.547238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:17:26.778855Z","title":"Qwen3.5: Towards native multimodal agents, February 2026","venue":null,"work_id":"5fbed0ab-3251-4174-88cf-edabd29a7641","year":2026},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:9ea571e6f0c0c5098fd66ca3b8c2733b0ea3f92214ba40ca912aaf87e080543e","observation_id":"98a17ecd-674d-4e54-99cd-b2226ee2fbf6","resolution":{"observed_at":"2026-05-13T19:28:10.543034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Step 3.5 flash: Open frontier-level intelligence with 11b active parameters","venue":null,"work_id":"2451b57c-40e3-4db8-a675-b4395a4f296d","year":2026},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:c529e1647e70d04812f892a6827bebdb4305c5b55ba1697e58bfa01b21a9cfac","observation_id":"69d54879-575a-48e6-a76b-ad5a51509966","resolution":{"observed_at":"2026-05-13T19:28:10.479552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:87f9bbb8e355e3dcd0d7a37ac48fd6f1e34a1a7393e5de459338c8feead066fa","observation_id":"fe974a28-39a1-414c-9941-0281b6f30ed6","resolution":{"observed_at":"2026-05-13T19:28:09.839889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:1b7d8000aa96f68441a879f5dfb136c12f65d667a16c4f33bd9259ef8797db57","observation_id":"6b85af3a-39d8-43ac-8061-03f12decd517","resolution":{"observed_at":"2026-05-13T19:28:09.782204Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:12:38.243273Z","title":"Root mean square layer normalization.Advances in neural information processing systems, 32","venue":null,"work_id":"86716eec-9606-4332-83ee-a0b92b4ffa7d","year":2019},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:998849941d11473800dce6e6c8bfb1100a7e19b142265a3d7eac5d143b5e8e31","observation_id":"9cc083a4-e118-4998-8c1d-a883d4d251cb","resolution":{"observed_at":"2026-05-13T19:28:10.434084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:57:26.595007Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063","venue":null,"work_id":"b5fd43ff-336f-45fd-933c-ffddf3003880","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:6beed2756fd130cdddafc919b35700b4478f5297380c2e51c48a7ed078afe057","observation_id":"28e3f31a-c824-4132-ac1a-452525ff1316","resolution":{"observed_at":"2026-05-13T19:28:10.438446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language modeling with gated convolutional networks","venue":null,"work_id":"1c564bf3-e822-46ec-8d79-a7ac299f7239","year":2017},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:6e45fe9c43e1b4f87ae11f30bfa6ece2eae39f660a7b68142ab57209d4e9359a","observation_id":"bd6a736e-7a48-4edb-894a-f55baccda2a2","resolution":{"observed_at":"2026-05-13T19:28:10.464835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15664","last_updated":"2024-08-28T09:31:09Z","snapshot_observed_at":"2026-08-03T02:22:36.564849Z","submitted_at":"2024-08-28T09:31:09Z","title":"Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2408.15664","doi":"10.48550/arxiv.2408.15664","metadata_source":"pith","pith_arxiv_id":"2408.15664","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts","venue":"cs.LG","work_id":"267500ca-1512-478f-8a1b-6ecbdb09771d","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2408.15664","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:f24184a2952b78c18b7a0a2c614289f4d9af8f99fbb945327de2db43739aa12c","observation_id":"418fd39c-5fca-493a-aaf1-0dc8058b07f8","resolution":{"observed_at":"2026-05-15T12:55:26.144096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Muon: An optimizer for hidden layers in neural networks","venue":null,"work_id":"b55789aa-f32b-45af-bf38-955277c723e9","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:ae6af723b4006bb530c30240d25bcbf3db18364cef923161ccd55c70c6115d30","observation_id":"9cad0653-cd53-4f05-8826-0542236f9436","resolution":{"observed_at":"2026-05-13T19:28:10.477750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":"2601.02780","doi":"10.48550/arxiv.2601.02780","metadata_source":"pith","pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"MiMo-V2-Flash Technical Report","venue":"cs.CL","work_id":"1f3df90c-4bc3-49b1-ad9b-7f3b34e4ffba","year":2026},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:f02c9ed6a1af339697d0f6bb8a8ad03aea599c05d0459a8fcc267622f77c7215","observation_id":"c7966360-1ac0-4758-af69-58adf84ceb18","resolution":{"observed_at":"2026-05-13T19:28:09.829778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:49.766877+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:49.766877+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":"1909.08053","doi":"10.48550/arxiv.1909.08053","metadata_source":"pith","pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-07-10T16:37:23.051852Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","venue":"cs.CL","work_id":"c888e6d1-0b1d-43d6-9ef5-f0912a0efa1b","year":2019},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:fae06e3f4d56ccd8198c69c4a377985d28364f2334e956e75f0934d78d85daf9","observation_id":"972da0ce-6073-4176-8935-4c2782f4a341","resolution":{"observed_at":"2026-05-13T19:28:09.779471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism","venue":null,"work_id":"b982ef98-c4cb-4df7-8fbc-5a4cf7fd97f4","year":2019},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:bf805de59e17962fe67c87a5b6ea10589c0b998ee5ed594ae3fbea8b8afec2ba","observation_id":"8154921d-0e94-4d9c-b126-e4ee9cc36926","resolution":{"observed_at":"2026-05-13T19:28:10.467076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pipedream: Fast and efficient pipeline parallel dnn training, 2018.URL https://arxiv","venue":null,"work_id":"a2150013-15ff-4185-bee9-954099388c3b","year":2018},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:139edcba4662b7b5dacf3887d5354ac8b98726b861f52f033ebb03cc9fdf053e","observation_id":"42b0c08b-b80d-45f4-80e8-d1159d7256dd","resolution":{"observed_at":"2026-05-13T19:28:10.473544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Breadth-first pipeline parallelism.Proceedings of Machine Learning and Systems, 5:48–67","venue":null,"work_id":"ce8a6b72-e0c0-4db4-9a3a-be2b648112bb","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7d3b20d02278e16c8ea53b318ed66bada35ebeb1a6296f646a593c14a68fa33c","observation_id":"bff34d02-a177-41bc-a1d2-26a718365025","resolution":{"observed_at":"2026-05-13T19:28:10.444732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hanayo: Harnessing wave-like pipeline parallelism for enhanced large model training efficiency","venue":null,"work_id":"32ed543c-f55a-4860-87c7-4b0a1f6559ef","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:93b329092a7c9536470519f9fb7631e35ebf996bfb29b304d89eee7b11ab31ed","observation_id":"c9ff4410-ec78-4d76-a7cf-0529d22d8e50","resolution":{"observed_at":"2026-05-13T19:28:10.447019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient large-scale language model training on gpu clusters using megatron-lm","venue":null,"work_id":"92ce8779-1aba-465a-a146-0a7633321f01","year":2021},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:44c0ca60c4b22e1ca3951a843bdc0f3425f2538de269bb7b728eadb3392497e3","observation_id":"93f488b1-1467-4b3b-9a97-762ad8f6ec8f","resolution":{"observed_at":"2026-05-13T19:28:10.436289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10241","last_updated":"2023-11-30T10:40:34Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2023-11-30T10:40:34Z","title":"Zero Bubble Pipeline Parallelism","version":1},"cited_work":{"arxiv_id":"2401.10241","doi":"10.48550/arxiv.2401.10241","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.10241","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2401.10241 , year=","venue":null,"work_id":"f195f5ef-7ae0-4a1a-9e39-50e9ed69094c","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2401.10241","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:6a66e263342517b7eb1d6538aca1b9a6fc480aef31899fe0a32ce6bea32802d0","observation_id":"9659b4c1-ea9a-4909-a3ac-c9bf427da449","resolution":{"observed_at":"2026-05-13T19:28:09.814751Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Moe a2a interleaved 1f1b based computation and communication overlap","venue":null,"work_id":"45c0f71f-9c59-4bc6-901e-c28aabdf7d48","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:6318ce449c2e5b8f05b8702e2f51cc7469a6c6a06dc88c0d09096c96c22a9735","observation_id":"848e5051-58a3-4ece-bc3b-77d246cf5b7d","resolution":{"observed_at":"2026-05-13T19:28:10.448951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-07-06T09:33:58.857566Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":"2006.16668","doi":"10.48550/arxiv.2006.16668","metadata_source":"pith","pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-07-11T01:07:44.079601Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","venue":"cs.CL","work_id":"52b3c9a6-2a27-45a7-ba2b-ebe4b5bb5a5f","year":2020},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7b342918a850110914be88a4650dcebdbda8f1657343523da049c5a1efca3f1b","observation_id":"92c9ce82-5dc8-4a87-8955-66f78233af0d","resolution":{"observed_at":"2026-05-13T19:28:09.837395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero: Memory optimizations toward training trillion parameter models","venue":null,"work_id":"bfc8ffbb-a706-4196-b3f7-a8f3cea081e0","year":2020},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:a734b0f3b29513422ac3f35a076ea192e9a30b7b448de878e58ff411deedd1e1","observation_id":"5226da3e-05bd-477f-a5d5-f58fc148a094","resolution":{"observed_at":"2026-05-13T19:28:10.502841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":"d9c5c697-5e4f-4ab9-9c80-ce9a45804942","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:2f0c3d12612c17365f21b87b28da9a606ccb4ea0aa1ac3076ccee6997d1afb0f","observation_id":"e89543ce-c11c-4ba6-b89a-8f94848dfbf8","resolution":{"observed_at":"2026-05-13T19:28:10.496556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Datatrove: large scale data processing","venue":null,"work_id":"7c4b9f34-886c-49f6-9488-93d106411a7c","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:bd2bebdc480ad4cc2deeb5dd6925089aaae19a615753b1fdbbfa5a93f53fb088","observation_id":"379bddea-c353-4f4b-b2b6-88d285d5677e","resolution":{"observed_at":"2026-05-13T19:28:10.498506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Approximate nearest neighbors: towards removing the curse of dimensionality","venue":null,"work_id":"148b1935-e209-4273-9320-62934c2959d1","year":1998},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:8ac0c0ad143515778fd69a896ab28fed9bfd4e892a67d5e257db552f3c371de7","observation_id":"90ec33bf-3237-40d2-9dd3-d8080a2b4634","resolution":{"observed_at":"2026-05-13T19:28:10.538731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"94c2604e-e732-49f4-89ed-70e74b0a413c","year":1997},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:4a926a7084edafd4a4bd569fd41c3dd5dabffaf5129a6d5eaaf8fb35e8533eea","observation_id":"1ab5c66c-91ee-4fc7-b2a5-fb69c48647fe","resolution":{"observed_at":"2026-05-13T19:28:10.488684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Starcoder 2 and the stack v2: The next generation","venue":null,"work_id":"0e63f2fb-7e29-4d9f-8669-95f37aa190b3","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:af0897b8f0f70259886ba0cd6e1414738ba6301ac30aa77947fe1d142f59a7fc","observation_id":"ee0a8965-cc29-43a2-997c-804cb71dc952","resolution":{"observed_at":"2026-05-13T19:28:10.490363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:43:47.659103Z","title":"Qwen2.5 technical report","venue":null,"work_id":"27b4f04c-43a7-4e1a-8fd0-0791db410a6c","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:07a75ee5605517039a46f15973015c9aca0dabce2b3427962c2c35e49b463d94","observation_id":"f60544ac-7343-4dcb-8878-cd56db694050","resolution":{"observed_at":"2026-05-13T19:28:10.494378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":"2409.12186","doi":"10.48550/arxiv.2409.12186","metadata_source":"pith","pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-07-10T16:07:20.290468Z","title":"Qwen2.5-Coder Technical Report","venue":"cs.CL","work_id":"09ba463d-6377-4017-9801-444ffb94b056","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:b54cd58074cd7b75cfc3aa4cb9ec21f65cdda5f34e83b9e6e1ae1c4d4ebe7628","observation_id":"9de5321a-0d54-4b08-9c7e-106ee08bbaa7","resolution":{"observed_at":"2026-05-13T19:28:09.817044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rewriting pre-training data boosts llm performance in math and code","venue":null,"work_id":"f49f070a-b83b-4e57-ab54-b94c054f5032","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:b78068be024a9cb9e7753f77b8dd41304eac40112fb695415c3b0db7374672cf","observation_id":"eb14207a-35af-46e8-b16e-aa7ed85fe724","resolution":{"observed_at":"2026-05-13T19:28:10.485286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Olmo 3","venue":null,"work_id":"acf3b6ed-a1e2-4d14-9790-d909f28de65f","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:c4af10a782616e635e2d91b805b56f692bb6a14e45c3464066ea30316c4e813a","observation_id":"1d036699-43c5-4e00-93b4-96875a8cf73b","resolution":{"observed_at":"2026-05-13T19:28:10.487063Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nemotron 3 nano: Open, efficient mixture-of-experts hybrid mamba-transformer model for agentic reasoning","venue":null,"work_id":"79d0d754-9928-4fa9-80ec-dcf9ea5e209a","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7ad70613cf0987c089ac50adf9745688d2d30be41d918aba5e6ca84ee2e1b490","observation_id":"a567d985-2a20-450f-b0f7-5593ac4e1f32","resolution":{"observed_at":"2026-05-13T19:28:10.492161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:34.849349Z","title":"Deepseek-v3.2: Pushing the frontier of open large language models","venue":null,"work_id":"a8309cf7-193a-4534-bf54-fa1d763fecfb","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:af2cd7236dd3e635c8a406e562e6eab759a6ea391f93cd6c4c39928340faec3f","observation_id":"65ae559f-c648-4c24-815b-4b1fc0c925bb","resolution":{"observed_at":"2026-05-13T19:28:10.500727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mineru2.5: A decoupled vision-language model for efficient high-resolution document parsing","venue":null,"work_id":"48579d1e-c9cf-4fa1-bd46-4a05b96a70fe","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:f4dabfed8f64ccaed440e4a383390c5df802634f07177ef2111ad4c717ab56b4","observation_id":"7dcd0ee4-b1ec-41c8-aa6d-a3db65e5e0b2","resolution":{"observed_at":"2026-05-13T19:28:10.504960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18234","last_updated":"2025-10-21T02:41:44Z","snapshot_observed_at":"2026-07-06T22:33:39.148066Z","submitted_at":"2025-10-21T02:41:44Z","title":"DeepSeek-OCR: Contexts Optical Compression","version":1},"cited_work":{"arxiv_id":"2510.18234","doi":"10.48550/arxiv.2510.18234","metadata_source":"pith","pith_arxiv_id":"2510.18234","snapshot_observed_at":"2026-07-10T17:07:25.735032Z","title":"DeepSeek-OCR: Contexts Optical Compression","venue":"cs.CV","work_id":"e85551be-f243-4764-886f-76a8813ccbb8","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2510.18234","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:35eef02caee8cb6c483a1c5e847b2d4b3d726296947a41cef9a2fb878e1f484b","observation_id":"7c13c86d-926f-418e-b5e1-4ff8bef4bac0","resolution":{"observed_at":"2026-05-13T19:28:09.826836Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reformulation for pretraining data augmentation","venue":null,"work_id":"b62a5022-6d85-4d13-98d1-d6c0ba06f8dc","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:26fed46b2595ad1f5181371ecf495a2d3f9c9c3efa06acb02c39b80890ef0473","observation_id":"29ee9997-a61d-412b-8f2b-21f9923124c5","resolution":{"observed_at":"2026-05-13T19:28:10.469400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02595","last_updated":"2025-05-30T20:49:42Z","snapshot_observed_at":"2026-08-04T07:58:32.632698Z","submitted_at":"2024-12-03T17:28:50Z","title":"Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset","version":2},"cited_work":{"arxiv_id":"2412.02595","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02595","snapshot_observed_at":"2026-07-02T17:47:18.026339Z","title":"Nemotron-cc: Transforming common crawl into a refined long-horizon pretraining dataset.arXiv preprint arXiv:2412.02595","venue":null,"work_id":"bab220a8-ec16-4f03-9452-4eb35d618607","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2412.02595","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:95fe53953e3e6732048176eae984a2cb750772aea986d84acab40bd2fd1eaa19","observation_id":"c997e95f-e109-4df0-929b-214d5a3e4b14","resolution":{"observed_at":"2026-05-13T19:28:09.809525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":"2404.06395","doi":"10.48550/arxiv.2404.06395","metadata_source":"pith","pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-07-11T03:07:51.226857Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","venue":"cs.CL","work_id":"f20a4304-bd39-414a-923b-d18322e29258","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:5db98fed68ad2948422330557800c9e263ec388c136bd5a029c2a7729721038a","observation_id":"a0763103-0681-4bd7-ba9f-d5a0c6fd8a4b","resolution":{"observed_at":"2026-05-13T19:28:09.824324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7e9c749a7fa8090b06bd74560631b5e17a76dcec6e830f8c6de7bcb3e5aa7a26","observation_id":"60263677-369e-4d7a-89be-6700e60e9741","resolution":{"observed_at":"2026-05-13T19:28:09.821936Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:0be32f30a1edf4d7b7c0702518731e8c1af6734095264eb674df201a2aa56a3e","observation_id":"65d3dcef-7067-4a40-91ec-515fde9960a4","resolution":{"observed_at":"2026-05-13T19:28:09.812053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:4d2db1d5df448391fb4e9fb1cafffa05a7611f095318c7d4d5618f20b3234b0d","observation_id":"1d1c8e8f-0a25-47b4-b9fe-61ead7bc5b30","resolution":{"observed_at":"2026-05-13T19:28:09.784892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-07-11T01:37:42.666395Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:29a4bf40a1df7ca965b4a56adcda05989fe6502e529d00d09087d27494965b7f","observation_id":"f2990fce-e9b6-43c1-bea3-f114d2464e68","resolution":{"observed_at":"2026-05-13T19:28:09.803991Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark.Advances in Neural Information Processing Systems, 37:95266–95290","venue":null,"work_id":"cf36bb6c-319e-4229-870c-07c0ed3dc8dc","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:4bab8b71c171f306b1980ba40deb34cd327f77852098dd01dc3f532bc08cff44","observation_id":"fa1c82da-88a2-4b60-a72b-ae8aceb694a8","resolution":{"observed_at":"2026-05-13T19:28:10.511926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cmmlu: Measuring massive multitask language understanding in chinese","venue":null,"work_id":"7492afe9-99b5-4ac8-ae63-206933b933a3","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:0a8c57e3834eea9c78e553e6a4326c53a3cdfcb87ee4c927dc9b22db6a5dbcae","observation_id":"d353b196-0472-4e19-9c8d-a6aa33394dfc","resolution":{"observed_at":"2026-05-13T19:28:10.456096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:f191dec9a025112a0f8fc3ea9726974b386328d373765dc466878835db5b6a93","observation_id":"15fb487e-e9a3-4ed7-a50c-e9e1e4e9cca9","resolution":{"observed_at":"2026-05-13T19:28:09.775839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-07-10T16:57:24.565388Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7d407981c7484fd5de35eec313b5b571082bc8cde2e38c33755dcd8c1577f548","observation_id":"e3447d75-9edf-4314-9d23-18fc3982e822","resolution":{"observed_at":"2026-05-13T19:28:09.865513Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-11T03:27:46.202228Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:c70a8cb1f6f8a739ba2d0bf5b2e7b8cfa0bfe896d5498cc19b6c181a26542755","observation_id":"6cb59b89-fd52-4f34-a8be-958382cf77c4","resolution":{"observed_at":"2026-05-13T19:28:09.819412Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":"2403.07974","doi":"10.1109/icsme52107.2021.00025","metadata_source":"pith","pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":"cs.SE","work_id":"ea9e51ce-1e75-4182-92d8-4d25f70d2ee4","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:0025924f3cdbba6b99c98f9e33234736148eec0f3ea969012d477d88913c1dbd","observation_id":"954bd46f-e309-41b4-8146-38c3c1dee172","resolution":{"observed_at":"2026-05-13T19:28:09.772620Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":"2404.06654","doi":"10.48550/arxiv.2404.06654","metadata_source":"pith","pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-07-10T20:07:33.531106Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","venue":"cs.CL","work_id":"c0bc4689-3ce8-4e3d-9442-bd74869445bb","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:6f3b335f17ff02c4e5b09a8ce564b0d7d295f98d7140ff915e43a19c889e6568","observation_id":"5044b67b-61d5-4d53-ac7a-f1f532a04fb4","resolution":{"observed_at":"2026-05-13T19:28:09.862765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T22:04:07.813872Z","title":"gpt-oss-120b & gpt-oss-20b model card","venue":null,"work_id":"f39eea0f-5b44-4c1d-8a6f-ad9c49e608f9","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:d6cf9b37ef7f38639221ed987045b62b1c1ed21db9950f626c2a160155f22504","observation_id":"651e46dd-4fa7-4967-a19c-e6c86dc40db0","resolution":{"observed_at":"2026-05-13T19:28:10.534031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omniforce: On human-centered, large model empowered and cloud-edge collaborative automl system.nature npj-ai","venue":null,"work_id":"93956838-baf9-4847-a15d-9eb1d9606cb9","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:a30c5a6fe664e6a1df6c210bab354bf50778bf15c1ee1a77e2d088df224ad7d2","observation_id":"e174b87f-b2cf-443c-96f5-d09727f6e3b1","resolution":{"observed_at":"2026-05-13T19:28:10.426319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21798","last_updated":"2025-05-21T17:21:45Z","snapshot_observed_at":"2026-07-06T21:17:09.837496Z","submitted_at":"2025-04-30T16:56:06Z","title":"SWE-smith: Scaling Data for Software Engineering Agents","version":2},"cited_work":{"arxiv_id":"2504.21798","doi":"10.48550/arxiv.2504.21798","metadata_source":"pith","pith_arxiv_id":"2504.21798","snapshot_observed_at":"2026-07-10T15:07:19.622042Z","title":"SWE-smith: Scaling Data for Software Engineering Agents","venue":"cs.SE","work_id":"6a906763-2e4e-4cea-a19c-d7a169c9376b","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2504.21798","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:d8a0719be75dc7c1c9d943a309a9b052303b0ca370e436ea8194add7a9bbf8f4","observation_id":"4ef1e9a5-a8c2-472f-a3dd-19ed9535be14","resolution":{"observed_at":"2026-05-15T10:22:07.061654Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","venue":null,"work_id":"fc7f2672-0dfe-40ce-be82-9fc4b2a0ea2c","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:09f862287ee768446a5063cf4c58f8b9562f3dc9a04bd34c817a932d99d0cc6f","observation_id":"3c7b5a22-57df-4f3d-8299-dc24fe95488f","resolution":{"observed_at":"2026-05-13T19:28:10.431763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SWE-agent: Agent-computer interfaces enable automated software engineering","venue":null,"work_id":"ad705189-64eb-4f20-8a1c-26480d1e38c3","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:3e2cd35c02c8dd6a8d502efd1fcb28e088ee4f91ff5e1e6505818f97cc75efea","observation_id":"706d6149-697f-4249-afaf-198ff7e4e76b","resolution":{"observed_at":"2026-05-13T19:28:10.531823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openr1-math-220k dataset","venue":null,"work_id":"a7efecf4-6745-4e8b-a167-35774b417ace","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:3d0a1f886de2bc33a8c8b0becb562268462c6bd04b77e84bf8d5fd49334ed654","observation_id":"60494e77-c67c-4305-87c9-b2a9eaa4cee8","resolution":{"observed_at":"2026-05-13T19:28:10.427958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.15489","doi":"10.48550/arxiv.2512.15489","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Nemotron-math: Efficient long-context distillation of mathematical reasoning from multi-mode supervision.arXiv preprint arXiv:2512.15489","venue":null,"work_id":"16de9c46-5d5d-4579-a32f-e128fd7c4d74","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:b189406eab80bab5f95cab7e83f25a9e1946d8df1ecd2755da06745919bbded0","observation_id":"8ff34400-00d6-450f-8c2f-fd7cf1c03826","resolution":{"observed_at":"2026-05-13T19:28:09.787895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:04:57.068389Z","title":"Constructing a multi-hop qa dataset for comprehensive evaluation of reasoning steps","venue":null,"work_id":"fd2bf568-cbd2-407a-a17c-0d9f01efdd9c","year":2020},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:cd709b2f36c9ad2e74f5bee04eecb96b2bf82ccc88720e6d6d83aced215bff71","observation_id":"dce4edec-6677-43b2-b2e4-b7ed1ddbc7e8","resolution":{"observed_at":"2026-05-13T19:28:10.507443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:16:21.060214Z","title":"Musique: Multihop questions via single-hop question composition.Transactions of the Association for Computational Linguistics, 10:539–554","venue":null,"work_id":"c8d66a44-9695-4211-998e-a85a97efa16e","year":2022},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:ae024e135f128bce59b00bf1c1ed64b0b2288dd205736ec0311a584b177a5148","observation_id":"3b942de5-657b-4581-adb8-c299083209df","resolution":{"observed_at":"2026-05-13T19:28:10.536481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:04:57.064523Z","title":"Measuring and narrowing the compositionality gap in language models","venue":null,"work_id":"997bfd0b-443c-4ff9-8c1a-1ae7bb3b6962","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:d4fafb5d12f9e584fa612b6372f1268761567b49a6298faf9832860ee74c96e4","observation_id":"bbb17914-00d1-4098-87cc-9644e2e3d536","resolution":{"observed_at":"2026-05-13T19:28:10.541036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":"2411.04368","doi":"10.48550/arxiv.2411.04368","metadata_source":"pith","pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Measuring short-form factuality in large language models","venue":"cs.CL","work_id":"f8e490ab-7057-43fb-8c6d-06fc603836c7","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:b6ad526f31fe47a893d6a2dfc6d168adebe48cef818bea6e3750250bf6b952e7","observation_id":"4b1d43f9-c86c-4653-a431-9f3582fddad2","resolution":{"observed_at":"2026-05-15T06:45:50.345693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fact, fetch, and reason: A unified evaluation of retrieval-augmented generation","venue":null,"work_id":"f762dd23-b2ea-403e-a8c4-de21a9c02b75","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:f6f04aedf195e781be33e5b31c74cd8d8d26d48f067bde68c80eede07d49b46e","observation_id":"03034d27-23cc-424f-9028-902ac8ebde34","resolution":{"observed_at":"2026-05-13T19:28:10.529504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13784","last_updated":"2025-06-20T15:48:51Z","snapshot_observed_at":"2026-08-01T07:23:35.053166Z","submitted_at":"2025-06-11T02:05:23Z","title":"ScholarSearch: Benchmarking Scholar Searching Ability of LLMs","version":2},"cited_work":{"arxiv_id":"2506.13784","doi":"10.48550/arxiv.2506.13784","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13784","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Scholarsearch: Benchmarking scholar searching ability of llms","venue":null,"work_id":"1cf14d1a-84bc-456a-8066-0be9dae3faec","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2506.13784","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:ebfe7094f45cd77701f47976cf6c20bf378cc26d5cb30dcc23230fe8babaf7ab","observation_id":"57875e66-e792-4ee4-a13c-0eee940264df","resolution":{"observed_at":"2026-05-13T19:28:09.855135Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":"da748386-42b0-4554-8054-014da4cb30e4","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7868a767397a5c5e1a07f060907e4119a06420ca6229f341f8c789cc5fde6228","observation_id":"604c728f-b890-484a-a792-ca93e1f7bf0b","resolution":{"observed_at":"2026-05-13T19:28:10.524189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10055","last_updated":"2025-06-17T15:19:26Z","snapshot_observed_at":"2026-07-06T21:40:36.021335Z","submitted_at":"2025-06-11T17:58:14Z","title":"TaskCraft: Automated Generation of Agentic Tasks","version":2},"cited_work":{"arxiv_id":"2506.10055","doi":"10.48550/arxiv.2506.10055","metadata_source":"pith","pith_arxiv_id":"2506.10055","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Taskcraft: Automated generation of agentic tasks","venue":"cs.CL","work_id":"f50e1a78-f462-4e9c-8b0b-724212df1fad","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2506.10055","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:1a7f21c643ab7e08efdbffe27d2a650d945e56dca64fdf96856725e36f2290ab","observation_id":"41b4775f-0556-4a06-aa1d-cce40b586e82","resolution":{"observed_at":"2026-05-13T19:28:09.852481Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nemotron-Post-Training-Dataset-v1","venue":null,"work_id":"a94361d0-4e68-4dde-b0f4-1e23248fc6db","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:f5b15d19b1dc21b44db3d5c76d6d29933b83791c2b49164d2a56bc2bf8ac6eaf","observation_id":"5197e854-9ed4-4d59-a3f3-d62636f1b7e1","resolution":{"observed_at":"2026-05-13T19:28:10.527031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:05:18.996048Z","title":"Training language models to follow instructions with human feedback.Advances in Neural Information Processing Systems, 35:27730–27744","venue":null,"work_id":"4e1ae784-2dd4-472c-9ed2-af60924b0189","year":2022},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7e3c705eba8e2e66ceea5c275a7a779756216025a175d7bb33e7fb7e135fee6e","observation_id":"0b26cd51-d574-4a1a-a41e-6a8931e3f91c","resolution":{"observed_at":"2026-05-13T19:28:10.509750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:4dabb9d80a675d982ed6f85678b3483d1a211c770ebf82fb800a5fec364cb9f7","observation_id":"5f838149-68e7-4e35-83cd-fd550252606f","resolution":{"observed_at":"2026-05-13T19:28:09.798740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:d6e75c429b6b25b3eaa2b423a6c2f21f3e71453d989b9e019e6eeadbb0e718ad","observation_id":"eb85d3bd-28e8-49a8-82e8-a47b56189951","resolution":{"observed_at":"2026-05-13T19:28:09.834749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-07-11T03:07:50.815080Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:4670c87aa2a6eedd14e966e15df97731de87e8761e1533dcd3478c7ae90d12ff","observation_id":"9676e8dc-918b-47fb-a07f-1c080e3295aa","resolution":{"observed_at":"2026-05-13T19:28:09.842227Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.08239","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fibration policy optimization","venue":null,"work_id":"46a6e064-cbff-424a-873a-4145c607cee7","year":2026},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:06e9d4da00fcea18f8976f9cfa9eb13dc97e86ff8ae50a9a3061891be9166580","observation_id":"a46fe3b2-18be-42b9-b7da-571d1f016f8f","resolution":{"observed_at":"2026-05-13T19:28:09.793546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trust region policy optimiza- tion","venue":null,"work_id":"04b3c3a7-7a24-4558-b4eb-a5a72c481a6e","year":2015},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:41a3c337fcff1741d39ffe2866955ea24ca66dff79a6097ab319fcc9c9bc0b5a","observation_id":"a043c26b-7be5-4fee-99b0-0cd43b0ddde4","resolution":{"observed_at":"2026-05-13T19:28:10.471290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":"2507.18071","doi":"10.48550/arxiv.2507.18071","metadata_source":"pith","pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-07-10T14:27:07.145784Z","title":"Group Sequence Policy Optimization","venue":"cs.LG","work_id":"3a98b53b-9f52-4d95-adf7-89353c0a9a65","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:a4bc6abadf7810490d1cf2f995e9efd4cf4d8acb40604060debe25422cafe012","observation_id":"39de28e9-a99b-4bfc-a586-cee283a09178","resolution":{"observed_at":"2026-05-13T19:28:09.806689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":"2409.19256","doi":"10.1145/3689031.3696075.url:","metadata_source":"pith","pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","venue":"cs.LG","work_id":"7eb9c9f4-b322-4bba-8011-09ff8d6ad801","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:9ceebd0f23c733e17b3a371002325e4ae34a46ccf390024c5f7a3cc52283441f","observation_id":"84f17b70-ad9c-4475-a2d5-4cd220319b3c","resolution":{"observed_at":"2026-05-13T19:28:09.796197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":"1905.07830","doi":"10.48550/arxiv.1905.07830","metadata_source":"pith","pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","venue":"cs.CL","work_id":"79f44c0c-96f4-4edb-bc50-a3c9d6b85936","year":2019},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:bfed1ec01843db2458ed477925abf087d3c9d2915e8fc72c0b3d3b938fa9e7a2","observation_id":"f425af20-3c31-4a73-830b-4b7f56787d9b","resolution":{"observed_at":"2026-05-13T19:28:09.849683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models","venue":null,"work_id":"18ff8c0f-dc6c-4f6e-be42-1dc0c172f21d","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:e98e2660dc9849c658abbda66f7782b341ef2c7a97c499ef3b7e6eafa73a9e79","observation_id":"2ba9e8bf-1dae-499c-89c3-ad748e5bb852","resolution":{"observed_at":"2026-05-13T19:28:10.483441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:14:00.898380Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":"1a65f421-2e48-4c87-8f62-4057a79265f3","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:c1cd1df5d08a9ea5af9875a607d7a42a2467505c8017e57ad486804a565a13cb","observation_id":"b433831b-aa5b-41c6-b029-625c8c43419f","resolution":{"observed_at":"2026-05-13T19:28:10.516169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Supergpqa: Scaling llm evaluation across 285 graduate disciplines","venue":null,"work_id":"370aa32b-67cd-4157-8cbc-35bc8c68fa30","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:3f6617d5e6b13a636753a514a25c28407b9b2ea2c4d7eb17605c446424bfb83d","observation_id":"230b77a3-c35c-4177-929a-7eb511be975b","resolution":{"observed_at":"2026-05-13T19:28:10.460484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SWE-bench: Can language models resolve real-world github issues? InThe Twelfth International Conference on Learning Representations","venue":null,"work_id":"0c803f70-cb9a-4980-981c-0deaa09929f8","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:868686b6ae42a6c85cc3f6d019abf8c931f146739a3e57506f447e8c62fa4e9e","observation_id":"a798dcf7-71b2-46b4-bfc7-cb4426de9185","resolution":{"observed_at":"2026-05-13T19:28:10.458231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AlignBench: Benchmarking Chinese alignment of large language models","venue":null,"work_id":"e80a04a0-b25c-43ad-a480-f57e08b8969d","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:a675997ef4939d7ac5880d715788b318f252267b9cc49c54efab75631ac1e225","observation_id":"05757393-257b-41f5-b47b-5a9d4a50e55f","resolution":{"observed_at":"2026-05-13T19:28:10.520377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.07911","doi":"10.48550/arxiv.2311.07911","metadata_source":"pith","pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-07-10T12:07:03.672931Z","title":"Instruction-Following Evaluation for Large Language Models","venue":"cs.CL","work_id":"3aa06177-125a-4f5a-8f4a-8070c5986c26","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:e57e2dcb2589f1ae24a00ac40f936ff7279970069ce556394c971594e34a9f28","observation_id":"26b2e4e7-0a2b-4777-9fdc-4c63d3f16a39","resolution":{"observed_at":"2026-05-13T19:28:09.860254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Livebench: A challenging, contamination-free LLM benchmark","venue":null,"work_id":"82b055e9-224e-495c-b8be-47986f0a9299","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:71b24434157a1868eb3c07688bbc669384f0c6cb5517a9044eba2f424a0e80c5","observation_id":"b0006e1a-090a-4177-85dc-508b41a5e606","resolution":{"observed_at":"2026-05-13T19:28:10.453758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"τ 2-bench: Evaluating conversa- tional agents in a dual-control environment","venue":null,"work_id":"00e86ee4-95f3-4bee-b9e5-aaeee58d257b","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:30bde6bd4c51e43f4c460b479f473d722c498a5bde6381d497fb458d6a66f636","observation_id":"da2d2657-f63d-4d4a-93bf-ebf0f73871ee","resolution":{"observed_at":"2026-05-13T19:28:10.451096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.05662","last_updated":"2019-09-25T14:33:44Z","snapshot_observed_at":"2026-07-06T07:39:06.044012Z","submitted_at":"2019-03-13T18:23:43Z","title":"Understanding Straight-Through Estimator in Training Activation Quantized Neural Nets","version":4},"cited_work":{"arxiv_id":"1903.05662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.05662","snapshot_observed_at":"2026-07-04T16:59:58.427669Z","title":"Understanding straight-through estimator in training activation quantized neural nets","venue":null,"work_id":"88958bb5-572d-40be-8cc7-9a5173285339","year":1903},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/1903.05662","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:388da21fd16f3f7aa1f3b9d5b6e98fb96adb54e30bb3ab1b2168f0de9ec2ab4b","observation_id":"a0f10731-a3dc-403d-abe3-f17d54838fa7","resolution":{"observed_at":"2026-05-13T19:28:09.857942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kimi-k2-thinking","venue":null,"work_id":"61012e71-0f73-466f-a79b-cfd85da36f2e","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:fdb85fde92400b4f6e31a6e950cbd71fe7814fa2d4a9dfc05c0a06e7a4977b57","observation_id":"f21ee827-939b-4cca-9a4a-23056b139123","resolution":{"observed_at":"2026-05-13T19:28:10.462650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glm-5: from vibe coding to agentic engineering","venue":null,"work_id":"11bc9fd8-ee0e-4037-8922-3b7a8f9d76ea","year":2026},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:698b041f3f6b48b2912b829999288ab26e8d58293478a933d10e1b8bba1730ac","observation_id":"a8a97c3a-f1b3-47ff-b32b-6a4d465b1eab","resolution":{"observed_at":"2026-05-13T19:28:10.475786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model optimizer quantization support matrix","venue":null,"work_id":"91978f99-882f-41c0-a044-77a5f35ba93f","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:7186d3004612a9b20853aa397df19e269e3f00ee699c733710967d50d7c1ec79","observation_id":"61f9d045-218c-4aaf-baae-fac389ca0c0f","resolution":{"observed_at":"2026-05-13T19:28:10.442554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"vllm: Easy, fast, and cheap llm serving","venue":null,"work_id":"5bae9db8-f2e9-4f2a-9044-6d9e341c04ea","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:5533237bc66efd6668de37d77b404ca8af2bd4dec65116c9e853ff4e505bd005","observation_id":"85e45fc9-7078-4338-a1d8-4da8dc0d09ce","resolution":{"observed_at":"2026-05-13T19:28:10.429769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tensorrt-llm","venue":null,"work_id":"51799aac-1b97-4a47-b241-529c1a8e7211","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:eb12961797d1af10904b38ee9dbbd63dc64311dddcbfe28c55d80769d371c1e5","observation_id":"dd8a22d0-3eff-45d7-af6e-a56f949931d6","resolution":{"observed_at":"2026-05-13T19:28:10.440598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:5f1c5d7acba1558e2f30dc7098f8955b7dd6d3b7c0799115b6ce48d86a203d76","observation_id":"299a89e9-73d7-47ab-8d3a-cfb38ab41e8d","resolution":{"observed_at":"2026-05-13T19:28:09.844721Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Readme: Gguf, 9 2025","venue":null,"work_id":"d9c7dde6-ef15-48c1-a4e0-91d6963190c7","year":2025},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:811c8357329306deeeea3287731e2fc5b025052d9be0feb4634d1c0f2223e01e","observation_id":"59fd732c-c9f9-4529-a1e2-afe290e567af","resolution":{"observed_at":"2026-05-13T19:28:10.481275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding","venue":null,"work_id":"aed47630-5570-4dd7-bc61-cc0b5b31175b","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:0b579fdd8f068a296c320c731ca247852ecd5e69dc22e68f69098035b4771657","observation_id":"060cb2ad-3c0b-42d5-ba9e-e3e0f0309882","resolution":{"observed_at":"2026-05-13T19:28:10.513998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glm-5: from vibe coding to agentic engineering","venue":null,"work_id":"f3b65941-56fd-4e71-ab79-65dfce6fd0ef","year":2026},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:dfcc3531cb3dfe2952f87b46ed01a69bc93c369e0947bb0c251f7f9d804b90b6","observation_id":"70a68d73-822a-4b10-99ac-9c8759fe61d9","resolution":{"observed_at":"2026-05-13T19:28:10.518261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offline optimization of your disaggregated dynamo graph","venue":null,"work_id":"349f931f-9014-4363-a75d-694099d8096a","year":2023},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:958978805dfb225c97ceb6011ee3e9cbde6adacfa678808466731332e7e2dc6a","observation_id":"bcc4465d-5219-47c3-811b-4b72d96a1340","resolution":{"observed_at":"2026-05-13T19:28:10.522324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00079","last_updated":"2025-09-03T14:56:29Z","snapshot_observed_at":"2026-07-06T18:38:42.333605Z","submitted_at":"2024-06-24T02:05:32Z","title":"Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving","version":4},"cited_work":{"arxiv_id":"2407.00079","doi":"10.48550/arxiv.2407.00079","metadata_source":"pith","pith_arxiv_id":"2407.00079","snapshot_observed_at":"2026-07-11T01:57:51.476463Z","title":"Mooncake: A kvcache-centric disaggregated architecture for llm serving","venue":"cs.DC","work_id":"eee8f937-db6b-4c48-887b-960ca80c0d81","year":2024},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2407.00079","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:450b03751db6d6e19a6858f06ae2311ab296f4793016a2b53c7faad30d85a895","observation_id":"2c786606-936f-41f7-9486-acba5244a115","resolution":{"observed_at":"2026-05-13T19:28:09.832457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:11.013176+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:11.013176+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":1,"unresolved":1,"verified_exact":37,"verified_fuzzy":56},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 4 inbound Pith citation observations for arXiv:2604.03044."}