{"as_of":"2026-08-06T06:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9fef372d6e2c7e8b1eed227f78b80a8fbf4c5952d355feeff671d9927d4de06b","coverage":[{"denominator":172,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T11:44:38.066501Z","state":"measured"},{"denominator":176,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":176,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":76,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:59:15.459932Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":27,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2401.02458","last_updated":"2026-04-29T07:43:10Z","snapshot_observed_at":"2026-07-29T23:57:44.096283Z","submitted_at":"2024-01-04T08:00:32Z","title":"Data-Centric Foundation Models in Computational Healthcare: A Survey","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-24T04:13:05.328492Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2401.02458"},"observation_digest":"sha256:fce4d95862927720135bd8732c307f053da36c5c75050bef194cd51bd0d97e50","observation_id":"08551589-17f8-406f-bb65-004df6b9f40b","resolution":{"observed_at":"2026-05-24T04:13:52.973221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T20:58:58.849040Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2404.16821"},"observation_digest":"sha256:60ea9e2cb7484bc425cc372c3cd13885c0c73494b1f586d8709c78ff14439fa2","observation_id":"512c53e1-9f10-4260-86fb-81da6b2b490f","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2406.11939"},"observation_digest":"sha256:c031c033bc42fc208a4c00e126c45f7cfbb9f48e512e043fe026c331de9d1c4e","observation_id":"95df49c6-7ed0-4fd1-8578-c9df2887dc29","resolution":{"observed_at":"2026-05-24T00:03:38.978285Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2407.03320","last_updated":"2024-07-03T17:59:21Z","snapshot_observed_at":"2026-08-04T22:09:42.241578Z","submitted_at":"2024-07-03T17:59:21Z","title":"InternLM-XComposer-2.5: A Versatile Large Vision Language Model Supporting Long-Contextual Input and Output","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T10:46:28.447347Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2407.03320"},"observation_digest":"sha256:42d00b90ccaed355a6706f2e672038304adb747122fb1ef5abbd77e638fecb27","observation_id":"8028fda7-9fa7-4b12-b7e3-89a08200c678","resolution":{"observed_at":"2026-05-17T10:46:28.782690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2409.18839","last_updated":"2024-09-27T15:35:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T15:35:15Z","title":"MinerU: An Open-Source Solution for Precise Document Content Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T04:00:25.624430Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2409.18839"},"observation_digest":"sha256:53cacc54ed3e0b2690029262d0abd1974758a1af808e953af47bd29a23167f15","observation_id":"e5cad035-453f-4a0c-9fc4-121c8aa563d4","resolution":{"observed_at":"2026-05-16T04:00:25.789593Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T16:18:01.560780Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2410.18451"},"observation_digest":"sha256:4dbfc114a3efdbfa74b1dba706debe029ad5505b9dd03ee25b216cf2c2f704b8","observation_id":"359aa580-0b57-4f62-b545-e43c6cba2075","resolution":{"observed_at":"2026-05-17T16:18:01.600452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T09:16:17.150383Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2411.10442"},"observation_digest":"sha256:b58d973649c3672beb2bdd16a0ab7be24b8f775d0cda5e00891e8adb146fb7b0","observation_id":"0b80a33e-10d1-47e3-a46b-efdf5858ea30","resolution":{"observed_at":"2026-05-16T09:16:17.264448Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T13:23:57.588851Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2412.05271"},"observation_digest":"sha256:5de3a71e6f79f322c9b628230a0e9ff2590227d18343d0aee74f471bb7640aa1","observation_id":"e101ffbc-5196-4ad1-923a-711163632721","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2501.12386","last_updated":"2025-07-13T18:57:17Z","snapshot_observed_at":"2026-08-05T00:52:07.112592Z","submitted_at":"2025-01-21T18:59:00Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T02:52:20.643070Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2501.12386"},"observation_digest":"sha256:12962caaee88c8d23219e19f9a1b27069896d957302287c58dde82c8d8100d98","observation_id":"1e93dfae-f8d2-48cb-bd97-4d65717864ef","resolution":{"observed_at":"2026-05-17T02:52:20.689675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2503.01785","last_updated":"2025-03-03T18:16:32Z","snapshot_observed_at":"2026-08-05T03:13:54.147007Z","submitted_at":"2025-03-03T18:16:32Z","title":"Visual-RFT: Visual Reinforcement Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T22:16:16.528682Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2503.01785"},"observation_digest":"sha256:a16aebd94525bbc05edd5d9083a9fccbca6aebaa5a988cc5c3616b8a7891066a","observation_id":"886be895-644a-48e6-add2-e8750a03b48a","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:4f1cfe42b730fe34f5ad5d9c8ac5980b979c0a07496751233a7c1cb23b910d4c","observation_id":"d3fe9b29-a3a5-45e4-85d7-f5427c245616","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2505.03233","last_updated":"2025-08-27T03:43:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-06T06:59:28Z","title":"GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-17T20:55:52.109166Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2505.03233"},"observation_digest":"sha256:a2df762fd187ce036f258775282dec5344bd6b58808f07d905056f9c6124508f","observation_id":"879c5ce4-ee42-4626-be16-25e2951f4994","resolution":{"observed_at":"2026-05-17T20:55:52.265998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2507.14200","last_updated":"2026-05-15T13:08:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-14T16:17:11Z","title":"A Scalable Multi-LLM Collaboration System with Retrieval-based Selection and Exploration-Exploitation-Driven Enhancement","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-21T23:26:38.457193Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2507.14200"},"observation_digest":"sha256:ea8f4a49573527aa60aa79a5dc5d8eec0fce527aec58e2708b1d8d0d0a060674","observation_id":"08cc6faa-8087-4c32-8aed-2320f6a33725","resolution":{"observed_at":"2026-05-21T23:30:46.082347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-06T05:59:15.459932Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01008","last_updated":"2025-08-01T18:19:51Z","snapshot_observed_at":"2026-08-06T05:59:14.014286Z","submitted_at":"2025-08-01T18:19:51Z","title":"ROVI: A VLM-LLM Re-Captioned Dataset for Open-Vocabulary Instance-Grounded Text-to-Image Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:59:15.459932Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2508.01008"},"observation_digest":"sha256:06a5421476aafeac1b53345b5c563361854cbc2abe617add7acb64faeedab7f3","observation_id":"3e6b6bcd-aa20-4a8d-b405-71ccf698ba34","resolution":{"observed_at":"2026-08-06T05:59:15.459932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-06T05:46:59.332958Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01233","last_updated":"2025-08-02T07:09:17Z","snapshot_observed_at":"2026-08-06T05:46:58.049974Z","submitted_at":"2025-08-02T07:09:17Z","title":"Detailed radial scale height profile of dust grains as probed by dust self-scattering in HL Tau","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T05:46:59.332958Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2508.01233"},"observation_digest":"sha256:5f0c73bf6eb0ee7dc6bf29dc76613dd82e5072a827ee5a83423f9795936ca9ba","observation_id":"fedc6eae-9448-4f9d-88df-6b1635c071ad","resolution":{"observed_at":"2026-08-06T05:46:59.332958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-06T05:48:15.948750Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01237","last_updated":"2025-08-02T07:22:51Z","snapshot_observed_at":"2026-08-06T05:48:15.283269Z","submitted_at":"2025-08-02T07:22:51Z","title":"SketchAgent: Generating Structured Diagrams from Hand-Drawn Sketches","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T05:48:15.948750Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2508.01237"},"observation_digest":"sha256:ce78653e2f250a637277c1a5f64b480f66b96b8ec65c72d3f5c250eda1db1520","observation_id":"cf18a937-c439-4355-acf4-b5b039a91693","resolution":{"observed_at":"2026-08-06T05:48:15.948750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T22:35:50.328264Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06895","last_updated":"2025-08-09T09:00:45Z","snapshot_observed_at":"2026-08-05T22:34:59.302688Z","submitted_at":"2025-08-09T09:00:45Z","title":"BASIC: Boosting Visual Alignment with Intrinsic Refined Embeddings in Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T22:35:50.328264Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2508.06895"},"observation_digest":"sha256:02f492221609917a5622bbb802d812e1069e140a9edd192c05a39971ea257aa2","observation_id":"9ba8def6-8af5-4b2a-b405-02d9322b37a7","resolution":{"observed_at":"2026-08-05T22:35:50.328264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T11:58:58.660564Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2508.18265"},"observation_digest":"sha256:67ff451708f96f7452c7eed25094d2f23ae09e438ded349021fef1f8fc14c491","observation_id":"912a80f7-9bf9-4a1e-8a04-0883191cb9bd","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T16:18:44.071163Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18763","last_updated":"2025-08-26T07:41:33Z","snapshot_observed_at":"2026-08-06T03:19:56.975838Z","submitted_at":"2025-08-26T07:41:33Z","title":"Dynamic Collaboration of Multi-Language Models based on Minimal Complete Semantic Units","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:18:44.071163Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2508.18763"},"observation_digest":"sha256:2e7eb4274231fcde964265404a824b9f9393606498f93641a38c2acec4cf4e67","observation_id":"01ebf2da-cbad-4c1c-a9b9-5964217ee933","resolution":{"observed_at":"2026-08-05T16:18:44.071163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T12:52:00.462898Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01221","last_updated":"2025-09-04T09:30:16Z","snapshot_observed_at":"2026-08-05T12:51:58.811588Z","submitted_at":"2025-09-01T08:06:49Z","title":"DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T12:52:00.462898Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2509.01221"},"observation_digest":"sha256:09e182168a28373d62408021f52836bea5e291cd018e5854017ecb2f465d0c97","observation_id":"1151e1ed-d782-4e73-b7f9-3c3a786e3bbd","resolution":{"observed_at":"2026-08-05T12:52:00.462898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T11:32:31.709766Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02659","last_updated":"2025-09-02T17:52:29Z","snapshot_observed_at":"2026-08-05T11:32:31.304822Z","submitted_at":"2025-09-02T17:52:29Z","title":"2nd Place Solution for CVPR2024 E2E Challenge: End-to-End Autonomous Driving Using Vision Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:32:31.709766Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2509.02659"},"observation_digest":"sha256:a61b6bb633eec71bcc5d25b0028e090516f4d3cfa67f7776cb117de8a4874559","observation_id":"77c316b4-fe87-4df9-8bc9-63ab4c6561bc","resolution":{"observed_at":"2026-08-05T11:32:31.709766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T11:01:16.700701Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03565","last_updated":"2025-09-03T15:45:03Z","snapshot_observed_at":"2026-08-05T11:01:11.188845Z","submitted_at":"2025-09-03T15:45:03Z","title":"ResearchPulse: Building Method-Experiment Chains through Multi-Document Scientific Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T11:01:16.700701Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2509.03565"},"observation_digest":"sha256:c88c01f81318c90b6045f811feac6d07ece0919526fcbb79ac5149fd7a9dd733","observation_id":"d39ed4e4-038b-4557-ac5a-95b13fd8fc40","resolution":{"observed_at":"2026-08-05T11:01:16.700701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T10:15:50.252054Z","title":"Internlm2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04378","last_updated":"2025-09-09T08:09:40Z","snapshot_observed_at":"2026-08-05T10:15:47.702669Z","submitted_at":"2025-09-04T16:40:15Z","title":"Aesthetic Image Captioning with Saliency Enhanced MLLMs","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:15:50.252054Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2509.04378"},"observation_digest":"sha256:e087b40b7c1ab96ae8a84e2ad044fdf83ce9803f671938cee829843b28a886d8","observation_id":"f14f4882-d36e-4e59-aea2-dcf53c76e976","resolution":{"observed_at":"2026-08-05T10:15:50.252054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-04T20:32:56.418696Z","title":"arXiv:2403.17297 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08538","last_updated":"2025-09-11T11:14:00Z","snapshot_observed_at":"2026-08-04T20:32:53.384449Z","submitted_at":"2025-09-10T12:34:07Z","title":"MESH -- Understanding Videos Like Human: Measuring Hallucinations in Large Video Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:32:56.418696Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2509.08538"},"observation_digest":"sha256:701e7b76598e1ed7f10eec14778f74b1627f2854cc45d29fde5767c922be4430","observation_id":"163f588a-820f-4e44-96dc-363e3f0a1951","resolution":{"observed_at":"2026-08-04T20:32:56.418696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2511.23332","last_updated":"2026-05-11T14:21:31Z","snapshot_observed_at":"2026-07-06T22:37:12.421372Z","submitted_at":"2025-11-28T16:40:08Z","title":"UniGeoSeg: Towards Unified Open-World Segmentation for Geospatial Scenes","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T04:37:12.944874Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2511.23332"},"observation_digest":"sha256:357d5e0969d13b797feb38d7fe2bff548ec21e0f40bc100f2f9dd491f82ebd8b","observation_id":"c607c490-baed-4204-b288-1d288398490a","resolution":{"observed_at":"2026-05-17T04:39:03.346050Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-03T14:00:20.874567Z","title":"Internlm2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.21970","last_updated":"2026-06-26T10:58:23Z","snapshot_observed_at":"2026-08-03T14:00:20.137728Z","submitted_at":"2025-12-26T10:34:20Z","title":"StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T14:00:20.874567Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2512.21970"},"observation_digest":"sha256:205f116de2d4e91fe01eca31ab48546f5d5b6344e230bec06d41094ecb1c5fac","observation_id":"183fd8e0-b25a-4fcc-a077-b286aba51e48","resolution":{"observed_at":"2026-08-03T14:00:20.874567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-03T09:13:38.456936Z","title":"Remote Sensing 16, 1477","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14637","last_updated":"2026-03-19T04:16:46Z","snapshot_observed_at":"2026-08-03T09:13:25.940437Z","submitted_at":"2026-01-21T04:23:33Z","title":"Forest-Chat: Adapting Vision-Language Agents for Interactive Forest Change Analysis","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T09:13:38.456936Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2601.14637"},"observation_digest":"sha256:08579c2847d5272733302adbb16869684671baac7721263337a8c0ef0caba9e2","observation_id":"9573271e-1e58-40bc-81ff-22004371ef3f","resolution":{"observed_at":"2026-08-03T09:13:38.456936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-03T07:17:13.383132Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.20789","last_updated":"2026-05-29T01:36:45Z","snapshot_observed_at":"2026-08-05T12:56:01.162423Z","submitted_at":"2026-01-28T17:27:08Z","title":"SERA: Soft-Verified Efficient Repository Agents","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T07:17:13.383132Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2601.20789"},"observation_digest":"sha256:b9d1d83a10fee19d857cd8fccddac13780ee1e22562ed606ace9489ea117d081","observation_id":"705b93b7-03fa-4fe5-90a7-e076852e4283","resolution":{"observed_at":"2026-08-03T07:17:13.383132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2602.07605","last_updated":"2026-04-27T13:49:08Z","snapshot_observed_at":"2026-08-03T08:11:38.794368Z","submitted_at":"2026-02-07T16:16:51Z","title":"Fine-R1: Make Multi-modal LLMs Excel in Fine-Grained Visual Recognition by Chain-of-Thought Reasoning","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T06:13:33.315525Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2602.07605"},"observation_digest":"sha256:6f8287d3647fdf667b18211255229997732c7ec8ad550647324410b2ca060e2f","observation_id":"a9d99423-d48c-49a6-a38b-833fa26e2c9f","resolution":{"observed_at":"2026-05-16T06:17:26.738281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-03T03:04:43.319892Z","title":"Internlm2 technical report.arXiv preprint arXiv:2403.17297,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-03T07:10:48.024369Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:43.319892Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:762909909384a94a8a1cc1c6c6a656b7c66e7e45a8b1cb1064bfc57fc1395535","observation_id":"0deb1ac7-bd31-4c6a-8b83-554ab65b3975","resolution":{"observed_at":"2026-08-03T03:04:43.319892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-07-31T18:08:52.441829Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T05:11:07.600760Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2602.12125"},"observation_digest":"sha256:0ebde82e6f7aa887cc406b05ae7e5af4a71d202ac3090060c9252a3632587d2f","observation_id":"edf32528-9d68-433c-9844-3459f9db6d08","resolution":{"observed_at":"2026-05-16T05:11:07.732983Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2602.24273","last_updated":"2026-05-14T16:23:55Z","snapshot_observed_at":"2026-08-02T04:41:42.758635Z","submitted_at":"2026-02-27T18:43:47Z","title":"A Minimal Agent for Automated Theorem Proving","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T18:44:35.600033Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2602.24273"},"observation_digest":"sha256:50a34ba099007a6d6ba0a0dfb255d1b4ab9f5ebf247bc8a55b5642bf21e503ca","observation_id":"065e7d23-65e6-4629-a474-ebf47fb08156","resolution":{"observed_at":"2026-05-15T18:46:29.343979Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-02T18:39:40.626602Z","title":"Internlm2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-02T21:49:12.756232Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.626602Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:f23641c1517517ce188f9f55b36f6db62386ddc84088edc18a5a3a24bc9c6a2d","observation_id":"8a1ffac9-03c3-4bcb-a9ef-a128db973ed6","resolution":{"observed_at":"2026-08-02T18:39:40.626602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2603.13224","last_updated":"2026-05-09T03:24:22Z","snapshot_observed_at":"2026-08-05T18:39:49.396872Z","submitted_at":"2026-03-13T17:58:14Z","title":"Visual-ERM: Reward Modeling for Visual Equivalence","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T11:19:42.002790Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2603.13224"},"observation_digest":"sha256:71311077d0fdd401b390d8943c331f985d43b27f0e7c2c84d3142f751c0983f2","observation_id":"96b28228-8386-4a0d-8f79-3a681dc80fc2","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-02T18:16:31.894398Z","title":"Internlm2 technical report.arXiv preprint arXiv:2403.17297,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-05T18:17:01.912120Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:31.894398Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:c59ac55188239d633944645b48fc8c31b53194bb18974893ea78962203e882b4","observation_id":"affbb95c-25f5-46b9-9509-47599f013b87","resolution":{"observed_at":"2026-08-02T18:16:31.894398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2604.07343","last_updated":"2026-07-30T00:53:05Z","snapshot_observed_at":"2026-08-02T23:16:51.675019Z","submitted_at":"2026-04-08T17:55:00Z","title":"Personalized RewardBench: Evaluating Reward Models with Human Aligned Personalization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:28:17.333001Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.07343"},"observation_digest":"sha256:3a3aec53ed458ba43ff0a82546eb814d3b3a6659e31cce8fb4a4bc0395375ef4","observation_id":"5f91b440-5e89-46d0-b59a-43edbdf57fdd","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-02T16:39:51.048852Z","title":"Internlm2 technical report.arXiv preprint arXiv:2403.17297,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.07343","last_updated":"2026-07-30T00:53:05Z","snapshot_observed_at":"2026-08-02T23:16:51.675019Z","submitted_at":"2026-04-08T17:55:00Z","title":"Personalized RewardBench: Evaluating Reward Models with Human Aligned Personalization","version":2},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-02T16:39:51.048852Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.07343"},"observation_digest":"sha256:7cd2c24fac1c10a1f852e52e1d759a3d4bd9301642350e6ab28bdf51d01e63db","observation_id":"48efea46-5b12-427f-a764-774733b42aa8","resolution":{"observed_at":"2026-08-02T16:39:51.048852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2604.07812","last_updated":"2026-04-09T05:09:22Z","snapshot_observed_at":"2026-08-02T06:27:25.025040Z","submitted_at":"2026-04-09T05:09:22Z","title":"HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T17:20:19.653806Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.07812"},"observation_digest":"sha256:94608cc4da98f20ea0e41d5776d35d5548b2e49f5256ff5a6824574575622e71","observation_id":"00da66ee-2403-41ea-91a3-4cca44162316","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2604.08948","last_updated":"2026-04-22T08:13:33Z","snapshot_observed_at":"2026-08-04T17:14:48.512299Z","submitted_at":"2026-04-10T04:36:21Z","title":"TaxPraBen: A Scalable Benchmark for Structured Evaluation of LLMs in Chinese Real-World Tax Practice","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-10T17:59:44.844149Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.08948"},"observation_digest":"sha256:2420fc04a0a3d13f1b949a24610577479143be2a3e9f4f11398086cb3cf29840","observation_id":"7886c7cb-361c-406d-b169-59ed727842ab","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2604.09378","last_updated":"2026-04-10T14:48:29Z","snapshot_observed_at":"2026-07-06T22:58:17.167367Z","submitted_at":"2026-04-10T14:48:29Z","title":"BadSkill: Backdoor Attacks on Agent Skills via Model-in-Skill Poisoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T17:09:24.662459Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.09378"},"observation_digest":"sha256:b925206342fc17e2fd8ebdc4da1484a9c21c36bcadf86fbce458edf117ce17db","observation_id":"f075c135-c828-45a3-939d-20210209be59","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2604.12312","last_updated":"2026-04-14T05:42:41Z","snapshot_observed_at":"2026-08-02T05:56:57.097541Z","submitted_at":"2026-04-14T05:42:41Z","title":"CompliBench: Benchmarking LLM Judges for Compliance Violation Detection in Dialogue Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T14:56:00.449776Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.12312"},"observation_digest":"sha256:581d88588296129dbe948c97343fd42928428533c0f6c24be937e87f3d3e79e4","observation_id":"2bbe4b02-6f5a-40c3-995c-aeb95b1978a8","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2604.14044","last_updated":"2026-04-15T16:23:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-15T16:23:05Z","title":"Decoding the Delta: Unifying Remote Sensing Change Detection and Understanding with Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T13:01:26.436025Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.14044"},"observation_digest":"sha256:ce5b8a4d3ac80fe4dc318fae037bdaa6a7a0855515cdf15e30f53608f91741f7","observation_id":"379b85a3-b710-492f-a00f-7087c9630f99","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2604.15280","last_updated":"2026-07-21T12:12:23Z","snapshot_observed_at":"2026-08-02T16:11:25.481009Z","submitted_at":"2026-04-16T17:49:58Z","title":"Why Do Vision Language Models Struggle To Recognize Human Emotions?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T11:02:51.836285Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.15280"},"observation_digest":"sha256:11149b05d152c530f22d6c9657afb8f17b76ed3cc8b76bc97bf921e06f585b59","observation_id":"48c09f6b-80c5-4538-b71c-25eb02ab6b33","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-02T16:11:27.037155Z","title":"arXiv preprint arXiv:2403.17297 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.15280","last_updated":"2026-07-21T12:12:23Z","snapshot_observed_at":"2026-08-02T16:11:25.481009Z","submitted_at":"2026-04-16T17:49:58Z","title":"Why Do Vision Language Models Struggle To Recognize Human Emotions?","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T16:11:27.037155Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2604.15280"},"observation_digest":"sha256:e3ee9f64ac5a516cd2f243d1f195122b4f60f339259d19fbda79112678d0299c","observation_id":"26889e96-d09a-4668-8138-5e8677587d5c","resolution":{"observed_at":"2026-08-02T16:11:27.037155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.01448","last_updated":"2026-05-02T13:55:28Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T13:55:28Z","title":"Decompose and Recompose: Reasoning New Skills from Existing Abilities for Cross-Task Robotic Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T14:30:00.890117Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.01448"},"observation_digest":"sha256:807c26aa18b3bc1167b561d463a87d706d967ee5fb78671fb15d377ffc4dd8b3","observation_id":"c7117c0e-5a4b-4bc2-9314-9c5a5ad2a79d","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.04495","last_updated":"2026-05-06T04:51:28Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T04:51:28Z","title":"CAR: Query-Guided Confidence-Aware Reranking for Retrieval-Augmented Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T17:24:53.691034Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.04495"},"observation_digest":"sha256:0595652cbec80b27709b009c8aad7458526ed441ef24620f4acd0f73f2a2e21f","observation_id":"8426b689-46c5-46a7-b26b-03f75c86b5ab","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:57b24128d6b888424e653d6922860f72d0659e91169cd5898083a0043070286f","observation_id":"c777bfe9-a4be-4265-a37a-5f570e73b893","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.04870","last_updated":"2026-05-06T13:01:52Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T13:01:52Z","title":"VTAgent: Agentic Keyframe Anchoring for Evidence-Aware Video TextVQA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T16:33:36.368456Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.04870"},"observation_digest":"sha256:8185083c54604ded7c6fa304f699435feb9a7ad44629e1af74160b8fea61833c","observation_id":"e8020996-4e4b-48ac-b6ed-1ea8a38b3ffa","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.08962","last_updated":"2026-05-09T13:59:27Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:59:27Z","title":"MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T02:04:07.344134Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.08962"},"observation_digest":"sha256:f75246b58bca2d07e8821cacfe99869cb2226b810c657a789c14dc55c8bd6216","observation_id":"d8f07c20-acc8-462a-aabd-d7ab3e872405","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.09352","last_updated":"2026-05-10T06:05:04Z","snapshot_observed_at":"2026-07-06T23:21:26.017420Z","submitted_at":"2026-05-10T06:05:04Z","title":"The Wittgensteinian Representation Hypothesis: Is Language the Attractor of Multimodal Convergence?","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-12T03:42:41.434485Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.09352"},"observation_digest":"sha256:cf4d5d92b9d1c4b40576b7a585e98d5e32e32e23c7e042d34b10f32c1a64afe3","observation_id":"fe849d50-87ef-4aa1-b358-584ca01074c3","resolution":{"observed_at":"2026-05-15T11:44:38.670888Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.16770","last_updated":"2026-05-16T02:44:32Z","snapshot_observed_at":"2026-08-02T08:08:44.029895Z","submitted_at":"2026-05-16T02:44:32Z","title":"Exploring Lightweight Large Language Models for Court View Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-19T21:35:00.419585Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.16770"},"observation_digest":"sha256:6c001752cd17eff2a1a9724c3dd5d3f2596e197b6f427cadebefbcfdba567c93","observation_id":"1906c7a2-f59a-42b2-89b6-db8fbd536229","resolution":{"observed_at":"2026-05-19T21:37:47.963794Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.23315","last_updated":"2026-05-22T07:32:07Z","snapshot_observed_at":"2026-07-06T23:33:34.409634Z","submitted_at":"2026-05-22T07:32:07Z","title":"Convergence Without Understanding: When Language Models Agree on Representations but Disagree on Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T04:59:59.593160Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.23315"},"observation_digest":"sha256:3ebcda6254840677cde76c164aa07e2f2a01a4fec56d88d387a56b111b4c852a","observation_id":"9c704ca5-d182-4b69-9f37-1860a7a8233f","resolution":{"observed_at":"2026-05-25T05:00:21.211544Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.30307","last_updated":"2026-05-28T17:51:38Z","snapshot_observed_at":"2026-08-02T22:39:52.853482Z","submitted_at":"2026-05-28T17:51:38Z","title":"Grounded 3D-Aware Spatial Vision-Language Modeling","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T08:08:36.012761Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.30307"},"observation_digest":"sha256:d9bc452b772841289a4eb02e6b15819f03e15de87edc4101b008a8f7084c959f","observation_id":"3b1c716e-8afd-4f0c-b00b-1ace6b648271","resolution":{"observed_at":"2026-06-29T08:13:15.368621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2605.30789","last_updated":"2026-06-02T09:15:19Z","snapshot_observed_at":"2026-08-02T15:38:17.906891Z","submitted_at":"2026-05-29T03:25:56Z","title":"Smaller Models are Natural Explorers for Policy-Level Diversity in GRPO","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T23:54:32.621093Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2605.30789"},"observation_digest":"sha256:1646559ab037d068dfdca8e6ace0dcca9b75c7b1d8100390aba968fbae5221c4","observation_id":"cbcfb6d9-d078-4531-8dc4-62f770210d5b","resolution":{"observed_at":"2026-06-29T00:02:50.016446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.03014","last_updated":"2026-06-02T01:40:33Z","snapshot_observed_at":"2026-08-02T16:16:58.338780Z","submitted_at":"2026-06-02T01:40:33Z","title":"MOSAIC: Efficient Mixture-of-Agent Scheduling via Adaptive Aggregation and Inference Concurrency","version":1},"reference_index":201,"source":"arxiv_source","source_observed_at":"2026-06-28T11:34:24.019560Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.03014"},"observation_digest":"sha256:5d8adb60a884d7b51a7b8721d4be18a7bf9d07c6d2fec95cdc8c21817eac5ae3","observation_id":"bc468521-4c6d-4b0d-be8f-10b356990f3e","resolution":{"observed_at":"2026-07-02T01:46:26.670728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.03131","last_updated":"2026-06-02T04:18:08Z","snapshot_observed_at":"2026-08-02T20:05:30.693121Z","submitted_at":"2026-06-02T04:18:08Z","title":"HARVE: Hacking-Aware Reward-Head Vector Editing for Robust Reward Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T11:32:16.166724Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.03131"},"observation_digest":"sha256:bd09b10568388f86bb2c04d77a01c69d43db46614f352d56686a4ffe7b1a4921","observation_id":"dfe61a3e-a3a6-48b7-b69b-6a8473ab770d","resolution":{"observed_at":"2026-07-02T01:46:26.798520Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.06342","last_updated":"2026-06-04T16:14:13Z","snapshot_observed_at":"2026-07-06T23:46:10.612537Z","submitted_at":"2026-06-04T16:14:13Z","title":"Symmetric Divergence and Normalized Similarity: A Unified Topological Framework for Representation Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T23:18:34.206475Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.06342"},"observation_digest":"sha256:02eedb2e4168dae645cc1c81ef80f8825080ad72560aee96f0d247d1619668c2","observation_id":"4ec984c0-c173-4fdf-a738-b008be3649d7","resolution":{"observed_at":"2026-07-02T15:47:06.979533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.06991","last_updated":"2026-06-05T07:29:20Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T07:29:20Z","title":"Don't Pause: Streaming Video-Language Synchrony for Online Video Understanding","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-06-27T22:11:01.690237Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.06991"},"observation_digest":"sha256:2b36e102b47821b30cb5de8f1cdb3f4a5873e40395f08e3602d7ff05027f0af2","observation_id":"910d1a5d-16df-47f2-9a0f-cf0e687a1aa5","resolution":{"observed_at":"2026-07-02T17:07:12.848001Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.12195","last_updated":"2026-06-10T15:17:08Z","snapshot_observed_at":"2026-08-01T02:09:41.655807Z","submitted_at":"2026-06-10T15:17:08Z","title":"InternVideo3: Agentify Foundation Models with Multimodal Contextual Reasoning","version":1},"reference_index":262,"source":"arxiv_source","source_observed_at":"2026-06-27T09:48:27.652901Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.12195"},"observation_digest":"sha256:58999591dd93b36d72c68c94d1f040b548e4c61b197cad0c53949a8544e6f714","observation_id":"46d887ac-cd1d-4108-a1e4-7c4ff7fa11b7","resolution":{"observed_at":"2026-07-03T10:48:02.946039Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.17798","last_updated":"2026-06-16T11:18:05Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:18:05Z","title":"LiveStarPro: Proactive Streaming Video Understanding with Hierarchical Memory for Long-Horizon Streams","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-27T01:12:46.295455Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.17798"},"observation_digest":"sha256:31cac9228e8fb10c4c9517f952966beb708b5d77c8b466e8d0ded2bfa3b7531f","observation_id":"bb3f9e80-9305-4707-9787-b669bfae4b17","resolution":{"observed_at":"2026-07-03T20:38:56.181360Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.18242","last_updated":"2026-06-16T17:58:40Z","snapshot_observed_at":"2026-08-02T10:04:20.980054Z","submitted_at":"2026-06-16T17:58:40Z","title":"EventDrive: Event Cameras for Vision-Language Driving Intelligence","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T01:26:43.752335Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.18242"},"observation_digest":"sha256:66683cb6cecbb8d8b265a2889bcded23263ae8206304068883a485626538ff44","observation_id":"93876711-365c-427d-850d-e57f551d3530","resolution":{"observed_at":"2026-07-03T20:18:57.098860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.18257","last_updated":"2026-05-06T02:21:57Z","snapshot_observed_at":"2026-08-01T15:29:41.145806Z","submitted_at":"2026-05-06T02:21:57Z","title":"From Memorization to Creation: Evaluating the Cognitive Depth of LLM-Generated Educational Questions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T23:50:38.674342Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.18257"},"observation_digest":"sha256:ffe9d929fe0d37e21daccf458bdc07f1f087fc6401de6c1708fc6e3bb2af514d","observation_id":"ba0d816e-bea1-4400-b87a-0c837e4d369b","resolution":{"observed_at":"2026-07-01T13:15:45.731046Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.22600","last_updated":"2026-06-26T02:45:32Z","snapshot_observed_at":"2026-08-05T19:54:05.746402Z","submitted_at":"2026-06-21T17:20:21Z","title":"On the Position Bias of On-Policy Distillation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T10:45:16.028763Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.22600"},"observation_digest":"sha256:a7a46453d5d5ec100d1fd12bd1abdc255c8e3f095ef414714c7f4e102ca520fc","observation_id":"48026837-9614-4a39-aa3e-369d477e6e4c","resolution":{"observed_at":"2026-07-04T08:59:42.592322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.22600","last_updated":"2026-06-26T02:45:32Z","snapshot_observed_at":"2026-08-05T19:54:05.746402Z","submitted_at":"2026-06-21T17:20:21Z","title":"On the Position Bias of On-Policy Distillation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T05:14:12.795412Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.22600"},"observation_digest":"sha256:9d8aa2e13f482bc424bd029566b0d17ff6eddbfc70a1bd450bdbd67956d57666","observation_id":"8c83e66a-7edc-4b9a-acc1-5fd9e7e1000e","resolution":{"observed_at":"2026-06-29T18:13:49.273784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.27161","last_updated":"2026-06-25T15:29:37Z","snapshot_observed_at":"2026-08-04T02:05:59.242279Z","submitted_at":"2026-06-25T15:29:37Z","title":"TOPS: First-Principles Visual Token Pruning via Constructing Token Optimal Preservation Sets for Efficient MLLM Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-26T04:24:38.917137Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.27161"},"observation_digest":"sha256:858fb08bb2ccb1e8d657d522e32e66915755ddcd838b09b7f77ef13f6f21aa59","observation_id":"7457c98a-fa9e-46f1-a4b1-9d31ddaa1dfd","resolution":{"observed_at":"2026-07-04T14:09:53.742911Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.28876","last_updated":"2026-07-10T02:16:42Z","snapshot_observed_at":"2026-07-15T23:17:48.998907Z","submitted_at":"2026-06-27T11:38:43Z","title":"Memory-Managed Long-Context Attention: Bounded Editable Memory with a Hard Lifecycle and Calibrated Sparse Fallback","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T09:46:57.030469Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.28876"},"observation_digest":"sha256:abe90f4040b2f53cb56673a94ca5171e3860012d073641858fd8d6cdb6647405","observation_id":"1c0a6d94-1ce2-4660-a0e5-7ef100807adc","resolution":{"observed_at":"2026-06-30T09:54:35.304992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-07-13T07:16:45.194991Z","title":"InternLM2 Technical Report.https://arxiv.org/abs/2403.17297, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.28876","last_updated":"2026-07-10T02:16:42Z","snapshot_observed_at":"2026-07-15T23:17:48.998907Z","submitted_at":"2026-06-27T11:38:43Z","title":"Memory-Managed Long-Context Attention: Bounded Editable Memory with a Hard Lifecycle and Calibrated Sparse Fallback","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T07:16:45.194991Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.28876"},"observation_digest":"sha256:e0941a3c5bdaaa8096a32039e89efdae78b17100fe28118c484f52c2c96de89b","observation_id":"0542b6c3-5e2f-48aa-820c-89542bbbc416","resolution":{"observed_at":"2026-07-13T07:16:45.194991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2606.30562","last_updated":"2026-06-29T17:02:34Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:02:34Z","title":"Morphing into Hybrid Attention Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T05:56:51.447893Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2606.30562"},"observation_digest":"sha256:9e2922d2e12ebd85afc156cc670792e0ab65b201cf3b53292eaeaae7ee0c4614","observation_id":"e30ea469-1e5f-49e7-b50c-378befa4935f","resolution":{"observed_at":"2026-06-30T08:44:28.058419Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2607.01707","last_updated":"2026-07-02T04:59:56Z","snapshot_observed_at":"2026-08-02T06:22:23.690891Z","submitted_at":"2026-07-02T04:59:56Z","title":"LASER: A Corrective Lens for LVLMs via Visual Attention Preservation and Sink Suppression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-03T16:53:43.427625Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2607.01707"},"observation_digest":"sha256:cd9c319a89ed1edf342b1e28b8528d0e487a08d267b1e2cdb5f0c776990430fa","observation_id":"16d96f7d-f1e3-4c41-b6fc-22a9572cea71","resolution":{"observed_at":"2026-07-03T16:58:42.350081Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2403.17297","doi":"10.48550/arxiv.2403.17297","metadata_source":"pith","pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternLM2 Technical Report","venue":"cs.CL","work_id":"dfa13e0e-1c3c-4fb6-943d-a19945bacdbe","year":2024},"citing_paper":{"arxiv_id":"2607.02118","last_updated":"2026-07-02T12:53:41Z","snapshot_observed_at":"2026-08-03T21:58:44.127238Z","submitted_at":"2026-07-02T12:53:41Z","title":"Enhancing Fitness Intelligence through Domain-Specific LLM Post-Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-03T13:11:44.893703Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2607.02118"},"observation_digest":"sha256:7f0cad450f9779a23f0feb03b473b3fe4fbb47cbcec8b4db2207d8b9461e8232","observation_id":"a3d2c6ed-2bff-46c6-86c3-26af4c695ed8","resolution":{"observed_at":"2026-07-03T13:18:12.274759Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-02T13:27:15.045935Z","title":"arXiv preprint arXiv:2403.17297 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20470","last_updated":"2026-05-22T13:37:33Z","snapshot_observed_at":"2026-08-05T16:36:59.697953Z","submitted_at":"2026-05-22T13:37:33Z","title":"PlanE: Meta Planning of Data, Tuning, and Inference for Extractive-based LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T13:27:15.045935Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2607.20470"},"observation_digest":"sha256:b9d6e62d18a62300fb1012809dbd7f58162f6696df25d2e145584c0187e16fa3","observation_id":"ae80fdb0-b39e-4f2e-b81c-22562341958d","resolution":{"observed_at":"2026-08-02T13:27:15.045935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-01T03:44:25.443149Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23075","last_updated":"2026-07-25T06:51:02Z","snapshot_observed_at":"2026-08-03T06:00:24.655937Z","submitted_at":"2026-07-25T06:51:02Z","title":"Traceable LLM Reasoning for Fake-Order Fraud Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T03:44:25.443149Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2607.23075"},"observation_digest":"sha256:6b268edd1fc8187ccaf176c1f90caa5c96c2096385b22cee53eb64e5cee86c7f","observation_id":"77dc4a1a-717b-4448-aae7-b650afd36128","resolution":{"observed_at":"2026-08-01T03:44:25.443149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-07-31T01:27:12.590150Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27421","last_updated":"2026-07-29T19:42:33Z","snapshot_observed_at":"2026-08-04T10:12:07.390131Z","submitted_at":"2026-07-29T19:42:33Z","title":"Selecting Open-Weight Language Models for Zero-Shot Intent Classification: A Systematic Evaluation of 41 Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T01:27:12.590150Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2607.27421"},"observation_digest":"sha256:b2d1c66dda9b869560ba345616c3a89247eb05415b744a4e4f0bcac490803cb5","observation_id":"715b7076-78a3-42f9-b383-383bd9266930","resolution":{"observed_at":"2026-07-31T01:27:12.590150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-01T01:24:37.439237Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27790","last_updated":"2026-07-30T07:23:27Z","snapshot_observed_at":"2026-08-03T10:31:11.646814Z","submitted_at":"2026-07-30T07:23:27Z","title":"Semantic-Aligned Structural Abstraction for Multimodal Sentiment Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T01:24:37.439237Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2607.27790"},"observation_digest":"sha256:0a58178fb0dc03dd0490d1f20510fad4f9a3d3e53cad325f8ade95bf676a8822","observation_id":"81395688-194b-4461-bd2c-74c0c08ad58e","resolution":{"observed_at":"2026-08-01T01:24:37.439237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T17:47:36.064409Z","title":"arXiv preprint arXiv:2403.17297 (2024) 26","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03508","last_updated":"2026-08-04T11:51:16Z","snapshot_observed_at":"2026-08-06T05:46:26.573896Z","submitted_at":"2026-08-04T11:51:16Z","title":"From Multi-Resolution Cells to Gigapixel Whole Slide Images Foundation Model for Computational Pathology","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T17:47:36.064409Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2608.03508"},"observation_digest":"sha256:72925f3dc81be7d64c8833c7c31c99ee40b6ddadd6dcb51d8a7934fac55f7745","observation_id":"e307e45a-ab02-482f-8f00-5484db6e875e","resolution":{"observed_at":"2026-08-05T17:47:36.064409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-05T04:17:18.586926Z","title":"arXiv:2403.17297 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04009","last_updated":"2026-08-04T17:59:56Z","snapshot_observed_at":"2026-08-06T05:47:33.043966Z","submitted_at":"2026-08-04T17:59:56Z","title":"SocietyBench: Forecasting Counterfactual Social-World Evolution","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T04:17:18.586926Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2608.04009"},"observation_digest":"sha256:5ff6d0b6e8a4a5bf79354d5fd4434ddf5f64210ef114148bfdff177156bf7c1b","observation_id":"f6d34313-4dea-4f30-83dc-a5537518c26c","resolution":{"observed_at":"2026-08-05T04:17:18.586926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.17297/citation-record","integrity":"/paper/2403.17297/integrity","json":"/paper/2403.17297/citation-record.json","paper":"/paper/2403.17297"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://github.com/MicrosoftDocs/azure-docs/blob/main/articles/ai-services/openai/includes/chat-markup-language.md","venue":null,"work_id":"ddc84d2c-1d10-43c7-8407-b56827141116","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6b3d7236ad06634e0e11847c1a999a09f299da91b45b668b84b0faf789eab87f","observation_id":"97829fbf-0d9c-4a45-90ae-2959c57063d2","resolution":{"observed_at":"2026-05-15T11:44:38.518469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://github.com/ggerganov/llama.cpp","venue":null,"work_id":"bb6f43fe-680f-452f-9df4-b29c26974610","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:efb962100994409051125158a91704775234fb3220787ab7ab386a9ec4b0a556","observation_id":"0d40e19d-eaee-4b82-8617-672e614a3acc","resolution":{"observed_at":"2026-05-15T11:44:38.523075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GQA: training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":"37fe73b3-f28c-4784-aa61-462c2c732875","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a654897e6f33f6265837d55d6c52a1ca7f442b92e3fa7c2c7f2d2c21faab43c3","observation_id":"3a7a1d33-16f6-4860-ac6b-21be572e04be","resolution":{"observed_at":"2026-05-15T11:44:38.525630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cibench: Evaluating your llms with a code interpreter plugin","venue":null,"work_id":"08d988b4-c703-40c0-97a2-50fd55e69f9b","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a7ae3ca83df7a44af07d27ee8bb02b9b74a69da618356de58858228532f2e2a8","observation_id":"f1385b0b-37fa-4da5-938d-67e80eb9a305","resolution":{"observed_at":"2026-05-15T11:44:38.528118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mathbench: Evaluating the theory and application proficiency of llms with a hierarchical mathematics benchmark","venue":null,"work_id":"9fbaeb80-e289-47c4-95cc-21d9641d6bbe","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:32db8a2859d73c1cc84d169571b6ed5e1c3ec371c492984607e81687b5aef1e1","observation_id":"c1e069f6-b1dd-47a5-be17-ebb2c6a20374","resolution":{"observed_at":"2026-05-15T11:44:38.530445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:03:45.699690Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":"6b9cf002-ab59-4c61-ae20-2d2f7b0eecaf","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6e1e21cd2ffc55b9544dc928533ffd76aad376f5675e9c3267eebec71997ecbe","observation_id":"27c9b14c-a1f9-46ee-ab5c-1fae2d3b87de","resolution":{"observed_at":"2026-05-15T11:44:38.532671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9f711468-19ce-4b64-a999-bb8e3e934e66","year":2020},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a8c7ea6fc28a7be1155e334df2f4a7e67af6d842e9063b35b2f7f5032a02f864","observation_id":"a76d24c3-63a9-4937-a19a-5505007735b3","resolution":{"observed_at":"2026-05-15T11:44:38.535107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Amsp: Reducing communication overhead of zero for efficient llm training, 2024 b","venue":null,"work_id":"48e7f24a-4f30-4903-8c83-b06c58f11ad9","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:71e1b7c68257208a5b00c64a17d6859020dfa21caa44cf5bf917dfe447c2ad27","observation_id":"a3620524-6879-4982-8fa1-d82a68fced52","resolution":{"observed_at":"2026-05-15T11:44:38.538283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Theoremqa: A theorem-driven question answering dataset","venue":null,"work_id":"debe7350-7e53-41a1-84d2-f6249c06a5c3","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:aeab3aef65a9b1bd8e147bd07b7b3a240a6d567cc3da6b9cf3762b9cb349319b","observation_id":"1010bce7-7097-4f7b-b14f-8d3bdd5931c8","resolution":{"observed_at":"2026-05-15T11:44:38.541115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agent-flan: Designing data and methods of effective agent tuning for large language models","venue":null,"work_id":"0a1c562f-df76-40c2-96f9-e23aadbf113d","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a2b03d5380eb7301b68e23101b9b0275299ba0ebbc0d10464d84f6e4eac97dee","observation_id":"aeac5f57-9240-47c0-89f8-385c726ab806","resolution":{"observed_at":"2026-05-15T11:44:38.543576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a13efb6c-e25a-45c0-8d9d-944bf659edd2","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:9f52746948498b86120cdd42472d09443dd07717cdb565959018ee4484856fd1","observation_id":"05002084-e366-46e4-9240-b02aa128718a","resolution":{"observed_at":"2026-05-15T11:44:38.545749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":"170cc3cb-da49-4037-b180-686d6f4b558a","year":2017},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:4c260e6f7cb44569ba561a0efa01a4ef5975bcb949abd777c6f7253032caf0d2","observation_id":"d2e62caa-edd3-41b4-8991-3fca0bcc224c","resolution":{"observed_at":"2026-05-15T11:44:38.547900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lmdeploy: A toolkit for compressing, deploying, and serving llm","venue":null,"work_id":"a288d938-5458-4a02-b9c5-9cc18957fa70","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:880078ae3c0cc29c2172738ad89ba38000a9ad5361e9b70ccc5ab212d71892e9","observation_id":"3d851398-87a4-4874-b4fe-3efebd3387ba","resolution":{"observed_at":"2026-05-15T11:44:38.550310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Opencompass: A universal evaluation platform for foundation models","venue":null,"work_id":"1b70101a-14e5-4f39-b4a7-4f07c0143852","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:739ae18f7843f8afb8f1cf8806cf60e24e7554396adb5944f072692cd9eb49b2","observation_id":"c138217d-4db9-4e71-bfc5-2c0a2fb3e326","resolution":{"observed_at":"2026-05-15T11:44:38.552620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ultrafeedback: Boosting language models with high-quality feedback","venue":null,"work_id":"2bcc9414-d433-4ac9-a0f5-e9d100f8da4d","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:4e067e2fc0b122e914a296cb6f819397a3686d6ba2aeebd3c19e8612bf4dcef8","observation_id":"07157ee7-8757-4b35-9817-4388aaabdaaa","resolution":{"observed_at":"2026-05-15T11:44:38.555100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safe rlhf: Safe reinforcement learning from human feedback","venue":null,"work_id":"a321999f-c47c-42fc-8a2c-7686b3c1e109","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ef23cb96cbdcb80efe4d6ca3ca0ef61c9f6e53643d23cdaa57b91c636ed61138","observation_id":"5c4dca02-6312-4877-a683-f05fd0524c93","resolution":{"observed_at":"2026-05-15T11:44:38.558031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding dataset difficulty with V -usable information","venue":null,"work_id":"2c7c5270-9cff-452c-b9db-466ce03e3a08","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:b836f71c81f692c43ef43c66243e4af100913ee5f1300fb71290f10ef9a261bd","observation_id":"8e3db53b-ed09-40e1-899c-e36ac51aa0eb","resolution":{"observed_at":"2026-05-15T11:44:38.560462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"a8b6b7d6-3bb5-45f3-b6d7-7fc13f6bf865","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:e8920179a7e857860d4a174e1687dbe84dd02dfe50f22cfa7b9b86a9b83209e1","observation_id":"f3076b39-0fc9-4d54-9535-c2d485ead989","resolution":{"observed_at":"2026-05-15T11:44:38.563121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":"2402.00838","doi":"10.48550/arxiv.2402.00838","metadata_source":"pith","pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OLMo: Accelerating the Science of Language Models","venue":"cs.CL","work_id":"a1dff8dc-221f-4519-a5d9-7dd458e6fe14","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:40ec6d41bfc7af30cd8acf6ee2bf5aff4b31a9ea859db1cad34a1da1837d5a3a","observation_id":"17017201-f584-43df-bddc-8cc96f117755","resolution":{"observed_at":"2026-05-16T23:00:15.763598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":"2401.14196","doi":"10.48550/arxiv.2401.14196","metadata_source":"pith","pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","venue":"cs.SE","work_id":"f22dae5a-27e2-41d0-a061-c4286418dee3","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:3cf685e0fa11889dc2f146b3908a7e46d49736fc8785de720b870b9bff19a909","observation_id":"cdb45960-754c-4b10-bd67-82787bed7197","resolution":{"observed_at":"2026-05-15T11:44:38.352246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T06:20:38.664414+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T06:20:38.664414+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":"b8f1c697-b540-409a-81ea-05fc9777c47c","year":2021},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:5cb183febb515780eca4bb447e53e981e12f71da302eaf19abd6c91d103897ab","observation_id":"0b2858c4-2181-4a9b-84d0-b4bcc1315c2b","resolution":{"observed_at":"2026-05-15T11:44:38.565493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Characterization of large language model development in the datacenter","venue":null,"work_id":"9e11f920-11eb-4227-8201-1466773bd45a","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:b8a355a7b5f6d6c0479786cb15b4c96044dc13c150d517e43d3b65bef4923364","observation_id":"17abd0e0-81e9-4694-83f1-2ce78713385e","resolution":{"observed_at":"2026-05-15T11:44:38.568098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism","venue":null,"work_id":"b982ef98-c4cb-4df7-8fbc-5a4cf7fd97f4","year":2019},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:356affee5472e2868c9d6d702b61eda38098d404aa202154db26777aa06ffaea","observation_id":"f9e16898-0fae-40f1-8840-9b80a70cb4b4","resolution":{"observed_at":"2026-05-15T11:44:38.570644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reducing activation recomputation in large transformer models","venue":null,"work_id":"539789ca-61c2-4026-9728-680268845d35","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:549f6578ac1f33e0c3c7312ec38a803edbc7703d4f17dd37865cb114e5577db0","observation_id":"c2e07501-cc53-456e-8b76-533e950166d0","resolution":{"observed_at":"2026-05-15T11:44:38.573167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toutanova, Llion Jones, Ming-Wei Chang, Andrew Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":"da4767ea-1362-4aef-be3c-2271342e9aef","year":2019},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a7823493e5886be331af5873befc9730593ac02cda4bb61b1c9b74f6761c91bb","observation_id":"ab31d341-eb76-44b3-9434-87e8eb561ad9","resolution":{"observed_at":"2026-05-15T11:44:38.575840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fabbri, Caiming Xiong, Shafiq Joty, and Chien - Sheng Wu","venue":null,"work_id":"777c8686-d3d3-46de-865b-25c24313287e","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a5834c455c75db7683d8a6e43bb04783ceaf7cbc01c684f3321e04907cb23719","observation_id":"6ba88bef-6148-42a0-af89-d62c765541a7","resolution":{"observed_at":"2026-05-15T11:44:38.578471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ds-1000: A natural and reliable benchmark for data science code generation","venue":null,"work_id":"a99da1ab-387a-4291-b410-83c56370b6fb","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:8d279d5806c50ce1b1760bac1aedcbc63a3a3c8961f4336581da987fd1576f48","observation_id":"eaa87136-0e5a-454e-a970-e0dd0e8c7d2e","resolution":{"observed_at":"2026-05-15T11:44:38.581260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cmmlu: Measuring massive multitask language understanding in chinese, 2023 a","venue":null,"work_id":"8aa1d4ca-f158-4f6f-8835-abaf7bddadde","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:3c7efb7c68a5cf4ecc620a2a17c3043a179bf656ca321a93b827b6781c1adc63","observation_id":"30c50e44-d0ea-4117-b719-bead0d949567","resolution":{"observed_at":"2026-05-15T11:44:38.584007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hashimoto","venue":null,"work_id":"896a46ab-7539-495d-865c-eafc8465c4a7","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:0007575b1fa6207133f3d82a42e0b7941dfc2960935df3498635ce37d95d07aa","observation_id":"41a1cf71-01bd-4921-b9ad-25163a7b74ff","resolution":{"observed_at":"2026-05-15T11:44:38.586494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamically scaled rope further increases performance of long context llama with zero fine-tuning, July 2023","venue":null,"work_id":"1ed64b1c-3dbc-4f1a-a9f1-b2ac5d107d80","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:fb0e792f1d4a35c0e0a3b77999275b661bfde40544bde435254a2e6a3ef7fa9a","observation_id":"46571e17-9067-47d9-a183-032ab438e1b3","resolution":{"observed_at":"2026-05-15T11:44:38.589454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"fd834bd2-ea89-427a-8fb8-66a71fb8bcf0","year":2019},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ff36368c0f69aa33fde55a2dd76e6dc83391b9e4245eac94426bb84b7f3fe365","observation_id":"4fd56c9f-b9ed-4eef-a137-7685bc016a1c","resolution":{"observed_at":"2026-05-15T11:44:38.592078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Longwanjuan: Towards systematic measurement for long text quality","venue":null,"work_id":"38de68ef-3fb7-4cd0-9d5a-4d34fbaeca62","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:eb2c3f70596df054ab7ef305625c486a53efcc73b1651daa375394862a6b6eb1","observation_id":"304ac6a6-4767-44eb-97ff-2e24f8fa0592","resolution":{"observed_at":"2026-05-15T11:44:38.595051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Categorizing variants of goodhart’s law","venue":null,"work_id":"c2b50547-807e-4d58-b1f1-7310ebff0304","year":2018},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:c878b3ced4217b3b5ddaa80f3ccb7fa601856605a60bf15afb563ce705354cbb","observation_id":"3112e327-ddb1-48c9-afdb-709154ea7308","resolution":{"observed_at":"2026-05-15T11:44:38.598285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mixed precision training","venue":null,"work_id":"4ad7bdef-7a00-4233-a9e2-2675058f1fd7","year":2017},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:93fe58c135fc4d198d5aa3bb3a925efa0be2a1d785f262aa4d5223a6eadd2883","observation_id":"461f1a9f-efff-47b1-8a74-86eefee0a793","resolution":{"observed_at":"2026-05-15T11:44:38.600635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9ac8fa07-28a0-4f0e-9122-8f76b48e58f2","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:21d344a1b832fe4e39b4cd3c2e0de8590254f15b691dcfb223e47c44df7ccd05","observation_id":"70bb8042-9f35-4934-b53c-323fc8faaddd","resolution":{"observed_at":"2026-05-15T11:44:38.603271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero: Memory optimizations toward training trillion parameter models","venue":null,"work_id":"503632b8-f687-4c7b-96d1-b3006b40d3b6","year":2020},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ad013f8cd08c1742aa363245e94c6b44d8a280e84a22aa4042b6ac7650aa73ce","observation_id":"24b2bc5b-79f1-4d07-b284-14f5fb4e2ac6","resolution":{"observed_at":"2026-05-15T11:44:38.605970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":"28feb47c-183c-441a-8b93-7e197c30bcf6","year":2020},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:d20e665ca14634bf73f5ae4ece86fd1ddc307b23927ffdfba60b435a962659e5","observation_id":"e0b32e98-4215-4257-9330-e8de9437e624","resolution":{"observed_at":"2026-05-15T11:44:38.609445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09668","last_updated":"2024-02-15T02:27:57Z","snapshot_observed_at":"2026-08-02T17:18:00.402118Z","submitted_at":"2024-02-15T02:27:57Z","title":"How to Train Data-Efficient LLMs","version":1},"cited_work":{"arxiv_id":"2402.09668","doi":"10.48550/arxiv.2402.09668","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.09668","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sachdeva, B","venue":"arXiv (Cornell University)","work_id":"b0f019d0-8b33-4842-a519-7e8b767152e0","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2402.09668","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:f726030f3e2b2b4493f4551b06ba33daf4498cedd0e17b98819e6b0d76f5d0f5","observation_id":"792957dc-e756-4ca0-bad0-21339c6cd949","resolution":{"observed_at":"2026-05-15T11:44:38.337372Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":"2560d586-2452-4fcb-ac5b-626cac6095e7","year":2020},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:7055bf3254bfeeb9ab9e410503b5ae1cc24d5705d227c72935c34f662f0e93b7","observation_id":"e84eec9b-d28f-4f91-b866-110a378794b8","resolution":{"observed_at":"2026-05-15T11:44:38.612162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09679","last_updated":"2019-12-17T16:44:40Z","snapshot_observed_at":"2026-08-04T21:38:19.353610Z","submitted_at":"2019-04-21T23:49:02Z","title":"Investigating Prior Knowledge for Challenging Chinese Machine Reading Comprehension","version":3},"cited_work":{"arxiv_id":"1904.09679","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1904.09679","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Investigating prior knowledge for challenging chinese machine reading comprehension","venue":null,"work_id":"7217ee0b-b650-49f5-8a3c-14d9d4919102","year":2020},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/1904.09679","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:920943b7ad14a154e6bbe9351dcbb755c35d7155d222216c75449951720e7e1d","observation_id":"a5e818fc-d843-442c-a034-3a286b2f1204","resolution":{"observed_at":"2026-05-15T11:44:38.297497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a65db006-4ddf-4a3f-b9e5-94a5d90f9681","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:7a795afe24a05211492c9f7f0d4dcf2eed7df495f79ae9e52e16f4305f43dc5d","observation_id":"6f4ef07b-ece9-4b4e-8628-b06470677179","resolution":{"observed_at":"2026-05-15T11:44:38.614136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"bb9b29b5-888b-4b2a-aaea-a1cd61971a2b","year":2017},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:714eda76651a838957539eb85d95d413b66918e090867a425b8c766961bc8747","observation_id":"71615caa-ad9e-475c-9542-3a492e10b4ca","resolution":{"observed_at":"2026-05-15T11:44:38.616743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Skywork: A more open bilingual foundation model","venue":null,"work_id":"02de259c-18d4-47a5-95f7-c9aeec952461","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:eabebf37f7319cec04bf9de72385fe36c607b9239ee75389ad4c2135df705388","observation_id":"5dd1e8f2-4264-448f-8228-d6e1732fc581","resolution":{"observed_at":"2026-05-15T11:44:38.619714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09739","last_updated":"2024-07-17T20:50:11Z","snapshot_observed_at":"2026-07-06T17:30:25.359458Z","submitted_at":"2024-02-15T06:36:07Z","title":"QuRating: Selecting High-Quality Data for Training Language Models","version":3},"cited_work":{"arxiv_id":"2402.09739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.09739","snapshot_observed_at":"2026-07-03T19:18:54.736613Z","title":"arXiv preprint arXiv:2402.09739 , year=","venue":null,"work_id":"00074fdb-f90b-47dd-9baf-a608823f0343","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2402.09739","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:8c95f926fec74697e5f3cc1abb6f9bbec6a258983b35799976c91c29b3829f47","observation_id":"8f757b88-4eec-45e2-a1bf-77dd0261d419","resolution":{"observed_at":"2026-05-15T11:44:38.290169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Narasimhan, and Yuan Cao","venue":null,"work_id":"901e6b7a-4d5e-476f-9403-2e19ee41f36b","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:7355fa177eff6288e6531f7f2adf73cb2e6dc35f9fcfe2fc462a183881ce329d","observation_id":"68f96622-52ec-4604-824e-07fd248ba4af","resolution":{"observed_at":"2026-05-15T11:44:38.621816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Internlm-math: Open math large language models toward verifiable reasoning","venue":null,"work_id":"64bdd75e-54da-42fa-8e75-4d93eb07e77c","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6bd3e3a8accc0afc683917bb55c307fa8926d7d513413b44a18df63a558037ff","observation_id":"73ce2f7e-34f5-4675-a5c6-eeedc51bf7b7","resolution":{"observed_at":"2026-05-15T11:44:38.624159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GLM-130B: an open bilingual pre-trained model","venue":null,"work_id":"aae4bb42-6f81-42bf-bacc-6cf1d9dc2637","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6622c10d1bbbe58ca53f523178798135f71dbffde5b7101bddfb296d7e645bd3","observation_id":"22b16eec-cf64-4f95-a68f-803ce1cade2c","resolution":{"observed_at":"2026-05-15T11:44:38.626351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Root mean square layer normalization","venue":null,"work_id":"7bc333f8-3c24-41b9-b082-18976d314807","year":2019},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:19a4bcec82d4c80adec662277a0fe4676886fe4f7e1c723c98965ba8ea2f2125","observation_id":"983887af-6570-4c39-b5b3-6a19d61cbb19","resolution":{"observed_at":"2026-05-15T11:44:38.628463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating the performance of large language models on gaokao benchmark","venue":null,"work_id":"b827e000-6964-495e-818f-7566a3e674cb","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6a9395e057f2da697d13731c332a79390cdeff5110a33c5cfbc745064a8274e7","observation_id":"eb6bb28e-469b-43c1-99f8-a68fa6175e99","resolution":{"observed_at":"2026-05-15T11:44:38.630956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mics: Near-linear scaling for training gigantic model on public","venue":null,"work_id":"f1e9ed2c-6491-47b3-9340-4a66b5be4458","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:3a7dc820806df7e1418f3bfbf09e31ffb4225a715d8d24cffce2c7c15b17d51f","observation_id":"50a0ba95-283f-427b-a93a-782ebab330e4","resolution":{"observed_at":"2026-05-15T11:44:38.633185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"P Xing, Hao Zhang, Joseph E","venue":null,"work_id":"7dc5cef7-4712-44c7-8530-949f726769fb","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:1c47097d45c435a3ef855f1aad02f3fc98e4a027bcfbb1466f26fc80c6998c09","observation_id":"01cc1215-0c87-400e-bfc9-ee418b8dff80","resolution":{"observed_at":"2026-05-15T11:44:38.635363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agieval: A human-centric benchmark for evaluating foundation models","venue":null,"work_id":"9bacb1bc-b7a5-49e6-a109-3192ad8f348c","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:0595bd85e559a96723672e3702c0d6d587bcc93a7e1bc9cb96ac22c238b3b761","observation_id":"58ddb2a2-1007-422b-9430-f1cae09d85b1","resolution":{"observed_at":"2026-05-15T11:44:38.637826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"76834421-1b34-42d4-89b8-da3fa6f3e456","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:e872c71ba75e85ce1467f7c85867e3ccd3b544790899d281a20a7ff8e991bec2","observation_id":"80b1a5f3-c227-4078-9c74-9d20c55c5331","resolution":{"observed_at":"2026-05-15T11:44:38.640010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16819","last_updated":"2024-02-27T15:22:57Z","snapshot_observed_at":"2026-07-06T17:35:41.168780Z","submitted_at":"2024-02-26T18:43:45Z","title":"Nemotron-4 15B Technical Report","version":2},"cited_work":{"arxiv_id":"2402.16819","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.16819","snapshot_observed_at":"2026-07-04T18:40:03.166467Z","title":"Nemotron-4 15B Technical Report","venue":null,"work_id":"5805e196-fdb8-4afa-84a5-9fbbe8b0763d","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2402.16819","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:30c9d4f955f258e0434ea2be9d7864b4dc9fdd6438e5fa6fcdc27d9676a2f27c","observation_id":"0b15add6-c13d-429e-be15-9f5eaae1f3be","resolution":{"observed_at":"2026-05-15T11:44:38.367934Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:07:05.804778Z","title":"Scaling Learning Algorithms Towards","venue":null,"work_id":"bb2761cc-98d0-411b-92f6-803773d64460","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:9da2edb3f0eb0cda04355cf5d156d99da3ad15801af67b6046b945bd057418b3","observation_id":"d689f78f-561b-480f-b9f2-4d76ae2ec6a9","resolution":{"observed_at":"2026-05-15T11:44:38.642399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"19th USENIX Symposium on Networked Systems Design and Implementation (NSDI 22) , pages=","venue":null,"work_id":"daeb4bb6-fefa-438b-936f-fb496875bee0","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:36783b5cd43b1a2cbee1810bc23fcbcdb1797158cdd5b4e2bb9b1cebb302771f","observation_id":"f492e7c4-2bba-486f-b58e-040fc5fe74c6","resolution":{"observed_at":"2026-05-15T11:44:38.644487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"USENIX Symposium on Networked Systems Design and Implementation (NSDI’24) , year=","venue":null,"work_id":"da3f3cef-27e5-4c4d-8681-0fd469a5a6cc","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:8f922b00229e2885cc6f93506e7f56a8616a6948fbd8e98382ef2445eff03b0c","observation_id":"c32df830-f466-41ee-b576-1334c73440ab","resolution":{"observed_at":"2026-05-15T11:44:38.646491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"13th USENIX symposium on operating systems design and implementation (OSDI 18) , pages=","venue":null,"work_id":"067f7e5f-675a-43c7-86a9-a899fbf7f2a5","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6aef21172e76598c69a0cd263744416be991e2b5586f69335c0789458e523dd8","observation_id":"d208c1a6-b6f7-4743-8889-f35c9891bfd3","resolution":{"observed_at":"2026-05-15T11:44:38.648383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13013","last_updated":"2024-02-20T13:56:38Z","snapshot_observed_at":"2026-07-06T17:32:52.500465Z","submitted_at":"2024-02-20T13:56:38Z","title":"Code Needs Comments: Enhancing Code LLMs with Comment Augmentation","version":1},"cited_work":{"arxiv_id":"2402.13013","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13013","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2402.13013 , year=","venue":null,"work_id":"90ebc50e-7358-4e7c-8408-072fd0324101","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2402.13013","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:8192833e376f71d01d83da182d3064e096a3db10d01c67fb4371be54fd5e9d80","observation_id":"d4527544-ec7c-49b1-9c71-26c6b2fe4cfb","resolution":{"observed_at":"2026-05-15T11:44:38.344488Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"4c76678a-63c0-48e5-91aa-c7ec06d39abb","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:2f841129ac864da6a762f54bd52c24a8bc768f895f700cb5e0621abda7914314","observation_id":"572628af-9556-4c10-892e-100d9e56c4c4","resolution":{"observed_at":"2026-05-15T11:44:38.650146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:40:41.120475Z","title":"Proceedings of the 26th ACM SIGKDD International Conference on Knowledge Discovery & Data Mining , pages=","venue":null,"work_id":"dd702f8b-e624-439f-b298-7381e66d860b","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:3cdd74f4ffa659e11bca3b9de67481fe5c374db638f36d646eedfe832b201f7b","observation_id":"4504217e-82ba-4b4d-9b4b-64f6fd3f2967","resolution":{"observed_at":"2026-05-15T11:44:38.652521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the VLDB Endowment , volume=","venue":null,"work_id":"4e507b3b-2506-4cb5-b8b0-e085597b542d","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:417dee848e6d85efbc76304525db2774d6981dc3d886f76e1dd30b7e608c085e","observation_id":"09104014-1ba5-4fb9-8d86-d987a0ee31c4","resolution":{"observed_at":"2026-05-15T11:44:38.654468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How to Train Data-Efficient LLMs , journal =","venue":null,"work_id":"28bfb97f-eef6-48ed-a227-0cd9144a63d7","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:62712bee9377a04c5dc387b1831ae7c664fa2a8a267ce71112f1e3d74295135c","observation_id":"48095d4f-f079-4ad1-a919-83f92c0e8864","resolution":{"observed_at":"2026-05-15T11:44:38.656580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"55c61479-51e4-4663-b616-62c6c3e40fda","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:b437ceef679e23d3036e22ed1c26964e13232a7a71ef29b173dcad5c8f5ad9e4","observation_id":"97cffde5-d8b7-496e-8fe2-11fc98e1ceda","resolution":{"observed_at":"2026-05-15T11:44:38.658322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wu and Y","venue":null,"work_id":"b51b1e68-9b4d-4e30-b464-3f4a2c34eb6f","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:670613ff1bb3bdbe0858bc1d99250f37295526137f061789b718df5d84593172","observation_id":"9726673b-043a-4212-a0e3-84ff78092036","resolution":{"observed_at":"2026-05-15T11:44:38.660247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"04d61cb9-73c4-40e8-9750-dc2df7ea3031","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:9af7793dca85ed54df5dbce07d2575141c1767e707f809f18804444fa29f39c5","observation_id":"802eef8f-290c-4fa7-b083-2e90d17a1140","resolution":{"observed_at":"2026-05-15T11:44:38.662119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"71502746-b555-452f-8ffd-93b3086509f5","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:c12209ec9fd04a097bf2aef8b5360e738a22ab11ad75c0ec92566da27b1e10d7","observation_id":"647a01f9-9f5b-4443-8f52-8ab8a67b5fce","resolution":{"observed_at":"2026-05-15T11:44:38.663784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09149","last_updated":"2024-01-22T06:40:44Z","snapshot_observed_at":"2026-07-06T17:16:47.315706Z","submitted_at":"2024-01-17T11:47:59Z","title":"InternEvo: Efficient Long-sequence Large Language Model Training via Hybrid Parallelism and Redundant Sharding","version":3},"cited_work":{"arxiv_id":"2401.09149","doi":"10.48550/arxiv.2401.09149","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.09149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2401.09149 , year=","venue":"arXiv (Cornell University)","work_id":"df9eb565-60d6-4240-9926-b66f4bada72b","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2401.09149","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:c786ad2fabb3f24f5d1889907c6c51923522637e15c3bdde5f40645a74f8e5d3","observation_id":"61b4aab4-62b2-475d-8ee1-443922e1e0f6","resolution":{"observed_at":"2026-05-15T11:44:38.356162Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T07:00:49.372351Z","title":"SC20: International Conference for High Performance Computing, Networking, Storage and Analysis , pages=","venue":null,"work_id":"f62f435f-90be-45ec-bdea-343bdc2734f6","year":2020},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:e4d9b2392df8e1586560a386b4d4beaa8677a52c67cc7d599a6f9ee5664f0e87","observation_id":"4b63cb89-dc03-4313-8708-a86945c4359c","resolution":{"observed_at":"2026-05-15T11:44:38.666120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:42:40.394002Z","title":"Proceedings of Machine Learning and Systems , volume=","venue":null,"work_id":"b81a5a71-f57e-42f0-9a44-77664125373e","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:0adf4805a4192ea105502d65a7707d3c17082712678ee1cef1e06c1aeb3f14ec","observation_id":"3b205ea0-f6a5-4698-b3ca-8c735a313825","resolution":{"observed_at":"2026-05-15T11:44:38.668101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"8e0cfa73-0d5f-464e-b095-f2225b34a274","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ab40f3be15c8fe9c873cb93aba15426e0af056f945c992ad0bff293d6aa2984a","observation_id":"49be7d67-c849-4a5c-9dbd-5a619e383518","resolution":{"observed_at":"2026-05-15T11:44:38.670144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":"1909.08053","doi":"10.48550/arxiv.1909.08053","metadata_source":"pith","pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","venue":"cs.CL","work_id":"c888e6d1-0b1d-43d6-9ef5-f0912a0efa1b","year":2019},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a859f8d90cf7f9a51052a3741bd9b2f537caafcde56eccf191b46c828ca53dfd","observation_id":"6373220f-520c-4288-8962-0666c4ec80a0","resolution":{"observed_at":"2026-05-15T11:44:38.305794Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"77744bfc-ea50-44d7-b46d-50f728b256bc","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ef14d947c48bcbf154e23838fcb61df3cf80217a3b3d68af2cb5f48bd9e53b52","observation_id":"e3b87393-5352-4ab4-a3b2-f1e8a5f0bebc","resolution":{"observed_at":"2026-05-15T11:44:38.382863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the International Conference for High Performance Computing, Networking, Storage and Analysis , pages=","venue":null,"work_id":"c158bfaf-23cd-49bb-9144-994e4e3e28a5","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:92345430f6ca79b38192d37e636c1c8f915bc7ed78a0a5276133d19d18b7efe4","observation_id":"dc5d63e6-ac95-4b0b-bfe5-34471f37b26e","resolution":{"observed_at":"2026-05-15T11:44:38.385906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9ebe38f7-7e8b-49f7-9f92-78a4318c71ab","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:2cb836f06bcac13af4f43e405035730abc0accf16a173658683c3be655279612","observation_id":"79835437-3282-4e0c-895c-b4b697449a86","resolution":{"observed_at":"2026-05-15T11:44:38.388552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:07:05.766846Z","title":"and Osindero, Simon and Teh, Yee Whye , journal =","venue":null,"work_id":"0a5921e3-ac4e-46f1-85ae-866119a87be0","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:5342af721635f4aa7daa38199d263f9a7ae042174d5a4ef273c43f9514f6d682","observation_id":"22db64fa-2c1d-4136-9eaf-a6d58acd5c76","resolution":{"observed_at":"2026-05-15T11:44:38.391279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:57:45.913036Z","title":"2016 , publisher=","venue":null,"work_id":"cf0899e0-53ee-4591-aae4-f38fa5ac12ad","year":2016},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:dff5fbd6cd7caa48b2a07b7a9fe3047853589dbfb0a5389a0606c8eb7b620958","observation_id":"809c8ef4-9b73-44b0-99df-a41a6af67b48","resolution":{"observed_at":"2026-05-15T11:44:38.394050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.950075Z","title":"Christiano and Jan Leike and Tom B","venue":null,"work_id":"06840f88-63ab-405b-b00b-3274296ae320","year":2017},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:b9031efd582b8f28606fd174354b9597742808c8bcecdff3dc809309a5ed8b80","observation_id":"58fbda4a-b4f1-43a4-8fb3-d305431437e2","resolution":{"observed_at":"2026-05-15T11:44:38.396745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:8906947a5d183847926a00e624fc1ced7bdb5c543bf5575844ae94f10555fc43","observation_id":"24acce60-4fb0-4a53-abf6-7c0ef8ab9977","resolution":{"observed_at":"2026-05-15T11:44:38.380080Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2351.110236","doi":"10.1145/1102351.1102363","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Preference Learning with Gaussian Processes","venue":null,"work_id":"c7e1a6fe-9922-4227-9be5-2ce9a9c6154d","year":2005},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":131,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ad84172206f4cb6059f9acd1a8df08e8112369ed52c5371b9d5cf60b8b0a507b","observation_id":"c682c4c1-f78d-473e-b559-f7a81a971488","resolution":{"observed_at":"2026-05-15T11:44:38.243928Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T17:23:06.399849+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T17:23:06.399849+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2017.324","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"(2017) Focal loss for dense object detection","venue":null,"work_id":"01d423c6-2d6b-4f3a-979f-9eb323635cfa","year":2017},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":132,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ea323de131477d8b29bfd5730bd7f4905732ddb6a04041e4e630a7c5a7c4d079","observation_id":"73c3e2f0-41d5-4c97-a11c-507cb8e2e71b","resolution":{"observed_at":"2026-05-15T11:44:38.147876Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T07:49:31.66643+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T07:49:31.66643+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:32:21.995696Z","title":"2022 , eprint=","venue":null,"work_id":"290b799d-7b6d-426f-b12b-1d750d415539","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:139cf72708e4c62db6ea010a694905318970d488b9171386bf2e7b5702fdda56","observation_id":"308c5fff-4e50-4afc-b9b0-575895e49970","resolution":{"observed_at":"2026-05-15T11:44:38.399266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ziegler and Ryan Lowe and Chelsea Voss and Alec Radford and Dario Amodei and Paul Christiano , title =","venue":null,"work_id":"68f47947-d0d8-45da-9341-f2dae74ed93c","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":134,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:dd76b586e2d4af7a9e910ecf80837180410ee02791e088f0bfcc9623eb91fbf0","observation_id":"5cdafcca-d327-421b-b904-4e6859a24767","resolution":{"observed_at":"2026-05-15T11:44:38.402494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":"2305.20050","doi":"10.1007/bf00262952","metadata_source":"pith","pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Let's Verify Step by Step","venue":"cs.LG","work_id":"6d05b790-04c5-4fd2-91b2-ba1dfdd5770f","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6246ead497608680e1df0759e9fbd7f52dda346dfd0e22b1a889df5c2ef77c56","observation_id":"f9e36472-49ff-47be-87a4-0011e9250d8a","resolution":{"observed_at":"2026-05-15T11:44:38.302566Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:25:58.132918Z","title":"2023 , eprint=","venue":null,"work_id":"865f7077-57b7-4cf5-b1c5-4996fcad2063","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:4b4a6a97ac280c48d6b6507d62f5688312507e34380441e990f862f5b5b27912","observation_id":"c32dc6ee-a4ea-4e64-8413-5590c33c410a","resolution":{"observed_at":"2026-05-15T11:44:38.405208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:47:55.932908Z","title":"Understanding Dataset Difficulty with","venue":null,"work_id":"1db96b79-a85a-403f-ba2b-d80b3ba649fc","year":2022},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6e2239c2c4235b9d2b1fd33fc05ee68a5fe7582c04ca1ad0e94fb6fea431828c","observation_id":"41746490-b5ec-4968-9074-6c5fca676f45","resolution":{"observed_at":"2026-05-15T11:44:38.407819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GitHub repository , howpublished =","venue":null,"work_id":"7732b05f-eba7-4d26-93c0-b30435bdcddc","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":138,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:5d8deb5c9b99e972dcf8d3ef7ead47ed83a22288baa349b7ce65eae8763f4810","observation_id":"99ecc1d9-b13d-431e-b583-086846b53a41","resolution":{"observed_at":"2026-05-15T11:44:38.410503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GitHub repository , howpublished =","venue":null,"work_id":"07f3a1c1-df31-4a48-b49c-24f4da878d98","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:211f989182aa582f645d4336f833bbfce147f695abeae29a6806f63d9fda5a34","observation_id":"99a5b0c8-b4d4-4c95-8612-a020b7c883dd","resolution":{"observed_at":"2026-05-15T11:44:38.413085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"author=","venue":null,"work_id":"8e78632d-98f1-4912-9d3f-9f601ea84a9d","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:a3bf16a7e674320c8c4deacdcd28094835c598e28c1c2901e5aa0ec037e3cbec","observation_id":"018f67bf-4c0b-4b38-9228-89917d15c0e3","resolution":{"observed_at":"2026-05-15T11:44:38.415537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , month=","venue":null,"work_id":"f4a443ec-8aed-4e32-a5ed-19af9746ce36","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":141,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:555037534f1fba1b17373bb97350e60ec0ec60b56f77c5734cce4cc42b61c415","observation_id":"ee4a9bb3-def5-4b4c-bbce-ca0054a7347b","resolution":{"observed_at":"2026-05-15T11:44:38.417991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:31:35.516699Z","title":null,"venue":null,"work_id":"b2fa25bb-75f7-4d60-b9a4-4bead50bd86e","year":null},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":142,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:42fdddf4ff8bf1f0f101d38f57cdb3fc593cf75019b5e496b79486933372a87a","observation_id":"50f07c67-0777-483f-bb32-0e7eee275493","resolution":{"observed_at":"2026-05-15T11:44:38.420762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , howpublished=","venue":null,"work_id":"67f95d6a-0240-4936-a2ee-3f5d0f6d94da","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":143,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:fd2c387339d43a2444663fa8bd149d52164e94583795ac26104096de56fcdfe6","observation_id":"12bbfef4-0b05-4e7b-a7bb-6c2df6e4325c","resolution":{"observed_at":"2026-05-15T11:44:38.423585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09149","last_updated":"2024-01-22T06:40:44Z","snapshot_observed_at":"2026-07-06T17:16:47.315706Z","submitted_at":"2024-01-17T11:47:59Z","title":"InternEvo: Efficient Long-sequence Large Language Model Training via Hybrid Parallelism and Redundant Sharding","version":3},"cited_work":{"arxiv_id":"2401.09149","doi":"10.48550/arxiv.2401.09149","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.09149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2401.09149 , year=","venue":"arXiv (Cornell University)","work_id":"df9eb565-60d6-4240-9926-b66f4bada72b","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":144,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2401.09149","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:41cccca93a4da2ce30faa102911e47f22cea2d81da0f39f6d6fe1e8826a4e277","observation_id":"0f95091f-4942-4288-b96d-f2745c75f862","resolution":{"observed_at":"2026-05-15T11:44:38.287109Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19341","last_updated":"2023-10-30T08:31:47Z","snapshot_observed_at":"2026-08-06T06:09:43.812715Z","submitted_at":"2023-10-30T08:31:47Z","title":"Skywork: A More Open Bilingual Foundation Model","version":1},"cited_work":{"arxiv_id":"2310.19341","doi":"10.48550/arxiv.2310.19341","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.19341","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"stitched","venue":"arXiv (Cornell University)","work_id":"b77c4dc3-f2c0-4513-b1de-5703b0468dda","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":145,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2310.19341","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:3f2f74dd248812af08278a0a544138edda62f52a2b2a44ea25cff5199c75c8ff","observation_id":"08bb3c70-e9ca-4d20-b2a4-61d598689b90","resolution":{"observed_at":"2026-05-15T11:44:38.158686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":146,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:ea1c3ea1cb0e12a3640a9f14458ff53ca23ba6461aeba81ff57292bda360c09d","observation_id":"fbb939c1-d1fd-47aa-b459-a30f4166bc4d","resolution":{"observed_at":"2026-05-15T11:44:38.165902Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11088","last_updated":"2023-10-04T10:04:25Z","snapshot_observed_at":"2026-07-06T15:56:38.019661Z","submitted_at":"2023-07-20T17:59:41Z","title":"L-Eval: Instituting Standardized Evaluation for Long Context Language Models","version":3},"cited_work":{"arxiv_id":"2307.11088","doi":"10.48550/arxiv.2307.11088","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.11088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2307.11088 , archivePrefix=","venue":"arXiv (Cornell University)","work_id":"8c5b99fd-55bf-4d88-b148-8bb61e28ee99","year":2024},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":147,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2307.11088","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:c315ae2b44cbfc96df221459246a4eacce6b8f11f3fe8a6c123f7e7d8fef6cd0","observation_id":"c8d343fb-e86f-43e3-9e17-4839fb1389e0","resolution":{"observed_at":"2026-05-15T11:44:38.169759Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-02T11:20:36.216220Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":"2308.14508","doi":"10.48550/arxiv.2308.14508","metadata_source":"pith","pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","venue":"cs.CL","work_id":"ba7831c4-9427-4e0e-a5c1-4e98511f4b53","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":148,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:6dcfe33350a47f87038c90d254161b08ee1669e31711e040a7e02b6baff6f01e","observation_id":"415934c8-667f-4497-a63d-da8295d89194","resolution":{"observed_at":"2026-05-15T11:44:38.181891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":"2309.07864","doi":"10.1186/s12912-025-04245-9","metadata_source":"pith","pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","venue":"cs.AI","work_id":"985ca219-7e34-4c4f-bdc5-ccd39763ad61","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":149,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:5a615347df752dde8b9937f59bf8f633625c51c278a75d0240d20866d0cc96be","observation_id":"d6a3cf08-0b43-4930-814a-8d21be62e240","resolution":{"observed_at":"2026-05-15T11:44:38.185681Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":"2312.10997","doi":"10.1186/1476-072x-8-72","metadata_source":"pith","pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","venue":"cs.CL","work_id":"b80d2790-6cd9-4c87-b3c4-de404f99a80e","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:fbbeac4a533d41b60f60cdfe940bb884fcc703ae1b845ff5207adcde4e388b26","observation_id":"425252be-ba26-4ab3-9f23-444edab00c15","resolution":{"observed_at":"2026-05-15T11:44:38.189111Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16039","last_updated":"2023-11-14T01:40:13Z","snapshot_observed_at":"2026-07-06T16:24:38.375055Z","submitted_at":"2023-09-27T21:41:49Z","title":"Effective Long-Context Scaling of Foundation Models","version":3},"cited_work":{"arxiv_id":"2309.16039","doi":"10.48550/arxiv.2309.16039","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.16039","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A., Oguz, B., et al","venue":"arXiv (Cornell University)","work_id":"100ca4eb-be6f-4510-9c7f-bbb24f10d946","year":2023},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":151,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2309.16039","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:49e4bc8e76adcd4dd718dbefa74aecb4f3573bfee3a3b17438d92797d95433da","observation_id":"b751f984-93be-4913-a9ad-b0e1f11f1341","resolution":{"observed_at":"2026-05-15T11:44:38.193152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":9,"verified_exact":13,"verified_fuzzy":70},"total_outbound_references":172},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 100 of 172 outbound references and 76 inbound Pith citation observations for arXiv:2403.17297."}