{"as_of":"2026-08-24T02:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:92691e7f673dc2e9183060097ea5638ca447592eb924affab0a369ca498f904d","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":112,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":112,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":49,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:12:01.959889Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":112,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2302.14045","last_updated":"2023-03-01T11:04:51Z","snapshot_observed_at":"2026-08-21T21:14:46.636998Z","submitted_at":"2023-02-27T18:55:27Z","title":"Language Is Not All You Need: Aligning Perception with Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T18:32:22.813668Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2302.14045"},"observation_digest":"sha256:dc480cdd1c120771df1a379c64b75c6356309c77681f2c846005f3f9843664a0","observation_id":"7243a705-f6df-4dc9-9652-b79c103cdd77","resolution":{"observed_at":"2026-05-15T18:32:22.945650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2303.17580","last_updated":"2023-12-03T18:17:21Z","snapshot_observed_at":"2026-08-12T12:50:51.005571Z","submitted_at":"2023-03-30T17:48:28Z","title":"HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T00:06:45.440071Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2303.17580"},"observation_digest":"sha256:f467c9d30b0fd255964e5650613e53282f19ab7fbd5787004c1b86c62c01606d","observation_id":"39128a26-8fef-4469-b28a-93936a101372","resolution":{"observed_at":"2026-05-14T00:06:45.584018Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2303.17760","last_updated":"2023-11-02T17:34:57Z","snapshot_observed_at":"2026-08-16T08:17:30.538734Z","submitted_at":"2023-03-31T01:09:00Z","title":"CAMEL: Communicative Agents for \"Mind\" Exploration of Large Language Model Society","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-14T01:40:53.351795Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2303.17760"},"observation_digest":"sha256:aa7b07201effd29d58f9fdfdd606ad8ba0ca26501af78fb34944802b56717ff3","observation_id":"014b4f8b-13c2-4964-96c0-d25dce40f900","resolution":{"observed_at":"2026-05-14T01:40:53.719195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"reference_index":201,"source":"pdf_text","source_observed_at":"2026-05-10T22:46:39.268353Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2303.18223"},"observation_digest":"sha256:763dabe4f1563fd49a10a775b000944344ae95d83b558845ed78592284a9f7f3","observation_id":"8720e55b-4b15-4442-85a2-5798fb669470","resolution":{"observed_at":"2026-05-10T22:46:39.895494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-13T07:28:24.827546Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2304.12244"},"observation_digest":"sha256:edd8f50346447071bc95a1f21599ae7856095d4ef83dafb5849300efac01b7fc","observation_id":"793432f6-6789-403a-b1d3-9b9586be4b43","resolution":{"observed_at":"2026-05-13T07:28:24.908226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-12T11:59:25.813128Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2305.10403"},"observation_digest":"sha256:a52204c7f9092c7a99739fb94024eefb0105ca65db85a7cd405945daa6596c8b","observation_id":"6a9d8022-4806-4004-a433-e4cbbe58ea2f","resolution":{"observed_at":"2026-05-12T11:59:27.192290Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-08-18T05:06:04.678949Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"reference_index":246,"source":"arxiv_source","source_observed_at":"2026-05-15T17:25:07.730933Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2305.14233"},"observation_digest":"sha256:5770f7358fbe209d0c421d529b5d16cf79705e4caff192fd7609c857c4dc6555","observation_id":"3359ad56-3dfc-4b37-a7d0-d5327f84cc41","resolution":{"observed_at":"2026-05-15T17:25:08.147917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-20T16:10:20.713555Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T13:29:53.345251Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2305.14314"},"observation_digest":"sha256:65e484a2ba2b2f1434c4c7dfa90ecbb2cbbb13a73b4d046529146a9bf02f4e18","observation_id":"7c4bf36d-1f14-4d58-a5dc-1708cacdb55d","resolution":{"observed_at":"2026-05-11T13:29:53.560528Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2305.16264","last_updated":"2025-06-28T00:00:06Z","snapshot_observed_at":"2026-08-21T22:49:19.447804Z","submitted_at":"2023-05-25T17:18:55Z","title":"Scaling Data-Constrained Language Models","version":5},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-18T01:35:21.150772Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2305.16264"},"observation_digest":"sha256:4134c69064d741529f1e44f96dd24ea781cc3c76cf9676151d2712dc25c3cf22","observation_id":"ba585559-a604-4554-8cb0-b6a992aaff76","resolution":{"observed_at":"2026-05-18T01:35:21.264047Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T18:52:59.033645Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2306.05685"},"observation_digest":"sha256:a8bcb2284925d328d5bb0bc8a0a136910414dc89f149bf1784091b28c601444e","observation_id":"5de40e0e-d688-4fbc-9ca9-36e30c1e56b6","resolution":{"observed_at":"2026-05-10T18:52:59.104420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T05:19:47.907355Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2306.14824"},"observation_digest":"sha256:2f97912cd4ce7205e1115a012eae283761871ec7f7c3c03d7111e93002ca7336","observation_id":"6023a44a-6b7d-4ea0-a4fb-03b04bb6444e","resolution":{"observed_at":"2026-05-12T05:19:48.056742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"reference_index":208,"source":"arxiv_source","source_observed_at":"2026-05-16T09:46:09.701440Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2311.16867"},"observation_digest":"sha256:68561fce2db7625d86da776f7b63443d50d5a831ced5da44e96f87d849c66796","observation_id":"640ad24a-3e5c-4325-9d31-20dca462e5b8","resolution":{"observed_at":"2026-05-16T09:46:09.896593Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2312.13771","last_updated":"2026-07-05T07:51:04Z","snapshot_observed_at":"2026-08-20T18:18:30.378150Z","submitted_at":"2023-12-21T11:52:45Z","title":"AppAgent: Multimodal Agents as Smartphone Users","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-17T10:16:43.364787Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2312.13771"},"observation_digest":"sha256:3d5be0828f1a9e0e4a4e7534296205d7fb0816951a980b813c2c61914eb0aeb0","observation_id":"a1306d2a-81e6-4289-b61c-c35cbb148368","resolution":{"observed_at":"2026-05-17T10:16:43.838307Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-21T09:34:41.269688Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-17T23:31:11.213552Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2402.13116"},"observation_digest":"sha256:c77dcd7544b079842475fe23e6130f2be6a20895acbea84c597a89f1e13cb97d","observation_id":"67e86b21-bbec-4298-9f64-b847ca53718c","resolution":{"observed_at":"2026-05-17T23:31:11.611067Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-12T15:58:03.210627Z","title":"Longpre, Le Hou, Tu Vu, Albert Webson, Hyung Won Chung, Yi Tay, Denny Zhou, Quoc V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-21T19:28:58.764570Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.210627Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:3eb5ca56cd1251a35d8e0707812c95d5f481076d1fde0daa7e4a6a36d48bf8b3","observation_id":"db7f2206-fea3-4d36-9092-c09a0e4d5349","resolution":{"observed_at":"2026-08-12T15:58:03.210627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-11T18:05:58.783674Z","title":"Longpre, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08258","last_updated":"2025-06-11T08:58:18Z","snapshot_observed_at":"2026-08-18T01:47:22.794064Z","submitted_at":"2024-12-11T10:11:41Z","title":"Large Language Models for Scholarly Ontology Generation: An Extensive Analysis in the Engineering Field","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T18:05:58.783674Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2412.08258"},"observation_digest":"sha256:b5d23d50948ddcbeb39315bd5a2cecb5d45f212229d2b6f117276464d40b9822","observation_id":"04398b2c-8c6d-481a-bd02-4058199d3b57","resolution":{"observed_at":"2026-08-11T18:05:58.783674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-11T13:19:18.891682Z","title":"Shayne Longpre, Le Hou, Tu Vu, Albert Webson, Hyung Won Chung, Yi Tay, Denny Zhou, Quoc V Le, Barret Zoph, Jason Wei, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13337","last_updated":"2024-12-17T21:16:59Z","snapshot_observed_at":"2026-08-17T19:05:36.135261Z","submitted_at":"2024-12-17T21:16:59Z","title":"Unveiling the Secret Recipe: A Guide For Supervised Fine-Tuning Small LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T13:19:18.891682Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2412.13337"},"observation_digest":"sha256:d3670dc5ef468b71337a6275eda318c3e2f89a72f124ac761fe342a5934ddb15","observation_id":"b44295e4-e54d-44c9-9db7-9f4020f34b5a","resolution":{"observed_at":"2026-08-11T13:19:18.891682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-11T12:05:48.499266Z","title":"W., Tay, Y., Zhou, D., Le, Q","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14689","last_updated":"2025-05-28T05:22:58Z","snapshot_observed_at":"2026-08-15T08:21:08.511659Z","submitted_at":"2024-12-19T09:43:39Z","title":"How to Synthesize Text Data without Model Collapse?","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T12:05:48.499266Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2412.14689"},"observation_digest":"sha256:bd25e20222aad4d2a8c232c20c62cb079cf9f871b72153b407808a39597dddc9","observation_id":"ae647b55-1f42-46d6-b697-393dbeb5837b","resolution":{"observed_at":"2026-08-11T12:05:48.499266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-11T11:59:28.325662Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-18T11:13:27.223623Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.325662Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:ad0558896882eb3968d9a00be348c066cf155952bf70e701e7c54f4fb19efce6","observation_id":"28670dcd-1a98-4585-a12b-1a6b3d64a724","resolution":{"observed_at":"2026-08-11T11:59:28.325662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-11T00:18:57.229525Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.229525Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:ee7519bc5e20047f049295cad58530c64cd83a231598b6ae72f52c7c0a0b626d","observation_id":"0da4e2f5-7d8a-4b6f-be4b-c036700f19b9","resolution":{"observed_at":"2026-08-11T00:18:57.229525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-10T20:54:02.266755Z","title":"The flan collection: Designing data and methods for effective instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07124","last_updated":"2025-01-17T09:39:17Z","snapshot_observed_at":"2026-08-14T10:55:02.137567Z","submitted_at":"2025-01-13T08:26:43Z","title":"LLM360 K2: Building a 65B 360-Open-Source Large Language Model from Scratch","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T20:54:02.266755Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2501.07124"},"observation_digest":"sha256:d926b2f63a9eb2c19cd56d3b2c5276f23aa5c39991f371785ea8ba1acafd58e5","observation_id":"3e7ff170-1ce7-4598-9f69-437e880b870b","resolution":{"observed_at":"2026-08-10T20:54:02.266755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-10T14:42:10.746779Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15103","last_updated":"2025-06-19T04:00:52Z","snapshot_observed_at":"2026-08-16T04:45:50.225037Z","submitted_at":"2025-01-25T06:56:39Z","title":"Each Rank Could be an Expert: Single-Ranked Mixture of Experts LoRA for Multi-Task Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T14:42:10.746779Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2501.15103"},"observation_digest":"sha256:23bc3e282bd09af8aebaf3e53e92d8075ec037ad96f538b3f905730c45f311d3","observation_id":"d29b2234-00e6-485b-a5b6-9595600b5cb6","resolution":{"observed_at":"2026-08-10T14:42:10.746779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-09T15:59:08.754510Z","title":"W., Tay, Y., Zhou, D., Le, Q","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01703","last_updated":"2025-02-03T10:52:32Z","snapshot_observed_at":"2026-08-18T01:25:51.246915Z","submitted_at":"2025-02-03T10:52:32Z","title":"QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T15:59:08.754510Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2502.01703"},"observation_digest":"sha256:d4c4b33a3d7564f6dc196eda9ea3cbc285e30b1c347766e0d0e4387e4f536b86","observation_id":"8557850e-c10e-4548-ad9c-b73db24a4ab3","resolution":{"observed_at":"2026-08-09T15:59:08.754510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-07T22:34:08.076522Z","title":"W., Tay, Y., Zhou, D., Le, Q","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.12170","last_updated":"2025-05-28T12:57:47Z","snapshot_observed_at":"2026-08-17T11:40:15.102906Z","submitted_at":"2025-02-13T10:26:27Z","title":"MUDDFormer: Breaking Residual Bottlenecks in Transformers via Multiway Dynamic Dense Connections","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T22:34:08.076522Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2502.12170"},"observation_digest":"sha256:d767a9150c0b9d938bf592b368fba69a216d3c63c5733d3a21ea88bb199a2a4c","observation_id":"ea988790-656e-497c-ae5b-91ac55725b5a","resolution":{"observed_at":"2026-08-07T22:34:08.076522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2503.08223","last_updated":"2026-04-09T15:28:27Z","snapshot_observed_at":"2026-08-13T00:23:14.495568Z","submitted_at":"2025-03-11T09:41:29Z","title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","version":3},"reference_index":163,"source":"pdf_text","source_observed_at":"2026-05-23T01:03:26.037233Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2503.08223"},"observation_digest":"sha256:871b542b7b447e9341f188ca13a21c93ca2b8848023a3f5c1fea1052e26932af","observation_id":"83af0024-a6fb-46cf-be68-267d854f6b6b","resolution":{"observed_at":"2026-05-23T01:05:16.330116Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-16T12:12:01.959889Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13439","last_updated":"2025-06-12T22:57:58Z","snapshot_observed_at":"2026-08-19T22:47:31.505108Z","submitted_at":"2025-04-18T03:40:11Z","title":"D-GEN: Automatic Distractor Generation and Evaluation for Reliable Assessment of Generative Model","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T12:12:01.959889Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2504.13439"},"observation_digest":"sha256:2816f077fbf57964205e2f8cfbbf62b63e74cbb26c33681614633f8638d936c9","observation_id":"2eb12b0e-7764-4bfe-9028-ab4631375cec","resolution":{"observed_at":"2026-08-16T12:12:01.959889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2505.05472","last_updated":"2025-05-11T18:47:18Z","snapshot_observed_at":"2026-08-12T22:02:52.918587Z","submitted_at":"2025-05-08T17:58:57Z","title":"Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-17T07:24:04.460276Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2505.05472"},"observation_digest":"sha256:dfee741af51e239ca0bba02cd36f6ee7104381600cb2ad9761e1aa4d35e8fb55","observation_id":"02658bbe-889c-4347-ae39-baa2fbac277a","resolution":{"observed_at":"2026-05-17T07:24:04.561486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-07T13:43:22.051553Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21191","last_updated":"2025-05-27T13:40:28Z","snapshot_observed_at":"2026-08-14T10:12:10.764232Z","submitted_at":"2025-05-27T13:40:28Z","title":"Unveiling Instruction-Specific Neurons & Experts: An Analytical Framework for LLM's Instruction-Following Capabilities","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:43:22.051553Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2505.21191"},"observation_digest":"sha256:7cb3f7edc7636e4037e6205507f215d1b1473acab6603ff6cc76e7e30e56e47f","observation_id":"7e9e2b38-8c79-4a2a-9839-be9d7bc72521","resolution":{"observed_at":"2026-08-07T13:43:22.051553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-07T11:45:03.041405Z","title":"The flan collection: Designing data and methods for effective instruction tuning.arXiv preprint arXiv:2301.13688,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01701","last_updated":"2025-08-14T03:59:04Z","snapshot_observed_at":"2026-08-20T15:27:48.879374Z","submitted_at":"2025-06-02T14:06:42Z","title":"Data Pruning by Information Maximization","version":2},"reference_index":1982,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:03.041405Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2506.01701"},"observation_digest":"sha256:8011edb33612fb936133541b6a5f35106048e5a81a7a2b7477c73196450ed2fa","observation_id":"5ab3b404-10e6-428e-8ebc-221e7dca3548","resolution":{"observed_at":"2026-08-07T11:45:03.041405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-07T05:54:49.193866Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06806","last_updated":"2025-07-19T04:38:19Z","snapshot_observed_at":"2026-08-22T04:04:26.489504Z","submitted_at":"2025-06-07T14:07:07Z","title":"Label-semantics Aware Generative Approach for Domain-Agnostic Multilabel Classification","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:49.193866Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2506.06806"},"observation_digest":"sha256:283705990b3b88a50b77ba76a7f3d40c23788ecd161529138309d1b49665469f","observation_id":"c3cfcc9d-01c1-4c4b-9888-f9dda7e3710f","resolution":{"observed_at":"2026-08-07T05:54:49.193866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-07T05:39:24.417175Z","title":"The flan collection: Designing data and methods for effective instruction tuning.arXiv preprint arXiv:2301.13688, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11116","last_updated":"2025-06-09T06:37:15Z","snapshot_observed_at":"2026-08-15T22:47:41.272189Z","submitted_at":"2025-06-09T06:37:15Z","title":"Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:24.417175Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2506.11116"},"observation_digest":"sha256:fe79e6f2a0cada450610da085cb3c5fbe714a68247de9c8b51a8858bcc83b4ef","observation_id":"52631b08-b61a-41c0-942e-8ea85a51b27f","resolution":{"observed_at":"2026-08-07T05:39:24.417175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-06T23:57:40.162587Z","title":"Preprint, arXiv:2301.13688","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15629","last_updated":"2025-06-18T17:00:54Z","snapshot_observed_at":"2026-08-15T13:46:20.859424Z","submitted_at":"2025-06-18T17:00:54Z","title":"Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:40.162587Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2506.15629"},"observation_digest":"sha256:69fb4b0917037d5a079e4b1d93cfac04b888deed311d788fe7fa444defe3ed74","observation_id":"69c3db94-30a5-4a9c-b9b2-b7832dff1810","resolution":{"observed_at":"2026-08-06T23:57:40.162587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-06T23:58:09.758887Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21595","last_updated":"2025-06-18T17:33:51Z","snapshot_observed_at":"2026-08-09T19:09:21.501829Z","submitted_at":"2025-06-18T17:33:51Z","title":"Thunder-LLM: Efficiently Adapting LLMs to Korean with Minimal Resources","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:09.758887Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2506.21595"},"observation_digest":"sha256:38d3541ade5eaa0d16985bb3bd2694d4d4992a2b197cb3d57bf8a04d46536bed","observation_id":"fac02de2-4be8-4c33-bddd-d830942e66bf","resolution":{"observed_at":"2026-08-06T23:58:09.758887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-06T20:46:00.167973Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01800","last_updated":"2025-07-02T15:20:08Z","snapshot_observed_at":"2026-08-18T02:45:46.537411Z","submitted_at":"2025-07-02T15:20:08Z","title":"HCNQA: Enhancing 3D VQA with Hierarchical Concentration Narrowing Supervision","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:00.167973Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2507.01800"},"observation_digest":"sha256:04e8efb6a110510c7e2ebc65e56efed1b2e1eac884dbc2c75a55697159885973","observation_id":"138a3894-2d02-4acf-ab6f-13bad33a42f6","resolution":{"observed_at":"2026-08-06T20:46:00.167973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-06T19:07:35.794165Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07140","last_updated":"2025-07-14T04:57:05Z","snapshot_observed_at":"2026-08-13T12:08:44.034823Z","submitted_at":"2025-07-09T03:25:45Z","title":"Exploring Sparse Adapters for Scalable Merging of Parameter Efficient Experts","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:07:35.794165Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2507.07140"},"observation_digest":"sha256:a9356332795b7e9e077759df7001c2f3b01950e22e8fff3fc6aad7016a841c66","observation_id":"307412f8-9ec6-4604-949b-9008ea4e6bba","resolution":{"observed_at":"2026-08-06T19:07:35.794165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-06T12:47:43.919893Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21482","last_updated":"2025-07-29T03:51:00Z","snapshot_observed_at":"2026-08-07T22:01:33.492073Z","submitted_at":"2025-07-29T03:51:00Z","title":"Improving Task Diversity in Label Efficient Supervised Finetuning of LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T12:47:43.919893Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2507.21482"},"observation_digest":"sha256:528a1141f519fd4eb4dd5c3d6397af1664a1f4de6b616414e3e91a64f22365c4","observation_id":"52929f99-87c0-4b09-a09f-3cbf48b5b619","resolution":{"observed_at":"2026-08-06T12:47:43.919893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-06T05:19:11.392853Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02092","last_updated":"2026-07-29T05:03:54Z","snapshot_observed_at":"2026-08-13T10:25:22.264464Z","submitted_at":"2025-08-04T06:00:22Z","title":"FPEdit: Robust LLM Fingerprinting through Localized Parameter Editing","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:19:11.392853Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2508.02092"},"observation_digest":"sha256:175c6b47e71b3c2d2ad0571624723520f8a67ad42c4441277dbc540c0a1f569f","observation_id":"b5c00bed-bdc1-4ab7-bc88-20baa0aa1aa6","resolution":{"observed_at":"2026-08-06T05:19:11.392853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2508.04149","last_updated":"2026-05-16T09:55:19Z","snapshot_observed_at":"2026-08-18T01:41:11.813052Z","submitted_at":"2025-08-06T07:24:14Z","title":"Difficulty-Based Preference Data Selection by DPO Implicit Reward Gap","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T23:46:24.208438Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2508.04149"},"observation_digest":"sha256:5cf331866f2eff2ac79ee0b150936b529ad7ba85d6f236fa3e7009408f86f846","observation_id":"f8e42260-904e-47a5-8ada-f9860269f5e5","resolution":{"observed_at":"2026-05-21T23:50:47.520392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T22:07:44.118629Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10927","last_updated":"2025-08-10T22:44:10Z","snapshot_observed_at":"2026-08-14T20:58:04.189513Z","submitted_at":"2025-08-10T22:44:10Z","title":"Modeling and Detecting Company Risks from News: A Case Study in Bloomberg News","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T22:07:44.118629Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2508.10927"},"observation_digest":"sha256:f87ee733b64cf42db6cc8852b8e66e6301285e1584ca6f18cfd79a5e1cb93b46","observation_id":"a98b89b3-7cd7-4cdd-8682-2f71d648d860","resolution":{"observed_at":"2026-08-05T22:07:44.118629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-15T16:37:52.929020Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03059","last_updated":"2026-07-26T23:59:38Z","snapshot_observed_at":"2026-08-15T17:21:39.654535Z","submitted_at":"2025-09-03T06:42:40Z","title":"Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T16:37:52.929020Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2509.03059"},"observation_digest":"sha256:0647de68ddfb59fda2d9fb7b0a07bdd1d3881adb1f9d72ad7a9359d4400bc3cd","observation_id":"544ca34c-2c5a-4c76-b34c-3d6c8c05bc72","resolution":{"observed_at":"2026-08-15T16:37:52.929020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-03T22:23:30.099098Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.10868","last_updated":"2026-05-29T03:47:16Z","snapshot_observed_at":"2026-08-14T08:08:59.695199Z","submitted_at":"2025-11-14T00:35:00Z","title":"Go-UT-Bench: A Fine-Tuning Dataset for LLM-Based Unit Test Generation in Go","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T22:23:30.099098Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2511.10868"},"observation_digest":"sha256:307da5b7b1b7b91758d3113a8290e632f50a9df9bbff931f7a9e82e872635cfe","observation_id":"908bab4d-3866-4610-8abb-ab33627ac629","resolution":{"observed_at":"2026-08-03T22:23:30.099098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2604.13846","last_updated":"2026-04-17T08:59:58Z","snapshot_observed_at":"2026-08-18T13:06:50.035525Z","submitted_at":"2026-04-15T13:17:36Z","title":"Beyond Static Personas: Situational Personality Steering for Large Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T13:42:40.616531Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2604.13846"},"observation_digest":"sha256:bfcffbe41b445ba90e3d0b617e1af473a19d44c2514d6d59fa075d147e952fac","observation_id":"ebe4f1cc-117e-4979-ab9b-b339424c0882","resolution":{"observed_at":"2026-05-10T13:45:27.970310Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2605.05227","last_updated":"2026-04-19T14:23:23Z","snapshot_observed_at":"2026-08-20T11:10:38.014744Z","submitted_at":"2026-04-19T14:23:23Z","title":"Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T07:09:21.652035Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2605.05227"},"observation_digest":"sha256:8b54df827ed5d912c5949567432d120d0f7106a221acd8ede81d6c8cdeda1097","observation_id":"511a15f9-8b57-424d-af2d-c3f71f6ff483","resolution":{"observed_at":"2026-05-10T07:11:53.285101Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2605.14289","last_updated":"2026-05-14T02:48:23Z","snapshot_observed_at":"2026-08-18T13:06:19.060430Z","submitted_at":"2026-05-14T02:48:23Z","title":"MetaMoE: Diversity-Aware Proxy Selection for Privacy-Preserving Mixture-of-Experts Unification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T02:21:10.641070Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2605.14289"},"observation_digest":"sha256:d58fdec82d28baa7d275cf91b03f16e53729c41bc5fe1c8b4d2012863e62851a","observation_id":"e7c27d02-e2fa-4c05-aa60-f66dad101415","resolution":{"observed_at":"2026-05-15T02:23:31.873160Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2605.21422","last_updated":"2026-06-01T04:58:51Z","snapshot_observed_at":"2026-08-15T13:16:35.532686Z","submitted_at":"2026-05-20T17:15:43Z","title":"PRISM: Preference-Aware Influence Function Based Data Selection Method for Efficient Fine-Tuning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T17:01:21.521025Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2605.21422"},"observation_digest":"sha256:d97f83eb121b39b0bb4860f3f6dd279073693c4a360f3e0353a6ef40c9450113","observation_id":"5031fbfb-2580-410b-b8b4-7ee94874f259","resolution":{"observed_at":"2026-06-30T17:04:56.633254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2606.05165","last_updated":"2026-06-03T17:59:36Z","snapshot_observed_at":"2026-08-14T08:06:00.534462Z","submitted_at":"2026-06-03T17:59:36Z","title":"STRIDE: Training Data Attribution via Sparse Recovery from Subset Perturbations","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T07:39:16.719604Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2606.05165"},"observation_digest":"sha256:67a893c5045e77696a15532db8312fe487def3d52a5295b1f448c1ef8ac69a95","observation_id":"dffccb34-b1a3-41cc-8663-3a784d7d7faf","resolution":{"observed_at":"2026-07-02T06:06:41.399455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2301.13688","doi":"10.48550/arxiv.2301.13688","metadata_source":"pith","pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","venue":"cs.AI","work_id":"56b2f752-8022-4d66-983c-2bb9cb4b2b77","year":2023},"citing_paper":{"arxiv_id":"2606.23591","last_updated":"2026-06-22T17:00:04Z","snapshot_observed_at":"2026-08-16T03:31:08.842158Z","submitted_at":"2026-06-22T17:00:04Z","title":"Quantifying the Agreement Between Data-Influence and Data-Similarity to Understand LLM Behavior","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-26T08:45:34.884703Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2606.23591"},"observation_digest":"sha256:1dccc381c564d540ce349170df131cafce75b6ee8abc2d8fdf520c6409e5ce2c","observation_id":"c3e398f9-e981-4f49-87d8-6b53d4e53cf6","resolution":{"observed_at":"2026-06-26T08:49:15.001610Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-02T00:17:36.181972Z","title":"Bo Lv, Zhiheng Xu, KeDong Xiu, Ruyi Ding, Tianhang Zheng, Zhibo Wang, and Kui Ren","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15081","last_updated":"2026-07-16T14:51:42Z","snapshot_observed_at":"2026-08-19T03:00:36.494628Z","submitted_at":"2026-07-16T14:51:42Z","title":"DataShield: Uncovering Risky Fine-Tuning Data Across LLMs Through Consensus Subspace Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T00:17:36.181972Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2607.15081"},"observation_digest":"sha256:d18d1e6464f45d3a27bf8a562e4e88b3bfdbae757b89758a5494edd66cbb5f6c","observation_id":"50cde21c-0997-4df4-a30e-c8ef546b679f","resolution":{"observed_at":"2026-08-02T00:17:36.181972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-01T16:08:01.264113Z","title":"arXiv preprint arXiv:2301.13688 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18110","last_updated":"2026-07-20T16:08:49Z","snapshot_observed_at":"2026-08-15T11:14:42.907953Z","submitted_at":"2026-07-20T16:08:49Z","title":"LLM-as-a-Coach: Experiential Learning for Non-Verifiable Tasks","version":1},"reference_index":300,"source":"arxiv_source","source_observed_at":"2026-08-01T16:08:01.264113Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2607.18110"},"observation_digest":"sha256:5adef4b05d0019a59045da5262aae2e15863ed47e75eaf976cc1d47f5cdba121","observation_id":"7d16c187-9c7a-44c0-8431-418a3dd4df18","resolution":{"observed_at":"2026-08-01T16:08:01.264113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2301.13688/citation-record","integrity":"/paper/2301.13688/integrity","json":"/paper/2301.13688/citation-record.json","paper":"/paper/2301.13688"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-08-18T11:44:22.813405Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":"2204.01691","doi":"10.48550/arxiv.2204.01691","metadata_source":"pith","pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","venue":"cs.RO","work_id":"037320f1-b0a9-4cbe-a639-bfb25409ce71","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:06cd634c16c7c7a3710c93003fa2ebde0fdaab1b51923533f7b88f535b295ad5","observation_id":"88ecd95e-0d87-4cd6-9ffe-b38ca88be16c","resolution":{"observed_at":"2026-05-24T09:14:16.371577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.10952","last_updated":"2022-01-29T07:41:54Z","snapshot_observed_at":"2026-08-16T17:40:20.517357Z","submitted_at":"2021-11-22T02:34:46Z","title":"ExT5: Towards Extreme Multi-Task Scaling for Transfer Learning","version":2},"cited_work":{"arxiv_id":"2111.10952","doi":"10.48550/arxiv.2111.10952","metadata_source":"pith","pith_arxiv_id":"2111.10952","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ext5: Towards extreme multi-task scaling for transfer learning","venue":"cs.CL","work_id":"39a693a1-b4d7-418b-b6a5-abd763bcbd54","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2111.10952","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:cd1033152c5d121ac3364252a5b7d5aa1fd2f03a4623f90dd87ee4af3804f833","observation_id":"758bf1d2-352a-4fa2-b9a5-281ebeee917a","resolution":{"observed_at":"2026-05-24T09:14:16.455950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:45c6e7600390105398d320b8ef1a18256422d88238bcf6e1d2ae5451eff89a2f","observation_id":"55e43099-3482-451d-85df-ebd291ec9cc3","resolution":{"observed_at":"2026-05-24T09:14:15.887934Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":"2108.07258","doi":"10.1016/j.specom.2008.12.003","metadata_source":"pith","pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"On the Opportunities and Risks of Foundation Models","venue":"cs.LG","work_id":"a18039e9-928d-47c9-a836-32656a71bf71","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:9dec245ccfd12a2ed2e91899e3a6574fe9770fe67cd4b9b23d53a0f4096dc5f3","observation_id":"e3d767d0-0bfd-493e-bf24-3b981e5bb898","resolution":{"observed_at":"2026-05-24T09:14:16.541559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:22:59.787075+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:22:59.787075+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":"2204.02311","doi":"10.48550/arxiv.2204.02311","metadata_source":"pith","pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaLM: Scaling Language Modeling with Pathways","venue":"cs.CL","work_id":"a94f3ef7-2c49-4445-93fe-6ec16aafd966","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:50d43532240b11a157e008633ea4fdff79f732f6fde9c5dcb5e93d2b06534760","observation_id":"191e9a6c-88e7-46f7-a625-1f500d941dda","resolution":{"observed_at":"2026-05-24T09:14:16.356701Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-21T12:25:21.411055+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T12:25:21.411055+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-08-17T14:44:42.060038Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":"1905.10044","doi":"10.48550/arxiv.1905.10044","metadata_source":"pith","pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","venue":"cs.CL","work_id":"511eeb84-4b95-46d5-b14f-50da43f4f19f","year":2019},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:1147547a1fca05794ac624ccfb199c9ae138ae09331302e876847b09be80c966","observation_id":"f4c705d9-8374-4a61-b399-af917374a6a1","resolution":{"observed_at":"2026-05-24T09:14:16.460987Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:8cd4bb150185211cccebcf76f01dec42e523821d9ad97dcecb1f4004dfad0e9c","observation_id":"007c7c0d-f10d-4685-9402-12603d50563f","resolution":{"observed_at":"2026-05-24T09:14:16.546553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:731a30cdfeded7dee6b15fd4217dc3148216c540721d149ad45a26e8c5155370","observation_id":"566f9c65-e838-4fd9-9b53-8c973d4fd65a","resolution":{"observed_at":"2026-05-24T09:14:16.314509Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ashwin Devaraj, William Sheﬃeld, Byron Wallace, and Junyi Jessy Li","venue":null,"work_id":"02745343-c95d-4ea1-a699-600bbc5e0f3b","year":2015},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:7ea310022a034cb87dd5ef4e2690e4ec91084029a64d4da54bd41c81b80dac4d","observation_id":"39ca9f85-0faa-44ca-89d7-2ab596c641d8","resolution":{"observed_at":"2026-05-24T09:14:17.008847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.506","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2022.acl-long.506","venue":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"8ad6c85a-5d8c-4422-ab9f-f5df036856a2","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:a1a0e70b409cdfdf3118f01c786b0fd931fc73ff0352dc684146ca46528da88d","observation_id":"f08f2921-9726-48a4-af47-1dcae35af14c","resolution":{"observed_at":"2026-05-24T09:14:15.892486Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-21T13:43:54.063053Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":"2209.07858","doi":"10.1136/bcr-2013-201554","metadata_source":"pith","pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","venue":"cs.CL","work_id":"1aabd84d-3779-4ba9-ba2f-15ce264a9b1e","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:7f3805a9446bd0f21f7d4910f84cf43d25e7631fc7a5c6d4fe072b13de976e45","observation_id":"f9546078-ba96-417e-bb62-bfed3f8f2bf1","resolution":{"observed_at":"2026-05-24T09:14:16.294944Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":"2101.00027","doi":"10.1117/1.jmi.10.6.061104","metadata_source":"pith","pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","venue":"cs.CL","work_id":"9b10667a-da61-4358-aceb-10578234d45d","year":2020},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:b5a63355c768ecb3924162ab4b90634543132401b3047bcfa9850eebd09551e1","observation_id":"1d4874ce-68d1-452e-8c9d-6571b2c9dada","resolution":{"observed_at":"2026-05-24T09:14:16.480491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.08726","last_updated":"2023-05-31T17:55:02Z","snapshot_observed_at":"2026-08-20T09:01:18.890165Z","submitted_at":"2022-10-17T03:44:30Z","title":"RARR: Researching and Revising What Language Models Say, Using Language Models","version":3},"cited_work":{"arxiv_id":"2210.08726","doi":"10.48550/arxiv.2210.08726","metadata_source":"pith","pith_arxiv_id":"2210.08726","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2210.08726 (2023)","venue":"cs.CL","work_id":"1b256ed6-0bda-498c-a14c-6299d1d1300e","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2210.08726","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:b8010cab8990660e1caadb087f782477b81082eef6bbe15499ae4e9eda165279","observation_id":"bfbcf1f5-3f93-4d96-956c-26ec11919194","resolution":{"observed_at":"2026-05-24T09:14:16.490462Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-08-16T09:29:21.586810Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":"2209.14375","doi":"10.48550/arxiv.2209.14375","metadata_source":"pith","pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving alignment of dialogue agents via targeted human judgements","venue":"cs.LG","work_id":"6ad5970e-7550-4ae8-a158-7084dec7e3cc","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:4e5ad36922e4467461392eda5fd9e3e5c174e38646e442eeffdbf1ab5e831ef7","observation_id":"1b11db04-25bd-472b-8a8a-ce02b4b07332","resolution":{"observed_at":"2026-05-24T09:14:16.363902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-17T17:38:12.779055+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T17:38:12.779055+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12673","last_updated":"2022-10-26T17:10:03Z","snapshot_observed_at":"2026-08-17T01:13:10.569882Z","submitted_at":"2022-05-25T11:37:06Z","title":"InstructDial: Improving Zero and Few-shot Generalization in Dialogue through Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2205.12673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.12673","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving zero and few-shot generalization in dialogue through instruction tuning.arXiv preprint arXiv:2205.12673","venue":null,"work_id":"7792ddde-a4f6-4fe6-b4e4-a30c2565debd","year":null},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2205.12673","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:72b2970f3a0373d03f2fab3e96c8ee09ac975a90da53b93dfb083951b88f7a14","observation_id":"27c10157-d483-4577-b583-bf0f2533baac","resolution":{"observed_at":"2026-05-24T09:14:16.530878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-21T02:12:10.329412Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:57b1ea72d33ba62fef58b095d75bcdd43b4497cdd2be76061c80775d2b07bd6d","observation_id":"a2645ea3-9151-4172-b565-948c48458d92","resolution":{"observed_at":"2026-05-24T09:14:16.417815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09689","last_updated":"2022-12-19T18:21:00Z","snapshot_observed_at":"2026-08-18T07:06:13.630649Z","submitted_at":"2022-12-19T18:21:00Z","title":"Unnatural Instructions: Tuning Language Models with (Almost) No Human Labor","version":1},"cited_work":{"arxiv_id":"2212.09689","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.09689","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unnatural instructions: Tuning language models with (almost) no human labor.arXiv preprint arXiv:2212.09689","venue":null,"work_id":"5f39ecf9-90b2-43a6-afa0-31c49f589257","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2212.09689","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:9103a0a18bc4c6c2733fd3187e71d74ae73a7daa84e6d78663eb53460a7f028f","observation_id":"9663fafa-0bbc-44dd-9420-1a0b4a6141d9","resolution":{"observed_at":"2026-05-24T09:14:16.525698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":"2106.09685","doi":"10.4088/pcc.v03n0609","metadata_source":"pith","pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","venue":"cs.CL","work_id":"0426219a-789e-4964-adc8-a04538510818","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:5de83b8c095a6669efdd6507b72b8f315b9e10bd1a2e34050c2ce549474a30d1","observation_id":"94410ea9-18c3-431e-9639-5335ed401f6d","resolution":{"observed_at":"2026-05-24T09:14:16.449306Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-08-17T09:42:08.942018Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":"2207.05608","doi":"10.1177/02783649231170897","metadata_source":"pith","pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","venue":"cs.RO","work_id":"f6e5e4a1-e34b-4602-a7ad-df0c6103a4d0","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:0da5c1047cd030888ae692cfcb983107b5aa1e9b9d87967e47ae02104914bc32","observation_id":"b389261a-b517-4603-a6b1-730ae51dde7d","resolution":{"observed_at":"2026-05-24T09:14:16.406184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.12017","last_updated":"2023-01-30T05:25:59Z","snapshot_observed_at":"2026-08-18T13:21:34.099818Z","submitted_at":"2022-12-22T19:56:09Z","title":"OPT-IML: Scaling Language Model Instruction Meta Learning through the Lens of Generalization","version":3},"cited_work":{"arxiv_id":"2212.12017","doi":"10.48550/arxiv.2212.12017","metadata_source":"pith","pith_arxiv_id":"2212.12017","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OPT-IML: Scaling Language Model Instruction Meta Learning through the Lens of Generalization","venue":"cs.CL","work_id":"dd464d2b-4adb-40de-9148-c19470e7533b","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2212.12017","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:7a6dec72b727dfee40f4fa07cbffe4625946e859d4cadf80846ac3c34d9cc5a6","observation_id":"96f42c8a-bdde-486f-b40e-2b454eb6f8ea","resolution":{"observed_at":"2026-05-24T09:14:16.475814Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09286","last_updated":"2019-09-20T18:01:55Z","snapshot_observed_at":"2026-08-21T10:55:25.258823Z","submitted_at":"2019-04-19T17:58:29Z","title":"Unifying Question Answering, Text Classification, and Regression via Span Extraction","version":2},"cited_work":{"arxiv_id":"1904.09286","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1904.09286","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nitish Shirish Keskar, Bryan McCann, Caiming Xiong, and Richard Socher","venue":null,"work_id":"fbad8b11-0d71-46f5-883a-99fa3989b854","year":1904},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/1904.09286","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:e4faa223d1a7266d0e1314db59ec06bc22a7f7ccccc7f63012626631af6cc9ac","observation_id":"b359bcc1-3ac0-4a57-a734-41eb4b9c8dfc","resolution":{"observed_at":"2026-05-24T09:14:16.443948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"UniﬁedQA:CrossingformatboundarieswithasingleQAsystem","venue":null,"work_id":"b978c331-21f6-4bc4-ba6d-baeced83cf13","year":2020},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:9e67f58f83c02dceb1051db9f2f9dbf81025fbc79fa0aa906916892bda6d9356","observation_id":"0355d574-abc3-4ea4-965d-4dd4f895e36c","resolution":{"observed_at":"2026-05-24T09:14:17.030142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4449744e-9962-4976-86de-6da749fd0eab","year":2020},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:d86600f613d010e85c6112c40d55d7832217886d18a6365dec45d6d607da62f6","observation_id":"85860fe8-a151-43d3-80ed-41bcf4e5960b","resolution":{"observed_at":"2026-05-24T09:14:17.051037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-23T19:18:14.358496Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":"2211.05100","doi":"10.48550/arxiv.2211.05100","metadata_source":"pith","pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","venue":"cs.CL","work_id":"337ba690-f35d-4154-9450-8edf4bc9f488","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:f7d002a742eac82ab5cd63281bf3b8f0a40a557fbed809ef200bdee12d480c1e","observation_id":"36e845d8-0fb5-44ac-908f-28b28ba2d259","resolution":{"observed_at":"2026-05-24T09:14:16.508523Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T16:25:57.975024+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T16:25:57.975024+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.emnlp-main.243","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T01:15:11.886945Z","title":"URL https://aclanthology.org/2021","venue":"Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing","work_id":"f7865b08-1db6-4a3c-ae44-d1fc2aac179e","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:fb6c4a53d0b6e985a61f1509a9f067eb1994b455847a1ab2caeb91ab93be4e4d","observation_id":"39b91a90-e6d3-4206-999a-16047ba7b1de","resolution":{"observed_at":"2026-05-24T09:14:15.896659Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:16.84782+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:16.84782+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.acl-main.703","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2020.acl-main.703","venue":null,"work_id":"6b309ef6-e88e-4de5-a589-3bff329254a0","year":2020},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:16645ca1e2147d540ab31837b7a40fd2fa1d632a8822f6374c0642f5213296e7","observation_id":"652f9de8-2d45-45eb-957a-44ac01cc6f35","resolution":{"observed_at":"2026-05-24T09:14:15.882473Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:08:07.2501+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T06:08:07.2501+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14858","last_updated":"2022-07-01T02:15:12Z","snapshot_observed_at":"2026-08-17T10:54:45.389424Z","submitted_at":"2022-06-29T18:54:49Z","title":"Solving Quantitative Reasoning Problems with Language Models","version":2},"cited_work":{"arxiv_id":"2206.14858","doi":"10.48550/arxiv.2206.14858","metadata_source":"pith","pith_arxiv_id":"2206.14858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Solving Quantitative Reasoning Problems with Language Models","venue":"cs.CL","work_id":"17214d12-1ca8-4186-806d-53c6715383a0","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2206.14858","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:c3505275a20b6767e06d4b491d3037916a587675dc62146e02c9a93fe2ef31c4","observation_id":"d2c7414a-13ce-438c-b0be-6a901b70ffa2","resolution":{"observed_at":"2026-05-24T09:14:16.398437Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-08T21:08:08.21276+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T21:08:08.21276+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05955","last_updated":"2022-11-15T00:42:00Z","snapshot_observed_at":"2026-08-16T17:28:06.905425Z","submitted_at":"2022-01-16T03:13:49Z","title":"WANLI: Worker and AI Collaboration for Natural Language Inference Dataset Creation","version":5},"cited_work":{"arxiv_id":"2201.05955","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2201.05955","snapshot_observed_at":"2026-07-04T03:59:32.536185Z","title":"Wanli: Worker and ai collaboration for natural language inference dataset creation.arXiv preprint arXiv:2201.05955 , 2022a","venue":null,"work_id":"54b7233a-47ca-4c46-85fe-e9d03897aa0c","year":null},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2201.05955","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:9036271bb20d6fdbc36a9440b61cb66d23e9d1c19517f484d73ec6ba90c42ae5","observation_id":"7952597a-2c8b-440a-a7c1-8d0fbfe56a32","resolution":{"observed_at":"2026-05-24T09:14:16.307535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Howeﬀectiveistask-agnosticdataaugmentationforpretrained transformers? In Findings of the Association for Computational Linguistics: EMNLP 2020 , pages 4401–4411","venue":null,"work_id":"0d3fffc8-50f6-4ac2-acb6-3f8cdbbab935","year":2020},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:18a710fe8fcf40cfb0192a22eeb2920a2dc295acdb56b9b2014c96a99ccd9fc9","observation_id":"d5a792ae-baff-4851-89af-9ec7db23773a","resolution":{"observed_at":"2026-05-24T09:14:17.015616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Entity- based knowledge conﬂicts in question answering","venue":null,"work_id":"0b389a36-d406-4378-a5d2-fdca6125b5b1","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:6b440ce23de3e3f155a0c7ac9fb3bc79979409a70a91e97b688a126e93d786b7","observation_id":"6f1422e9-134d-4586-bd2d-f0523c0a9afb","resolution":{"observed_at":"2026-05-24T09:14:17.012066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On faithfulness and factuality in abstractive summarization","venue":null,"work_id":"4092a95f-ae48-48e5-be1c-39ee38fcf178","year":1906},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:c4c32a8c2497dd3e41bf9edcb39b66e00569396d806974a30af143098c54bacd","observation_id":"c2039fdc-bba2-4659-9b40-8739e7cb410c","resolution":{"observed_at":"2026-05-24T09:14:17.005591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08730","last_updated":"2018-06-20T16:39:26Z","snapshot_observed_at":"2026-08-17T06:16:47.122449Z","submitted_at":"2018-06-20T16:39:26Z","title":"The Natural Language Decathlon: Multitask Learning as Question Answering","version":1},"cited_work":{"arxiv_id":"1806.08730","doi":"10.2466/pr0.1957.3.3.635","metadata_source":"pith","pith_arxiv_id":"1806.08730","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Natural Language Decathlon: Multitask Learning as Question Answering","venue":"cs.CL","work_id":"75b95963-bb63-4588-816d-17e4bf36092e","year":2018},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/1806.08730","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:01326c4a614e4302c530eab9774e71a3ca274703badd55ae8b70583e1fdefde0","observation_id":"6e92a788-a5bb-4ca0-8d4b-36b4db5e3374","resolution":{"observed_at":"2026-05-24T09:14:16.347695Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06807","last_updated":"2020-09-15T00:55:00Z","snapshot_observed_at":"2026-07-06T09:55:38.633548Z","submitted_at":"2020-09-15T00:55:00Z","title":"The Radicalization Risks of GPT-3 and Advanced Neural Language Models","version":1},"cited_work":{"arxiv_id":"2009.06807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2009.06807","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The radicalization risks of gpt-3 and advanced neural language models","venue":null,"work_id":"db28063e-debb-4b76-be5a-d82330232ec7","year":2009},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2009.06807","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:eee35a8ba3e90329a869ae46b460a125ca4877f892d0ad06da9e2ac6f4ecb92b","observation_id":"214b2b0b-62d4-4551-aae7-98a684c98977","resolution":{"observed_at":"2026-05-24T09:14:16.300932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sewon Min, Mike Lewis, Luke Zettlemoyer, and Hannaneh Hajishirzi","venue":null,"work_id":"0a332763-079c-4156-bcae-24a4e2efb0fb","year":2013},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:e66bcd08f771ed741fdf7d8a49645671f7ac18011038e28d97e3b04a34824e82","observation_id":"953fa6ca-4fed-43c7-a4cc-7e6f6305e94a","resolution":{"observed_at":"2026-05-24T09:14:17.002239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08773","last_updated":"2022-03-14T09:15:08Z","snapshot_observed_at":"2026-08-14T21:03:13.110127Z","submitted_at":"2021-04-18T08:44:56Z","title":"Cross-Task Generalization via Natural Language Crowdsourcing Instructions","version":4},"cited_work":{"arxiv_id":"2104.08773","doi":"10.1002/wps.20513","metadata_source":"pith","pith_arxiv_id":"2104.08773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cross-Task Generalization via Natural Language Crowdsourcing Instructions","venue":"cs.CL","work_id":"807e5cef-0bb3-4eae-a684-154fc2d6aa06","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2104.08773","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:ba62e572285a92b809e32798a2518310b36294850f58f979a7ed0941effe050e","observation_id":"b2fc5103-797a-460a-9e3c-88973ca45451","resolution":{"observed_at":"2026-05-24T09:14:16.518612Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01786","last_updated":"2023-05-29T16:40:37Z","snapshot_observed_at":"2026-08-17T05:58:22.357239Z","submitted_at":"2022-11-03T13:19:32Z","title":"Crosslingual Generalization through Multitask Finetuning","version":2},"cited_work":{"arxiv_id":"2211.01786","doi":"10.48550/arxiv.2211.01786","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.01786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosslingual generalization through multitask ﬁnetuning","venue":"arXiv (Cornell University)","work_id":"b4e14028-01ab-41ea-a454-23b4a72a4cf0","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2211.01786","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:a35a572183f66506b26546b8f0a749fbfb85eaeee18bed084645cdf1996890de","observation_id":"ad200f19-f2c0-4d95-b20e-0945d6d22325","resolution":{"observed_at":"2026-05-24T09:14:16.290290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-19T02:54:55.334346Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":"2112.09332","doi":"10.48550/arxiv.2112.09332","metadata_source":"pith","pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebGPT: Browser-assisted question-answering with human feedback","venue":"cs.CL","work_id":"e25ef3e1-4848-4cb9-bf28-67a420591165","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:09be69397e5fc49ac9c8f5ab948af32d2ea3f6342fad1d4df00176171a493ab5","observation_id":"e7fdd210-08c4-41bd-9075-65c2bf569d97","resolution":{"observed_at":"2026-05-24T09:14:16.484775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":"2203.02155","doi":"10.1007/s00354-022-00198-8","metadata_source":"pith","pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training language models to follow instructions with human feedback","venue":"cs.CL","work_id":"52aff42f-4fa9-4fcf-bdb3-1459b9bebf65","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:11579dc4ebac2734d287e5cc28816f2548bb691f7449fedc5433c7996aef8f00","observation_id":"9c031496-28f5-4758-bd74-ee1c62efefc5","resolution":{"observed_at":"2026-05-24T09:14:16.284485Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Arkil Patel, Satwik Bhattamishra, and Navin Goyal","venue":null,"work_id":"3b41627b-f4f4-426a-b15b-d5685dfa020d","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:2b401762a56cfdef65e7468bc7fadee6e91b2af467b2890131c8069fdc142106","observation_id":"85c5b8f5-c6b0-4717-9974-8f65e39edda0","resolution":{"observed_at":"2026-05-24T09:14:16.999125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:2fd79ea66795164d8e7a282a8b6b521164c706b6061dae61a9a451e548b474e7","observation_id":"a3b286bc-cc6f-4794-9bbf-53d334864877","resolution":{"observed_at":"2026-05-24T09:14:16.339591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-08-14T16:16:21.567225Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":"1910.10683","doi":"10.18653/v1/2020.acl-main.259","metadata_source":"pith","pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","venue":"cs.LG","work_id":"50e3b368-0243-4726-8186-233869802ad1","year":2019},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:c44ca06ab0503a2b842aa7a7fb3be84bcfb3794ec88c091c5440aaf481d69b66","observation_id":"7029cad0-0da8-4c8c-89d5-c5dfb2272b1b","resolution":{"observed_at":"2026-05-24T09:14:16.328824Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00295","last_updated":"2022-11-01T06:10:26Z","snapshot_observed_at":"2026-08-16T16:19:33.523621Z","submitted_at":"2022-11-01T06:10:26Z","title":"CONDAQA: A Contrastive Reading Comprehension Dataset for Reasoning about Negation","version":1},"cited_work":{"arxiv_id":"2211.00295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.00295","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"30bf0f26-f2ad-4da7-ba50-445ac770d55f","year":null},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2211.00295","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:2d79c678a6b09338f26186097acc7f7994deeb2ba28f6e125600fe3343a529ed","observation_id":"3f9f7ea4-bdca-4847-b506-dcda38b9928f","resolution":{"observed_at":"2026-05-24T09:14:16.424523Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17189","last_updated":"2022-03-31T17:12:13Z","snapshot_observed_at":"2026-08-16T17:10:11.301337Z","submitted_at":"2022-03-31T17:12:13Z","title":"Scaling Up Models and Data with $\\texttt{t5x}$ and $\\texttt{seqio}$","version":1},"cited_work":{"arxiv_id":"2203.17189","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17189","snapshot_observed_at":"2026-06-30T15:44:48.510903Z","title":"Alexey Romanov and Chaitanya Shivade","venue":null,"work_id":"b4ce3d71-9be2-4401-8618-528a87b188bd","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2203.17189","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:4b8e26ebad0b4eabcc21e9a8774b840b4c6149a08d9b16f63889d571a62e0444","observation_id":"a5886f98-9e55-4429-910e-7a75f63e791d","resolution":{"observed_at":"2026-05-24T09:14:16.503648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VictorSanh,AlbertWebson,ColinRaﬀel,StephenH.Bach,LintangSutawika,ZaidAlyafeai,AntoineChaﬃn, Arnaud Stiegler, Teven Le Scao, Arun Raja, et al","venue":null,"work_id":"aba763c6-a64a-4bb3-be67-02b68d4cb62b","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:9fa36a4f606b84a638f1bf4b00f04e9e3a136cb9a7f180776348582759a68704","observation_id":"ea36860d-4974-4bbe-987d-975332d705fe","resolution":{"observed_at":"2026-05-24T09:14:17.044165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08207","last_updated":"2022-03-17T17:53:01Z","snapshot_observed_at":"2026-08-14T04:21:28.978034Z","submitted_at":"2021-10-15T17:08:57Z","title":"Multitask Prompted Training Enables Zero-Shot Task Generalization","version":3},"cited_work":{"arxiv_id":"2110.08207","doi":"10.48550/arxiv.2110.08207","metadata_source":"pith","pith_arxiv_id":"2110.08207","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multitask Prompted Training Enables Zero-Shot Task Generalization","venue":"cs.LG","work_id":"1857c952-db2f-4810-9e3c-27a862c8d276","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2110.08207","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:314c7b06d1585fb70477b9101d1e2c95b10663c01683015b108ebb19a1fd4c7c","observation_id":"27525df6-af94-4eb8-82a3-2bf087a6ad6c","resolution":{"observed_at":"2026-05-24T09:14:16.322047Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1339","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/D19-1339","venue":null,"work_id":"ab1d6b4f-364e-4aea-91e5-c3992b422ca9","year":2019},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:59574b9d5b5b69f93c63980de764b7e43cfb9431996dcfc668d9d0b71f7b9431","observation_id":"40bb1f13-0ede-415c-8537-0ddbcd0e54e0","resolution":{"observed_at":"2026-05-24T09:14:15.873771Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-17T17:38:12.586018+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T17:38:12.586018+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.13138","last_updated":"2022-12-26T14:28:24Z","snapshot_observed_at":"2026-08-18T17:55:17.693956Z","submitted_at":"2022-12-26T14:28:24Z","title":"Large Language Models Encode Clinical Knowledge","version":1},"cited_work":{"arxiv_id":"2212.13138","doi":"10.48550/arxiv.2212.13138","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.13138","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aarohi Srivastava, Abhinav Rastogi, Abhishek Rao, Abu Awal Md Shoeb, Abubakar Abid, Adam Fisch, Adam R Brown, Adam Santoro, Aditya Gupta, Adrià Garriga-Alonso, et al","venue":"arXiv (Cornell University)","work_id":"6d556ac1-21d1-495a-8147-1b3d48aa79e8","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2212.13138","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:234893daf5511f19de89ff2d856f883b34d8bbf4e8ca37c3bb0c6a8442057811","observation_id":"7d666164-e69e-43d1-9965-309b6f602f02","resolution":{"observed_at":"2026-05-24T09:14:16.514281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":"2206.04615","doi":"10.1162/tacl_a_00688","metadata_source":"pith","pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","venue":"cs.CL","work_id":"bb63abb3-0d50-4362-b97c-b5e725b03b39","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:6278834f579d39c7081cd11f89bb8a5b890ec776e934cf2f206bfd0811b11bd6","observation_id":"e208446e-2900-4851-90ab-8b131f407bb0","resolution":{"observed_at":"2026-05-24T09:14:16.494657Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-08-21T02:25:44.454471Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":"2210.09261","doi":"10.48550/arxiv.2210.09261","metadata_source":"pith","pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","venue":"cs.CL","work_id":"513eb205-04ca-4722-9a43-a74e8cbe7e85","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:e15670dbc0a7119779bd9680eb9aaec921b9126018b8faa80466dbfc6cf0a204","observation_id":"2676db0a-d9b8-45b7-ba3b-7aca5b8e5b5f","resolution":{"observed_at":"2026-05-24T09:14:16.498887Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ea264da7-36f1-492b-ba84-0abc424b1902","year":2019},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:89c9f178f2a040d0cff8131b02b7ac3be32326354679e14f4096723bc626bd88","observation_id":"dc988501-a154-4fa9-bcc8-629729128d63","resolution":{"observed_at":"2026-05-24T09:14:17.033955Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05131","last_updated":"2023-02-28T17:20:36Z","snapshot_observed_at":"2026-08-16T17:01:15.052646Z","submitted_at":"2022-05-10T19:32:20Z","title":"UL2: Unifying Language Learning Paradigms","version":3},"cited_work":{"arxiv_id":"2205.05131","doi":"10.48550/arxiv.2205.05131","metadata_source":"arxiv_reference","pith_arxiv_id":"2205.05131","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unifying language learning paradigms.arXiv preprint arXiv:2205.05131, 2022a","venue":"arXiv (Cornell University)","work_id":"140d045f-bac6-4ab3-8d76-b527416fd007","year":2023},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2205.05131","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:500a15c1a000dee94907fc46cc1c8fbf213af47f6276cf7297fd4de5bf38bed3","observation_id":"4a0dd766-ef91-4a66-ad69-16caea522272","resolution":{"observed_at":"2026-05-24T09:14:16.537141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":"2201.08239","doi":"10.48550/arxiv.2201.08239","metadata_source":"pith","pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LaMDA: Language Models for Dialog Applications","venue":"cs.CL","work_id":"1b66d0a5-f6ae-4332-8025-c662dc64b238","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:9e55166826fae42ae6d73702431dc9426233eac2e78ba5aa65b7499b1a943ee0","observation_id":"8b82d451-d934-49ef-9060-ae40e5b40fc1","resolution":{"observed_at":"2026-05-24T09:14:16.380262Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tu Vu, Brian Lester, Noah Constant, Rami Al-Rfou’, and Daniel Cer","venue":null,"work_id":"196f3606-4a3f-401c-b62e-2f82ca52f702","year":2020},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:b2b9a4b4b85ede07092e7efb154447a12637f587a3be80d5730a7159cc6d5e83","observation_id":"5a1fa59e-4c6c-4e91-a742-6339456d7490","resolution":{"observed_at":"2026-05-24T09:14:17.037585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eric Wallace, Shi Feng, Nikhil Kandpal, Matt Gardner, and Sameer Singh","venue":null,"work_id":"cffcc012-8259-4979-914a-fa798df683f8","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:d9e36d969c06347a7ee6557db763a4309824b0fd6efe12911597bdc20128720f","observation_id":"a349c555-02a3-4f1b-9426-9251f979781b","resolution":{"observed_at":"2026-05-24T09:14:17.047650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1221","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/D19-1221","venue":null,"work_id":"edfb81d1-b34f-408d-a8e2-1aa33d1d0f35","year":2019},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:f330d03e5a1c7dc5925f979fef5a9df69eb9da0cba4d0f77b0746f62a9c54629","observation_id":"bf86fed8-c129-46ac-bdce-1f829f823232","resolution":{"observed_at":"2026-05-24T09:14:15.877464Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:39.764148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:39.764148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05832","last_updated":"2022-04-12T14:19:49Z","snapshot_observed_at":"2026-08-16T17:07:27.352968Z","submitted_at":"2022-04-12T14:19:49Z","title":"What Language Model Architecture and Pretraining Objective Work Best for Zero-Shot Generalization?","version":1},"cited_work":{"arxiv_id":"2204.05832","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.05832","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What language model architecture and pretraining objective work best for zero-shot generalization? ICML, 2022a","venue":null,"work_id":"414f8557-66dc-483c-b2cd-25b668633d80","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2204.05832","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:efc384fac218549fdd09c10c6a92de0fb273558a3298c0a383058b173a4856df","observation_id":"ac462a33-3b21-43aa-9cf4-c6e06d0879dc","resolution":{"observed_at":"2026-05-24T09:14:16.430799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-08-16T16:07:05.433415Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2212.10773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qinyuan Ye, Bill Yuchen Lin, and Xiang Ren","venue":null,"work_id":"e55ac875-6538-4b8f-8400-fb64b49c0056","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:c1be82d26888e5e04aad0c62b04da11c7b6c820757e0d0cacd4d646cbae9e26d","observation_id":"fde93e06-3f15-492a-85ab-da365e81ff90","resolution":{"observed_at":"2026-05-24T09:14:16.466194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08835","last_updated":"2021-09-30T22:36:50Z","snapshot_observed_at":"2026-08-16T18:30:45.848424Z","submitted_at":"2021-04-18T12:14:46Z","title":"CrossFit: A Few-shot Learning Challenge for Cross-task Generalization in NLP","version":2},"cited_work":{"arxiv_id":"2104.08835","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.08835","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seonghyeon Ye, Doyoung Kim, Joel Jang, Joongbo Shin, and Minjoon Seo","venue":null,"work_id":"3faa9a4d-bc3b-464e-80de-14bc53dfaab8","year":null},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2104.08835","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:83edc75406f6784ff4de2ff5c180745ed4252df47bc44604cc007703c7ff8823","observation_id":"0f47fd42-e406-4835-b7f5-fe8fcceeedc7","resolution":{"observed_at":"2026-05-24T09:14:16.471427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02414","last_updated":"2023-10-25T05:22:43Z","snapshot_observed_at":"2026-08-22T03:29:29.580654Z","submitted_at":"2022-10-05T17:34:44Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","version":2},"cited_work":{"arxiv_id":"2210.02414","doi":"10.48550/arxiv.2210.02414","metadata_source":"pith","pith_arxiv_id":"2210.02414","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","venue":"cs.CL","work_id":"b6ef9427-af31-4c7c-8c34-bee621978c23","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2210.02414","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:8d87500afb4b048e5d0dcb4acecb038ff1e68700aa020a82cd6176e1547472b7","observation_id":"3865ca79-b7cc-46ae-9889-4cbf4d73efa6","resolution":{"observed_at":"2026-05-24T09:14:16.437094Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":"2205.01068","doi":"10.48550/arxiv.2205.01068","metadata_source":"pith","pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-07-11T03:37:45.880117Z","title":"OPT: Open Pre-trained Transformer Language Models","venue":"cs.CL","work_id":"d7ff3b21-1fff-4cf4-952a-4714e3ef2307","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:29774c44ce00f06ccd2891ef68088edeb8755479a7dd80ba114528c5a828103f","observation_id":"6c44102c-db25-4f48-82e0-b50ca30988da","resolution":{"observed_at":"2026-05-24T09:14:16.389868Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"20 A.2 Single-Task Finetuning","venue":null,"work_id":"05230053-2c80-4566-9ca2-f118fa521679","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:67548090b68e3e22d2cc48f5d6e25e28d4dfb90508ccf6d220ba9292f2b36b98","observation_id":"20fec69b-aea8-49e1-b731-d5160d64d548","resolution":{"observed_at":"2026-05-24T09:14:17.022282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"These datasets are contained in the Flan 2022 ﬁnetuning collection and represent challenging benchmarks, often used to evaluate LLMs on QA and NLI","venue":null,"work_id":"072596aa-e697-4029-b3cf-c2550b1b7d53","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:51e9f1abb9686e86416340da817b57dd9800bc0dd5c8042a18dee8639fbf94e5","observation_id":"3fe5f7b9-4382-4aee-99f4-80e76fab46e2","resolution":{"observed_at":"2026-05-24T09:14:17.025604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"13bfbbf8-e289-4121-bfca-b8d88bfdb7d1","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:07b51152ce9713aa4c2789654240bdd03840c29b8ca32543d87ebf1ff6c14814","observation_id":"5fa64225-82be-454f-9568-4994eb573dbc","resolution":{"observed_at":"2026-05-24T09:14:17.019112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":1,"metadata_mismatch":15,"parse_uncertain":0,"unresolved":3,"verified_exact":32,"verified_fuzzy":12},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 49 inbound Pith citation observations for arXiv:2301.13688."}