{"as_of":"2026-08-19T13:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cee0ccfadb93215fcab668b0e77ded2ab1ec739fc252a0db9d0c28f360d89533","coverage":[{"denominator":88,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":88,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:56:21.386107Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.05970/citation-record","integrity":"/paper/2505.05970/integrity","json":"/paper/2505.05970/citation-record.json","paper":"/paper/2505.05970"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.425570Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.425570Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:607746ec2245d427988e6517cff1e80bb14162fde37661dd11ce2224f67489e3","observation_id":"b0c73017-8d53-47ab-aa94-a8a9751ad894","resolution":{"observed_at":"2026-08-15T22:56:20.425570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.444388Z","title":"Lmrl gym: Benchmarks for multi-turn reinforcement learning with language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.444388Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:b87f008fd4f35397a01d6963e59c096a25e4ddbcad59ca00da92a43e66606a5b","observation_id":"1d1687d4-57ee-4095-9e39-4a910474c5b5","resolution":{"observed_at":"2026-08-15T22:56:20.444388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.455962Z","title":"On the proper role of linguistically-oriented deep net analysis in linguistic theorizing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.455962Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:519c4f7a67b06133b3e17a6d18f7abd6e84a06f234973301b2a385fd414f04c7","observation_id":"f9bc6b34-bfef-44b4-b12e-a0dd9e3b1202","resolution":{"observed_at":"2026-08-15T22:56:20.455962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.462402Z","title":"Pythia: a suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.462402Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:5e18575ac5111cc535fe13dd32821405052db18b3febda20845d004c1abe411e","observation_id":"82f40f8d-971b-4ca7-b27b-4ea76e6c27cf","resolution":{"observed_at":"2026-08-15T22:56:20.462402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.469633Z","title":"Experiment Tracking with Weights and Biases , 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.469633Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:c6d5ebee6951b1855da8e615e86b16ccf9096775699230d4c9e3036d9bb4e4f1","observation_id":"3456caa0-260c-4f02-9038-d44c5151c4f9","resolution":{"observed_at":"2026-08-15T22:56:20.469633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.478344Z","title":"Language Development : Form and Function in Emerging Grammars","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.478344Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:7110467ca51049e7de6f7d0d107d0500f0d56bc5d89e4b6d6550f7611e51afa3","observation_id":"48fa525d-ba18-404d-9dc8-b8898aadd18e","resolution":{"observed_at":"2026-08-15T22:56:20.478344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.491156Z","title":"Derivational complexity and order of acquisition in child speech","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.491156Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a423e16cb88b9b33c52491c03edc886d5a8ec49c6a1fda7484220b0669f00b5d","observation_id":"b7a03277-ffac-4347-b8d1-f55d2153470d","resolution":{"observed_at":"2026-08-15T22:56:20.491156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/026565908500100113","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.527314Z","title":"Child's Talk : Learning to Use Language","venue":null,"work_id":"85584a9b-24ac-4b5b-bc7e-8e4616b877e3","year":1985},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.502452Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:87e7b66f4c17086985e41a7729ee5dc16bb06da251f085697889d867d882f7e9","observation_id":"6c81995d-42d4-492d-9fc7-839e31109491","resolution":{"observed_at":"2026-08-15T22:56:22.536732Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.510692Z","title":"Meaning and necessity","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.510692Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:60c8a48e03c81c305f8e30af40903d0e79b6d95b7d2243425a388a8bc7a78d27","observation_id":"cfc09f1f-5a8e-4524-96a3-2af856b838c0","resolution":{"observed_at":"2026-08-15T22:56:20.510692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.518816Z","title":"Chang and Benjamin K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.518816Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:643a518f20827f240829cd55c58d6e1bc657d39f08d94c752b56aca9dec9fad3","observation_id":"8b9e5694-1c22-4295-bb1e-d829c916d07a","resolution":{"observed_at":"2026-08-15T22:56:20.518816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.531413Z","title":"Conceptual 12M : Pushing web-scale image-text pre-training to recognize long-tail visual concepts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.531413Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:27fd5bb34e5e112cb2e9d9fbe2c98883ca34d77316670850eb6829f6b5e4351a","observation_id":"58c17242-ab57-4564-8f0a-778de9bfa163","resolution":{"observed_at":"2026-08-15T22:56:20.531413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.805105Z","title":"Not all layers are equally as important: Every Layer Counts BERT","venue":null,"work_id":"1205cbb3-62c2-4397-a608-cf1ae1c65b62","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.544168Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:26bd487775cab60cff5b2789ba2b578a34cc285e739543f0c3b0f50fd82df20f","observation_id":"9ecedce5-a9ab-4473-bce6-4297e9f1492e","resolution":{"observed_at":"2026-08-15T22:56:24.810709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s0305000903005701","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.483063Z","title":"Chouinard and Eve V","venue":null,"work_id":"a0bfde2a-7d67-4019-a8ea-3bef1fafde8f","year":2003},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.558511Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:c6354b8f0e5b3374080f5563c2a0955c3cf7b263dfa597ee78933664cf6d1cb6","observation_id":"851be6c7-2969-45a0-9d39-5dda8e9eb7c2","resolution":{"observed_at":"2026-08-15T22:56:22.490484Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.564384Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.564384Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:0927a797da87029ee32bc5286373dcd6274606a00b8b1dfd65d4c01bd6e0ddfe","observation_id":"7f249f40-238c-4971-8327-f61c367c0c8b","resolution":{"observed_at":"2026-08-15T22:56:20.564384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.17197","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.536598Z","title":null,"venue":null,"work_id":"e474af69-c203-479e-9d8d-5e3ef7d6d1bd","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.576083Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:240de38bb48cbfb9af1dc90ded645f239f784d72c8b83ab453cadcc9eb64c997","observation_id":"aae9b3e4-3405-409c-ba8f-708331d6a984","resolution":{"observed_at":"2026-08-15T22:56:23.549050Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.783942Z","title":"Automatic text summarization: A comprehensive survey","venue":null,"work_id":"894b0491-4e1d-462f-b6d8-a22a078341ec","year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.586185Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:891a08efff4d93850db15eb51cd3d2775e4019fd8ec7cdba1520abc36c7f052b","observation_id":"6c895fa6-e3e3-4943-bbd8-b79b0129d039","resolution":{"observed_at":"2026-08-15T22:56:24.790699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.597485Z","title":"Johnson, Annette Karmiloff-Smith, Domenico Parisi, and Kim Plunkett","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.597485Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:4974723aa31ca38261dcf736a9b66f2f2802595818649a06c10ce7dedd19a3a6","observation_id":"800cea8c-7c11-498f-aed8-76393d8eba8b","resolution":{"observed_at":"2026-08-15T22:56:20.597485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.764501Z","title":"Finding structure in time","venue":null,"work_id":"8e3fb9c3-97c0-4748-8a85-84fc8f7ecee3","year":1990},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.606259Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:ff41a90d599bade320b6c1f521ba6d230bc464e52d716e94ca5510bba3b2dee1","observation_id":"ce3b2d6a-9378-4698-b8db-499ee0356a07","resolution":{"observed_at":"2026-08-15T22:56:24.769649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05892","last_updated":"2025-02-09T13:15:59Z","snapshot_observed_at":"2026-08-14T22:08:11.952556Z","submitted_at":"2025-02-09T13:15:59Z","title":"A Distributional Perspective on Word Learning in Neural Language Models","version":1},"cited_work":{"arxiv_id":"2502.05892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05892","snapshot_observed_at":"2026-08-15T22:56:23.431728Z","title":"A Distributional Perspective on Word Learning in Neural Language Models","venue":"cs.CL","work_id":"6baf4782-4a27-4905-be20-e576309d3c92","year":2025},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.614187Z"},"links":{"cited_paper":"/paper/2502.05892","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:4972341674abdd519826fff256598ac35c706fb9ad96e299bf21734c8ad2e6d2","observation_id":"56b1985d-1efa-4153-8e6d-80111c1b811d","resolution":{"observed_at":"2026-08-15T22:56:23.438181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.624800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.624800Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:1b725975fc032d9a62aa0b05f80f1a7ee2b7f03e23c87a52f9074a2caaaf21f6","observation_id":"05dbe06c-962b-438d-8621-67ebdda4c914","resolution":{"observed_at":"2026-08-15T22:56:20.624800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.631833Z","title":"Richards, Steven F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.631833Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:29152398d222df27fc1f21b22bb5be40112ca261f3d9aee5f945cafe8254281b","observation_id":"06aa1aa3-fe1b-441b-993e-35d2bdca391b","resolution":{"observed_at":"2026-08-15T22:56:20.631833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.738422Z","title":"Towards pragmatic production strategies for natural language generation tasks, 2022","venue":null,"work_id":"ba89b058-d3a8-4260-bd4b-acbaf15ff6a9","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.640713Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:07799bdd059d3de47607b4cdd4f395f8948e3ff45402ac32a5fd004fc304d35d","observation_id":"e54ca779-1369-49dd-8a16-ece77167c42c","resolution":{"observed_at":"2026-08-15T22:56:24.745009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.649005Z","title":"Language identification in the limit","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.649005Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:9e40002276c3c62a2c8e396e231e0cf6cc1cdb4a6dadb5d676cdb5851aea0e71","observation_id":"475c9fd7-cfb5-43c8-bb7f-739f83971ffb","resolution":{"observed_at":"2026-08-15T22:56:20.649005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.664253Z","title":null,"venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.664253Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:3caf3088755284879e5b784bfcfdc220e21502aa95fb42f2acc7fa83771b377b","observation_id":"a3253c66-765b-49bb-9727-fc2c3e03fd77","resolution":{"observed_at":"2026-08-15T22:56:20.664253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.714716Z","title":"Dynamic population-based meta-learning for multi-agent communication with natural language","venue":null,"work_id":"cd698818-a405-4a60-a3cf-ff0cb13855de","year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.671896Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:ed9656ea1e2809a9d5fbaf14aa24be23e38737951cece56a43a449463c1a454d","observation_id":"07103a33-378c-47f4-959a-ea43b1a68b43","resolution":{"observed_at":"2026-08-15T22:56:24.724180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/k16-1011","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.098504Z","title":"A Data -driven Investigation of Corrective Feedback on Subject Omission Errors in First Language Acquisition","venue":null,"work_id":"754f95f4-5228-465a-8572-66907908e297","year":2016},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.681199Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:8e5975596e9fbc910a0c18e68bf70b01d76ddce70f24f4b3c2a2771d9f0f0db3","observation_id":"4426fcda-041e-4cc6-bf76-3dd606b625bf","resolution":{"observed_at":"2026-08-15T22:56:22.109609Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/wcs.142","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.062925Z","title":null,"venue":null,"work_id":"8755321e-c827-43df-b05e-b6834eef6d63","year":2011},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.687358Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:10daac66f1b409b38136e51786089c2ac2e4893ac777584f1ccf2fe87bf2939b","observation_id":"57c267c0-472f-4bf7-865f-b884101871b5","resolution":{"observed_at":"2026-08-15T22:56:22.075162Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.691474Z","title":"Multitasking inhibits semantic drift, 2021","venue":null,"work_id":"fa08e09e-17cf-47c7-962e-c5f0d8ae831d","year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.698422Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:e0e2259cbb59ad210fcc9cd62fb94a80e08bbb72bcb1ca11900204c4f803e0cb","observation_id":"73d518cb-bc70-4d47-bc26-884f3e70c4ea","resolution":{"observed_at":"2026-08-15T22:56:24.697700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.714958Z","title":"Why Large Language Models Are Poor Theories of Human Linguistic Cognition : A Reply to Piantadosi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.714958Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:6964ecee69092334aeb1cb0f079a2df078871a843ee512418e76eb22d777cb30","observation_id":"dbf3cec1-3b3d-4b1d-a55e-07baf1cc4829","resolution":{"observed_at":"2026-08-15T22:56:20.714958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.657134Z","title":"Unifiedqa: Crossing format boundaries with a single qa system, 2020","venue":null,"work_id":"668debef-dc47-45ed-a686-f4e5327149e7","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.724744Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:136ac4942b328dd94d4813e74b4137e3e2fd53932671914ebc4b949e9e36dddc","observation_id":"cc1bbb64-cee6-4bc8-905f-dde7bd8ed9fc","resolution":{"observed_at":"2026-08-15T22:56:24.663304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.610771Z","title":"Unifiedqa-v2: Stronger generalization via broader cross-format training, 2022","venue":null,"work_id":"51016c8f-2f3b-446e-88fd-5c23f9a7aeca","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.736993Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:fb26b69ce2061c71d3690773f1bb6a7ac9cb75e41547d0a6c385d4333d49d913","observation_id":"8d8aaa90-632c-46eb-aea9-aa0e820eed7d","resolution":{"observed_at":"2026-08-15T22:56:24.618742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.588937Z","title":"The handbook of pidgin and creole studies","venue":null,"work_id":"15d483d3-d7c1-4c43-919a-ffcc91e8a3e0","year":2009},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.746376Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:7fe71fa6bc8afa1166e2267685a10030c5c399a3b155fb0e0c91d608f7683549","observation_id":"e330642f-f6ab-4524-9150-c7aa2ed00ea4","resolution":{"observed_at":"2026-08-15T22:56:24.595754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.756942Z","title":"Large language models and the argument from the poverty of the stimulus","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.756942Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:25084505a6cb25dddaea86118f766231578a2ad543dbb8217fe9075796d35a8b","observation_id":"38654566-52b5-49c8-bfb4-9342b0516345","resolution":{"observed_at":"2026-08-15T22:56:20.756942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.551488Z","title":"Grammaticality, acceptability, and probability: A probabilistic view of linguistic knowledge","venue":null,"work_id":"d720f459-5174-4948-93f4-27fb816fe1ac","year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.763707Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:48fac612c0d68f0164484ef5075517a0ed4806680312f291b74c5008f0075a5b","observation_id":"439d6e4d-a425-49b7-8f2b-aa7954083a62","resolution":{"observed_at":"2026-08-15T22:56:24.562441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.522417Z","title":"Multi-agent communication meets natural language: Synergies between functional and structural language learning, 2020 a","venue":null,"work_id":"dbd1765f-d522-465b-a921-635b8ad36528","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.771658Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:e4639e3100ca45f02dca2799c599554d37e404b6498fa4256621be0f71b6bbea","observation_id":"1860fc31-232f-4ea1-bacd-952ff11b9015","resolution":{"observed_at":"2026-08-15T22:56:24.531648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.784253Z","title":"Multi-agent Communication meets Natural Language : Synergies between Functional and Structural Language Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.784253Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:7e17dc436c04baa6bf7cb313c79502c28779f90e0aa04cd2b039a8d5e2a1cf33","observation_id":"b982e871-61cc-42ed-b885-ff033071bd18","resolution":{"observed_at":"2026-08-15T22:56:20.784253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.794313Z","title":"Expectation-based syntactic comprehension","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.794313Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:065d555a3e6a807a126b1afa93df8e8e0f423a315c7c96aec241238a0ae9680c","observation_id":"71495e5a-e542-4968-adab-1a78daf87ad3","resolution":{"observed_at":"2026-08-15T22:56:20.794313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7551/mitpress/7503.003.0111","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.958820Z","title":"Florian Jaeger","venue":null,"work_id":"01c05841-e5c7-4de7-a049-aac78d9951a0","year":2007},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.806110Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:b8f86f0bf349d5e90bfc91f464ef6fec9e0439a6fbdf93332e54a8ed22569a53","observation_id":"316e9993-99ba-4fef-b742-ba9d76397395","resolution":{"observed_at":"2026-08-15T22:56:21.964754Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.496946Z","title":null,"venue":null,"work_id":"69483a35-5835-4e1b-8811-208df5df8c86","year":1986},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.814952Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:ca4af5d60a2e73464d725440092fce98093a5e689e7d51d2ecb38bfd340fa597","observation_id":"e8a1dbf7-aa5e-4686-93dc-93edb57b1658","resolution":{"observed_at":"2026-08-15T22:56:24.502751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.462792Z","title":"Convention: A Philosophical Study","venue":null,"work_id":"c195dd4d-a198-4918-874f-b6fc7528d0bc","year":1969},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.825386Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:26860c3065aa1778e6af62258d60642ab76434b324ec00fbca46e7beea726de8","observation_id":"eeec0803-6352-43a9-8dc1-ceba35f08d62","resolution":{"observed_at":"2026-08-15T22:56:24.470661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.839046Z","title":"ROUGE : A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.839046Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:832f3bc2221380137807fab17ff703ee5c337f8b699dafcfb8b32ff5ac4ec518","observation_id":"dcb70154-2081-438c-8ad2-0ca62376b0f3","resolution":{"observed_at":"2026-08-15T22:56:20.839046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.408634Z","title":"What can linguistics and deep learning contribute to each other? Response to Pater","venue":null,"work_id":"a3cff15a-0fd4-43b0-8038-0e2b7a97a9a2","year":2019},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.847878Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:2b805a28402d8f86db0bdfe0d9e90ee0ca580cf825bbb8c5ef630f8aca359086","observation_id":"ed787409-5147-498a-95da-9e7f2d51112d","resolution":{"observed_at":"2026-08-15T22:56:24.416990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01502","last_updated":"2023-03-02T18:59:46Z","snapshot_observed_at":"2026-08-18T14:38:38.322392Z","submitted_at":"2023-03-02T18:59:46Z","title":"Computational Language Acquisition with Theory of Mind","version":1},"cited_work":{"arxiv_id":"2303.01502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.01502","snapshot_observed_at":"2026-08-15T22:56:23.371938Z","title":"Computational Language Acquisition with Theory of Mind","venue":"cs.CL","work_id":"7fff22a0-df3e-4ccb-b84d-f7e7c85297fa","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.864401Z"},"links":{"cited_paper":"/paper/2303.01502","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:3973795dc5428178cc3d08c4e6cbfcb5113bbf47c5250dec9c45b0c649cd1d9b","observation_id":"52d51fe2-2608-4ce1-b847-e780fb35ea23","resolution":{"observed_at":"2026-08-15T22:56:23.378871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.373674Z","title":"On the interaction between supervision and self-play in emergent communication, 2020","venue":null,"work_id":"815de58c-dd53-4364-9f55-c3b7d2663094","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.875410Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:24996e7eadbd0c1eb7273ef05903feca95c42c89626aa25eeadc30f97ade1813","observation_id":"1d67ec54-d09b-4aaa-ae6c-3a1656c7795e","resolution":{"observed_at":"2026-08-15T22:56:24.382250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.344541Z","title":"Countering language drift with seeded iterated learning, 2020","venue":null,"work_id":"f950430e-8bb6-470c-8a92-90cbfdaa5a50","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.881146Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:2eec8b498f0ec085f2612cfd4ac3c3ba4df484c85eba9b4554939e4c0ca41610","observation_id":"0dd35a7c-17ff-4cdd-b436-4386bb31777d","resolution":{"observed_at":"2026-08-15T22:56:24.352142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.893284Z","title":"Words and the World : Predictive Coding and the Language - Perception - Cognition Interface","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.893284Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:376acc7f24630e47286ac1def9fc0397261fc6169be0bf9f9870284f5b1a941b","observation_id":"bcd6889b-026c-4399-9f41-08be5c821117","resolution":{"observed_at":"2026-08-15T22:56:20.893284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.903961Z","title":null,"venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.903961Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:491037dfc9ccff8ea178b90c35f75a57306fcab1de9ed348b469cd2d3f5e2dd9","observation_id":"f4481f62-9b46-42e2-aa35-2123f8ae729b","resolution":{"observed_at":"2026-08-15T22:56:20.903961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.302856Z","title":"CLIMB – curriculum learning for infant-inspired model building","venue":null,"work_id":"ab8d9940-9d42-43f7-a709-f64129c19158","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.914679Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d6c27e8e522828893dfd035988144366527363893c8c58455bfcf9148500f460","observation_id":"10be7c89-4a91-4e09-8691-e1b2bad19de9","resolution":{"observed_at":"2026-08-15T22:56:24.312796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T22:56:20.932944Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.932944Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:82724305360c0e2fd2b20ede401e94506601f2db01c0aecf79541aa0452378e4","observation_id":"f77f14e8-fd55-4320-a2bf-9433057717d1","resolution":{"observed_at":"2026-08-15T22:56:20.932944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07144","last_updated":"2024-08-13T18:26:04Z","snapshot_observed_at":"2026-08-17T17:41:05.901340Z","submitted_at":"2024-08-13T18:26:04Z","title":"Language Models as Models of Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07144","snapshot_observed_at":"2026-08-15T22:56:20.949085Z","title":"Language Models as Models of Language","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.949085Z"},"links":{"cited_paper":"/paper/2408.07144","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:cda0a4a0aa7b8ad15ac5b82dc8a4249e277fe447502b809ccbf9fef79a77f1e0","observation_id":"b2ef277b-364d-4b91-a624-a7eb99d652e1","resolution":{"observed_at":"2026-08-15T22:56:20.949085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02373","last_updated":"2023-10-24T14:53:50Z","snapshot_observed_at":"2026-08-16T15:03:07.327872Z","submitted_at":"2023-09-05T16:35:41Z","title":"nanoT5: A PyTorch Framework for Pre-training and Fine-tuning T5-style Models with Limited Resources","version":2},"cited_work":{"arxiv_id":"2309.02373","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.02373","snapshot_observed_at":"2026-08-15T22:56:23.256576Z","title":"nanoT5: A PyTorch Framework for Pre-training and Fine-tuning T5-style Models with Limited Resources","venue":"cs.CL","work_id":"11f0ec4d-4814-4950-929d-e492b270c3ae","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.962032Z"},"links":{"cited_paper":"/paper/2309.02373","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:7f0958339ba4cc89e56626a79e002936c4c3a6f3b4808741e56886079758de39","observation_id":"f801f7de-4bf3-4ef9-bb65-73e61f88f42d","resolution":{"observed_at":"2026-08-15T22:56:23.265509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.973957Z","title":"Modeling the interaction between perception-based and production-based learning in children ' s early acquisition of semantic knowledge","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.973957Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:29a64bc99f658e28158f88c465a82b8c90fa7494768bb0a906c8c451e7491751","observation_id":"090288e0-9e26-4f9a-a9a4-5aac167fada8","resolution":{"observed_at":"2026-08-15T22:56:20.973957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.993163Z","title":"Communicative Feedback in Language Acquisition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.993163Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:66586db43fe64ccd3d480ec3dbcf503b68b2c8b7001b392d74ba5d562e5cdca4","observation_id":"9ba02cab-07b8-450a-b5e6-3052a3b66a78","resolution":{"observed_at":"2026-08-15T22:56:20.993163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.31234/osf.io/sg5mv","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.855564Z","title":"Communicative Feedback as a Mechanism Supporting the Production of Intelligible Speech in Early Childhood","venue":null,"work_id":"cf28b8ae-f5b4-4bbd-ba8f-fa11248ace84","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.002148Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:fdd8c1bfa1e6d9f5c547f37ea03b4cff2cff4206c92569b80497805a9d97ea47","observation_id":"535aa241-b565-40cc-abef-68910020924b","resolution":{"observed_at":"2026-08-15T22:56:21.868618Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.263838Z","title":"Communicative Feedback in Response to Children 's Grammatical Errors","venue":null,"work_id":"29d53ec7-52ed-46bd-8c8a-00c8ec672395","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.010264Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:cb4c91b3fdc40b43e34cab24c6c41ef057c36d971f6d4409559c267e182e7644","observation_id":"183e506e-2adb-4d2d-8904-100f3b4dac54","resolution":{"observed_at":"2026-08-15T22:56:24.272052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.228363Z","title":"Language acquisition through language use: The functional sources of children's early utterances","venue":null,"work_id":"2834af9a-52ac-4d8b-a875-12eca0e7e390","year":1988},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.029321Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:446de77d6c48aee7656b4e11d740cc7a0ba5ae89dcb11952cab5e480bd015eb7","observation_id":"28bed85b-fa83-48c4-aadd-804cd0ba4cf9","resolution":{"observed_at":"2026-08-15T22:56:24.236064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.201449Z","title":"ChatGPT : Optimizing language models for dialogue, 2022","venue":null,"work_id":"fe4f55b0-1692-4391-8744-47c9c4294e6a","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.042002Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:1e098e38cac3c2f51b9eea955227c64ba3fb85577ef7572036870e9486b253ff","observation_id":"3a368353-f546-4a29-adde-7654c20aa059","resolution":{"observed_at":"2026-08-15T22:56:24.207177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.167443Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"c4f4dd02-63fe-49a6-9b58-89b489d88b77","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.054044Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:62b99d3eab18b929401d4714920222fde483ddd2418bf462bc6e7aa1e25c74e5","observation_id":"7d9b77d7-e714-4513-9b78-1bedc1ea9a3d","resolution":{"observed_at":"2026-08-15T22:56:24.176837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.135795Z","title":"Christiano, Jan Leike, and Ryan Lowe","venue":null,"work_id":"42673216-11f1-4bd5-9308-4948d192003b","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.064846Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:4c57d8a548b85c0f18aac9fbae02868748fe18f3d29776b9677a48b9a7ef8274","observation_id":"75bfab95-1d1e-4696-b135-1d909ac23c6d","resolution":{"observed_at":"2026-08-15T22:56:24.143179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.074804Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.074804Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:265d74ce42d01b2313bb219901d7e434f95a29e1cde65ac95ecaedb30a0d3b7e","observation_id":"d698d455-fd94-4951-a68a-dba2cb726758","resolution":{"observed_at":"2026-08-15T22:56:21.074804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.081624Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.081624Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d51cf1466b8be6eeec264b258cd186ea96bba3f8e2af026c40811a51a16f402c","observation_id":"7d70ce74-f8d4-403b-8569-4a444ef66108","resolution":{"observed_at":"2026-08-15T22:56:21.081624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.087945Z","title":"Know what you don ' t know: Unanswerable questions for SQ u AD","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.087945Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:43948d0e64fed162182e63a2984fa16fddf8743e96972865b8cd9d102430479d","observation_id":"12ab7006-c456-45e4-8e37-69ff4d51437f","resolution":{"observed_at":"2026-08-15T22:56:21.087945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11958","last_updated":"2024-03-18T16:52:54Z","snapshot_observed_at":"2026-08-16T14:08:43.432248Z","submitted_at":"2024-03-18T16:52:54Z","title":"Language Evolution with Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11958","snapshot_observed_at":"2026-08-15T22:56:21.098482Z","title":"Language evolution with deep learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.098482Z"},"links":{"cited_paper":"/paper/2403.11958","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:bdb3cde61f2a9deeabfc617ff8c7c84443714703525132bf77aa04a80253a5e4","observation_id":"53af847d-f417-41aa-a0f9-9c374bc5065a","resolution":{"observed_at":"2026-08-15T22:56:21.098482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.078052Z","title":"Information structure: Towards an integrated formal theory of pragmatics","venue":null,"work_id":"b45a9cae-0090-41d4-844d-26385c9ee408","year":1996},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.108353Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:9bc9b9479417f9bb7ec10681d2dc2eed7db5686531e33d0acd3fb701f9b2bdc5","observation_id":"8f1f5d65-cc6b-430a-bb4e-cebb4abe4053","resolution":{"observed_at":"2026-08-15T22:56:24.085139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s030500099600298x","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.801654Z","title":"The Contrast Theory of negative input","venue":null,"work_id":"54a0149e-c88b-4aea-81f5-49690fc0d3e6","year":1997},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.116583Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:5a6ff38c190b9c003bfd8da529e18dcf504536a1897cf0c4ea594eaeb9b80d78","observation_id":"8e2e93e8-feb7-49a0-ba46-240435fefe7e","resolution":{"observed_at":"2026-08-15T22:56:21.808521Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1086/229903","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.770635Z","title":"Schegloff","venue":null,"work_id":"cdc784f5-cfc8-44e8-bb46-665cffa851f1","year":1992},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.122011Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:6775b2502f0c78d5639d3247a8ae13e2f617e8e66e9f6437d87152d99f595a7d","observation_id":"c7e251f3-40fd-4ac4-8b83-030f4ff375f0","resolution":{"observed_at":"2026-08-15T22:56:21.778644Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf03393086","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-18T11:03:46.223893Z","title":"Three Myths from the Language Acquisition Literature","venue":"The Analysis of Verbal Behavior","work_id":"916ae39e-02f5-46d1-9983-cf56761c70df","year":2010},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.133161Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:bc7bbb47e6593e9df0235256575314cd6a2b31f168e04c1cb1db0f2a63d13ba6","observation_id":"03067475-96ce-4af2-a3e4-c7a151863204","resolution":{"observed_at":"2026-08-15T22:56:21.732377Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.145711Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.145711Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:dbf25df8ce349df56feb4ab89d71a1ea1343f2d88f6cbf3744a6a0be976995df","observation_id":"101bf25f-c1e8-4b01-9906-6e751b1bfb19","resolution":{"observed_at":"2026-08-15T22:56:21.145711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.035887Z","title":"Speech Acts : An Essay in the Philosophy of Language","venue":null,"work_id":"d419a032-e391-40d2-80f5-90c2be87410c","year":1969},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.155090Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:e30413e8d5a2135f2fccb8fe8cb48729ed0ac82259e5cd040f43f70f236e9aaf","observation_id":"716ed7cf-aa50-4c96-8a0f-c940d85c616f","resolution":{"observed_at":"2026-08-15T22:56:24.042026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.162685Z","title":"Liu, and Christopher D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.162685Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:b75f7d5535238d06713351aa06e0b582e07ef3dabf6cd928608e6599bddf2d41","observation_id":"a3ca2a81-b38b-4da7-a2bf-0d4a4bde42ac","resolution":{"observed_at":"2026-08-15T22:56:21.162685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9280.00359","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.996564Z","title":"Children creating language: How nicaraguan sign language acquired a spatial grammar","venue":null,"work_id":"976b86b9-f89f-49e6-82eb-6d83e98d8cc9","year":2001},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.167424Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:3d0cf4e293e3a70b9b36e6e39c85913775a2bd6e145488fa6709526e88b77bba","observation_id":"b9f31125-d1c8-40d7-bd66-1fa4fec1639e","resolution":{"observed_at":"2026-08-15T22:56:23.009967Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.007849Z","title":"Dignum Sepulveda","venue":null,"work_id":"63387c78-a0d3-4c35-894d-5b293e0fcb6e","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.172857Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:93d24e8f022d5b13a3649f6d20c8375294396123de16aa9003a4490967f6a51e","observation_id":"07795b87-561e-4ea1-a243-0dad611e0763","resolution":{"observed_at":"2026-08-15T22:56:24.014220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.186032Z","title":"fMRI reveals language-specific predictive coding during naturalistic sentence comprehension","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.186032Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:ea7ea978e352226b05d52cf0ef48a51f27fb20f84d2034345e41b23a972d7595","observation_id":"a1323cec-4f06-4d29-b236-ab39a01ecadb","resolution":{"observed_at":"2026-08-15T22:56:21.186032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.196147Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.196147Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:587c1a2cabb7177ec1adeae5ee669a989316619e1b16b1ffbc4a8f256a8c6159","observation_id":"0d2771e8-8e31-44d4-a07a-001c53ff4385","resolution":{"observed_at":"2026-08-15T22:56:21.196147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.979087Z","title":"Predictive coding: a fresh view of inhibition in the retina","venue":null,"work_id":"80dec13b-7e77-4952-bd8f-5f77ab01cb12","year":1982},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.208148Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:e00e9d76669947cd1d5e55cff2f195b45a3ea4f14773ea7c09c37fe4893b8059","observation_id":"3eeea45d-31d3-4680-bdfe-dfe53af1e2e2","resolution":{"observed_at":"2026-08-15T22:56:23.990693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.219206Z","title":"Stalnaker","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.219206Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a2628d27c9e432398d2107abfac819f7bc9c4ee60ace6480603be18907716205","observation_id":"c934213a-bf9e-4eb1-80c3-8df55692be6b","resolution":{"observed_at":"2026-08-15T22:56:21.219206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.952672Z","title":"Constructing a Language : A Usage - Based Theory of Language Acquisition","venue":null,"work_id":"a7598249-be50-4b73-ada4-6b79f85263ca","year":2003},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.229525Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:412b99b577a8b133c768666c795e87f893e2c97670c9b3e6b16ed8084cf5e79b","observation_id":"f9f59519-38bf-4ab8-89c0-bb3266540f91","resolution":{"observed_at":"2026-08-15T22:56:23.962556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.239925Z","title":"Emin Orhan, and Brenden M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.239925Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:4bf4cead6abd1c2dd188be14bb186b4e46cd1720b3203bcbae1568df35493c75","observation_id":"2c7d9ab1-c4cb-47ff-805c-86cc50d529ff","resolution":{"observed_at":"2026-08-15T22:56:21.239925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.917507Z","title":"What artificial neural networks can tell us about human language acquisition","venue":null,"work_id":"66aa3830-3971-4e61-b1f0-3f23c16b9b66","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.260745Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:44281969c842675677033296ca762a90f7e8f7c0adc5f77e8e3d5e06c01b645c","observation_id":"25c4bc36-5604-40b0-b2d7-bb192a5065e0","resolution":{"observed_at":"2026-08-15T22:56:23.927704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.876822Z","title":null,"venue":null,"work_id":"f2217b1d-10af-41cc-8266-1ef8b9e186c0","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.268206Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:34922e35f930af2c53820855872fb3ba6480f455b32929282fc0d517cf23d547","observation_id":"e0749183-19c5-41cb-aa50-924b5fc5098b","resolution":{"observed_at":"2026-08-15T22:56:23.891216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11796","last_updated":"2023-01-27T15:52:50Z","snapshot_observed_at":"2026-08-16T15:59:41.015785Z","submitted_at":"2023-01-27T15:52:50Z","title":"Call for Papers -- The BabyLM Challenge: Sample-efficient pretraining on a developmentally plausible corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11796","snapshot_observed_at":"2026-08-15T22:56:21.278086Z","title":"Call for papers -- the babylm challenge: Sample-efficient pretraining on a developmentally plausible corpus","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.278086Z"},"links":{"cited_paper":"/paper/2301.11796","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:c4e49211be2220355d5f1e61a177b01bf8ac0cdc53295dfd4efd2d7775010413","observation_id":"1cba198f-6a62-4df4-808e-bce871f461e9","resolution":{"observed_at":"2026-08-15T22:56:21.278086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.287863Z","title":"Using computational models to test syntactic learnability","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.287863Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:685b8ca69ca235c8ed0bf09d39c803ba8f5800083a5d524212190c0500c8403a","observation_id":"2f5cdb1e-2dd7-43ca-a3ff-9664078da108","resolution":{"observed_at":"2026-08-15T22:56:21.287863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.297039Z","title":"A survey on knowledge distillation of large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.297039Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:bf9e5e66ee44630bf0a2ed0db4fa5755142220049d0fd5e75c49d93c8886e038","observation_id":"16694a86-14c5-4719-9993-dd5cf4b2b057","resolution":{"observed_at":"2026-08-15T22:56:21.297039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.newideapsych.2017.09.001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.558198Z","title":"A communicative approach to early word learning","venue":null,"work_id":"462c5040-10eb-48cf-9a30-e634564b6226","year":2018},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.311585Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:16f9b5265b6203e7b90a3034d4a60890ffe48eecfd4a7daab2dba8e5ee366e4a","observation_id":"842a53f3-e3b2-47c8-883d-706078c64c07","resolution":{"observed_at":"2026-08-15T22:56:21.572466Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.323227Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.323227Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:414cedd2ed70f8a2a2f8aa915b0592564dbd7eade5e70362094fc0b46e164385","observation_id":"2eff14b9-0b8f-453e-9d7d-7fef55cb2512","resolution":{"observed_at":"2026-08-15T22:56:21.323227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.341528Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.341528Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:69a2e427a6d13b0d042d34bff0fb2d13ea67c9920018815146b728583d3d77e6","observation_id":"2639918b-7594-4e51-af6e-0beaa0ed1a48","resolution":{"observed_at":"2026-08-15T22:56:21.341528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.369531Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.369531Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a631ae82d7708b7fe119c0499840c827158be21d5e61167ba39038211cedd3ed","observation_id":"f02afdbf-8d03-4877-919d-22817184d9ba","resolution":{"observed_at":"2026-08-15T22:56:21.369531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2013.0302","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.653278Z","title":"back channel","venue":null,"work_id":"5feca902-194a-4171-8a29-c1828c21ddcb","year":2019},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.386107Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:bad6a6cf329393b13992fb06e87c7ff1e818e106273555c60dcd2f8f8aaba46f","observation_id":"0cb58f7c-fb9e-4601-a263-096cde74d573","resolution":{"observed_at":"2026-08-15T22:56:22.666509Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T05:18:00.246222Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models"},"reference_resolution":{"displayed":88,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":45,"verified_exact":15,"verified_fuzzy":27},"total_outbound_references":88},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 88 of 88 outbound references and 0 inbound Pith citation observations for arXiv:2505.05970."}