{"as_of":"2026-08-20T17:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cb193834dcc4dd7ec6469825cd1b3c9715ca300cddd945d9d62fd0ca5d3371f3","coverage":[{"denominator":88,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":88,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:56:21.386107Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.05970/citation-record","integrity":"/paper/2505.05970/integrity","json":"/paper/2505.05970/citation-record.json","paper":"/paper/2505.05970"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.425570Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.425570Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:5f9f411e7eca00bbd962c232ad9b74ab94e0fc9eb289e32f5cf6f513c7c2d591","observation_id":"b0c73017-8d53-47ab-aa94-a8a9751ad894","resolution":{"observed_at":"2026-08-15T22:56:20.425570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.444388Z","title":"Lmrl gym: Benchmarks for multi-turn reinforcement learning with language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.444388Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:0dffcd345fc3db5a1b7e6403ec5f177733624c2ecce8cc7e66c0ef0554006cf1","observation_id":"1d1687d4-57ee-4095-9e39-4a910474c5b5","resolution":{"observed_at":"2026-08-15T22:56:20.444388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.455962Z","title":"On the proper role of linguistically-oriented deep net analysis in linguistic theorizing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.455962Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:4d293dd9dc043a25a9f9feeca7a7a7ff5b3758e5e6ea045d8b50a0c7ced9d0ff","observation_id":"f9bc6b34-bfef-44b4-b12e-a0dd9e3b1202","resolution":{"observed_at":"2026-08-15T22:56:20.455962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.462402Z","title":"Pythia: a suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.462402Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:5c76b478df6c5375dc7a80d2fca79678c5180f8fe18f550155f9304887c48e7e","observation_id":"82f40f8d-971b-4ca7-b27b-4ea76e6c27cf","resolution":{"observed_at":"2026-08-15T22:56:20.462402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.469633Z","title":"Experiment Tracking with Weights and Biases , 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.469633Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a9f6f92ba45c47840da7beb0fd9235fc0ed66f7ea84a220c84571de3ad65a490","observation_id":"3456caa0-260c-4f02-9038-d44c5151c4f9","resolution":{"observed_at":"2026-08-15T22:56:20.469633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.478344Z","title":"Language Development : Form and Function in Emerging Grammars","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.478344Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:091bd525507bb44634da37f24566a2720ac16895f592efdf92d6bd3123e1aa50","observation_id":"48fa525d-ba18-404d-9dc8-b8898aadd18e","resolution":{"observed_at":"2026-08-15T22:56:20.478344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.491156Z","title":"Derivational complexity and order of acquisition in child speech","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.491156Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:00299083c3ded3e53d52710f0d8ec6092745b3245c7d41a58c543a589720e01e","observation_id":"b7a03277-ffac-4347-b8d1-f55d2153470d","resolution":{"observed_at":"2026-08-15T22:56:20.491156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/026565908500100113","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.527314Z","title":"Child's Talk : Learning to Use Language","venue":null,"work_id":"85584a9b-24ac-4b5b-bc7e-8e4616b877e3","year":1985},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.502452Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:b071eef76ccf0562c41d90dfdffc1a761f1595d554a1ef2cfb88cf320c15d53e","observation_id":"6c81995d-42d4-492d-9fc7-839e31109491","resolution":{"observed_at":"2026-08-15T22:56:22.536732Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.510692Z","title":"Meaning and necessity","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.510692Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:65ed8ee8f3de9fb82c38fbc83cedbb4af117d8130646b237ca58fa0bd3198627","observation_id":"cfc09f1f-5a8e-4524-96a3-2af856b838c0","resolution":{"observed_at":"2026-08-15T22:56:20.510692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.518816Z","title":"Chang and Benjamin K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.518816Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d8e7e92bd717f11f2d486e7d36ac6c602ddb348f5303b226491c322b7cfd37e1","observation_id":"8b9e5694-1c22-4295-bb1e-d829c916d07a","resolution":{"observed_at":"2026-08-15T22:56:20.518816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.531413Z","title":"Conceptual 12M : Pushing web-scale image-text pre-training to recognize long-tail visual concepts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.531413Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:810ecce4a8a58f4ce604dd0f447e70ff3a772707a5fea00dec8743463379db32","observation_id":"58c17242-ab57-4564-8f0a-778de9bfa163","resolution":{"observed_at":"2026-08-15T22:56:20.531413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.805105Z","title":"Not all layers are equally as important: Every Layer Counts BERT","venue":null,"work_id":"1205cbb3-62c2-4397-a608-cf1ae1c65b62","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.544168Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:9d39c2b003625283eae67d9f6519933b922316d06313bcf70b62236740854a7b","observation_id":"9ecedce5-a9ab-4473-bce6-4297e9f1492e","resolution":{"observed_at":"2026-08-15T22:56:24.810709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s0305000903005701","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.483063Z","title":"Chouinard and Eve V","venue":null,"work_id":"a0bfde2a-7d67-4019-a8ea-3bef1fafde8f","year":2003},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.558511Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:239f1071ba23c56ea17ec3a94a31dac9e3ff76e494ce562b947ae872dcfb2543","observation_id":"851be6c7-2969-45a0-9d39-5dda8e9eb7c2","resolution":{"observed_at":"2026-08-15T22:56:22.490484Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.564384Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.564384Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:f66d10be4f98b7e0e92b8f7a200c7a9ee22ac005dd0b145c0b4066b468d755e9","observation_id":"7f249f40-238c-4971-8327-f61c367c0c8b","resolution":{"observed_at":"2026-08-15T22:56:20.564384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.17197","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.536598Z","title":null,"venue":null,"work_id":"e474af69-c203-479e-9d8d-5e3ef7d6d1bd","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.576083Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:c4c2ca152bd1609f9e6f36e2f8d9fd06c287fd2ea048fc66e36ebafac1ecf89d","observation_id":"aae9b3e4-3405-409c-ba8f-708331d6a984","resolution":{"observed_at":"2026-08-15T22:56:23.549050Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.783942Z","title":"Automatic text summarization: A comprehensive survey","venue":null,"work_id":"894b0491-4e1d-462f-b6d8-a22a078341ec","year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.586185Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:248b5f1e044d858c5c061a15ac8270bedc4d55604705a16992d87364ef7f2c4b","observation_id":"6c895fa6-e3e3-4943-bbd8-b79b0129d039","resolution":{"observed_at":"2026-08-15T22:56:24.790699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.597485Z","title":"Johnson, Annette Karmiloff-Smith, Domenico Parisi, and Kim Plunkett","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.597485Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:bfe3a022fa0b665b508913e133bc144aeeb08797045bba3b18769e22e734c02f","observation_id":"800cea8c-7c11-498f-aed8-76393d8eba8b","resolution":{"observed_at":"2026-08-15T22:56:20.597485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.764501Z","title":"Finding structure in time","venue":null,"work_id":"8e3fb9c3-97c0-4748-8a85-84fc8f7ecee3","year":1990},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.606259Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:db80c030ab7eee6525d2d62b60c6e1ad4036235394b0e5b57003ea4a6754d838","observation_id":"ce3b2d6a-9378-4698-b8db-499ee0356a07","resolution":{"observed_at":"2026-08-15T22:56:24.769649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05892","last_updated":"2025-02-09T13:15:59Z","snapshot_observed_at":"2026-08-19T23:11:01.506114Z","submitted_at":"2025-02-09T13:15:59Z","title":"A Distributional Perspective on Word Learning in Neural Language Models","version":1},"cited_work":{"arxiv_id":"2502.05892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05892","snapshot_observed_at":"2026-08-15T22:56:23.431728Z","title":"A Distributional Perspective on Word Learning in Neural Language Models","venue":"cs.CL","work_id":"6baf4782-4a27-4905-be20-e576309d3c92","year":2025},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.614187Z"},"links":{"cited_paper":"/paper/2502.05892","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:e527fe52851ea5726dfaa1cbc8d6f1025504df16f1fe40860f8a56aca368f347","observation_id":"56b1985d-1efa-4153-8e6d-80111c1b811d","resolution":{"observed_at":"2026-08-15T22:56:23.438181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.624800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.624800Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:f127d1b2a48a75aae5df2b74d7378aab43ce7f32b0834cd9df3dfe3aa635c525","observation_id":"05dbe06c-962b-438d-8621-67ebdda4c914","resolution":{"observed_at":"2026-08-15T22:56:20.624800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.631833Z","title":"Richards, Steven F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.631833Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:df7882eacbc29473c290cb4601bd61f0bd1ef92dd9533d30cd21caee91a8f55c","observation_id":"06aa1aa3-fe1b-441b-993e-35d2bdca391b","resolution":{"observed_at":"2026-08-15T22:56:20.631833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.738422Z","title":"Towards pragmatic production strategies for natural language generation tasks, 2022","venue":null,"work_id":"ba89b058-d3a8-4260-bd4b-acbaf15ff6a9","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.640713Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:3b145f85bcfa9b6e466003f62a92957f9cc8511a81ec90f1727fc4690beeec64","observation_id":"e54ca779-1369-49dd-8a16-ece77167c42c","resolution":{"observed_at":"2026-08-15T22:56:24.745009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.649005Z","title":"Language identification in the limit","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.649005Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:0a2eeaf931a8466716a134a7e64d78a09ad9634affc810dd13305bd25dcb44de","observation_id":"475c9fd7-cfb5-43c8-bb7f-739f83971ffb","resolution":{"observed_at":"2026-08-15T22:56:20.649005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.664253Z","title":null,"venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.664253Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:532505009b5eb5b3f815ead649d607d48a684481eac3639078eafe11a7598c5d","observation_id":"a3253c66-765b-49bb-9727-fc2c3e03fd77","resolution":{"observed_at":"2026-08-15T22:56:20.664253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.714716Z","title":"Dynamic population-based meta-learning for multi-agent communication with natural language","venue":null,"work_id":"cd698818-a405-4a60-a3cf-ff0cb13855de","year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.671896Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:01cdc87cda231fa7b8b384ff4e495469a8b75a649233bbb6ba1ff63b9f614a21","observation_id":"07103a33-378c-47f4-959a-ea43b1a68b43","resolution":{"observed_at":"2026-08-15T22:56:24.724180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/k16-1011","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.098504Z","title":"A Data -driven Investigation of Corrective Feedback on Subject Omission Errors in First Language Acquisition","venue":null,"work_id":"754f95f4-5228-465a-8572-66907908e297","year":2016},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.681199Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:009165557df4cdefa7ba34a207c4763461cf000123ad5dc587b8a1ec3d9a611f","observation_id":"4426fcda-041e-4cc6-bf76-3dd606b625bf","resolution":{"observed_at":"2026-08-15T22:56:22.109609Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/wcs.142","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.062925Z","title":null,"venue":null,"work_id":"8755321e-c827-43df-b05e-b6834eef6d63","year":2011},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.687358Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:426dbd8b994f6d9558b39d0d9a080ff2c162355f7c8dfdff6051f95724e822c0","observation_id":"57c267c0-472f-4bf7-865f-b884101871b5","resolution":{"observed_at":"2026-08-15T22:56:22.075162Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.691474Z","title":"Multitasking inhibits semantic drift, 2021","venue":null,"work_id":"fa08e09e-17cf-47c7-962e-c5f0d8ae831d","year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.698422Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:3350c995f74a8e47e984f974af3b0c1a44fb2cfe8d5a3b869bf82861e0aa9f2f","observation_id":"73d518cb-bc70-4d47-bc26-884f3e70c4ea","resolution":{"observed_at":"2026-08-15T22:56:24.697700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.714958Z","title":"Why Large Language Models Are Poor Theories of Human Linguistic Cognition : A Reply to Piantadosi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.714958Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:09313beabccee56c2de3e165f9d729afaf87ae61d36ecffd3a4fdd704dfa2ceb","observation_id":"dbf3cec1-3b3d-4b1d-a55e-07baf1cc4829","resolution":{"observed_at":"2026-08-15T22:56:20.714958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.657134Z","title":"Unifiedqa: Crossing format boundaries with a single qa system, 2020","venue":null,"work_id":"668debef-dc47-45ed-a686-f4e5327149e7","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.724744Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:16c63205f076079f891c30f6128e3d1aa7998f6af26a62f6c5d6f472c8c08c1c","observation_id":"cc1bbb64-cee6-4bc8-905f-dde7bd8ed9fc","resolution":{"observed_at":"2026-08-15T22:56:24.663304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.610771Z","title":"Unifiedqa-v2: Stronger generalization via broader cross-format training, 2022","venue":null,"work_id":"51016c8f-2f3b-446e-88fd-5c23f9a7aeca","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.736993Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:4d341d354e457489489e040c62ec8c9c2cd0fc46357402a1941d5fd829083487","observation_id":"8d8aaa90-632c-46eb-aea9-aa0e820eed7d","resolution":{"observed_at":"2026-08-15T22:56:24.618742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.588937Z","title":"The handbook of pidgin and creole studies","venue":null,"work_id":"15d483d3-d7c1-4c43-919a-ffcc91e8a3e0","year":2009},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.746376Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:2ca5383fda547ed4bd420a173d50d9ce85a5ed2810364d3bea849be0d9a43ff5","observation_id":"e330642f-f6ab-4524-9150-c7aa2ed00ea4","resolution":{"observed_at":"2026-08-15T22:56:24.595754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.756942Z","title":"Large language models and the argument from the poverty of the stimulus","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.756942Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:20200f50577e49829b883ecc026f767ff72badb45c1794ad75d12c805d52c4aa","observation_id":"38654566-52b5-49c8-bfb4-9342b0516345","resolution":{"observed_at":"2026-08-15T22:56:20.756942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.551488Z","title":"Grammaticality, acceptability, and probability: A probabilistic view of linguistic knowledge","venue":null,"work_id":"d720f459-5174-4948-93f4-27fb816fe1ac","year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.763707Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:6efacb17ac26d5d9c95aa5fb1de10d1cac8a15af8c88b6921d8d9451c3190a7c","observation_id":"439d6e4d-a425-49b7-8f2b-aa7954083a62","resolution":{"observed_at":"2026-08-15T22:56:24.562441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.522417Z","title":"Multi-agent communication meets natural language: Synergies between functional and structural language learning, 2020 a","venue":null,"work_id":"dbd1765f-d522-465b-a921-635b8ad36528","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.771658Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:485cb1069749a73a2ab5cb79d205acf3e0f5c2d6fafa1dadbc2099a3de7f0882","observation_id":"1860fc31-232f-4ea1-bacd-952ff11b9015","resolution":{"observed_at":"2026-08-15T22:56:24.531648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.784253Z","title":"Multi-agent Communication meets Natural Language : Synergies between Functional and Structural Language Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.784253Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:7926aae2012846536c93530fb9883e6697d23ceedd6b7b78b85dad8aeab5ae1e","observation_id":"b982e871-61cc-42ed-b885-ff033071bd18","resolution":{"observed_at":"2026-08-15T22:56:20.784253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.794313Z","title":"Expectation-based syntactic comprehension","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.794313Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:7057c8b001ad5a3d3764f6da467003be9f6509c1ff8f35985491a5b9f26d26fb","observation_id":"71495e5a-e542-4968-adab-1a78daf87ad3","resolution":{"observed_at":"2026-08-15T22:56:20.794313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7551/mitpress/7503.003.0111","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.958820Z","title":"Florian Jaeger","venue":null,"work_id":"01c05841-e5c7-4de7-a049-aac78d9951a0","year":2007},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.806110Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d619784603926ec368364336cf9a5ea2fcd5628b6685eb9e7f7f1aa2201407e8","observation_id":"316e9993-99ba-4fef-b742-ba9d76397395","resolution":{"observed_at":"2026-08-15T22:56:21.964754Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.496946Z","title":null,"venue":null,"work_id":"69483a35-5835-4e1b-8811-208df5df8c86","year":1986},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.814952Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:0667261e9a3d20f06eddbbc4e5e36018c1593e29124210c05ebb3f6d11c4fb40","observation_id":"e8a1dbf7-aa5e-4686-93dc-93edb57b1658","resolution":{"observed_at":"2026-08-15T22:56:24.502751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.462792Z","title":"Convention: A Philosophical Study","venue":null,"work_id":"c195dd4d-a198-4918-874f-b6fc7528d0bc","year":1969},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.825386Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d0e4c71876795e6f3d35a3874ba88e47e10c67f9218eec355db649cf74f8822d","observation_id":"eeec0803-6352-43a9-8dc1-ceba35f08d62","resolution":{"observed_at":"2026-08-15T22:56:24.470661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.839046Z","title":"ROUGE : A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.839046Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:9269dd02fd39e798081d2be43d4f1a28f4e9a86efcde8cc2ab61c8fec0e73617","observation_id":"dcb70154-2081-438c-8ad2-0ca62376b0f3","resolution":{"observed_at":"2026-08-15T22:56:20.839046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.408634Z","title":"What can linguistics and deep learning contribute to each other? Response to Pater","venue":null,"work_id":"a3cff15a-0fd4-43b0-8038-0e2b7a97a9a2","year":2019},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.847878Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:259afde9432dd3d8634e7e01c3b83b6613328fce8dba2cf9805df33f68fe5162","observation_id":"ed787409-5147-498a-95da-9e7f2d51112d","resolution":{"observed_at":"2026-08-15T22:56:24.416990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01502","last_updated":"2023-03-02T18:59:46Z","snapshot_observed_at":"2026-08-19T21:33:32.319534Z","submitted_at":"2023-03-02T18:59:46Z","title":"Computational Language Acquisition with Theory of Mind","version":1},"cited_work":{"arxiv_id":"2303.01502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.01502","snapshot_observed_at":"2026-08-15T22:56:23.371938Z","title":"Computational Language Acquisition with Theory of Mind","venue":"cs.CL","work_id":"7fff22a0-df3e-4ccb-b84d-f7e7c85297fa","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.864401Z"},"links":{"cited_paper":"/paper/2303.01502","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:2dd870fa7dc0c74c71fd20a581a6e1066d2b44df31114c6d89698a2578246372","observation_id":"52d51fe2-2608-4ce1-b847-e780fb35ea23","resolution":{"observed_at":"2026-08-15T22:56:23.378871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.373674Z","title":"On the interaction between supervision and self-play in emergent communication, 2020","venue":null,"work_id":"815de58c-dd53-4364-9f55-c3b7d2663094","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.875410Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:1ae0793879ca67042e4193add874fe0d9e42c26642a94efd68a586d4e32f45b3","observation_id":"1d67ec54-d09b-4aaa-ae6c-3a1656c7795e","resolution":{"observed_at":"2026-08-15T22:56:24.382250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.344541Z","title":"Countering language drift with seeded iterated learning, 2020","venue":null,"work_id":"f950430e-8bb6-470c-8a92-90cbfdaa5a50","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.881146Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d8ed9bb931dc3b562c7452e03a29e9e1acc002168a6c271b891d454c635a6053","observation_id":"0dd35a7c-17ff-4cdd-b436-4386bb31777d","resolution":{"observed_at":"2026-08-15T22:56:24.352142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.893284Z","title":"Words and the World : Predictive Coding and the Language - Perception - Cognition Interface","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.893284Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:600f5b6351f198e32a0d38c575fdf8e68fe2b1a976de6b60d0fcfc97551bf2ab","observation_id":"bcd6889b-026c-4399-9f41-08be5c821117","resolution":{"observed_at":"2026-08-15T22:56:20.893284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.903961Z","title":null,"venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.903961Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d41d958f97bf485dd44da7759d7cb2ffacd2a3b339e4f7bee54e6d108e51c313","observation_id":"f4481f62-9b46-42e2-aa35-2123f8ae729b","resolution":{"observed_at":"2026-08-15T22:56:20.903961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.302856Z","title":"CLIMB – curriculum learning for infant-inspired model building","venue":null,"work_id":"ab8d9940-9d42-43f7-a709-f64129c19158","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.914679Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:3f581f187e153606471edcbe351bb48c6be6dac8155b8e0e98500cdfc0075fe8","observation_id":"10be7c89-4a91-4e09-8691-e1b2bad19de9","resolution":{"observed_at":"2026-08-15T22:56:24.312796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T22:56:20.932944Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.932944Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:fcf2c09479d6878da2f6d5fdd978322b110cc47c7b4c74c870e5db3940201006","observation_id":"f77f14e8-fd55-4320-a2bf-9433057717d1","resolution":{"observed_at":"2026-08-15T22:56:20.932944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07144","last_updated":"2024-08-13T18:26:04Z","snapshot_observed_at":"2026-08-17T17:41:05.901340Z","submitted_at":"2024-08-13T18:26:04Z","title":"Language Models as Models of Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07144","snapshot_observed_at":"2026-08-15T22:56:20.949085Z","title":"Language Models as Models of Language","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.949085Z"},"links":{"cited_paper":"/paper/2408.07144","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:75489a2d4b54a4f6571ae8cb9347df5288791b7080da15e1ee5fbd51029ff19f","observation_id":"b2ef277b-364d-4b91-a624-a7eb99d652e1","resolution":{"observed_at":"2026-08-15T22:56:20.949085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02373","last_updated":"2023-10-24T14:53:50Z","snapshot_observed_at":"2026-08-16T15:03:07.327872Z","submitted_at":"2023-09-05T16:35:41Z","title":"nanoT5: A PyTorch Framework for Pre-training and Fine-tuning T5-style Models with Limited Resources","version":2},"cited_work":{"arxiv_id":"2309.02373","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.02373","snapshot_observed_at":"2026-08-15T22:56:23.256576Z","title":"nanoT5: A PyTorch Framework for Pre-training and Fine-tuning T5-style Models with Limited Resources","venue":"cs.CL","work_id":"11f0ec4d-4814-4950-929d-e492b270c3ae","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.962032Z"},"links":{"cited_paper":"/paper/2309.02373","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:15ce8e0b8f3e4a4146ee29705dee76c73d181355b945c129190f2cc80138da08","observation_id":"f801f7de-4bf3-4ef9-bb65-73e61f88f42d","resolution":{"observed_at":"2026-08-15T22:56:23.265509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.973957Z","title":"Modeling the interaction between perception-based and production-based learning in children ' s early acquisition of semantic knowledge","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.973957Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:3c610028f31d96949f067a184b69ca72cb2c261107398d2382a02e262b1b2552","observation_id":"090288e0-9e26-4f9a-a9a4-5aac167fada8","resolution":{"observed_at":"2026-08-15T22:56:20.973957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:20.993163Z","title":"Communicative Feedback in Language Acquisition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:20.993163Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:45310fcbef0230a647816261070040b43bd1041c87001497c87ef00062d5b6b0","observation_id":"9ba02cab-07b8-450a-b5e6-3052a3b66a78","resolution":{"observed_at":"2026-08-15T22:56:20.993163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.31234/osf.io/sg5mv","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.855564Z","title":"Communicative Feedback as a Mechanism Supporting the Production of Intelligible Speech in Early Childhood","venue":null,"work_id":"cf28b8ae-f5b4-4bbd-ba8f-fa11248ace84","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.002148Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:bf6c4a2b04601a72089385fad372c3e2ae79ea83b9ed1f6e18ce53f63a53435d","observation_id":"535aa241-b565-40cc-abef-68910020924b","resolution":{"observed_at":"2026-08-15T22:56:21.868618Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.263838Z","title":"Communicative Feedback in Response to Children 's Grammatical Errors","venue":null,"work_id":"29d53ec7-52ed-46bd-8c8a-00c8ec672395","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.010264Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:52ee24da91c1d153c21fe4b20f39e53fc381162169947ef1d890727166c72164","observation_id":"183e506e-2adb-4d2d-8904-100f3b4dac54","resolution":{"observed_at":"2026-08-15T22:56:24.272052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.228363Z","title":"Language acquisition through language use: The functional sources of children's early utterances","venue":null,"work_id":"2834af9a-52ac-4d8b-a875-12eca0e7e390","year":1988},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.029321Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:478b534d2bcb0d6a90f0d1c9c176ca45c4b8a6ed399806130874d961b20dc567","observation_id":"28bed85b-fa83-48c4-aadd-804cd0ba4cf9","resolution":{"observed_at":"2026-08-15T22:56:24.236064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.201449Z","title":"ChatGPT : Optimizing language models for dialogue, 2022","venue":null,"work_id":"fe4f55b0-1692-4391-8744-47c9c4294e6a","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.042002Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:2ae0c70e00918416553240f606cf91e592489433eecd22bff3832759346cc878","observation_id":"3a368353-f546-4a29-adde-7654c20aa059","resolution":{"observed_at":"2026-08-15T22:56:24.207177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.167443Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"c4f4dd02-63fe-49a6-9b58-89b489d88b77","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.054044Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:014bec275d0597aacd2079ff521c5ccc66e889f3422d0a0dc016a591560a443f","observation_id":"7d9b77d7-e714-4513-9b78-1bedc1ea9a3d","resolution":{"observed_at":"2026-08-15T22:56:24.176837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.135795Z","title":"Christiano, Jan Leike, and Ryan Lowe","venue":null,"work_id":"42673216-11f1-4bd5-9308-4948d192003b","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.064846Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:aec824b5003104056aacb565b3d81099180b1264661522f5bb59cc37000346d1","observation_id":"75bfab95-1d1e-4696-b135-1d909ac23c6d","resolution":{"observed_at":"2026-08-15T22:56:24.143179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.074804Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.074804Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:0ced90ed1715f46fec68c2827094b15387cd3d2534d4d78d3cd1eaf91c516a47","observation_id":"d698d455-fd94-4951-a68a-dba2cb726758","resolution":{"observed_at":"2026-08-15T22:56:21.074804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.081624Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.081624Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:04594f11f09e1d089fc2beaf8da98f5ad4ff0ed60edf9ce802ed427b9d7c49e6","observation_id":"7d70ce74-f8d4-403b-8569-4a444ef66108","resolution":{"observed_at":"2026-08-15T22:56:21.081624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.087945Z","title":"Know what you don ' t know: Unanswerable questions for SQ u AD","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.087945Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:c652d0335157d72475330b4092cdb86e2b3ddb3822e743c03f20dfc82f00fb2b","observation_id":"12ab7006-c456-45e4-8e37-69ff4d51437f","resolution":{"observed_at":"2026-08-15T22:56:21.087945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11958","last_updated":"2024-03-18T16:52:54Z","snapshot_observed_at":"2026-08-19T15:04:34.494061Z","submitted_at":"2024-03-18T16:52:54Z","title":"Language Evolution with Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11958","snapshot_observed_at":"2026-08-15T22:56:21.098482Z","title":"Language evolution with deep learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.098482Z"},"links":{"cited_paper":"/paper/2403.11958","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:9c5691a6fee347970011deff7b2af0c3070f9dbded6c92381ef4b55399d2eca2","observation_id":"53af847d-f417-41aa-a0f9-9c374bc5065a","resolution":{"observed_at":"2026-08-15T22:56:21.098482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.078052Z","title":"Information structure: Towards an integrated formal theory of pragmatics","venue":null,"work_id":"b45a9cae-0090-41d4-844d-26385c9ee408","year":1996},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.108353Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a76cb96b6e85b878e406bf28cc1ff286f9f5a25cfc45b5bd734aeb36150e838d","observation_id":"8f1f5d65-cc6b-430a-bb4e-cebb4abe4053","resolution":{"observed_at":"2026-08-15T22:56:24.085139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s030500099600298x","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.801654Z","title":"The Contrast Theory of negative input","venue":null,"work_id":"54a0149e-c88b-4aea-81f5-49690fc0d3e6","year":1997},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.116583Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:8efe6dbd9d789a0b16f73fe30cb618e809d056cbea4835a6b0ae03ed9a7971b5","observation_id":"8e2e93e8-feb7-49a0-ba46-240435fefe7e","resolution":{"observed_at":"2026-08-15T22:56:21.808521Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1086/229903","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.770635Z","title":"Schegloff","venue":null,"work_id":"cdc784f5-cfc8-44e8-bb46-665cffa851f1","year":1992},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.122011Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:bf2d885adb9903c7a2f7efad78dbe872f9a986df2169f8d2636852d0eba5718d","observation_id":"c7e251f3-40fd-4ac4-8b83-030f4ff375f0","resolution":{"observed_at":"2026-08-15T22:56:21.778644Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf03393086","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-18T11:03:46.223893Z","title":"Three Myths from the Language Acquisition Literature","venue":"The Analysis of Verbal Behavior","work_id":"916ae39e-02f5-46d1-9983-cf56761c70df","year":2010},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.133161Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:c932fda71b00695e91021b81c829c0260b99440489763d83713c3c6c1aa07fc7","observation_id":"03067475-96ce-4af2-a3e4-c7a151863204","resolution":{"observed_at":"2026-08-15T22:56:21.732377Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.145711Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.145711Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d0b144c968a9f50b968d14506f00f0ec39cfced0bc7bcef08d4737d004cdf81e","observation_id":"101bf25f-c1e8-4b01-9906-6e751b1bfb19","resolution":{"observed_at":"2026-08-15T22:56:21.145711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.035887Z","title":"Speech Acts : An Essay in the Philosophy of Language","venue":null,"work_id":"d419a032-e391-40d2-80f5-90c2be87410c","year":1969},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.155090Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a89688e7e800c1f818123b375ec1e8d10298a3f4002c64167263ff1b992d1bea","observation_id":"716ed7cf-aa50-4c96-8a0f-c940d85c616f","resolution":{"observed_at":"2026-08-15T22:56:24.042026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.162685Z","title":"Liu, and Christopher D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.162685Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:f466396d332df83bfd628a48b4b210e091151aab990b883c9cc18635f15bcd77","observation_id":"a3ca2a81-b38b-4da7-a2bf-0d4a4bde42ac","resolution":{"observed_at":"2026-08-15T22:56:21.162685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9280.00359","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.996564Z","title":"Children creating language: How nicaraguan sign language acquired a spatial grammar","venue":null,"work_id":"976b86b9-f89f-49e6-82eb-6d83e98d8cc9","year":2001},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.167424Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:48a1113ba3ee237d70d7d40fb0b866138f4d358ea5f88904b35cbb5582266c2b","observation_id":"b9f31125-d1c8-40d7-bd66-1fa4fec1639e","resolution":{"observed_at":"2026-08-15T22:56:23.009967Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:24.007849Z","title":"Dignum Sepulveda","venue":null,"work_id":"63387c78-a0d3-4c35-894d-5b293e0fcb6e","year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.172857Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:46270811de8d87bdbf5a3928620dba8a9ec6769b98f47bf26798da09a3efde47","observation_id":"07795b87-561e-4ea1-a243-0dad611e0763","resolution":{"observed_at":"2026-08-15T22:56:24.014220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.186032Z","title":"fMRI reveals language-specific predictive coding during naturalistic sentence comprehension","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.186032Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:f74a08f8aa07c4e2f74b79e23610946b3a8b582354aad1c653dcfc89b32613a8","observation_id":"a1323cec-4f06-4d29-b236-ab39a01ecadb","resolution":{"observed_at":"2026-08-15T22:56:21.186032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.196147Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.196147Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:65e280069dc67501b8ac4d248bc224648086c687a2752a129ea443d94036b005","observation_id":"0d2771e8-8e31-44d4-a07a-001c53ff4385","resolution":{"observed_at":"2026-08-15T22:56:21.196147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.979087Z","title":"Predictive coding: a fresh view of inhibition in the retina","venue":null,"work_id":"80dec13b-7e77-4952-bd8f-5f77ab01cb12","year":1982},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.208148Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:269270581b4b7bf70eae369d9f38bb1c0b696a92ad999a2dac19f9eacff8602a","observation_id":"3eeea45d-31d3-4680-bdfe-dfe53af1e2e2","resolution":{"observed_at":"2026-08-15T22:56:23.990693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.219206Z","title":"Stalnaker","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.219206Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:12918d6e5ae5146a4028cf1c665acb3a8de86b57da3c28970b5e87f2dc39124b","observation_id":"c934213a-bf9e-4eb1-80c3-8df55692be6b","resolution":{"observed_at":"2026-08-15T22:56:21.219206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.952672Z","title":"Constructing a Language : A Usage - Based Theory of Language Acquisition","venue":null,"work_id":"a7598249-be50-4b73-ada4-6b79f85263ca","year":2003},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.229525Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:9a87c403ccb45604def3405da6d629f9a110a96c4f93a20039295218d31fee01","observation_id":"f9f59519-38bf-4ab8-89c0-bb3266540f91","resolution":{"observed_at":"2026-08-15T22:56:23.962556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.239925Z","title":"Emin Orhan, and Brenden M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.239925Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a25ae1e3f5969e15297011df3152ec3c5de0825273bd11087d4283de9a8a8b74","observation_id":"2c7d9ab1-c4cb-47ff-805c-86cc50d529ff","resolution":{"observed_at":"2026-08-15T22:56:21.239925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.917507Z","title":"What artificial neural networks can tell us about human language acquisition","venue":null,"work_id":"66aa3830-3971-4e61-b1f0-3f23c16b9b66","year":2022},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.260745Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:ed82cf1b451f1bcf3fc4eebb2bf319fe9eb1739efa98a77313dee55a400567c3","observation_id":"25c4bc36-5604-40b0-b2d7-bb192a5065e0","resolution":{"observed_at":"2026-08-15T22:56:23.927704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:23.876822Z","title":null,"venue":null,"work_id":"f2217b1d-10af-41cc-8266-1ef8b9e186c0","year":2020},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.268206Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:88e904ecec1d935a6f42a4cecd33046e06671b9eefad809c207ddbb2d86edf36","observation_id":"e0749183-19c5-41cb-aa50-924b5fc5098b","resolution":{"observed_at":"2026-08-15T22:56:23.891216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11796","last_updated":"2023-01-27T15:52:50Z","snapshot_observed_at":"2026-08-16T15:59:41.015785Z","submitted_at":"2023-01-27T15:52:50Z","title":"Call for Papers -- The BabyLM Challenge: Sample-efficient pretraining on a developmentally plausible corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11796","snapshot_observed_at":"2026-08-15T22:56:21.278086Z","title":"Call for papers -- the babylm challenge: Sample-efficient pretraining on a developmentally plausible corpus","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.278086Z"},"links":{"cited_paper":"/paper/2301.11796","citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:d521c2f6391cdebd158728c7dad7c8819ad5f12979a81c704b7637ae0e41fbf4","observation_id":"1cba198f-6a62-4df4-808e-bce871f461e9","resolution":{"observed_at":"2026-08-15T22:56:21.278086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.287863Z","title":"Using computational models to test syntactic learnability","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.287863Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:50754e745028db0d1cb088b8cff56aa6fd1a7135cdfbb8d6b3e3233aa4afea0b","observation_id":"2f5cdb1e-2dd7-43ca-a3ff-9664078da108","resolution":{"observed_at":"2026-08-15T22:56:21.287863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.297039Z","title":"A survey on knowledge distillation of large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.297039Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:dfb34e10c57d9f680364ee490163fa9c5dd2a972afe7e0e477bc9494a59fa619","observation_id":"16694a86-14c5-4719-9993-dd5cf4b2b057","resolution":{"observed_at":"2026-08-15T22:56:21.297039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.newideapsych.2017.09.001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.558198Z","title":"A communicative approach to early word learning","venue":null,"work_id":"462c5040-10eb-48cf-9a30-e634564b6226","year":2018},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.311585Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:f3f40cf9a1f2bac70dd5f81394dbdb26058ab61712bcee43fb09393e22cadd9d","observation_id":"842a53f3-e3b2-47c8-883d-706078c64c07","resolution":{"observed_at":"2026-08-15T22:56:21.572466Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.323227Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.323227Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:0b4d90bd14e0d3a3a3d324daa76d7e19a64b7043826299fa42e4c9373afeaf6d","observation_id":"2eff14b9-0b8f-453e-9d7d-7fef55cb2512","resolution":{"observed_at":"2026-08-15T22:56:21.323227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.341528Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.341528Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:58bed98d763396f79dad8afe6fb07894cba54159db848cf08516a59695778820","observation_id":"2639918b-7594-4e51-af6e-0beaa0ed1a48","resolution":{"observed_at":"2026-08-15T22:56:21.341528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:21.369531Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.369531Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:ccb916a12fd7da52141f4fc47ac424ced2c648068184e7b14831047a95ce58f4","observation_id":"f02afdbf-8d03-4877-919d-22817184d9ba","resolution":{"observed_at":"2026-08-15T22:56:21.369531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2013.0302","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:56:22.653278Z","title":"back channel","venue":null,"work_id":"5feca902-194a-4171-8a29-c1828c21ddcb","year":2019},"citing_paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-15T22:56:21.386107Z"},"links":{"citing_paper":"/paper/2505.05970"},"observation_digest":"sha256:a6391c7ef19233a7b47124b8eaaa3d56edca95fe68355c1d98fcafc9c154dacd","observation_id":"0cb58f7c-fb9e-4601-a263-096cde74d573","resolution":{"observed_at":"2026-08-15T22:56:22.666509Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05970","last_updated":"2025-05-09T11:48:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T23:11:43.961396Z","submitted_at":"2025-05-09T11:48:36Z","title":"Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models"},"reference_resolution":{"displayed":88,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":45,"verified_exact":15,"verified_fuzzy":27},"total_outbound_references":88},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 88 of 88 outbound references and 0 inbound Pith citation observations for arXiv:2505.05970."}