{"as_of":"2026-08-19T05:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d46b5be753f8445e050dbe1fb6717af5a63990254b4b5e1ff385b3d22ef3173","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:28:24.695242Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T01:01:38.475397Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05109","snapshot_observed_at":"2026-08-06T01:01:38.475397Z","title":"arXiv:2506.05109","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03991","last_updated":"2025-08-06T00:46:38Z","snapshot_observed_at":"2026-08-16T16:59:22.548614Z","submitted_at":"2025-08-06T00:46:38Z","title":"Galaxy: A Cognition-Centered Framework for Proactive, Privacy-Preserving, and Self-Evolving LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T01:01:38.475397Z"},"links":{"cited_paper":"/paper/2506.05109","citing_paper":"/paper/2508.03991"},"observation_digest":"sha256:01b58928900045550fa4b047e06b54177541aaa382a068d4035e4591b2ea181c","observation_id":"62023054-4f59-4d22-a34e-161cd3d1902c","resolution":{"observed_at":"2026-08-06T01:01:38.475397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"cited_work":{"arxiv_id":"2506.05109","doi":"10.48550/arxiv.2506.05109","metadata_source":"pith","pith_arxiv_id":"2506.05109","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","venue":"cs.AI","work_id":"ee163b6e-ffc2-4fe7-a87c-e0eabc5ff1e4","year":2025},"citing_paper":{"arxiv_id":"2606.23127","last_updated":"2026-06-22T10:14:11Z","snapshot_observed_at":"2026-08-14T03:17:49.655720Z","submitted_at":"2026-06-22T10:14:11Z","title":"Managing Procedural Memory in LLM Agents: Control, Adaptation, and Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T08:39:41.575494Z"},"links":{"cited_paper":"/paper/2506.05109","citing_paper":"/paper/2606.23127"},"observation_digest":"sha256:6761054f68bed652ba1dc84775c09904592e9350b6279c2769d953d045629ca4","observation_id":"c14027cb-b536-4031-babb-0b38c0958ac8","resolution":{"observed_at":"2026-06-26T08:49:15.256236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"cited_work":{"arxiv_id":"2506.05109","doi":"10.48550/arxiv.2506.05109","metadata_source":"pith","pith_arxiv_id":"2506.05109","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","venue":"cs.AI","work_id":"ee163b6e-ffc2-4fe7-a87c-e0eabc5ff1e4","year":2025},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-08-12T14:05:29.940431Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2506.05109","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:35306fbfbb897ae99a43aaad079fe28dcd897e7f054bcc8f6a0d2811cfbb74a4","observation_id":"1e3ff57d-18da-485b-b977-6daeef297033","resolution":{"observed_at":"2026-07-09T03:45:55.365517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05109/citation-record","integrity":"/paper/2506.05109/integrity","json":"/paper/2506.05109/citation-record.json","paper":"/paper/2506.05109"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:16.760749Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.760749Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:7f926c4a33def0908d4d6338db5fded6dbaec74adc23160237475921f3501ef2","observation_id":"d5a42c6a-9ccf-4747-9c48-3453a2caed51","resolution":{"observed_at":"2026-08-07T10:28:16.760749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-19T00:16:57.115468Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-07T10:28:16.864213Z","title":"Rest meets react: Self-improvement for multi-step reasoning llm agent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.864213Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:66e4bc33fba7530fccf0bde2f6661b6ff425e12349fc8551b513fc51ddfb66fd","observation_id":"e146ce08-8442-47ea-baba-77c1d7e78c41","resolution":{"observed_at":"2026-08-07T10:28:16.864213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-16T13:42:51.892765Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T10:28:16.963397Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.963397Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:fbe465b023afbb6e07698072cc51d1c8e5983ea7de701900d0f4d8316d949ebd","observation_id":"e94ea10d-0614-4f9b-860c-ae435ececd19","resolution":{"observed_at":"2026-08-07T10:28:16.963397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T10:28:17.065407Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.065407Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:c0026656c65dba19e0371390c4428da99b08eeac4dd5bcaa8188d8845490bf24","observation_id":"42676b98-b535-4b3e-806e-cb062700f94d","resolution":{"observed_at":"2026-08-07T10:28:17.065407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.166714Z","title":"Human-timescale adaptation in an open-ended task space","venue":null,"work_id":null,"year":1935},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.166714Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b8a6c19c54aaabd648b6f2164bdf3fdb85635a8d0bdce07a5bab1437f991d9b2","observation_id":"9fc23d32-3abb-4533-b8b7-d752cbf6cdfd","resolution":{"observed_at":"2026-08-07T10:28:17.166714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.243242Z","title":"M., Gebru, T., McMillan-Major, A., and Shmitchell, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.243242Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:be6f2d69e4226af3a827ef1b28f2dc097d89cbc700fbd93e9f5163e7a3d902aa","observation_id":"f9027692-9226-49ec-a94c-162ff8aa8467","resolution":{"observed_at":"2026-08-07T10:28:17.243242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.306726Z","title":"Curriculum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.306726Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4654329c61d55920344fccb1451617349caa5cb559520718c771a6ddb08262b0","observation_id":"a4a7c8a1-d526-498d-ada7-ef02fb380f90","resolution":{"observed_at":"2026-08-07T10:28:17.306726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.380705Z","title":"B., Zhang, J., Oostermeijer, K., Bellagente, M., Clune, J., Stanley, K., Schott, G., and Lehman, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.380705Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:91276626c21c30110f9134d581f65b5114f5c599e5720652470d6f06d2b47301","observation_id":"5d6eabb9-39cb-45ba-8af2-c442f20bd220","resolution":{"observed_at":"2026-08-07T10:28:17.380705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.459026Z","title":"Metacognition, executive control, self-regulation, and other more mysterious mechanisms","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.459026Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d14a0e8eb18043ad2f2cecaf2601b2d53e2f6b6c1bd2826d5dc3d2d511345f3a","observation_id":"09013d81-5b43-452a-a558-fc3123a7320c","resolution":{"observed_at":"2026-08-07T10:28:17.459026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.544773Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.544773Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:cbd7184a4a78a237b19a6404712f88786a28a03a67978e942c82d5be0f9d823a","observation_id":"5ee11e9a-3e13-4e8e-8618-5c454426f0f7","resolution":{"observed_at":"2026-08-07T10:28:17.544773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.620825Z","title":"D., Edwards, A., Parker-Holder, J., Shi, Y., Hughes, E., Lai, M., Mavalankar, A., Steigerwald, R., Apps, C., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.620825Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:eeaefd8cfd5fab613e18c6052f8ed9c0121bc600018bfd49b75148749f77355c","observation_id":"4e865748-7cec-4e32-bf0a-dbb511d75b72","resolution":{"observed_at":"2026-08-07T10:28:17.620825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.712364Z","title":"Alphamath almost zero: Process supervision without process","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.712364Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:15ffa71bbe14836cb96ae202a5ce030ed29beec970ae83f52372c540ac63792f","observation_id":"b8f435bf-9fb7-4b6c-b76f-897d41a99e53","resolution":{"observed_at":"2026-08-07T10:28:17.712364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.793828Z","title":"Teaching large language models to self-debug","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.793828Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d6d57abfe0a04c1b487e69d81530c245fea826bc4efcc85a6e3657c5dbbf011a","observation_id":"eb335fc1-f301-4df1-95e0-d15d1313ee77","resolution":{"observed_at":"2026-08-07T10:28:17.793828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.871805Z","title":"N., Li, T., Li, D., Zhu, B., Zhang, H., Jordan, M., Gonzalez, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.871805Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:3886df4aeec244679c6094c038d3964fb54cc4fdc76dea9d0168e6d03f256653","observation_id":"1a47be92-21f4-4c31-be34-4591795da1d1","resolution":{"observed_at":"2026-08-07T10:28:17.871805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-08-17T05:38:14.090895Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-07T10:28:17.940922Z","title":"On the measure of intelligence","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.940922Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2c5f0b32eb55028a6dcf83025d25eaf2764fb8ca78bd21997861cd87e630d584","observation_id":"dffe7a3b-37f3-47b6-b933-da2c3552a718","resolution":{"observed_at":"2026-08-07T10:28:17.940922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.043043Z","title":"W., Sutton, C., Gehrmann, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.043043Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b151a437cc4ffb545bfadf109d89932a8d147e03ecd26f5ae310afa4ea684d1c","observation_id":"631581fb-b26f-4552-9927-82f102ecc763","resolution":{"observed_at":"2026-08-07T10:28:18.043043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.112668Z","title":"W., Hou, L., Longpre, S., Zoph, B., Tay, Y., Fedus, W., Li, Y., Wang, X., Dehghani, M., Brahma, S., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.112668Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:086fd634c914a1ca3d07ac8a264ef1f0e916812f75d8c608579503109add0d0d","observation_id":"27828ccd-c7bd-4550-9724-6e956804c27b","resolution":{"observed_at":"2026-08-07T10:28:18.112668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:28:18.211427Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.211427Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:43a0ea2b257d7406c131cd5803f64b497452c9de17ade1013508df92df8bfea6","observation_id":"62529be3-2c24-43ca-b538-79c462921deb","resolution":{"observed_at":"2026-08-07T10:28:18.211427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.283310Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.283310Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:96a04c2b72ac2c7d2d2f372c639e2465bc0831bf83e64c115feb9761f6969b23","observation_id":"2a08b2ae-80c5-4ce0-971d-567f9e5dbde8","resolution":{"observed_at":"2026-08-07T10:28:18.283310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.356818Z","title":"Meta-rules: Reasoning about control","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.356818Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:e0edb75a7a9badcab52e0d6cabbc8e4d6abcbdfbc4d0d771cd5e38f9489e3ca6","observation_id":"66b7c29f-e2fe-409e-9379-724d0af430c3","resolution":{"observed_at":"2026-08-07T10:28:18.356818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.967561Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design","venue":null,"work_id":"976d976a-7551-4e5c-bc86-6e1227765138","year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.428745Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:3ff72fd9190267e2202b74986234041c8547b29ecaa614ee105bdfc91f593669","observation_id":"1bf443c0-3679-4e42-87b2-eea0fb618d92","resolution":{"observed_at":"2026-08-07T10:28:34.064823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12205","last_updated":"2024-05-20T17:45:26Z","snapshot_observed_at":"2026-08-16T13:51:14.060214Z","submitted_at":"2024-05-20T17:45:26Z","title":"Metacognitive Capabilities of LLMs: An Exploration in Mathematical Problem Solving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12205","snapshot_observed_at":"2026-08-07T10:28:18.501424Z","title":"R., Guo, S., Valko, M., Lillicrap, T., Rezende, D., Bengio, Y., Mozer, M., and Arora, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.501424Z"},"links":{"cited_paper":"/paper/2405.12205","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4a025a853c911b772a2bd154b969a95b1f8562da4a148ba7376b7931f6b23397","observation_id":"21ae20e8-1966-4d87-a94f-1e426f679340","resolution":{"observed_at":"2026-08-07T10:28:18.501424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.582485Z","title":"F., Lan, Q., Rahman, P., Mahmood, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.582485Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:ef2b7ad8a0202161dd53314ceffce7d1a6ca68ecba48771b7546285b519f960d","observation_id":"0d56e7b4-087a-4ddc-a7e9-86f30a67f08c","resolution":{"observed_at":"2026-08-07T10:28:18.582485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.670347Z","title":"RAFT : Reward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.670347Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:ce75fa12dbf6aff51a3d74fafe2d859adf70e3728af0828d661ed999043f2379","observation_id":"d2f7922e-b28a-4a07-af18-4cceb61e88e6","resolution":{"observed_at":"2026-08-07T10:28:18.670347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15568","last_updated":"2025-02-14T14:24:59Z","snapshot_observed_at":"2026-08-17T17:09:26.087615Z","submitted_at":"2024-05-24T13:57:32Z","title":"OMNI-EPIC: Open-endedness via Models of human Notions of Interestingness with Environments Programmed in Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15568","snapshot_observed_at":"2026-08-07T10:28:18.762189Z","title":"Omni-epic: Open-endedness via models of human notions of interestingness with environments programmed in code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.762189Z"},"links":{"cited_paper":"/paper/2405.15568","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:86d8fee395f289843e19d1062914eb6f1d9a28fb3fa27450f67a624b1f1c5860","observation_id":"b6225795-fd3d-4425-aa41-bb93d186e8cc","resolution":{"observed_at":"2026-08-07T10:28:18.762189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.718746Z","title":null,"venue":null,"work_id":"b376648f-9dcc-4c69-98d9-9f4e2ac17666","year":1979},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.842019Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f69d017ff278b928ade10fffe83994fa1256898ad1ac441200edbd4f1e2a62a6","observation_id":"3fe51d09-b95f-4a68-91b9-485fa1565199","resolution":{"observed_at":"2026-08-07T10:28:33.821225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.443120Z","title":"S., Bredeweg, B., and van den Bos, W","venue":null,"work_id":"6cc06b7e-0e83-455e-8fd6-d171be4c32c4","year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.933139Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:151391fc31f479ee094adfd482b2196801e00af945b43e136e1dd5085ba60f64","observation_id":"40115d67-a1fa-496d-b6ad-69fd02f1ae4c","resolution":{"observed_at":"2026-08-07T10:28:33.573085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.200723Z","title":null,"venue":null,"work_id":"b8eb7cf9-04b4-4691-bee7-ffc3b2257e83","year":1983},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.046245Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:688ac92484184d9272c830353a6ec69ce2c6ed969f0b37f0d95f7db68ff966d1","observation_id":"8ca6eb6f-9fff-4bca-91d4-20e5637d4d50","resolution":{"observed_at":"2026-08-07T10:28:33.299726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.993642Z","title":"Auto-gpt: An autonomous gpt-4 experiment, 2023","venue":null,"work_id":"a7e456d2-cd1d-42a7-8a0d-96cf49a1e03a","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.130458Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:91b940411858bcf747ccf8352fbe25ee48bd684ed0c02e284eba143980ea24a9","observation_id":"5516b231-b978-414d-84aa-af0238a9044d","resolution":{"observed_at":"2026-08-07T10:28:33.062588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.218992Z","title":"Connecting large language models with evolutionary algorithms yields powerful prompt optimizers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.218992Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:375f2316b8c5554b33f29c2885c724098a22c9333909b3dc15719180448cb059","observation_id":"1b64439d-31d9-4c67-8bb2-151b1333ffdf","resolution":{"observed_at":"2026-08-07T10:28:19.218992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.767917Z","title":"V., Safdari, M., Matsuo, Y., Eck, D., and Faust, A","venue":null,"work_id":"dad64007-d1b3-4270-8625-d196feaf6837","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.296099Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:db4ecc6c6b6be30ccd224ba911bebb265d5cbf064ca585e19961afe1b6812b8d","observation_id":"e4dfa4d5-baa4-4f18-b9dd-9f474cf778d3","resolution":{"observed_at":"2026-08-07T10:28:32.899862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.528128Z","title":"J., Wang, Z., Wang, D","venue":null,"work_id":"11fc6a0e-10f1-49bf-a04f-1280883fe10b","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.361090Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:8e978b227608997b4519d179392d4480321e408ecbaea8ab50f9aa00b1f4578c","observation_id":"e7d02b9a-2cd2-4860-a31b-43f333446651","resolution":{"observed_at":"2026-08-07T10:28:32.617602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04642","last_updated":"2024-03-07T16:36:29Z","snapshot_observed_at":"2026-08-16T14:11:54.240619Z","submitted_at":"2024-03-07T16:36:29Z","title":"Teaching Large Language Models to Reason with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04642","snapshot_observed_at":"2026-08-07T10:28:19.442762Z","title":"C., Nalmpantis, C., Dwivedi-Yu, J., Zhuravinskyi, M., Hambro, E., Sukhbaatar, S., and Raileanu, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.442762Z"},"links":{"cited_paper":"/paper/2403.04642","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:1d4e6060b72ca5cf07c1f6e7df9773f23d13615a3ff0a20fa3c79a976cfbd089","observation_id":"a53a291c-66f3-4219-8f0f-dc8fd58cf89f","resolution":{"observed_at":"2026-08-07T10:28:19.442762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.521152Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.521152Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:871f6350019ea293ca8446c9359d76fb7a8586d1e709125c658c2be2f2f65a2c","observation_id":"e0204f75-9542-43a9-b767-fc3e4bfcc5e0","resolution":{"observed_at":"2026-08-07T10:28:19.521152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.280237Z","title":null,"venue":null,"work_id":"c2dfeadb-198e-49f5-98ec-537ab6f5c0d4","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.617890Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:ec17feb4dbe3d293d572cb4fe20d5b036c93e084ea128ff54389ae2108150d58","observation_id":"ae3e674f-e94f-4f6b-8863-07c8d8f3b981","resolution":{"observed_at":"2026-08-07T10:28:32.390166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.028163Z","title":"D., Parker-Holder, J., Behbahani, F., Mavalankar, A., Shi, Y., Schaul, T., and Rockt\\\" a schel, T","venue":null,"work_id":"cfdb7949-eca2-4f1a-8ddb-55f4416dd4f8","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.660963Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:61c69063a19fd0eed769d57f2cc3218bf89c839b032e870bd2d1c21084582b59","observation_id":"cf752242-d7b8-446a-af39-b098f6a75ce8","resolution":{"observed_at":"2026-08-07T10:28:32.170040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.727240Z","title":"Prioritized level replay","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.727240Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:30124cca2ff1c3ecd3593735bc5f2ac75f44a489a322588e579ca40a5eef285b","observation_id":"fd7f6e70-1b1b-4e15-9bdc-ada83a9c63d2","resolution":{"observed_at":"2026-08-07T10:28:19.727240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02907","last_updated":"2023-06-05T14:12:46Z","snapshot_observed_at":"2026-08-18T05:17:30.297940Z","submitted_at":"2023-06-05T14:12:46Z","title":"SelfEvolve: A Code Evolution Framework via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02907","snapshot_observed_at":"2026-08-07T10:28:19.784378Z","title":"Selfevolve: A code evolution framework via large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.784378Z"},"links":{"cited_paper":"/paper/2306.02907","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:75deaecfebb30fc9584ac7c439993c3826f6bf6ed28a434e9397fea3881c07de","observation_id":"3b4168f6-d3d7-4e17-b2da-398db35c9093","resolution":{"observed_at":"2026-08-07T10:28:19.784378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.854733Z","title":"G., Karimi, A.-H., Bengio, Y., Chater, N., Gerstenberg, T., Larson, K., Levine, S., Mitchell, M., Rahwan, I., Sch \\\"o lkopf, B., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.854733Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4acf80fafa1c9e46488be10c0fa1411e54d862748cdc831968edf358da3dc852","observation_id":"483af8bf-ca6b-47c4-985c-d011d718f506","resolution":{"observed_at":"2026-08-07T10:28:19.854733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T10:28:19.943318Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.943318Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:08c6453abdc3313d41b7b9bdcde27998e21015c60b2e27c68bc877f109de0dbf","observation_id":"66444608-831f-4293-83e9-155342fc7419","resolution":{"observed_at":"2026-08-07T10:28:19.943318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.807078Z","title":"V., Haq, S., Sharma, A., Joshi, T","venue":null,"work_id":"4658f9dd-798b-44c5-85e3-144f6066280d","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.034475Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6489ffc1b1a090ff67d9d6eb025e48bdc889135b8fd4d363599825bbb2c9e109","observation_id":"ba02476b-bd30-4c52-b294-8734a5c49572","resolution":{"observed_at":"2026-08-07T10:28:31.893092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.624644Z","title":null,"venue":null,"work_id":"65038bbc-20c5-4b6d-93ba-684447a28c2b","year":2009},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.133380Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:db082b40f2dbf8edc217dd2c607ab85d3875403d0548a18e5af7e86cec14bdbc","observation_id":"51757441-9150-431e-aa24-fd0d10aebad6","resolution":{"observed_at":"2026-08-07T10:28:31.716688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.356673Z","title":"and Bjork, R","venue":null,"work_id":"1c703e10-1d9e-49a0-a1cc-142f525c27b8","year":2005},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.232344Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:31953df9c41ded32ee0200d91d996a4f11fd6027dd314416f035048b6d140b9c","observation_id":"2bb84647-02cd-47b7-9ed1-5021916bf16c","resolution":{"observed_at":"2026-08-07T10:28:31.456959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.148503Z","title":"Specification gaming: the flip side of ai ingenuity","venue":null,"work_id":"b1f202a7-0c31-4489-be53-ee32f945d890","year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.329656Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:8bf42cf49bb7cf8a2cb8d17031b642e708d477e6bc21719d88abcfa9372624f5","observation_id":"51fc9f4b-bfae-4297-b83d-c53da0e89c7a","resolution":{"observed_at":"2026-08-07T10:28:31.222136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:20.404733Z","title":"M., Ullman, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.404733Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:1e9fb8ae69e46b8691f1f2704a786e219f068316f1f3e968eaf914ea4a2e74fb","observation_id":"ac17182f-6518-44fd-a519-b0d881fcda3d","resolution":{"observed_at":"2026-08-07T10:28:20.404733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:20.489962Z","title":"u ttler, H., Lewis, M., Yih, W.-t., Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.489962Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:96b88ba86cb0fb769ef1947e75e6ecb494ac296ee2a0b63f8adc6e70cfbf0144","observation_id":"60791e4c-a5a6-4082-aaa2-f021a86eb949","resolution":{"observed_at":"2026-08-07T10:28:20.489962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.960792Z","title":"From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning","venue":null,"work_id":"4e648e51-5f84-4ecd-8384-adbe113b6976","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.560985Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:e0ed3662b8197b164b545013214234f36cb1570d61f1fc0b006970e6b8ef250a","observation_id":"73c32ec4-069d-401c-8c87-252cb280e432","resolution":{"observed_at":"2026-08-07T10:28:31.039020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17882","last_updated":"2024-02-16T09:47:38Z","snapshot_observed_at":"2026-08-16T14:22:51.011988Z","submitted_at":"2024-01-31T14:41:23Z","title":"I Think, Therefore I am: Benchmarking Awareness of Large Language Models Using AwareBench","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17882","snapshot_observed_at":"2026-08-07T10:28:20.658807Z","title":"I think, therefore i am: Awareness in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.658807Z"},"links":{"cited_paper":"/paper/2401.17882","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:19fb6c6c13be2d704258a5f92d33b1547c70e1046b145dc28c874d6f06313799","observation_id":"ba3a48cd-c8d5-4c2c-a5b6-45fde16add6b","resolution":{"observed_at":"2026-08-07T10:28:20.658807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-07T10:28:20.727797Z","title":"T., Foerster, J., Clune, J., and Ha, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.727797Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:edfbc1ae072d14e5495e95d7490e3ab1c8848a8df5531a302593b047f80b6449","observation_id":"b43ef41f-fa84-4658-9ea7-de02a61f1389","resolution":{"observed_at":"2026-08-07T10:28:20.727797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.764140Z","title":"J., Liang, W., Wang, G., Huang, D.-A., Bastani, O., Jayaraman, D., Zhu, Y., Fan, L., and Anandkumar, A","venue":null,"work_id":"e82afd4a-7c88-4e15-bfc9-09d697e848db","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.791681Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:738de534385d0bda9cac557034a11952b3c569537ff527513f76118a493400a4","observation_id":"40d65aee-ce1b-4bc5-b4b8-ea89df7cf338","resolution":{"observed_at":"2026-08-07T10:28:30.860012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.606867Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":"e03375ae-52b1-4956-a816-a498217d7451","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.899514Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b9cb97f127f150a23a2eb7ff1ef2e27283c4cc502d644af7717a9fb8745da056","observation_id":"c615e20f-bd51-4cea-aff0-54e1317ede47","resolution":{"observed_at":"2026-08-07T10:28:30.684549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-19T02:54:55.334346Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-07T10:28:20.990171Z","title":"Webgpt: Browser-assisted question-answering with human feedback","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.990171Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:45ea786a5647af74553c987256f0aa65b1345d9c4789c3e3f21924a5473b6041","observation_id":"ad6c4fc7-72ad-4f03-a28a-250c701d527a","resolution":{"observed_at":"2026-08-07T10:28:20.990171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.436014Z","title":"Superintelligence: Paths, dangers, strategies","venue":null,"work_id":"9c7542f3-9ce4-49b9-bafc-cac0f3883a53","year":2014},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.054167Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:7470e07f281ab8442474fc865aee01827c14a3b2ebf98ef2705adc074971b586","observation_id":"a2a9e057-9368-4e74-8220-df685b85f6c8","resolution":{"observed_at":"2026-08-07T10:28:30.509798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:21.105201Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.105201Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6e68f22f323716528d8ceb1c7c2283f42e3344093bf5c4c7bcfe29a6cdd9bc69","observation_id":"09207605-cc07-4509-aea2-c76672548ac3","resolution":{"observed_at":"2026-08-07T10:28:21.105201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:21.216381Z","title":"S., O'Brien, J., Cai, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.216381Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:5797f6e492dd9ea1a4815e716a63eb84f00a57be02124b5ada095bae4c5167dc","observation_id":"df850d23-ee5a-4659-8ce3-27779a4d418c","resolution":{"observed_at":"2026-08-07T10:28:21.216381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.201646Z","title":null,"venue":null,"work_id":"c4c899a6-6e15-4320-80e5-90c71b5e2806","year":2002},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.441438Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:5d67e47b51b1a3d1ee6629cf0a48467d8c58e95ca5fae51ff44c0f607e4e9180","observation_id":"2df7fb13-680e-46e2-8e24-f348bcf72c1b","resolution":{"observed_at":"2026-08-07T10:28:30.313778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02337","last_updated":"2025-01-27T11:56:15Z","snapshot_observed_at":"2026-08-18T10:06:51.290180Z","submitted_at":"2024-11-04T17:59:58Z","title":"WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02337","snapshot_observed_at":"2026-08-07T10:28:21.810260Z","title":"L., Lai, H., Sun, X., Yang, X., Sun, J., Yang, Y., Yao, S., Zhang, T., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.810260Z"},"links":{"cited_paper":"/paper/2411.02337","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f65ced1447e5663122bc50f3ab078f092eec0dce0c410b0cf0e71f6bcd644f3f","observation_id":"7498d1e4-28c7-4c4e-bd30-e41f5108b9a1","resolution":{"observed_at":"2026-08-07T10:28:21.810260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.995840Z","title":"Vision-language models are zero-shot reward models for reinforcement learning","venue":null,"work_id":"a2632166-0989-41e7-9549-b8d825cbf403","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.907724Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2b6c3f5df562d8e0cbe7db52cda67fd2c2f07713a5fb81d35be0c592e09a40ae","observation_id":"30502117-d889-4cb3-a595-72b0f13334f8","resolution":{"observed_at":"2026-08-07T10:28:30.103119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.799337Z","title":"Human-compatible artificial intelligence., 2022","venue":null,"work_id":"69b78dbe-3eec-4e5a-ba7d-ca7344f2c652","year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.034929Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:c3d044d9c13d27901658e92ccf05214d4389a9cd732e8d17f0b34965ce7999b6","observation_id":"11fd6b50-2753-46a7-9216-7e01d06c192d","resolution":{"observed_at":"2026-08-07T10:28:29.909495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.505472Z","title":"and Wefald, E","venue":null,"work_id":"90a24423-9707-4a62-840f-5f97c413d1d8","year":1991},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.106404Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f85ec2465e629284fae5fc20d8ec5b217dd10e35b20ada3361a89f834a089b12","observation_id":"cdb1ccfa-6327-4cb3-b2c3-92f5a888b56b","resolution":{"observed_at":"2026-08-07T10:28:29.623871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09668","last_updated":"2024-02-15T02:27:57Z","snapshot_observed_at":"2026-08-16T14:18:27.107802Z","submitted_at":"2024-02-15T02:27:57Z","title":"How to Train Data-Efficient LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09668","snapshot_observed_at":"2026-08-07T10:28:22.198008Z","title":"H., Caverlee, J., McAuley, J., and Cheng, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.198008Z"},"links":{"cited_paper":"/paper/2402.09668","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:39d0b8e7ee675e85b3766b88a5e4bcc38975714b55b2b099f718ded871bfc0be","observation_id":"baf9518d-8283-4d8e-9693-627a73a6bf4c","resolution":{"observed_at":"2026-08-07T10:28:22.198008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:22.274561Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.274561Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:349bd33cb5b85241c90f26d0d78705a6b37701e374407037cc0f8396ec8dd725","observation_id":"ab7052d9-503e-499e-87d6-7bd2c7654320","resolution":{"observed_at":"2026-08-07T10:28:22.274561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.380719Z","title":null,"venue":null,"work_id":"c8c6d795-037e-402d-9007-aeded31c2694","year":2009},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.378748Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:ec3d5fdf7a3ab3481bda2147bf260a7642e12df75fe866e2cfcadc6da984389f","observation_id":"443bb5cb-4018-490b-b9b9-18ac5afe28b8","resolution":{"observed_at":"2026-08-07T10:28:29.420717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.196130Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"3450acfa-bcfe-4c9c-855f-819dc67f3f64","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.494287Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:948db0093eede2f6a35968c8f5ce16896064c6b6823d87afecadb880424b1383","observation_id":"93f1d9a9-a8ef-4323-bd4a-7a621876368d","resolution":{"observed_at":"2026-08-07T10:28:29.283609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:22.627881Z","title":"J., Guez, A., Sifre, L., Van Den Driessche, G., Schrittwieser, J., Antonoglou, I., Panneershelvam, V., Lanctot, M., et al","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.627881Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:79a9fc32c141c4ffe021c52f0f6649522add658f9c92c0b0737c357923bb72c2","observation_id":"40856bd1-7d7e-4c60-a168-2e8075a191a3","resolution":{"observed_at":"2026-08-07T10:28:22.627881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.994017Z","title":"D., Agarwal, R., Anand, A., Patil, P., Garcia, X., Liu, P","venue":null,"work_id":"ebfa9623-e051-4f4e-b833-d0764fb7810e","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.727873Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4d2cd80b101b02490710804ed0ca7f18b62fb3b02b860be0f9a4ed945869583f","observation_id":"bdcfe909-8341-4704-a609-08fa553736ad","resolution":{"observed_at":"2026-08-07T10:28:29.098415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02674","last_updated":"2025-02-25T16:59:11Z","snapshot_observed_at":"2026-08-14T20:58:55.959220Z","submitted_at":"2024-12-03T18:47:26Z","title":"Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02674","snapshot_observed_at":"2026-08-07T10:28:22.812009Z","title":"Mind the gap: Examining the self-improvement capabilities of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.812009Z"},"links":{"cited_paper":"/paper/2412.02674","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b4c161e8105b15d6971b2a38a2d9acab9cf51735ec6561614874903cf596d0f9","observation_id":"e61b5bbf-b799-4ccf-ab58-29688b857d9b","resolution":{"observed_at":"2026-08-07T10:28:22.812009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.849065Z","title":null,"venue":null,"work_id":"534b9411-1268-452c-b6aa-3e571f15daca","year":2003},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.840098Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f991b68adfd494bb378001864b2486e2a2024cadc999b5078910452cb3373858","observation_id":"820c7bdb-02f5-48c3-96ed-324ac61af2ef","resolution":{"observed_at":"2026-08-07T10:28:28.915071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.666412Z","title":"Cognitive architectures for language agents","venue":null,"work_id":"b98e2bde-eb4b-4237-87a7-b2faaa0132b1","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.925737Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:eeb51c263dfd3e42cc5f3377bab5f472d2ab4dbc79829fd9e0b89ce1f9841b6b","observation_id":"323dc2fc-943f-4f59-ad20-d2d20ad8219d","resolution":{"observed_at":"2026-08-07T10:28:28.732086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.495465Z","title":null,"venue":null,"work_id":"49e91687-324f-4218-b593-284d40d69e9f","year":1988},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.977812Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:40a20b6e7c5bcddccc6eeeec9929742f8cdb4443ec9ed2b691889cbe98e2e221","observation_id":"b2dffad8-29b1-4541-a89c-38c105103b2b","resolution":{"observed_at":"2026-08-07T10:28:28.586189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.295492Z","title":"E., Sarkar, A., Sellen, A., and Rintel, S","venue":null,"work_id":"d4edda7d-c5ba-4b17-bca8-d2f5401cc613","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.020525Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:535864e4401a941e53652239c09235fc7977c035d2e514acd6e2d66e8ccb19d5","observation_id":"a67b8b24-e232-4bcd-b90b-120a90925c11","resolution":{"observed_at":"2026-08-07T10:28:28.383657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14387","last_updated":"2024-06-03T17:47:30Z","snapshot_observed_at":"2026-08-18T08:11:04.376031Z","submitted_at":"2024-04-22T17:43:23Z","title":"A Survey on Self-Evolution of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14387","snapshot_observed_at":"2026-08-07T10:28:23.089533Z","title":"A survey on self-evolution of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.089533Z"},"links":{"cited_paper":"/paper/2404.14387","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f6135984a388f1cf5014944bff5cf9a38293cac75c21fe5486205a794073a025","observation_id":"70fdfd3d-505d-474c-a5e4-c203e2f899ba","resolution":{"observed_at":"2026-08-07T10:28:23.089533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-07T10:28:23.137247Z","title":"Voyager: An open-ended embodied agent with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.137247Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6327a33db8716b2ce587422953f5acfb6d932d75efbe44f8ddf83480e313d789","observation_id":"9d6ff0b8-97c5-4fc3-bfc1-4512b44c9322","resolution":{"observed_at":"2026-08-07T10:28:23.137247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:23.177586Z","title":"A survey on large language model based autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.177586Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:bdbe0f525cb28e1337cea606bcef6a22be84835b4c3c8af7cdce6508986ee1e9","observation_id":"629e8220-685f-4277-a032-089cd9067781","resolution":{"observed_at":"2026-08-07T10:28:23.177586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.136952Z","title":"Emotional intelligence of large language models","venue":null,"work_id":"7aaa7e19-b3e6-4945-9f78-4df03cd3e4ef","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.247881Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f00f78243b3d1a2bc6d98d1253001f2c39087d9adb23ba5d6796bb64f85d6a1e","observation_id":"4016d8fb-0416-4ee8-b916-2a432988204a","resolution":{"observed_at":"2026-08-07T10:28:28.205033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.989503Z","title":"A., Khashabi, D., and Hajishirzi, H","venue":null,"work_id":"455ac4ab-2e4b-48e0-b450-d5d967556375","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.314426Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:5604e83bc7b6bd0d543c1e123d8fc545a240adb6d3342108c1cfd554b6be6936","observation_id":"1479d99f-2c4b-44c6-99bf-8dc5754350bf","resolution":{"observed_at":"2026-08-07T10:28:28.047808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.809984Z","title":"Metacognitive ai: Framework and the case for a neurosymbolic approach","venue":null,"work_id":"97d14273-f0ee-4c84-bb17-54bf1f49a564","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.399854Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:1810b29f980af606b10392d254a431fdfcf7ab560099a6634bac52734c8f12fc","observation_id":"afc6906f-b03c-4154-afbe-f1a097ba562b","resolution":{"observed_at":"2026-08-07T10:28:27.910261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.522865Z","title":null,"venue":null,"work_id":"3fdf48b5-0115-4336-a348-8e3be297d470","year":2014},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.447332Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:fc7ac4f22669643ad51888e08f2844b898378524084d91dcef7a3e2744285d29","observation_id":"81814fb6-e247-44eb-a405-d2462cf588e7","resolution":{"observed_at":"2026-08-07T10:28:27.667495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07456","last_updated":"2024-02-15T09:30:48Z","snapshot_observed_at":"2026-08-16T14:19:26.200721Z","submitted_at":"2024-02-12T07:29:22Z","title":"OS-Copilot: Towards Generalist Computer Agents with Self-Improvement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07456","snapshot_observed_at":"2026-08-07T10:28:23.486683Z","title":"Os-copilot: Towards generalist computer agents with self-improvement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.486683Z"},"links":{"cited_paper":"/paper/2402.07456","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:25d8a94edac2a8b9391bd4c28e1a58c4cbd8c58d4746564ce6d2304340a56835","observation_id":"8c3c78bd-e0b5-4bf6-b3c9-d6638188751c","resolution":{"observed_at":"2026-08-07T10:28:23.486683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-17T06:15:32.510873Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-07T10:28:23.548433Z","title":"The rise and potential of large language model based agents: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.548433Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6b16918b99ce922c0800c5e013c82563a87e8ec43bed9dbcf9204b1a707541db","observation_id":"2643ba2a-11b2-4363-93a8-c3af68948a40","resolution":{"observed_at":"2026-08-07T10:28:23.548433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.273184Z","title":"J., Cheng, Z., Shin, D., Lei, F., Liu, Y., Xu, Y., Zhou, S., Savarese, S., Xiong, C., Zhong, V., and Yu, T","venue":null,"work_id":"329354a7-fc55-4602-9930-426cd9cf7e04","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.620932Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:20fafddbcaed3c91fe86a1894070e9f9306bdeb4c464d854fa231e1382e15c76","observation_id":"44e9f224-5fcb-4450-aa4d-9914b7b83ca8","resolution":{"observed_at":"2026-08-07T10:28:27.400891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.014282Z","title":"V., Zhou, D., and Chen, X","venue":null,"work_id":"14fa8182-3c7c-4402-a8e5-65de91fa0d02","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.705839Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:969be1c9e5ed0a14adbdf5e6f331b67b20934993dc8911bcdb59c83b28e3b2b2","observation_id":"b0f540aa-993d-4aa0-9589-bd3ba0804f5c","resolution":{"observed_at":"2026-08-07T10:28:27.170574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.819546Z","title":null,"venue":null,"work_id":"9c7d04a8-ea32-45fc-99d8-d262adbbf441","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.759255Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:7d042977f2f704fdda323abbc38485618d3205a84d004e4866e874c1698ea068","observation_id":"7e3049ec-fa99-4f67-91a4-5748dc1390b0","resolution":{"observed_at":"2026-08-07T10:28:26.951792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.617981Z","title":"Failures pave the way: Enhancing large language models through tuning-free rule accumulation","venue":null,"work_id":"cd175394-8107-401e-abe9-5afc2f7e680c","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.816080Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:905dffa46e2c01d47f174a5a7537139de5841bba534a36078bbf97466a7616c0","observation_id":"bc5afa07-cc54-4c53-ab1e-7bd5f0de81bc","resolution":{"observed_at":"2026-08-07T10:28:26.707251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.444749Z","title":"R., and Cao, Y","venue":null,"work_id":"36ee86da-0718-48ad-b56c-0952f633e149","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.865099Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2cca25790769a35982a847d0604f4415d8ca783b90007e580855f2016fab7cab","observation_id":"57f0e311-d0bc-43f9-9515-511447d82332","resolution":{"observed_at":"2026-08-07T10:28:26.549263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.295151Z","title":"Star: Bootstrapping reasoning with reasoning","venue":null,"work_id":"d784c30c-9082-4078-8979-407dda959269","year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.932489Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:3715fdea2f6e8d3128d0c7e62b194a0cf25d724aababa660a0c7fa5ab624f5a7","observation_id":"45ab5fba-cc3c-4747-850f-0e62de2600f7","resolution":{"observed_at":"2026-08-07T10:28:26.379100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.113733Z","title":"Large language models are semi-parametric reinforcement learning agents","venue":null,"work_id":"a9504bc7-a4f9-4c05-975e-0c499942da00","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.011471Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:45a776d9441d94222e917b14e2786de25d9a3bbaabc54c28b88d8f935914da7d","observation_id":"e0761761-8e2d-4193-a640-865a86194ce8","resolution":{"observed_at":"2026-08-07T10:28:26.190985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15506","last_updated":"2024-11-09T00:28:26Z","snapshot_observed_at":"2026-08-16T14:15:48.898355Z","submitted_at":"2024-02-23T18:56:26Z","title":"AgentOhana: Design Unified Data and Training Pipeline for Effective Agent Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15506","snapshot_observed_at":"2026-08-07T10:28:24.108717Z","title":"Agentohana: Design unified data and training pipeline for effective agent learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.108717Z"},"links":{"cited_paper":"/paper/2402.15506","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:a538ff0c350d01f287a177f3239bb53926aeac5eec3fd8484940933cc1aef91d","observation_id":"a6e1580c-d7a3-4dea-9374-2b80f795498a","resolution":{"observed_at":"2026-08-07T10:28:24.108717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.956776Z","title":"OMNI : Open-endedness via models of human notions of interestingness","venue":null,"work_id":"9f754878-f2f4-4ad6-b86a-22a72821b193","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.173811Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6a8f86dadbb78f14b5c3bf70118d910aa7d32a3d0b810f32aeeab8f835532a85","observation_id":"748cf989-85bc-4426-8237-273a1c18150f","resolution":{"observed_at":"2026-08-07T10:28:26.008245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:24.270265Z","title":"Expel: Llm agents are experiential learners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.270265Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:dc75b982938561ff669678fd467503e7ba46d312ad0b2461537ec66c8a347523","observation_id":"333dd0ed-4f18-4a42-bf3f-c123bf8e197a","resolution":{"observed_at":"2026-08-07T10:28:24.270265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15809","last_updated":"2024-08-08T07:05:46Z","snapshot_observed_at":"2026-08-18T07:49:15.652922Z","submitted_at":"2024-02-24T13:13:04Z","title":"Empowering Large Language Model Agents through Action Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15809","snapshot_observed_at":"2026-08-07T10:28:24.359078Z","title":"Empowering large language model agents through action learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.359078Z"},"links":{"cited_paper":"/paper/2402.15809","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2fbe1ff77603ecf8902ccdc15a01be3a4bf5991067a74d829b53a1ced981973c","observation_id":"53795e59-98ae-4552-9f91-01f1dcf8c4ae","resolution":{"observed_at":"2026-08-07T10:28:24.359078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.728273Z","title":"E., and Stoica, I","venue":null,"work_id":"7ad80c92-93fa-4725-98d6-c49c0ffeaf9f","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.367110Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:0dfc5831355d27b2b3e6c02cfa2dace7c1b15e4d03b36ae78e2b2f5f5beb796b","observation_id":"4a8b815d-0033-4f99-bf35-198c76937523","resolution":{"observed_at":"2026-08-07T10:28:25.826078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.485138Z","title":"and Hadfield-Menell, D","venue":null,"work_id":"548fee63-b404-44bd-8478-44f483397db2","year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.481803Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:951090e82cf724494d8d39f9e46f1246dac9d02e1c10cce29ea0e69fb731c13c","observation_id":"c915e8ba-3de0-4194-add4-072dee8df19d","resolution":{"observed_at":"2026-08-07T10:28:25.618435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.272615Z","title":"GPTS warm: Language agents as optimizable graphs","venue":null,"work_id":"7a13b80f-74d6-45e9-91f9-3b2ddc2a684d","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.601914Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f51313d70e7dbc46c58b27f583c2cbedc474f9e80ece2a2e6f424debee34e4c7","observation_id":"dad5cf41-3360-4ff9-a46e-8e52d69b4ef8","resolution":{"observed_at":"2026-08-07T10:28:25.415949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.157639Z","title":null,"venue":null,"work_id":"34d1ca89-87b0-43fe-82f5-7e97532e6809","year":2013},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.695242Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:72c909daba4819b71f1a10c345c0a6d65c2cd7ae7b7e0187cc277df67347727a","observation_id":"29c2ecbb-7d46-4643-a6eb-7b204d76a3f5","resolution":{"observed_at":"2026-08-07T10:28:25.213666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 3 inbound Pith citation observations for arXiv:2506.05109."}